
2026/07/19 2:32
キミ K3 モメント
RSS: https://news.ycombinator.com/rss
要約▶
Japanese Translation:
主要な主張は、Anthropic から Claude を継続して支払うことは、Kimi K3 が費用のわずかな分においてより優れた価値とパフォーマンスを提供しているため、次第に見直しがつかなくなっている点にある。証拠として、Kimi K3 は入力トークンに対して大まかに 1/3 の価格、出力トークンについては Claude のトップモデルよりもはるかに低い価格を設定しており、そのサブスクリプションプラン(月額 $19 から開始)は完全に機能する。一方、Claude は持続不可能な価格設定モデルにより低層のプランで高度な機能を無効化しており、例えば 20 ドールのプランでは Fable アクセスを無効化し、代わりに Opus モデルにデフォルトとして設定した。Kimi の層には、その主要モデルに関するこのような制限やフォールバックは含まれていない。ベンチマークの結果では、GLM 5.2(中国製の MIT ライセンスモデル)がアメリカの規制により拒絶されるタスクを拒まず遂行する点で Claude を超え、サイバー分野でのベンチマークにおいてClaude を凌駕しており、同じタスクに対する出力品質/トークン数は Claude とほぼ同等と報告されている。この乖離は、国内代替製品である Fable のようなものを事実上ブロックする一方、高度な中国製モデルは規制なしで利用可能であるという政策環境の中に存在する。このアプローチは、製品の質に関係なく国内製品を有利に扱う自動車の保護主義者のプレイブックに類似している。もしこの傾向が継続すれば、官民連携により米国でしか使用されない排他的な domestic AI ツールが開発される可能性があり、その結果、アメリカの技術が世界競争力を失うことになる。実質的な影響は明確である:規制による障壁が強制するまでには、Kimi を選ぶための経済的あるいは機能的な理由は現在存在しない。
本文
Kimi K3 対 Claude:実力差はほぼなく、価格差は巨大
実用性能の比較
日常の開発作業における実用上の違いはほとんど感じられません。
- 同等の実績
- 同じタスクを処理できます。
- 同様の出力品質を維持できます。
- ほぼ同等のトークン数で到達します。
- オープンソースモデルへの誤解
- 推論が粗雑だと予想されていましたが、実際は高品質です。
- トークン消費が多そうだが、効率性は高いです。
価格構造の決定的な違い
両者の経済的な差は比較にならないほど大きく、特にサブスクリプションモデルでは顕著です。
API コスト比較(入力・出力 100 万文字あたり)
| モデル | 入力料金 | 出力料金 |
|---|---|---|
| Kimi K3 | $3 | $15 |
| Claude (上位) | $10 | $50 |
サブスクリプションプラン比較
- Kimi の有料プラン
- ベース価格:月額 $19。
- 開発者向けプラン($39):非常に手厚い特典が含まれています。
- Claude の有料プラン
- 割当量(クォータ)が厳しく制限されています。
- 通常のエージェント作業を一日こなすだけで、昼食前には配额を使い切るほどです。
運用上の重要な違い:モデルフォールバック
Kimi と Claude は、料金を支払うことと得られるモデルに根本的な違いがあります。
- Claude の課題
- $20 プランでは「Fable」モデルへのアクセスが維持できませんでした。 -現在は静かに Opus モデルにフォールバックする仕組みになっています。
- 経済的に持続可能な形で「頭角を現すモデル」を提供できない場合、そのプラン自体が無意味になります。
- Kimi の強み
- ター(ティア)にはそのような注釈や制限は一切ありません。
- 支払った対価に相応の最先端モデルが提供されます。
米国の AI ポリシーの失敗と現実
この背景には、米国における AI 規制政策の著しい失敗があります。
- 行政当局の方針
- 最先端モデル(Frontier)を後回しにし、特定の分野のタスクを拒否する制限付きバージョンのみをリリースしました。
- 実際の選択肢
- これらの制限をかけないFrontier クラスの性能を持つモデルは、中国の研究所からダウンロードすれば入手可能です(米政府が規制権限を持たないため)。
- 「ゲート」設置の理論的な根拠に関わらず、それはアメリカの顧客のみを制約するものであり、海外では機能しません。
- ベンチマーク結果
- 半端な理由で作業を拒否する Claude と対照的に、オープンモデルはタスクをこなします。
- このため、Semgrep のサイバーベンチマークでは、GLM 5.2 が Claude を上回る結果となりました。
今後の趨勢と警告
政府が AI やオープンソースを規制しようとする際、自動車産業で採用された手法を踏襲する可能性があります。
- 過去の教訓:自動車産業
- 長年の補助金や保護関税により育成された米国メーカーは、国内ではトラックを販売しながら、世界中で存在感が薄いです。
- 将来の予測
- 現在の政権も、米国内でのみ使用できる「国内モデル」を支援する官民連携プロジェクトを通じて国際競争力を失わせないよう保護し続けるでしょう。
- その結果、米国は最高品質かつ最も手頃な価格のモデルにアクセスできない唯一の国となり、腐敗した政権と結びついたモデルを購入せざるを得ない悲しい未来が訪れる可能性があります。
結論:Claude を支払う意義を見い出せず
現状においては、Claude に料金を支払う合理的な理由は見つけられないままです。 特に Kimi K3 や GLM 5.2 といったオープンソースモデルは、Opus よりも実務で性能が高く、費用はその何分の一にも過ぎないためです。