直接対決
Kimi K3 vs DeepSeek V4 Pro
Kimi K3とDeepSeek V4 Pro、どちらが優れているか?
インデックスではKimi K3がDeepSeek V4 Proを上回り、87.5対86.8となりました。クラフトではKimi K3が上ですが、コントロールとコストパフォーマンスではDeepSeek V4 Proが依然としてリードしています。両者とも同じ週に同じ評価基準で採点しており、どちらの順位もスポンサーによるものではありません。
更新
Kimi K3
53件中05位
87.5
誰も公開したことがない規模の最大のオープンウェイトモデル。100万トークンをまばたきせず読む。
DeepSeek V4 Pro
53件中07位
86.8
フロンティアの推論モデルが、MITライセンスで、おまけのような価格で。
4つのスコアを並べて
| スコア | Kimi K3 | DeepSeek V4 Pro | 差 |
|---|---|---|---|
| クラフト | 91 | 86 | +5 |
| スピード | 74 | 74 | — |
| コントロール | 91 | 94 | +3 |
| コストパフォーマンス | 82 | 90 | +8 |
| インデックススコア | 87.5 | 86.8 | +0.7 |
どちらを選ぶべきか
コントロールとコストパフォーマンスが決め手にならない限り、選ぶべきはKimi K3です。まさにその点においてのみ、DeepSeek V4 Proのほうが良い答えになります。
Kimi K3
MoonshotがK3を、誰も公開したことがない規模で、ネイティブビジョン・明示的な思考モード・100万トークンウィンドウ付きで公開した。長文書処理とエージェント業務では本当にフィールドの上位に近い。注意すべき点が2つある。ライセンスは収益閾値を超える商業利用を制限しており、オープンソースではなくオープンウェイトだ。そしてホストAPIは中国の他のフロンティアモデルではなく、フロンティアモデルの価格設定だ。
特に優れている点
- 名目上ではなく適切に処理される100万トークンコンテキスト
- ネイティブビジョンと明示的な思考モード
- エージェントベンチマークで最強のオープンウェイトモデル
DeepSeek V4 Pro
ProはDeepSeekの推論フラッグシップだ。答える前に考える非常に大きなスパースモデルで、数学やコードでは最高のクローズドモデルに近い水準に達する。注目すべきはベンチマークではなく、ウェイトがMITライセンスで公開されており、ホストAPIの料金もあらゆる西側モデルのごく一部だという事実だ。FlashよりA遅いが、それは当然だ——考えることがこのモデルの本質だから。
特に優れている点
- フロンティア隣接の推論をオープンウェイト価格で
- 推論トレースを含めてMITライセンス
- 非常に長いコンテキストにより、リポジトリ全体を1回の呼び出しに収められる