DeepSeek V4 Pro 0813 公開、1Mコンテキストで入力0.435ドル/Mトークン
DeepSeekが大規模MoEモデル「DeepSeek V4 Pro 0813」のGA版をリリース。OpenRouterで提供され、入力0.435ドル、出力0.87ドル(100万トークンあたり)、コンテキスト長は1Mトークン。キャッシュ読み取りは0.003625ドルと低価格。推論能力を強化し、コーディングやエージェントワークロードに最適。OpenRouter経由でAPI利用可能。
DeepSeek V4 Pro 0813は、DeepSeekによる大規模なMixture-of-Expertsモデルであり、これはDeepSeek V4 ProのGAリリースです。
HNでの議論
453- simonw
素敵な自転車チェーンですね。魚の入った小さなバスケットが正しい場所に表示されませんでした: https://tools.simonwillison.net/markdown-svg-renderer#url=ht...
- simjnd
Deepseek V4 Flash 0731は、あの小さなモデルと価格でこれほど大きな能力の飛躍を遂げたので、今回のリリースには少しがっかりしています。
私はエージェントを厳重に管理し、アイデアやアーキテクチャをぶつけ合うために対話的に使い、それからコード(特にプロトタイピング)を書くのに使っていますが、Flashは私が必要とするすべてのことを完璧にこなしてくれています。
FableやSolグレードのモデルを必要とする人々に比べると、私の野心は控えめすぎるかもしれませんが、当分の間はFlashを使い続けてProには移行しないつもりです。
- freakynit
OpenRouter経由でテストしました。まったく同じタスクを与えました。タスクは、既存のリポジトリをスキャンして、Caddyサーバーの背後にデプロイするための単一のdocker-composeファイルを生成することでした。特定のポート範囲はすでに使用されており、サービスは外部からワイルドカード証明書のプロビジョニングを要求し、PostgreSQLは組み込みのものでなければなりません。
このモデルとgpt-5.6-terra-highをテストしました。
結果: こちらはいくつか問題がありました。terraは問題なし。
これらの結果は、最新のFlashバージョンでの私の過去の観察とも一致しています。ベンチマークが示すことと、私が観察していることは異なります。
プロジェクトが単純なうちは良いですが、それ以上は...
- alecsm
私は先週から最新のDeepseek Flashアップデートを使っていますが、驚いています。簡単なタスクには有能なモデルでしたが、今では重い開発もほんのわずかなコストでできるようです。
この新しいものを試すのが待ちきれません。
- book_mike
私が気にしているのは、モデルが最低コストで私が与えるタスクを実行できるかどうかです。今はKimi-K3/GLM-5.2/MiniMaxを使っています。Sonnetは素晴らしいですが、トークンを消費しすぎます。Opus 5を最大設定にすると素晴らしく、私たち全員よりも賢いです。しかし、98%の確率でそのような知能は必要ありません。仕事が完了すればいいのです。
- monster_truck
一日中、トラフィックシミュレーター/分散物理エンジンでかなり激しく回しています(2Bで約12.50ドル、キャッシュヒット率50%)。新しい問題を導入することなく、かなりの改善が見つかりました。
満足しています。
- jklmnopqrstuvw
DS v4 pro 0813とGrok 4.6(両方ともOpenRouterから)をCodex CLIでテストしました。私のプロジェクトで同じ新機能開発に取り組みました。
Deepseek 4 pro: 12分02秒 - コスト$0.12 - バグあり。
Grok 4.6: 3分18秒 - コスト$1.41 - バグなし。
- Gecko4072
現在、公式のDeepseek APIでお金を急速に燃やしています。彼らは今日から価格も引き上げています。V4 Flash 0731は、過去数ヶ月、そしておそらく今後も最も傑出したモデルだと感じています。
- scrlk
ベンチマーク:
| ベンチマーク | DS-V4-Pro | DS-V4-Flash | DS-V4-Pro | DS-V4-Flash | GLM-5.2 | Kimi-K3 | Opus-4.8 | Fable 5 |
| | 0813 | 0731 | Preview | Preview | | | | (w/ fallback) |
|--------------------------|-----------|-------------|-----------|-------------|-----------|-----------|-----------|---------------|
| HLE (wo/w tools) | 42.7/60.0 | 37.8/51.5 | 37.7/48.2 | 34.8/45.1 | 40.5/54.7 | 43.5/56.0 | 49.8/57.9 | 53.3/63.0 |
| Terminal Bench 2.1 | 87.9 | 82.7 | 72.1 | 61.8 | 81.0 | 88.3 | 85.0 | 88.0 |
| NL2Repo | 61.5 | 54.2 | 38.5 | 39.4 | 48.9 | - | 69.7 | - |
| Cybergym | 83.3 | 76.7 | 52.7 | 38.7 | - | 80.0 | 78.3 | 83.1 |
| DeepSWE | 62.7 | 54.4 | 12.8 | 7.3 | 46.2 | 67.5 | 58.0 | 70.0 |
| Toolathlon-Verified | 74.1 | 70.3 | 55.9 | 49.7 | 59.9 | 76.5 | 76.2 | 77.9 |
| Agents' Last Exam | 25.7 | 25.2 | 16.5 | 15.8 | 23.8 | 27.6 | 25.7 | - |
| AutomationBench (Public) | 31.8 | 25.1 | 12.8 | 10.8 | 12.9 | 30.8 | 27.2 […]
- Hardd
これまでの私の経験によると、以前のモデルと比較して、DeepSeek V4 Proは以前と同等以上の結果を達成しますが、コストは低くなります。