DeepSeek、シリコンバレーに匹敵する低コストモデルを発表

DeepSeek、シリコンバレーに匹敵する低コストモデルを発表

100万トークンのコードベースをプレビューモデルに読み込ませて、いつものような途切れなくトークンカウンターが上昇するのを見た。部屋は静まり返り、私のラップトップはパニックを起こさず、静かに唸っていた。あの小さな電気的な衝撃と同じ感覚──スケールには新たな価格が付いたのだと悟った。

私はAIのリリースを十分に追ってきたので、技術的な飛躍がマーケティング上のノイズなのか、それとも市場を動かすものなのかを見極めることができる。DeepSeekの最新プレビューは、その両方だ。

デスクで、リポジトリ全体を収めた単一のプロンプトを開いた――100万トークンのウィンドウとその重要性

ヘッドラインとなる機能はシンプルで明白だ。100万トークンのコンテキストウィンドウ。これにより、モデルはコードベース全体、長文の法的文書、または数時間にわたるトランスクリプトを、パズルのように細かく分割することなく把握できる。あなたにとっては、プロンプトの回数が減り、つなぎ合わせによるエラーが減り、問題から解決策への道筋がより明確になることを意味する。

V4はスケールを実用的なものにする。それは巨大なコードベースのためのスイスアーミーナイフのようなものだ。プロジェクト全体を、数多くの断片化されたメモの集まりではなく、一つの生きた文書として扱えるようになる。セッションをまたいでコンテキストを再構築するのに何時間も費やしたことがあるなら、これは時間を回収したような感覚になるだろう。

オフィスのホワイトボードでVCがコスト対パフォーマンスをスケッチした――MoEアーキテクチャと効率

DeepSeekのV4ラインナップ(V4 Proと軽量版のV4 Flash)は、Mixture-of-Experts(MoE)設計を採用している。これは、何兆ものパラメータが存在するものの、リクエストごとにその一部しかアクティブにならないため、推論コストを低く抑えられることを意味する。

このアーキテクチャは、選択的な電力網のように機能する。電球一つにプラント全体を稼働させるのではなく、必要な場所にのみ回路が作動する。実用的な結果として、パフォーマンスに線形的な影響を与えることなく、トークンコストの削減が実現される。

DeepSeekはGPT-5.4やGeminiと比較してどうなのか?

DeepSeek自身の技術論文によると、V4-Pro-Maxは標準的な推論テストでGPT-5.2やGemini-3.0-Proを上回り、同社のベンチマークではGPT-5.4やGemini-3.1-Proより数ヶ月遅れをとっているという。これは、独立したテスターが発見し始めていることとも一致する。強力な推論能力、優れたコーディングスキル、エージェント機能の向上が見られるが、最先端システムのごく一部ではわずかに差がある。

コーヒーショップで、エンジニアがクラウド請求について笑っているのを耳にした――既存プレイヤーへの価格圧力

これが重要である理由は、お金だ。Simon Willisonらがトークン価格を比較したところ、DeepSeekの料金は顕著に低いことがわかった。V4 Flashの場合、DeepSeekは入力トークン100万あたり0.14ドル(約0.13ユーロ)、出力トークン100万あたり0.28ドル(約0.26ユーロ)を請求している。対照的に、GPT-5.4 Nanoは入力トークン100万あたり0.20ドル(約0.18ユーロ)、出力トークン100万あたり1.25ドル(約1.15ユーロ)であり、AnthropicのClaude Haiku 4.5は入力および出力トークン100万あたりそれぞれ1ドルと5ドル(約0.92ユーロと4.60ユーロ)となっている。

プロレベルのスループットでは、DeepSeekはV4 Proの場合、入力トークン100万あたり1.74ドル(約1.60ユーロ)、出力トークン100万あたり3.48ドル(約3.20ユーロ)をリストしている。Gemini 3.1 Proは入力トークン100万あたり2ドル(約1.84ユーロ)、出力トークン100万あたり12ドル(約11ユーロ)であり、GPT-5.5は入力および出力トークン100万あたりそれぞれ5ドルと30ドル(約4.60ユーロと28ユーロ)となっている。これらの差は、スケールアップすると急速に積み重なる。

DeepSeekはOpenAIやGoogleよりも安いのか?

はい、Simonらが報告した価格帯では、DeepSeekはトークンコストにおいて大手クラウドプロバイダーを凌駕している。これは、オープンウェイト配布を考慮する前の話だ。V4のMITライセンスは、ハードウェアがあれば誰でもモデルを実行でき、トークンごとのベンダー手数料なしで利用できることを意味する――ただし、電気代、GPU、運用コストは依然としてかかる。

取引室で、ニュースが ticker にスクラブされたヘッドラインを流した――市場の反応と地政学

DeepSeekの軌跡は単なる技術的な話ではない。昨年、それは市場に波紋を広げた。同社が最初にR1推論モデルをリリースした際、その動きは急激な売りにつながり、インデックス全体で約1兆ドル(約9200億ユーロ)の価値が消滅し、Nvidiaは1日で約6億ドル(約5億5200万ユーロ)下落したと報じられた。このような反応は一つのことを示している――既存プレイヤーは、その利益を脅かすあらゆる効率性を注視しているのだ。

オープンソースライセンスと安価な推論コストは、クラウドベンダーやチップメーカーにとって戦略的な問いを投げかける。開発チームがトークンあたりのコストを大幅に削減したり、社内でモデルを実行したりできる場合、調達とアーキテクチャの選択は変化するだろう。

V4をローカルで実行できますか?オープンウェイトとはどういう意味ですか?

V4はMITライセンスでオープンウェイトだ。実際には、モデルファイルはHugging Faceで入手可能であり、十分なハードウェアと運用スキルを持つ人なら誰でも自社でウェイトを実行できる。「無料」というラベルはライセンス面では正しいが、運用上の現実としてはそうではない――電気代とGPU時間は依然として請求書に載る。

トレードオフもある。DeepSeekは、最先端の商用リリースと比較した場合、わずかなパフォーマンスの差があることを認めており、その差を埋めるには約3〜6ヶ月のリードタイムを見積もっている。多くの企業にとって、ベンチマークの優位性よりも、価格とパフォーマンスのバランスが決定的な要因となるだろう。

私は以前にも、プラットフォーム、研究者、運用チームが新たなコストカーブに適応するのを見てきた。より安価で有能な選択肢が登場すると、導入は迅速に進む可能性がある。誰が最も恩恵を受けるか――クラウドベンダー、スタートアップ、それともエンドユーザーか――は、各グループがサプライチェーンとサービスモデルをどれだけ早く調整できるかにかかっている。

では、エンジニアやバイヤーであるあなたは、どこに位置するのだろうか?もし、プレミアム価格なしで、長文コンテキストの推論と大規模なトークン処理能力が必要なら、DeepSeekは検討リストに入れる価値がある。もし、クリティカルなタスクにおいて絶対的なトップティアのスコアが重要なら、既存プレイヤーはまだわずかにリードしている。あなたの次のAIへの賭けは、どちらの側に倒れるだろうか?

私たちの活動を応援してください ❤️

この記事を気に入っていただけたら、今後も質の高いコンテンツを発信し続けられるようチップのご支援をご検討ください。

PayPalでの安全な支払い
関連項目:  DeepSeek CEO、情報漏洩疑惑で混乱:AIドラマは一般大衆を飽きさせる
Moyens I/O のスタッフはあなたをやる気にさせ、テクノロジー、自己啓発、ライフスタイル、そしてあなたを助ける戦略についてのヒントを提供してくれます。