Bloomberg Intelligence(BI)によると、中国の先端AIモデルと米国勢のベンチマーク上の性能差は、DeepSeekが2026年9月にV4.1 Flashを公開した後、約3%まで縮まりました。BIが示した差は、5月時点で約9%、年初には約**15%**でした。急速な追い上げを示す数字ですが、中国がAI産業全体で米国を上回ったという意味ではありません。
LiveBenchで見えたDeepSeekの成績
DeepSeek V4.1 Flashは、LiveBenchで81.1点を獲得し、報道されたランキングで世界6位となりました。Anthropicの最高位モデルは83.4点。この2.3点差は、BIが推定する約3%の性能差に相当します。
12
ただし、これは特定のベンチマークでの比較です。AIの能力全体や、米中の技術競争のすべてを測るものではありません。今回の結果から分かるのは、LiveBench上でこの2つの先端モデルが近い成績を示したことまでで、あらゆるモデルや用途で同じ差になっているとは限りません。
差は縮小、それでも中国勢が上位を占めたわけではない
追い上げは数カ月かけて進んできました。BIは6月時点で、中国モデルと米国モデルの差が5月の9%から**6%**に縮まったと報告。その時点で、中国モデルはLiveBenchの世界ランキングに2モデルが入っていました。今回の約3%という推定は、その後も性能向上が続いたことを示しています。
2
一方、後のLiveBenchランキングでは、上位15モデルのうち中国モデルは3つにとどまりました。トップモデル同士の差が小さくなったことと、中国勢がランキング上位に厚みを持つことは別の話です。「追いつきつつある」とはいえても、「すでに追い越した」とは言い切れません。
8
半導体規制と米国のAI優位をどう見るか
先端半導体へのアクセスが制限されるなかで中国の研究機関が成果を上げていることは、米国の輸出規制がモデル性能での優位をどこまで保てるのか、という問いにつながります。ただし、今回のベンチマーク結果だけで、規制に効果がなかったと結論づけることはできません。BIは、中国企業が米国の競合より資金力で劣り、最先端の半導体を使えない点も指摘しています。
1
17
現時点で慎重に言えるのは、この指標における米国のリードが大きく縮まったということです。AI分野全体の主導権がどうなるかは、単一のランキングだけでは判断できません。企業が使える資金や、モデルを広く利用される収益性の高い製品に育てられるかどうかも関わります。
高性能モデルが利益につながるとは限らない
モデルの性能は、事業の成否を決める要素の一つにすぎません。Bloombergの報道は、中国製モデルを低コストで競争力のある選択肢と捉える一方、業界には収益化の壁があるとも伝えています。DeepSeekの低価格は競争を強めますが、安価に利用者を集められることだけで、企業が持続的に利益を得られるとは限りません。
3
18
要点: BIの評価では、DeepSeek V4.1 Flashの登場後、測定された性能差は2026年初めの約15%から約3%へと大きく縮まりました。米国がモデル性能で長く優位を保つという見方を揺さぶる結果ですが、中国がAI全体で優位に立った証明ではありません。競争力のあるモデルを、長期的に利益を生む事業へつなげられるかも、なお課題です。
3