この記事について海外で公開された情報をもとにAIが要約・解説した記事です。原文の翻訳ではありません。正確な内容は記事末尾の出典元をご確認ください。

モデル発表とコスト競争

Google DeepMindは、コーディングとエージェント向けの新モデル「Gemini 3.7 Flash」を発表した。前モデルの3.6 Flashからわずか3週間でのリリースであり、ソフトウェアエンジニアリングやウェブ開発、知識業務で性能が向上している。導入期間中の料金は3.6 Flashの当初の半額に設定され、低コストでプロダクション向けエージェントを構築しやすくなった。

xAIも新モデル「Grok 4.6」を公開した。1.5Tパラメータの大規模モデルで、長時間動作するエージェントや対話的・視覚的な作業に重点を置く。独立評価ではGPT-5.6 Sol Maxと同等の指標を示し、コーディングエージェント性能ではTerminal-Bench v2.1で88.4%を記録した。価格は入力100万トークンあたり2ドル、出力あたり6ドルと、フロンティアモデルの中では低い水準だ。

OpenAIはGPT-5.6ファミリーの開発者向けガイドを公開し、従来よりはるかに低いコストでフロンティア級のエージェント性能を実現できると説明した。Responses APIに追加された推論の永続化やプログラムによるツール呼び出しなどの新機能も特徴だ。小型モデルのLunaやTerraを活用した導入事例も紹介され、モデル選択と実装のヒントが示された。

大型IPOとインフラ拡大

Anthropicが2026年10月に予定する新規株式公開(IPO)で、2兆ドル以上の評価額になる見込みであることが複数の投資家の情報として報じられた。これは過去最大のIPOとなり、宇宙開発企業SpaceXの評価額も上回る規模だ。背景には、同社の年換算売上高が2026年末までに1,000億〜1,200億ドルへ急成長するとの見通しがある。一方で、米国政府との対立や輸出規制によるモデル一時撤去など、リスク要因も指摘されている。

NVIDIAは、米オハイオ州のPORTS-Pikeテクノロジーキャンパスで、SB Energyと連携してAI工場に必要なLPS(土地・電力・建物)容量を確保すると発表した。このサイトにはNVIDIAのコンピュートを設置し、OpenAIがテナントとして入る。初期展開は4.25GWで、OpenAIの2030年までのコミットメントは約12GW、条件次第で約16GWに達する可能性がある。NVIDIAはサイトの保証の範囲や資金の仕組みについても詳しく説明している。

エコシステム再編と中国勢

AIコードエディタのCursorがSpaceXaiにより600億ドルで買収され、完了が報じられた。同時に、Z.aiがGLM-5.3を公開し、AlibabaはQwen3.8-27Bをリリースした。DeepSeek V4-ProやRedNoteのdots3-noteなど中国勢のオープンモデルが相次ぎ、エージェント向けの性能向上が目立つ。

一方で、ベンダーのベンチマーク主張への懐疑論も強まっており、モデル選定には自前評価の重要性が増していると指摘された。こうした動きは、AIエコシステムの再編が進む中で、ユーザー側が適切にモデルを評価・選択する必要性を示している。

明日以降の注目点

明日以降は、Gemini 3.7 FlashやGrok 4.6の実運用での評価が進み、コストパフォーマンスの実力が明らかになることが注目される。また、AnthropicのIPOに向けた動向や、NVIDIA・OpenAIのインフラ計画の具体的な進展も続報が期待される。

さらに、Cursor買収後の統合戦略や、中国勢のオープンモデルのエージェント性能がどのように評価されるかも見どころだ。特に、ベンチマークと実環境の乖離が叫ばれる中、開発者コミュニティでの自前評価の結果が次のモデル選定に影響を与える可能性がある。

AI導入も顧問も、お任せください

何から手をつけるか、どこまでAIに任せるか。自社の業務に合わせて整理し、導入から運用まで伴走します。相談だけでも構いません。

AI導入について相談する