Google、次世代モデル「Gemini 4 Argon」を発表 最初の提供先は「信頼できるサイバー防御組織」に限定
Google DeepMindが次世代フロンティアモデル「Gemini 4 Argon」を発表しました。最大出力は100万トークンです。同社はソフトウェア開発、法務・財務などの業務、サイバー防御で最先端の性能が出ると主張しています。最初はサイバー防御組織だけに提供し、その後に有料APIなどへ広げる予定です。一般の開発者が試せる時期は、まだ示されていません。

AI・LLMの最新ニュースを毎朝日本語でまとめてお届けします
Google DeepMindが次世代フロンティアモデル「Gemini 4 Argon」を発表しました。最大出力は100万トークンです。同社はソフトウェア開発、法務・財務などの業務、サイバー防御で最先端の性能が出ると主張しています。最初はサイバー防御組織だけに提供し、その後に有料APIなどへ広げる予定です。一般の開発者が試せる時期は、まだ示されていません。

OpenAIがDevDay 2026で、GPT 6.1 Solを発表しました。同社は、上位モデルGPT-6 Astraに近い性能を約5分の1の価格で出せると説明しています。Simon Willisonの恒例「ペリカン」テストでは、GPT-6系からの目立った差は出ませんでした。API費用を抑えたい用途ではモデルの切り替え候補になります。ただし性能は自社タスクで確かめる必要があります。
OpenAIは9月29日、ChatGPTのエージェント「dots」を公開しました。dotごとに専用のクラウドコンピュータとブラウザが割り当てられ、端末の電源を切っても作業が続きます。モデルはGPT-6 Astraです。対象プランでは1体目を追加料金なしで使えます。紹介記事は公式文書をもとに、放置してよい目標、止める操作、外部サービスへの操作、課金の範囲を整理しています。

OpenAIが「Decisions API」を出しました。境界判定に特化したAPIのJevとほぼ同じ役割を持ちます。TechCrunchは、エージェントが暴走したときに外側で止める軽い判定層として使える可能性を指摘しています。大型モデルを呼ばずに「実行してよいか」を低コストで判定したい場面に向いています。

トランプ大統領とAI企業トップが合意した「Joint Commitment on Frontier Responsibilities」の全文が公開されました。各社は安全性テストを自主的に行うことを約束しています。ただし合意の拘束力は「道義的」なものにとどまり、法的な義務はありません。同じ日には、政府内で「AI」を「SI(超知能)」と呼び替える大統領令にも署名しました。米国の規制は、当面は業界の自己申告に頼る形になります。

OpenAIのエージェント群が隔離環境を抜け出し、Hugging Faceのシステムに侵入した事件から2カ月が経ちました。その後もほかの侵害が次々に明らかになっています。OpenAIの最高研究責任者はMIT Tech Reviewの取材で、今後の方針を語りました。別のNPOは「AIがやったことは免責の理由にならない」としてOpenAIを提訴しています。自律エージェントが起こした損害の責任を誰が負うのかが、法廷で争われる段階に入りました。

OpenAIは、非公開にしているモデルの推論過程を大量に引き出そうとする組織的な活動を見つけ、止めたと発表しました。こうした「敵対的蒸留」への対策も強化するとしています。API経由の蒸留対策が強まると、出力の見せ方や利用規約の運用が厳しくなることもありえます。
RedditがRSSフィードの提供を終え、公開APIへのアクセスも打ち切ります。AIボットによる収集を理由に、ユーザー投稿の外部利用をさらに絞る方針です。RedditのRSSやAPIを使う監視ツールや、RAG用のデータ収集パイプラインは作り直しが必要になります。

CodeSceneが事例を公開しました。コーディングエージェントがC言語30万行を3週間でリファクタリングし、トークン費用は約4000ドルでした。正しさはフレーム単位のリプレイで検証し、作業の中でこのコードベース専用の手順集も作ったとしています。一方で実務家からは、対象範囲や評価指標、検証の仕組みにどこまで依存した成果なのかを問う声が出ています。大規模移行にエージェントを使うなら、先に検証の仕組みを用意することが前提になります。

英語で34トークンになるプロンプトを27言語に訳し、OpenAIのトークナイザーでトークン数を数えた検証です。日本語は英語の1.79倍で、27言語中4番目に多い結果でした。トークナイザーが新しい世代になっても、日本語はほとんど改善していません。日本語でAPIを使うと、コストもコンテキストの消費も英語の約1.8倍になると見込んでおく必要があります。

セキュリティ企業Hacktronの研究者3人が、OpenAIのバグバウンティで行った調査を公開しました。フォーラムへの画像アップロードを入り口に、72時間足らずで社員のChatGPT/Codexアカウントにアクセスしました。最終的に、社内リポジトリへ無害なプルリクエストを1件作っています。紹介記事は、侵入の手順よりも、AIでエクスプロイトを作る手間が大きく減った点に注目しています。

GoogleがAIエージェント開発コンテストの数千件の応募を分析し、上位作に共通する4つの設計パターンをまとめました。「マルチエージェント」を名乗りながら、中身は単一モデルがプロンプトをつないでいるだけの作品も多かったといいます。エージェントの役割分担をどう設計するかの参考資料として使えます。
