FORSMILE
第7号2026年10月4日発行 / 対象期間 9/28〜10/4Read in English

今週のAIニュース13選 — 新モデルの単価が3社とも$2/$10に並び、競争の軸は「同じ仕事に使うトークン数」と「誰が使えるか」へ動いた

今週の総括

今週の軸は、新モデルの単価が3社で$2/$10に並んだことです。OpenAIのGPT-6.1 Sol(9月29日)とAnthropicのClaude Sonnet 5.5(9月28日)は標準価格が同じ入力$2・出力$10で、GoogleのGemini 4 Argon(9月30日)も導入価格は同じ$2/$10ですが、期間が終わると$4/$20になり、しかも今は信頼できるサイバー防御者にしか出ていません。OpenAIとAnthropicはタスクあたりの費用を、Googleはキャッシュ入力の95%引きを前面に出しており、単価が同じなら差は自分のワークロードで測るしかありません。もう1つの動きは、OpenAIのdotsとSpaceXAIのTeam Botsに代表される、常時動き・チームで共有されるエージェントが製品の中心になったことです(OpenAI DevDayは9月29日で、発表は20件超)。さらに同じ週に、OpenAIが組織的な蒸留の遮断を公表し、AnthropicもSonnet 5.5に推論の抽出を防ぐ分類器を入れました。出力や思考を持ち出させない設計が、標準装備になりつつあります。

モデル・製品

OpenAI、GPT-6.1 Solを公開。Astraに近い性能を5分の1の価格で、キャッシュ入力は$0.10

GPT-6 Solの更新版。標準価格はGPT-6 Solと同じ$2/$10のまま、性能をAstraへ近づけた。

9月29日公開(DevDay 2026の当日)。OpenAIは「GPT-6 Astraの知能にほぼ並ぶ性能を、Astraの標準入出力価格の5分の1で」と説明しています。100万トークンあたりの価格は入力$2・出力$10・キャッシュ入力$0.10で、Astraは$10・$50・$1.00、Lunaは$0.10・$0.50・$0.01です。DeepSWE v1.1ではAstraと並び(費用は約5分の1)、GPT-6 Solの最高スコアを6.4ポイント上回りました。AutomationBench 1.0.6ではClaude Opus 5.5(medium)を2.2ポイント上回って費用は約3分の1です。事実誤りを含む回答の割合は、低推論努力で11.4%から7.7%へ下がりました(ユーザーが誤りを指摘した会話から集めた難問での値で、通常利用の代表値ではないとOpenAIが注記)。提供はChatGPT WorkとCodex(Plus・Pro・Business・Enterprise・Edu)とAPI(`gpt-6.1-sol`)で、Chatにはまだありません。AWSも同日にAmazon Bedrockで一般提供を始めました。

So What

APIで回している処理では、Astraに近い結果を5分の1の単価で試せます。ただしOpenAIの比較は自社が選んだ指標と推論設定で、科学研究ではAstraが68.1%で最高だとOpenAI自身が書いています。難しい推論はAstra、複雑なコーディングや計算機操作はSol、という切り分けは10月2日のモデルガイドにもあります。ChatGPTで試す人は、Chatではなく「Work」側で選ぶ必要があります。

モデル・製品

Anthropic、Claude Sonnet 5.5を公開。価格はSonnet 5と同じ$2/$10で、Terminal-Bench 4.0は70.6%

Sonnetを全面更新。単価は据え置きで、同じ仕事に使うトークンが減り、30%以上速くなった。

9月28日公開。Claude 5.5ファミリーの2番目のモデルで、Opus 5.5(9月22日)の下位に当たります。価格は100万トークンあたり入力$2・出力$10、キャッシュ読み出し$0.20・書き込み$2.50です(Opus 5.5は$4・$20・$0.20・$5)。Terminal-Bench 4.0は70.6%(Sonnet 5は10.3%、Opus 5.5は66.4%で、Opus 5.5の値は最高努力のXhighのもの)、OSWorld 2.1は80.1%(部分点)です。Sonnet 5より30%以上速く、タスクあたり最大30%安いとAnthropicは述べています。Haiku 5.5は「今後数週間で追加」とされています。AWS・Google Cloud・Azureを含む全プラットフォームで使え、モデルIDは `claude-sonnet-5-5` です。

So What

thinkingをオフにしてSonnetを使っているなら、移行前の確認が要ります。新しい `between_tools` 設定へ切り替えてからSonnet 5.5へ移る必要があるとAnthropicの移行ガイドにあります。サイバー面では、Sonnetとして初めてOpus 5.5並みの安全装置つきで出荷され、危険度の高いサイバー作業は表示つきでSonnet 5へフォールバックします(通常のバグ修正は影響なし)。さらに推論の抽出を防ぐ分類器が初めてSonnetに入り、思考を作成したアカウントから切り離せなくなるため、会話をアカウント間で移す運用(Claude Codeでの途中のアカウント切替を含む)は影響を受けます。

モデル・製品

Google、Gemini 4 Argonを発表。まず信頼できるサイバー防御者だけに提供し、導入価格は$2/$10

出力上限を1Mトークンへ広げた新しいフロンティアモデル。一般提供の前に段階公開へ入った。

9月30日発表。サイバー防御者向けの Fairwind Program から配り始め、米政府の任意の事前公開審査に参加しながら段階的に広げるとGoogleは書いています。開発者・企業・一般向けは「できるだけ早く」で、最初は有料APIとGoogle AI Ultraの契約者の予定です。価格は導入価格として100万トークンあたり入力$2・出力$10、キャッシュ入力は入力価格の95%引きで、導入期間が終わると$4/$20になります。出力トークンの上限は64Kから1Mへ拡大されました。DeepSWE v1.1で77.9%(同社が最高と主張)、ZapierのAutomationBenchで51.3%の1位、CWE-bench v1で68%の首位タイです。信頼できる防御者と社内チームにはサイバー用のガードレール無しで出すとしています。

So What

今は申し込んでも使えない可能性が高いモデルです。対象は信頼できるサイバー防御者に限られ、開発者向けの日付は示されていません。そのため$2/$10は今買える価格ではなく、期間限定の予告価格で、期間後は倍になります(導入期間の終了日は原文に無し)。成績はGoogleが選んだ指標で、他社の最新モデルとの直接比較は載っていません。フロンティアの能力を審査制の裏に置いてから段階公開する流れは、第3号(9月6日)の3社と同じです。

モデル・製品

OpenAI、常時稼働のエージェント「dots」を提供開始。専用のクラウドPC上で24時間動く

ChatGPTの中に、自分専用で常駐するエージェントを1つ持てるようになった。

9月29日発表。GPT-6 Astraを土台に、dotごとに専用のクラウドPCとブラウザを持ち、プラグインを通じて4,000以上のアプリにつながります。ChatGPT・Slack・Teamsから会話でき、頼まれる前に先回りして調べる「proactive research」では、接続済みのアプリに対して読み取り専用のツールしか使いません。提供はProとBusiness Premiumの対象市場で順次始まり、Enterprise・Edu・Healthcareは管理者が有効にするとベータを試せます(既定ではオフ)。最初の1つは追加料金なしでプランに含まれ、dotとの会話はChatGPTの利用上限に数えられません。ただしdotにCodexやChatGPT Workでタスクを始めさせると、通常どおり上限に数えられます。Microsoftとは、企業向けの専門dotをAgent 365の統制機能で管理できるようにする統合を進めているとしています。

So What

料金の見通しが立たないのが最大の注意点です。最初の1つは無料で含まれ、将来は追加のdotや速度・処理量を増やす形で拡張する構想が書かれただけで、価格は未公表です。プライバシー面では、Business・Enterprise・Eduのワークスペースの内容は既定ではモデル改善に使わず、個人プランでは設定で選べます。dotの自分宛メモやproactive researchは直接は学習に使わないが、設定によっては関連する会話の参考にされうると書かれています。パスワード変更のような機微な作業は、常に人の手に残ります。

モデル・製品

SpaceXAI、チームで共有して学習する「Team Bots」を発表。Slackで呼び出せるGrok Bot

1つのBotを部署で共有し、個人ごとの会話は分けたまま、共通の知識とツールで動かす。

9月28日発表(SpaceXAIはx.aiのニュースでの表記)。Team Botはコンテキスト(ファイル・指示・スキル)、プラグイン(Salesforce・Notion・GitHubなど)、認証情報、記憶の4つを束ねて、役割やワークフロー単位で作ります。Botは共有されても、各人との会話は非公開で、Botは利用者ごとに別の文脈と記憶を持ちます。Slackでは専用のハンドルで呼び出せます。SpaceXAI自身の事例として、営業アカウントごとのBotが毎朝ブリーフィングを出す例や、エンジニアリングBotがCursorのクラウドエージェントを動かして5人のチームが1日に100件超のPRを出した例(同社の自己申告)を挙げています。

So What

OpenAIのdots(個人に常駐)に対し、こちらは「チームで1体を共有する」設計です。同じ週に各社が「常時動く・共有される」エージェントを製品の中心に置いた、という点が拾った理由です。数字は同社の自社事例で、他社の環境での再現性は示されていません。

モデル・製品

OpenAI、GPT-6 Astraの高速枠「Ultrafast」と新プラン「Pro 500」を開始。AWS Bedrockも翌日に対応

Astraのトークン生成を最大8倍速くする追加の速度枠。料金はこの号では確認できなかった。

9月29日開始。UltrafastはCodexで最大8倍(毎秒300トークン)、APIで最大6倍のトークン生成をうたう速度枠で、対象はGPT-6 Astraです。提供はAPIと、Pro 500とEnterpriseのChatGPT Work・Codexで、GPT-6.1 Sol版は「近日」とされています。NVIDIAは10月1日に、Blackwell GPUで動いていると説明し、AWSは9月30日にAmazon Bedrock対応を発表しました。新プランのPro 500は、ChatGPT Plusの25倍の利用枠でUltrafastを含みます。

So What

速度は追加の枠で、料金は「Ultrafast guide」にあり、この号では確認していません。Pro 500の月額も、取得した原文にはありません。速度が効くのは、エージェントが「書く→ツールを呼ぶ→確かめる」を何周も回す処理だとOpenAIとNVIDIAは説明しています。導入を検討する前に、価格を一次資料(Ultrafast guideとプランの価格ページ)で確かめてください。

開発ツール

OpenAI、Agents APIにコンピュータ操作を追加。AWS内で完結するBedrock Managed Agentsもプレビューに

OpenAIのエージェント実行基盤が、APIとAWSの両方で使えるようになった。

9月29日発表。Agents APIはコンピュータ操作に対応し、Codexのマルチエージェント機能・ツール検索・ツール呼び出し・コンテキスト圧縮を自分のアプリへ組み込めます(基盤の運用はOpenAI)。AWSとOpenAIが共同開発したAmazon Bedrock Managed Agentsは、OpenAIのAgents APIをAWS向けにカスタマイズしたもので、既存のID・権限・統制のままAWS内で完結してエージェントを動かせます。AWSの発表では、これは9月29日にプレビューになりました。別にDecisions API(Lunaを使い、定義した有限の回答から選ばせる分類・振り分け用)が限定プレビューで、広い公開は「数日中」とされています。

So What

AWSで運用している組織は、データをAWSの外へ出さずにOpenAIのエージェントを使う選択肢が増えました。ただしAWS側はプレビューで、価格や稼働保証などの本番条件は本号では確認していません。Decisions APIは「数日中に広く公開」とあるだけなので、公開されたかどうかは次号で確認します。

開発ツール

OpenAI、Codexをクラウドで常時動かせる形に。CLIに音声操作、Security Cloudも追加

自分のPCを閉じていても、クラウド側でCodexが作業を続けられる。

9月29日発表。Codex in the cloudは、手元のPC・スマホからの遠隔・任意の端末からのクラウド実行を選べ、再利用できる開発環境で、承認済みの設定と権限をチームで共有できます(Plus・Pro・Business・Healthcare・Education・Enterprise)。Codex CLIは音声でタスクを始められるようになり、複数タスクを見渡す `/agents` ビューが入りました。Codex Security CloudはGitHubリポジトリ全体を手動またはスケジュールで走査し、新しいコミットも継続して検査します。発見事項の調査・重複の除去・修正案づくりまでクラウドで行い、Daybreak Blue経由のモデルを別途のDaybreak申請なしで使えます(Pro・Business・Enterprise・Eduのデスクトップとウェブ)。

So What

「ノートPCを閉じても走る」点が今回の変化です。一方、クラウドで走らせるセキュリティ走査は、リポジトリ全体の読み取りと修正案づくりをOpenAI側のクラウドに任せることになります。対象リポジトリの範囲と権限を決めてから有効にする判断が要ります。Security Cloudの対象はPro以上のプランで、Plusは含まれません。

開発ツール

Claude Code 2.1.284〜2.1.289。Sonnet 5.5が既定のSonnetになり、プラグインが深い挙動を変えられる「Claude Mods」が入った

モデル更新への追従に加えて、プラグインに許す権限の範囲が広がった週。

9月28日〜10月3日の6リリース。2.1.284でSonnet 5.5(`claude-sonnet-5-5`、1Mコンテキスト、$2/$10・キャッシュ読み出し$0.20)がAnthropic APIの既定のSonnetになりました。2.1.285で、端末が使えるAPIプロバイダを制限する管理設定 `allowedProviders` と、WebFetchを無効にする環境変数 `CLAUDE_CODE_DISABLE_WEB_FETCH` が入っています。2.1.287でClaude Mods(プラグインがより深い挙動を変えられる)が入り、組み込みのモッド「You should know」(横で見張る補助エージェント)を `/plugin enable cc-plugin-you-should-know@builtin` で有効にできます(ファーストパーティのセッションでテレメトリがオンの場合)。2.1.289では、管理対象マシンでユーザーが入れたモッドの承認が、複合シェルコマンドの入れ子部分のdeny/askルールを上書きできた問題と、ユーザーが入れたプラグインが組織管理のMCPサーバのサインインツールの説明を書き換えられた問題が修正されました。

So What

権限ルールで縛っている組織は、Modsが入った後の2.1.289まで上げる意味があります。上の2件の修正が2.1.289に入っているので、それ以前の版では起こりえたと読めます(条件は修正文のとおり、管理対象マシンや組織管理のMCPサーバ)。`allowedProviders` は、モデルの接続先を管理側で絞る手段として使えます。

市場・業界構造

OpenAI、契約中のコミットを提携ソフトの支払いに充てる「Marketplace」を開始。ChatGPTの利用枠を16社のツールで使える連携も

OpenAIとの契約が、他社ソフトの購入・利用の支払い手段にもなる。

9月29日発表。OpenAI Marketplaceは、対象の企業顧客が既存のOpenAIコミットの一部を、承認済みの提携ソフトに充てられる仕組みです。最初の32社には、クリエイティブのFigma、顧客対応のAdobe・Sierra・Decagon・HubSpot・Salesforce・ServiceNow、法務のHarvey・Legora、セキュリティのPalo Alto Networks・CrowdStrike、オープンモデルのBasetenが含まれます。別にSign in with ChatGPTで、ChatGPTの利用枠をCognitionのDevin、Notion、Vercel、T3、OpenClaw、Dactylなど16社のツールで使え、各社に使わせる量も制御できます。プランの利用枠の共有はPlusとProの利用者が対象です。

So What

OpenAIとの契約額が、周辺ツールを買う予算としても動かせるようになりました。受ける側のソフト会社にとっては、OpenAIの顧客が自社製品を買う導線が増えます。買う側は、コミットを充てられる条件(対象の契約・上限・精算方法)がこの発表に書かれていないので、営業窓口に確かめるまで、すぐ自由に使えるとは読めません。

市場・業界構造

Anthropic、1億ドルで2027年末までに1万人を育てる「Claude Frontier Academy」を開始

AI導入が進まない原因を「人材」とみて、顧客・提携先の技術者を自社の基準で育てる。

10月2日発表。1億ドルのコミットメントで、2027年末までに1万人のFrontier Deployed Engineer(FDE)を育てます。最初のコホートにはAccenture、Bain、Capgemini、Commonwealth Bank of Australia、Deloitte、McKinsey、Morgan Stanley、Novo Nordiskなどの技術者が入り、サンフランシスコ・ニューヨーク・ロンドンで始まっています。数日間の対面プログラムと採点つきの実技を経て「Claude Resident Engineer」のバッジを得て、続く12週間のレジデンシーで自組織の実案件を率います。再審査に通ると FDE のバッジとなり、最初の修了は2027年初めの見込みです。参加は組織による推薦制です。

So What

「モデルの性能」ではなく「導入できる人の数」を競争の軸に置いた発表です。対象は顧客と提携先の技術者で、問い合わせは自社のAnthropic担当窓口を通す形なので、個人が申し込む制度ではありません。資格が市場でどう評価されるかは、最初の修了者が出る2027年初めまで分かりません。

規制・安全

OpenAI、モデルの「保護された推論」を抜き取る組織的な蒸留キャンペーンを遮断したと公表。中核はMoonshot AI関係者と推定

暗号化された推論を別の会話で復号させる手口まで見つかり、複数ベンダーに共通の問題だと位置づけた。

9月30日公表。最初の活動は7月1日で、7月24〜25日に4,000人超のユーザーから、該当する抽出パターンのリクエスト1万6,000件の急増があり(試行であり成功とは限らない)、関連する1万5,000人超のクラスターを7月28日までに完全に遮断したと書いています。手口の1つは、ある会話から暗号化された推論をコピーし、別の会話のモデルに復号と書き起こしを頼むものでした。OpenAIは中核の一群をMoonshot AI(Kimiの開発元)に関わる個人と見ている一方、観測した全運用者が単一の主体かどうかは不明としています。対策はアカウント措置と、他人の暗号化された推論を再生して内容を復元できる経路の遮断、推論を露出しうる出力の保留などで、Frontier Model Forumと政府の情報共有経路にも共有しました。

So What

推論を持ち運べる・再生できる仕組みは攻撃面になります(OpenAI自身が、そうした成果物を扱うシステムは同様のリスクを持ちうると書いています)。同じ週にAnthropicもSonnet 5.5を、推論の抽出を防ぐ分類器つきで出しました。ベンダーのモデルの出力や思考を、別のモデルの訓練や再現に使う運用は、規約違反として遮断される対象です(OpenAIは規約に反するとしています)。ただしMoonshot AIへの帰属はOpenAIの推定で、本号では同社側の反応を一次情報で確認できていません。

規制・安全

OpenAI、フロンティアAIの訓練に「セーフティケース」を求める指針を公開。上級リーダーに拒否権、事後検証の公開も

訓練を続ける前に、リスクの論拠を文書で示すべきだとする初期ガイドライン。

9月28日公開。フロンティアの強化学習の訓練を続ける前に、構造化した安全文書(理想的にはセーフティケース)を求めるべきだとし、航空や原子力と同じ厳密さは難しいので「目指す北極星」と位置づけています。技術面は整合訓練・封じ込め・監視の3層で、運用面では他チームによる反対意見(pre-mortem)、上級リーダーの承認と拒否権、責任者の説明責任、一時停止のrunbookとSLA、監査人に必要な権限を渡すことなどを挙げます。第3部は重大な誤配列(misalignment)の調査手順で、根本原因の分析、事後検証、調査結果の公開を含みます。これはOpenAIが実装を進めている現行の推奨で、数週間のうちに変わりうるとしています。

So What

これは基準ではなく、OpenAI自身の提案です。法的拘束力はなく、他社が採る保証もありません。それでも、第5号の誤配列の報告や、Anthropicによる外部評価者の常駐と並べると、「訓練の途中の安全を外から検証できる形にする」方向が、各社の公式文書で揃ってきている点は押さえておく価値があります。

継続監視(今号では確定情報が無かったもの)

  • 対象期間の起点を9月28日にした。前号(第6号)の対象が9月22日〜27日なので、重複も谷間も作らずに繋がる。前号のwatchingに挙げた「OpenAI DevDay 2026(9月29日)は次号で扱う」を、本号で回収した。
  • Gemini 4 Argonの開発者向け・一般向けの提供日は未定で、導入価格($2/$10)がいつ終わるかも原文に書かれていない。有料APIとGoogle AI Ultraへの開放が始まった時点で扱う。
  • OpenAIのDecisions API(限定プレビュー、「数日中に広く公開」)と、UltrafastのGPT-6.1 Sol版(「近日」)は、公開されたかどうかを次号で確認する。UltrafastとPro 500の価格は一次資料(Ultrafast guide・プランの価格ページ)をこの号では確認していない。
  • Moonshot AI側の反応は、一次情報で確認できていない。OpenAIの帰属は「中核の一群をMoonshot AIに関わる個人と見ている」という推定で、観測した全運用者が単一の主体かどうかは不明とされている。
  • Microsoft AIの音声認識モデル(10月1日)はページ本文を取得できず、内容を確認できなかったので項目にしない。Meta・Apple・中国勢(DeepSeek・Alibaba・Moonshot)は対象週の新規発表を一次情報で確認できていない(ai.meta.comの一覧は取得できなかったため、Metaは網羅できていない可能性がある)。

各項目の「一次」は当事者自身の発表(公式ブログ・プレスリリース・公式ドキュメント等)、「参考」は報道・第三者分析です。数値や日付は発行時点で確認したものを記載しています。

← 週刊AIニュースの一覧へ