AI最新動向(2026年10月8日)

目次

AI最新動向

OpenAI、GPT-6とIntelligent UIをChatGPTの全利用者へ 無料版にはGPT-6 Lunaを10月8日から
10月7日(米国時間)公表、OpenAIのX告知は10月8日3時5分(JST)。週12億人超が使うChatGPTに、文章・図・押せるボタン・入力フォーム・グラフ・その場で動く道具を組み合わせて答える「Intelligent UI」を入れた。Plus・Pro・Business・Enterpriseは同日から世界で順次、FreeとGoは翌日から。有料版はGPT-6 Sol、Free・GoはGPT-6 Lunaで動く。Enterpriseは管理者設定次第。WorkとCodexのモデルは変えない。X告知:https://x.com/OpenAI/status/2107894997538525580
無料版の利用者にも、表や比較図で答えが返る形が標準になる点

Anthropic、小型モデル「Claude Haiku 5.5」を公開 Haiku 4.5より平均で約75%安く、入力100万トークン0.10ドル
10月7日公表、Claudeの公式Xは10月8日3時1分(JST)。要約・分類・データベース照会など大量で単純な処理、Opus 5.5やSonnet 5.5の下で動く補助役、接客やブラウザ操作のような速さが要る用途向け。価格は10万トークン以下の指示で入力0.10ドル・出力0.50ドル(Haiku 4.5は入力1ドル・出力5ドル)。前のHaikuへの依頼の約9割が10万トークン以下だったとする。知識労働の評価GDPval-AAは1620(Haiku 4.5は735、OpenAIのGPT-6 Lunaは1437)、PC操作のOSWorld 2.1は72.4%(同15.7%、48.9%)。Haikuで初めて推論の深さを選べる設定を持つ。あわせてSonnet 5.5のキャッシュ読み取りを半額にし、長い処理で約20%安くなるとした。AWS・Google Cloud・Azureでも提供。X告知:https://x.com/AnthropicAI/status/2107894208547983705
大量の定型処理をAIに回すときの単価が一段下がった点

Anthropic、GoogleドキュメントとスプレッドシートとスライドでClaudeを使えるアドオン「Claude for Google Workspace」を公開ベータに
10月6日(米国時間)公表、9to5Googleの報道は10月7日4時10分(JST)。有料プラン(Pro・Max・Team・Enterprise)が対象。開いている文書・表・スライドの横にClaudeのサイドバーが出て、選んだ文章・セル・スライドを読んで、その場で書き換える(変更は版の履歴に残る)。数式の作成と修正、表の集計、長い文書の構成の組み直し、既存のレイアウトに沿ったスライドの追加ができる。あわせてClaudeの画面からGoogleのファイルを作り、編集するコネクター(ベータ)も出した。Google Workspace Marketplaceからアプリを入れられる設定のGoogleアカウントが要る
関連報道:https://9to5google.com/2026/10/06/claude-google-docs-sheet-slides/
社内でGoogle Workspaceを使う会社では、資料をAIの画面へ貼り直す往復がなくなる一方、Marketplaceのアプリ導入を管理者がどこまで許すかの線引き

Microsoft、Windowsを「エージェントが安全に働く場所」に作り替えると発表 PC上で動くコーディングモデル「MAI-Code-1.1 Flash」と、エージェント専用の隔離環境を搭載
10月7日(米国時間)、Windows・デバイス担当のパヴァン・ダヴルリ上級副社長がブログで公表。サティア・ナデラCEOは10月8日3時17分(JST)にXで要点を挙げた。1370億パラメータ・文脈長25万6000トークンのコーディングモデル「MAI-Code-1.1 Flash」をPC上で動くよう最適化し、GitHub Copilotが作業をこうした手元のモデルに回して費用を大きく下げる。Copilotが機密性の高い作業を端末の中にとどめたままPC上で操作を実行する「Hybrid Intelligence」、クラウドのトークンを使わずにデスクトップのソフトを作れる「Copilot内のCode」、WindowsとAgent 365の統合、エージェントを隔離して動かす「Microsoft Execution Containers(MXC)」を挙げた。NVIDIA RTX Spark搭載の「Surface Laptop Ultra」なども発表した。ナデラCEOのX投稿:https://x.com/satyanadella/status/2107898018112647313
関連報道:https://blogs.windows.com/windowsdeveloper/2026/10/07/microsoft-execution-containers-policy-driven-containment-for-ai-agents/
社内PCでエージェントを動かすとき、何をどこまで触らせるかをOS側の隔離と管理で決められるようになる点

OpenAI、社内の未公開モデルが書いた数学の論文722本をGitHubで公開 成果1件あたりの計算量はChatGPT Proの思考時間で平均約3時間分
10月6日(米国時間)公表、X告知は10月7日7時19分(JST)。公開先のリポジトリ(github.com/openai/math)には722本の原稿が372の系統に分けて載る。既存の数学の評価で点数が頭打ちになったため、未解決の研究問題で評価を広げたとしている。多くの証明を、コンピューターで正しさを検証できる言語Leanで形式化して添えたが、全部ではなく、形式化していない成果には誤りがありうると自ら書いている。モデルの推論の要約10件、計算量の推計、挑んだ問題数の統計も公開し、公開方法は米プリンストン高等研究所の数学とAIの諮問グループと協議した。X告知:https://x.com/OpenAI/status/2107596713791767021
関連報道:https://www.itmedia.co.jp/news/article/2610/07/2000002071/
研究の量そのものをAIが生み出す段階に入り、検証が追いつくかが問われる点

xAIの「Grok Bot」、課題ごとにClaude Opus 5.5やMidjourney、Sunoなど他社のモデルを裏で使い分ける方式へ
10月7日15時46分(JST)、イーロン・マスク氏が投稿。「今後SpaceXは、Claude Opus 5.5、MidJourney、Sunoなど主要なAPIを含め、その課題に最適な裏側のモデルを使う」とした。10月8日3時2分(JST)には、簡単な依頼の大半は今後出す「Grok 4.8」の超高速版で処理すると補足した https://x.com/elonmusk/status/2107894231922876510
自前のモデルを持つ会社でも、利用者向けの窓口は他社のモデルを束ねる形に寄っていく点

Google、AI生成のコンテンツかを確かめる「SynthID Detector」を全員に開放 OpenAIやNVIDIA、Kakaoの生成物も判定対象、Appleも近く参加
10月7日23時3分(JST)、Google DeepMindが告知。オンラインの文章・画像などが、GoogleのAIか、提携先(OpenAI、NVIDIA、Kakao、近くApple)の道具で作られたかを synthid.com で確かめられる
生成物に埋め込まれた透かしを、各社をまたいで1か所で確かめられるようになる点

Anthropic、セキュリティ専門家向けに攻撃能力の制限を緩めたモデルを提供する制度を3段階に拡充 最上位の「Claude Mythos 5.1」も対象
10月6日(米国時間)公表、X告知は10月7日4時0分(JST)。審査を通ったセキュリティ担当者に、攻撃関連の依頼を止める仕組みを弱めたOpus 5.5・Sonnet 5.5・Mythos 5.1を提供する。利用の幅に応じた3段階の枠を設けた。一般向けのモデルには、サイバー関連の作業の大半を止める保守的な安全策を掛けているとしている。X告知:https://x.com/AnthropicAI/status/2107546569654636883
守る側には最上位の能力を渡し、一般の利用者には絞るという二段構えの運用

Claude CodeやCodexに渡す映像表現・動き・編集の指示をまとめた無料ライブラリ「NANKA DEKIRU」 選んでエージェントにコピペするだけ
10月6日21時5分(JST)投稿。AI映像を作る「絵空事テレビ」(@boke_ai)が、映像表現・モーション・編集の型を一覧にし、使いたいものを選んでClaude CodeやCodexなどのエージェントに貼り付ける機能を付けて、自社サイト(esoragototv.com)の「公開ツール」で無料公開した
型を選ぶだけで動画の演出を指示できる一方、仕上がりは使うエージェントとモデルに左右される点

同じ「3Dアバターを作って」をCodexとClaude Codeに頼むと作り方が分かれる CodexはBlenderで一から、Claude Codeは配布モデルの組み合わせを提案
10月6日18時15分(JST)投稿。いのり氏(@lnkiai)が、Codex(GPT-6.1 Sol)とClaude Code(Opus 5.5)に同じ依頼を出した結果を並べた画像を載せた。CodexはBlenderでモデルを一から作り、Claude Codeは配布されているモデルや部品を探して組み合わせ、加工する方法を提案したという
同じ依頼でもモデルごとに「作る」か「探して組む」かが分かれ、配布物を使う側は利用規約の確認が要る点

有識者の受け止め

マーク・チェン(OpenAI研究責任者)、数学の成果公開に「今回の実行は、1週間で数学の10年分の進歩にあたる」
10月8日1時53分(JST)投稿。OpenAIの数学の成果公開を引用し、「ナビエ・ストークスの時も、本題は問題そのものより下の図のほうだった。今回の実行は、1週間で数学の10年分の進歩にあたる。これらの道具を生命科学に向け、次のモデルを作り、整合させるのが待ちきれない」と書いた
1件の難問の解決より、成果を量産できる速度のほうに意味があるという見方

ゲイリー・マーカス(認知科学者)、同じ公開に「本当のニュースは結果ではなく、知らされていないことのほうだ。査読は通らない」
10月8日2時16分(JST)公開。「AIはかつて科学であろうとした。『同じ手順』『未公開のモデルを使用』では査読は通らない。手順も構造も分からない。証明は一度で生成されてLeanで検証されたのか、繰り返しがあったのか」とし、「新しい仕組みはAGIへの正当な一歩かもしれないし、検証できる分野でLeanと合成データを巧みに使っただけで、汎用性はまったくないのかもしれない。最初の報告からはほとんど何も分からない」と書いた。前日10時29分(JST)のX投稿では、記号処理のLeanを併用している点を自説(ニューロシンボリックAI)の裏付けとしつつ、「数学の部分は、答えを記号的に検証できない現実の開かれた世界には広く一般化しない」とした https://x.com/GaryMarcus/status/2107644352021639447
成果の数ではなく、手順の開示と検証できない分野への一般性を問う立場

イーサン・モリック(ウォートン校教授)、「低品質な科学が制度を侵食する短い時代を経て、AIによる2つの革命が起きる可能性が高まっている」
10月7日10時38分(JST)投稿。「1) これまでに出版されたすべてのものが、人間の科学者が予想しなかった方法で読み直され、再評価される。2) 新しい発見が急速に生まれ始める」と書いた
既存の論文の読み直しと新しい発見の両面で、研究の進め方そのものが変わるという見方

  • URLをコピーしました!
  • URLをコピーしました!
目次