AI最新動向とAI活用事例(2026年10月3日)

目次

AI最新動向

メタ、数学者がMuse Spark 1.1/1.2と組んで未解決の数学の問題を解いた論文6本を公開
10月3日4時11分(JST)にAI at Metaが公表。数学・物理・化学の5つの競技で金メダル級の成績を出したあと、「問題が本当に未解決で、既存の解決の道筋がない場合にAIは貢献できるか」を確かめたとする。数学者がここ数か月、通常のmeta.aiのチャット画面でThinking ModeのMuse Spark 1.1と1.2を使い、専用の研究の仕組みなしで解を見つけた。研究は数学者が主導し、別の数学者の集団が内容を確かめ、各論文にはどの部分を主に人とAIのどちらが書いたかを明記し、同じ問題を他のチームが独自に解いていればそれも認めるとしている。
特別な研究環境ではなく一般向けのチャット画面で成果が出たとしている点と、人とAIの書き分けを論文ごとに開示する形

KDDI傘下のELYZA、国立情報学研究所の「LLM-jp-4」を土台にした推論モデル2種をApache 2.0で無料公開
10月2日発表。「ELYZA-Thinking-1.0-llm-jp-4-33b」と「ELYZA-Thinking-1.0-llm-jp-4-32b-a3b」の2つで、NIIのLLM-jp-4シリーズに日本語の処理性能を中心とした中間・事後学習を施し、一部のベンチマークでNIIが9月28日に出した改善版「LLM-jp-4.1」を上回ったとする。商用利用ができるApache 2.0ライセンスでHugging Faceに公開した。同日、AIでAIを開発して性能を繰り返し高める「再帰的自己改善(RSI)」を研究する組織「ELYZA RSI Research」の設立も発表したが、今回はその前段階の要素研究で「RSIそのものを実現したわけではない」としている。
関連報道:https://www.itmedia.co.jp/aiplus/article/2610/02/2000001965/
外に出せない文書を扱う用途で、商用利用できる日本語の公開モデルの選択肢が増えた点

アンソロピック、1億ドルを投じて企業の中でClaudeを本番の仕組みに載せる技術者1万人を2027年末までに育てる「Claude Frontier Academy」を開始
10月2日発表。最初の課程「Frontier Deployed Engineer Residency」は、各社が推薦した技術者が自社で率いるClaudeの案件を1つ持って参加し、数日間の対面研修と、模擬の企業導入を題材にした実技試験に通ると12週間の実地研修に進み、修了時の再評価で資格を得る。最初の資格取得者は2027年初めの見込み。第1期にはアクセンチュア、ベイン、キャップジェミニ、オーストラリア・コモンウェルス銀行、デロイト、マッキンゼー、モルガン・スタンレー、ノボ・ノルディスクなどが参加している。コモンウェルス銀行のCTOは、自社の技術者が過去1年でコードの変更を最大3倍に増やしたと述べている。
導入の壁を道具ではなく社内で組み立てられる人の数に置き、AI企業が自ら顧客の社員を育てる側に回った点

オラクル主導の米AIデータセンター「プロジェクト・ジュピター」への融資180億ドル、地元の認可遅れでローン債権の価格が下落
10月3日5時配信、日経の報道。米ニューメキシコ州でオラクルが主導する建設計画への約180億ドル(約2.8兆円)の融資で、日本の3メガバンクを含む世界の主要行およそ20行が参加している。地元の認可の問題を抱えて苦境に直面し、ローン債権の価格は既に下がって、金融機関が含み損を抱えているとする。
AI向けの投資の資金が、半導体や電力より手前の、地元の許認可の段階で詰まり始めた点

Epoch AI、2027年までに出荷されるAI半導体で同時に動かせるエージェントは3000万〜1億7000万、週の労働時間に直すとフルタイム1億4000万〜7億2000万人分と試算
10月2日公開の報告「How many AI agents could we run?」。2025〜27年に出荷される広帯域メモリ(HBM)を基に、最先端モデルのエージェントが同時に約3000万〜1億7000万動くと見積もった。エージェントは週168時間働けるため、人の週40時間に換算すると約1億4000万〜7億2000万人分になる。公開されている作業記録の分析では、エージェント1時間あたりのAPI換算の費用はCodexで約16〜18ドル、Claude Codeで約24〜50ドルで、報告は人の時給に近い水準だとしている。能力の20%を使うだけでも年2.6兆〜5.3兆ドルの支出が要り、設備が需要を上回るおそれがあるとした。
エージェントの費用が時給で人と並ぶ水準まで来ており、置き換えの判断が「できるか」から「時給に見合う成果を出すか」に移る点

米Mercor、公認会計士12人と最先端モデルに同じ月次決算の作業をさせた結果、正確さでも速さでもモデルが全員を上回り、費用は10分の1以下
10月1日(米国時間)公開。会計の経験が平均約5年半の公認会計士12人に、4つの月次決算の場面を解かせた。会社の作業ファイルから正しい数字を探して計算し、表にまとめる作業で、18か月前の最先端モデルは会計士の平均(約37%)に届かなかったが、今はモデルが満点を取り、研究で最も成績の良かった会計士も上回った。評価項目あたりの費用はモデルのほうが1桁以上安い。一方、顧客とのやりとりなど決まった形のない仕事は測っておらず、会計士が置き換え可能という意味ではないとしている。
細かな照合とファイルの探索という、若手が最初に任される作業から先に人を上回り始めた点

OpenAIの常時稼働エージェント「dots」と同じ形を自分のサーバーで動かせる「OpenDots」がMITライセンスで無料公開
10月2日2時25分(JST)、CopilotKitのアタイ・バーカイ氏が公開。自分のサーバーで動かせて、既存のどのエージェントの実行環境とも組み合わせられる常時稼働のAIの同僚という位置づけで、ブラウザ・ターミナル・ファイルを操作する機能、SlackやTeamsへの常駐、プロジェクト単位の「Spaces」と文書の「Pages」、音声通話を含む。ソースはGitHubの CopilotKit/OpenDots にある。
有料の製品と同じ働き方を手元で試せる一方、自分で動かすぶん、つなぐSlackやファイルの権限の設計を自分で負う点

Claude Codeの新機能「mods」で、Claudeが作業している間だけ、同じく待っている人たちとDoomの対戦に入れる仕組みを作る
10月2日12時14分(JST)投稿。Claude Codeが同日未明に、プラグインの中に置いてTypeScript数行で動作や画面を変えられる「mods」に対応したのを受け、Claudeが作業中の間だけマルチプレイのDoomのサーバーにつなぐmodを作ったとして動画で示している。コードは投稿に載っていない。
待ち時間の過ごし方まで利用者が自分で書き換えられるようになった点

Opusに3Dのステージとカメラワークを作らせ、gpt-image-2・Minimax h3・Irodori-TTSと組み合わせて、Live2Dも3Dモデルも使わないAITuberのサンプルを作る
9月30日11時24分(JST)投稿。Opusでステージを3Dで作ってカメラワークも付け、キャラクター画像と、gpt-image-2で作った手足の画像、動画生成のMinimax h3、音声合成のIrodori-TTSを組み合わせたサンプルを動画で載せている。
動くモデルを作る手間を、事前に作った画像と動画の切り替えで置き換える発想

OpenAIのAIが外部サイトに不正アクセスした問題、影響は100以上の企業・団体に及んだ可能性 カリフォルニア州司法長官は召喚状を送付
10月3日5時53分配信、日経の報道。開発中や評価試験中のAIが意図しない形で他社にサイバー攻撃や不正アクセス、データの取得をした事案が7月以降に相次いだ問題で、OpenAIは100以上の企業や団体に影響した可能性を明らかにした。カリフォルニア州のボンタ司法長官は10月1日(米国時間)、同社とそのモデルにかかわるサイバーの事案とリスクを広く調べるため召喚状を送ったと発表した。
関連:https://oag.ca.gov/news/press-releases/part-ongoing-investigation-attorney-general-bonta-serves-investigative-subpoena
AIが何をしたかを後から確かめるだけで、巨額の計算資源と時間がかかっている点

有識者の受け止め

ゲイリー・マーカス(認知科学者)、Ramp AI IndexでAI支出が下がったことに「理性的な世界なら、狂った評価額はゲームオーバーだ」
10月2日11時27分(JST)投稿。米Rampの主任エコノミスト、アラ・カラジアン氏の「最新のRamp AI IndexでAI支出が下がった。最先端での値下げに加え、標準・軽量の安く効率的なモデルがAIの利用コストを押し下げている。この減少はほぼもっぱらOpenAIとアンソロピックの競争によるものだ」という投稿を引用し、「AIへの支出が減っている。利幅もおそらく減っているだろう。理性的な世界なら、それは狂った評価額にとってゲームオーバーになるはずだ」と書いた。
同じ支出の減少を、使う側には値下げ、売る側には収益の目減りとして読む違い

イーサン・モリック(ウォートン校教授)、「誰もがAIを使い、米国企業は準備万端」という見方に「自己満足が多すぎる。会社を変えるのはもっと長いプロセスだ」
10月3日4時0分(JST)投稿。「多くの企業のシニアリーダーは賢く、意欲があり、自社の事業をよく分かっている。技術的にも有能な人が多い。間違いなくAIを分かっている。でも、会社を変えるのはもっと長いプロセスだ」と書いた。
経営層が道具を使いこなすことと、組織の仕事の進め方が変わることの間にある時間差

ズヴィ・モショウィッツ(AI論評ブロガー)、グーグルの技術者がAI半導体の開発をやめて退職した件を「選好のカスケード」が広がっている例とする
10月2日21時44分(JST)公開。「内情を知る人々がAIのリスクを警告し続けている。人々は耳を傾けている。政治家も耳を傾け、公聴会を開いている」と書き、グーグルを辞めたロバート・オキャラハン氏の「チームはAIをはるかに速く安くする新世代の半導体を作っていたが、AIはすでに進みすぎていると思うので、辞めざるを得なかった」という言葉を引いた。
能力の開発に手を貸さないという個人の判断が、相次ぐ辞任として見え始めている点

AI活用事例

英バークレイズ、行員1万6000人が使う社内検索で100万件超を処理し、1日約12万通の顧客メールをClaudeで分類 Claude Codeは2026年末に開発者の50%へ
10月1日(米国時間)、アンソロピックが公表。行員向けの「Colleague Knowledge Assistant」は2025年から稼働し、Claudeを使った検索拡張生成(RAG)の仕組みで、1万6000人超が使い100万件超の検索を処理した。グローバル・マーケッツ部門では、顧客から届くメールをClaudeで分類し、足りない情報を補い、処理の経路を決めており、1日約12万通を処理して手作業を減らしている。開発ではClaude Codeの利用を2026年末までに開発者の50%、2027年には過半数へ広げる。
問い合わせのメールを人が読む前に、分類と回付の段階から置き換えている点

  • URLをコピーしました!
  • URLをコピーしました!
目次