AI最新動向(2026年9月22日)

目次

AI最新動向

SpaceXAI、「Grok 4.7」を公開 価格と速度を4.6から据え置き、CursorBench 4.0は40.4%→46.3%

9月22日1時25分(JST)に公開。4.6より大きな基盤モデルを使い、完了までに何時間もかかる問題に重みを置いた難易度の高いタスクの組み合わせで、より長い強化学習を回したとする。公表値は、入力100万トークンあたり2ドル、出力100万トークンあたり6ドルで4.6と同額。ベンチマークは、ソフトウェア工学のCursorBench 4.0が46.3%(Grok 4.6は40.4%、GPT-5.6 Sol Maxは41.7%、Fable 5.1 Maxは51.8%)、長時間のターミナル作業のTerminal-Bench 4.0が38.0%(同20.3%、37.3%、57.9%)、法務のHarvey Legal Agent Benchmarkが19.6%(同15.8%、2.5%、6.7%)。危険・悪意あるサイバータスクの自社ベンチマークHackerBench v0.3では、危険なデュアルユースのプロンプトの通過率が3.3%だとする。提供はCursor、Grok Build、Grok API、第三者のコーディングハーネス、モデルルーター、クラウドプラットフォーム。イーロン・マスクは同日、Artificial Analysisの集計を引いて「エージェント型コーディングでAnthropicとOpenAIに次ぐ3位」と書いている https://x.com/elonmusk/status/2102082011233931762
法務タスクのベンチマークだけ他の3モデルを大きく引き離しており、文書の読み取りと確認の用途で価格差がそのまま効く可能性

OpenAI、8月28日に学習を始めた社内モデルがナビエ–ストークス方程式のミレニアム懸賞問題を解決 数学のほとんどの分野で100件超の未解決問題も

9月21日公開。同社は「8月28日に新しい社内モデルの学習を開始した。このモデルはナビエ–ストークスのミレニアム懸賞問題を解決したことに加え、数学のほとんどの分野にわたって100件を超える長年の未解決問題を解決した」とし、その進展の速さは社内の数学者を驚かせたと書いた。数学の結果の評価と公表の進め方、学術的・専門的な基準の維持、研究と学習を支援するツールの構築について助言を受けるため、数学者が設立した独立の諮問グループと協力するとしている。背景として、数学者が公開書簡「A Severe Misalignment of AI in Mathematics」で、未解決問題を解くことを新しいAIシステムのベンチマークにすることの負の外部性に懸念を示していることを挙げた。@Dr_Singularity は9月21日20時33分の投稿で、ホッジ予想もほぼ確実に解決し現在検証中で、バーチ・スウィンナートン=ダイアー予想もおそらく解決したとしている https://x.com/Dr_Singularity/status/2102134222945484849
成果そのものより先に「誰が結果を評価し、どう出すか」の枠組みを外部に置いたこと

Google、Gemini前提のノートPC「Googlebook」を発表 899ドルから、10月4日発売

9月22日0時42分(JST)、Androidエコシステム担当のサミール・サマット氏が発表した。「Gemini Intelligence のために設計され、他のどのプラットフォームも達成できていない役立つAI機能を提供する」とし、Androidの技術スタックの上に作ったため、スマートフォンとラップトップがシステムレベルでネイティブに連携すると説明した。9月21日(現地時間)から予約受付を開始し、10月4日から店頭で販売する。価格は899ドルから。まずAndroidコミュニティから始めるとし、ハードウェアは「世界最高のラップトップメーカー」からのプレミアム機だとしている。日本ではITmedia NEWSが9月22日7時30分に約14万円と報じた
ChromebookでもWindows機でもない三つ目の枠として出しており、社内標準機の選定でAIの動く場所がクラウドか端末かという論点が増える点

Perplexity、「Perplexity Computer」で動画生成に対応 MiniMax H3とByteDance Seedance 2.5を使用

9月22日1時25分(JST)投稿。キャンペーン用のクリップ、製品デモ、SNS用の素材を依頼すると、コピーとクリエイティブの隣に完成した動画を同じスレッドの中で生成するとした。提供はProとMaxのプラン
原稿と画像と動画が1つのスレッドの中で出てくる形になり、制作を外に出す単位が「動画1本」から「企画ごと」へずれていく点

アンソロピック、中国のKimiが利用者の質問をクロードへ転送し、その回答を自社AIの回答として示していたと指摘

9月22日3時38分配信。アンソロピックが10日付の報告書で、月之暗面(ムーンショット)の中国企業によるAIの新たな不正使用を指摘したもの。利用者の質問をアンソロピックの「クロード」へ転送し、その回答を自社AIの回答だと装って示すケースが確認されたとする。やり取りのデータを自社AIに学習させ、性能を高めようとしたとみられる
蒸留や無断学習をどこから不正とするかの線引きが、モデルを提供する側からの指摘という形で出てきた点

双日テックイノベーション調査、Copilot導入企業の87.5%が社内情報の分散を課題に 78.0%は「Copilotだけでカバーできている」とも回答

9月21日7時公開。双日テックイノベーションが9月15日に公開した「Copilot・M365活用と社内情報活用に関する実態調査」。対象は従業員1000人以上でCopilotを導入している企業に勤務し、生成AIやAIツールの導入・活用推進に携わる担当者。2026年7月31日〜8月3日にインターネットで実施し、105人から有効回答を得た。CopilotとM365だけで業務に必要な社内情報の検索・活用をカバーできるかでは、「非常にそう思う」39.0%と「ややそう思う」39.0%の計78.0%が肯定。一方で、業務に必要な情報がM365の内外の複数システムに分散していることについては、「非常に感じている」42.3%と「やや感じている」45.2%の計87.5%が課題を感じていた。社内情報を横断的に検索・活用できるAI環境によってAI活用が広がるとしたのは96.2%
同じ回答者が「足りている」と「散らばっている」を同時に答えており、何が不足しているかを本人も切り分けられていない状態

RAND、米国の超知能への戦略について「何が最適か分からないので、いま金を使って選択肢を残せ」と提言

9月21日21時31分(JST)、ジャック・クラーク氏のニュースレター「Import AI」第473号が扱った。RANDが「超知能への不確実な道筋で地政学的優位を確保する」ための米国の方策について長文の論文を公表したもの。主旨は、AIの離陸が次にどう進むかの大部分が未知であるため、米国は今から支出して選択肢を残しておくべきだ、というもの
具体的な政策ではなく「決め打ちしないことに金を払う」という形の提言が、シンクタンクから出てきている点

有識者の受け止め

アンドリュー・ング(DeepLearning.AI創設者)、「AI技術そのものが予期せぬ危険な方向に進んだわけではない。それを取り巻く誇張が、かなりの恐怖を引き起こした」

9月21日20時59分投稿。「AIの危険性に対する恐怖を煽る最も大きな声が、過去2週間で驚くべき進展を遂げた。AI技術自体が予期せぬ危険な方向に進んだわけではないが、それを取り巻く誇張——よく計画されたPRキャンペーンのように見えるものによって推進された——が、かなりの恐怖を引き起こした。私はこれが私たちの分野にとって後退を意味しているのではないかと心配している」と書いた。「数ヶ月前と比べてAIによる人類絶滅のリスクが一段と高まったとは思わない。このような理論は、数ヶ月前と同じく空想的なSFシナリオのままだ。AIリスクの最大の変化はサイバーセキュリティ能力であり、これは真剣に受け止めるべきトピックだが、世界の終わりにはつながらない」とし、OpenAIのチームがHugging Faceへエージェントの群れを展開した件について「一部の出版物では1,200体のエージェントの群れが攻撃を実行したと報じられた。技術的には正確だが、私がこれを書いている今、私のラップトップでは約1,300のプロセスが動作している」と書いた。OpenAIの不具合のあるサンドボックスと監視の工程がこのインシデントを可能にした鍵であり、バグを修正して監視を改善することが対応だとしている
事案の技術的な中身と、報道で使われた数字の見え方とを切り分けにかかっている点

ゲイリー・マーカス(認知科学者)、「どの極端も筋が通らない。希望は戦略ではない」

9月22日6時11分(JST)公開。国連総会のデジタル協力イベント(ヨシュア・ベンジオ氏、ノーベル平和賞受賞者のマリア・レッサ氏も登壇)での自らの導入発言を載せたもの。「我々は道徳的、政治的、経済的な危機の瞬間にいる」と始め、「極端であることがメディアに載る方法だ。だが、どの極端も筋が通らない。一方の極端は、規制はまったくゼロというものだ。AIを走らせるに任せ、最善を望む。希望は戦略ではない」と書いた。もう一方の極端として、いま必要なのは恐怖ではなく信頼性の向上、より良いサイバーセキュリティ、実効性のある執行であり、危険な製品を繰り返し市場に出す企業に対する製品リコールや訴追にまで及びうるとした。「いわゆる『暴走AI事案』の大半は、政府がインターネットへの無制限のアクセスを持つAIエージェントを、安全だと示されるまで禁止すれば避けられる」とも書いている。あわせて、ほぼ同時刻に20を超える国がAIに関する行動の呼びかけに署名したとし、「多くの問いが残るが、これは胸躍る第一歩だ」と記した
規制ゼロと終末論の両方を退けたうえで、打ち手を「エージェントの外部接続の制限」という具体まで落としている点

イーサン・モリック(ウォートン校教授)、「AIが多くの人が思うほど急速に物事を変えない理由の一つが、この投稿で示されている」

9月21日20時34分投稿。OpenAIが数学者の独立した諮問グループと協力するという発表を引用し、「OpenAIは、数学者たちと協力して、新しい証明をより破壊的でない方法で公開するように努めている。同じことが、弁護士会、米国医師会、その他の職業でも、さらに顕著に起こるだろう」と書いた
能力が先に出ても、職業団体の側が出し方を握ることで実際の置き換わりが遅れるという見方

ネイト・シルバー(統計家)、「『確率的オウム』と特徴づけた点は、どのような意味で洞察的だったのか」

9月21日21時32分投稿。「確率的オウム」論文の著者の1人であるマーガレット・ミッチェル氏が、その認識が解決策の特定に役立ってきたとしてスレッドを立てたのを引用し、「LLMを「確率的オウム」と特徴づけた点がどのような意味で洞察的だったのか、その論文がLLMの能力を著しく過小評価しているように見えたことを考えれば?」と問うた
批判の枠組みそのものが、当時の能力予測として正しかったかどうかで問い直されている点

  • URLをコピーしました!
  • URLをコピーしました!
目次