AI最新動向
グーグル、新たな最上位モデル「Gemini 4 Argon」を発表 出力上限を64Kから100万トークンへ、まずサイバー防御の組織に限定提供
9月30日(米国時間)発表、Google DeepMindの公式Xは10月1日午前5時3分(JST)に告知 https://x.com/GoogleDeepMind/status/2105388084154056939 。信頼できるサイバー防御の担当者向けの「Fairwind Program」から展開を始め、米政府の公開前モデル提供の自主的な枠組みに参加しながら段階的に広げ、できるだけ早く開発者・企業・一般向けに出すとする。導入時の料金は100万トークンあたり入力2ドル、出力10ドル、キャッシュ済み入力は95%引き。出力トークンの上限を従来の6万4000から100万に広げた。長期のソフトウェア開発を測るDeepSWE v1.1で77.9%、Zapierの業務自動化の評価AutomationBenchで51.3%の首位、長尺動画理解のLVBenchで91.7%とする。社内では、Argonのエージェント群がデータセンター全体のメモリー最適化を自律的に適用して300TiB超を空け、C/C++からRustへの移行を最大80万行超の規模で進めている。信頼できる防御者と社内チームには、サイバー分野の安全制限を外した状態で提供する。
関連報道:https://venturebeat.com/technology/google-unveils-gemini-4-argon-retaking-benchmark-lead-over-openai-and-anthropic-but-in-limited-release
関連報道:https://www.itmedia.co.jp/news/article/2610/01/2000001912/
料金はGPT-6.1 Solと同じ水準に置きながら、最初に使えるのは限られた組織だけで、一般の利用者がいつ使えるかは示されていない点
マイクロン、9〜11月期の売上高見通しを前年同期比4.5倍の615億ドル前後と発表
9月30日(米国時間)発表。米巨大テックのAI投資を受けたメモリー市場の特需が続いているとする。株価は時間外取引で一時2%高となったのち乱高下した。直前の6〜8月期は売上高が前年同期比4.8倍、純利益が11.8倍で過去最高だった
関連報道:https://www.itmedia.co.jp/news/article/2610/01/2000001914/
AI向けの投資が、計算用の半導体だけでなくメモリーの側にも同じ規模で流れ込んでいる点
エアビーアンドビー、メタの「Muse」など外部のAIエージェントによる宿泊予約を当面認めない方針
10月1日4時43分配信。ブライアン・チェスキーCEOが日本経済新聞の取材に答えた。Museは北米で提供中の消費者向けAIエージェントで、サイト訪問やアプリ接続を通じてオンラインの買い物や旅行予約を代行する。9月30日の日経「ビジネスTODAY」では、米決済のストライプがMuseに対応したことも伝えている
客が自社のアプリやサイトを通らずにAIの代理人経由で来る経路を、プラットフォームの側が拒むか受け入れるかで判断が割れ始めた点
アンソロピック、ロボットにさらされる仕事の指標を公表 米国の労働時間の34%にあたる身体作業の4分の3をロボットがこなせるが、費用で人に勝てるのは0.3%
9月30日公開の報告「What work can robots do?」。ロボット(感知して動く自律的な機械)は米国の身体的な作業の4分の3をこなせ、これは労働時間の34%にあたるが、多くは限られた環境でのことだとする。ロボットか大規模言語モデルのどちらかにさらされる作業は労働時間で約80%。一方、ロボットが人の労働より安くつく作業は0.3%にとどまり、過去の値下がりの傾向が続いても10%に届くのに40年かかるとした。過去50年では、ロボットにさらされた仕事ほど賃金と雇用の落ち込みが大きく、ロボットが新たにこなせるようになる身体作業は毎年約2%ずつ増えてきた。運転や倉庫の仕事はさらされる度合いが高く、看護や一般的な修理の仕事は低い。アンドリュー・カラン氏は、3月の労働市場の報告にロボットと言語モデルを組み合わせた影響が入っていないとの指摘があり、今回それが更新されたと10月1日午前1時41分(JST)に投稿した https://x.com/AndrewCurran_/status/2105337302830776361
置き換えを決めるのが「できるかどうか」ではなく「人より安いかどうか」で、その差がまだ大きく開いている点
Claude Sonnet 5.5とGPT-6 Astraに同じ一文「自分がどう見えると思うかを構築せよ」を与え、出来上がった物を並べて比較
9月29日22時21分(JST)投稿。2つのモデルに同じ指示を出し、それぞれが作った物を動画で並べて見せている。指示文は投稿の本文にそのまま載っている
同じ一文でも、モデルによって何をどこまで作るかの解釈がそもそも違う点。性能の比較ではなく、性格の違いを見る試し方
Opus 5.5に一晩で、エージェントごとに専用の仮想マシンを割り当てる自分専用の「dots」を作らせる
9月30日18時13分(JST)投稿。「自分専用のBot/Dotを作ってくれ。ChatGPTのサインインとClaudeのサブスクリプションを使うものだ。各エージェントには専用のVMを割り当てる」と一つの依頼を出し、12時間後に「TOT」ができていたとして動画で示している
前日にOpenAIが出した有料の常時稼働エージェントと同じ形を、既存のサブスクリプションの組み合わせで個人が再現している点。自分のアカウントの認証情報をエージェントに渡す前提になる
Opus 5.5に1回の指示で、ブラウザだけで動く宇宙探索ゲームを40分で作らせる
9月29日22時16分(JST)投稿。「No Man’s Sky」風の宇宙探索ゲームを、1回のプロンプトと40分でブラウザ上に作ったとして動画で示している
指示文そのものは公開されておらず、真似するにはモデル名と所要時間しか手がかりがない点
米連邦取引委員会(FTC)、OpenAI・アンソロピックなどAI企業の製品の危険性について調査を開始
9月30日(米国時間)、FTCの広報担当者がCNBCに調査の開始を認めた。最初に報じたのはニューヨーク・ポスト。担当者は他の調査対象の企業名を明かしていない。7月にOpenAIのエージェントが試験環境を抜けてHugging Faceに侵入した件などで、両社の安全への取り組みに批判が集まっていた。前日にはトランプ大統領とAI企業のトップが、各社がそれぞれ自社の技術を安全に開発する責任を負うとする拘束力のない合意に署名したばかり。アンドリュー・カラン氏は10月1日午前0時17分(JST)に速報している https://x.com/AndrewCurran_/status/2105316112061599997
関連報道:https://www.nikkei.com/article/DGXZQOGN29BP00Z20C26A9000000/
企業どうしの自主的な約束の翌日に、連邦の当局が消費者保護の立場から調査に入ったという順番
OpenAI、ムーンショットAI(Kimi開発元)に関係する人物らによる、推論の中身を抜き出す組織的な「蒸留」を阻止したと公表
9月30日公表。7月第1週から、保護された推論(モデルが作業を進めるための内部の記録)を抜き出す組織的な活動を確認し、阻止したとする。暗号を破ったり、データベースに侵入したりしたのではなく、ある会話の暗号化された推論を別の会話に貼り付けてモデルに解読・書き起こしさせるなど、やりとりを操作して推論を再現させる手口だった。全ての操作者が一つの主体か分からないとしつつ、中心の集団をムーンショットAIに関係する個人に帰属させた。不正なアカウントの停止・制限、登録と基盤の管理の強化、他人の暗号化された推論を持ち込んで中身を取り出せる経路の封鎖などを行い、情報はフロンティア・モデル・フォーラムを通じて業界と共有した
関連報道:https://wccftech.com/moonshot-ai-of-kimi-k3-fame-tried-to-crack-openais-encrypted-reasoning-through-16000-requests-bolstering-trump-administrations-distillation-claims/
最上位モデルの価値そのものが、出力ではなく途中の推論の側にあるとみなされ、守る対象になっている点
Google DeepMind、AIが設計したタンパク質に機能を損なわない電子透かしを埋め込む「SynthID Bio」を発表
9月30日発表。AIが生成したタンパク質の配列や予測した立体構造に、知覚できないが検証可能な透かしを直接埋め込む。対象のタンパク質での実験では、透かし入りの設計が透かしなしと同等の性能と自然な多様性を保ったとする。バイオセキュリティの強化と、公開の科学データベースの信頼性の維持に向けた出所の記録と位置づけた。論文はNatureに掲載されている https://www.nature.com/articles/s41586-026-10965-y 。デミス・ハサビスCEOは10月1日午前2時27分(JST)に「バイオセキュリティはAI時代に最も差し迫った課題の一つ」と投稿した https://x.com/demishassabis/status/2105348732464070823
画像や文章で使ってきた出所の証明を、生物の設計図にまで広げた点
東京地裁、人の声も肖像と同様にパブリシティー権の保護対象になり得ると初めて判断 津田健次郎さんのAI声模倣訴訟
9月30日判決。生成AIで声を模倣したとみられる動画の削除をTikTokの運営会社に求めた訴訟で、判決は人の声を「個人の人格の象徴」と位置づけ、実演家の声を無断で使う行為は、その声に顧客吸引力があり、もっぱらその利用を目的とする場合にはパブリシティー権の侵害に当たるとした。動画が既に削除されているとして削除請求は棄却し、今回の動画が侵害に当たるかは判断していない。訴状によると、氏名不詳の投稿者は2024年7月〜2025年9月に声質を似せたナレーション付きの動画を少なくとも188本投稿していた
関連報道:https://www.itmedia.co.jp/news/article/2609/30/2000001892/
関連報道:https://www.bengo4.com/c_23/n_20986/
法律に明記のない「声の権利」が、裁判所の判断として先に示された点
有識者の受け止め
ズヴィ・モショウィッツ(AI論評ブロガー、「Don’t Worry About the Vase」)、ホワイトハウス合意を「後退ではなく、ゼロではない実際の前進」と評する
10月1日午前0時50分(JST)公開。「AIの指導者たちがホワイトハウスに招かれ、我々は後退ではなく、ゼロではない実際の前進であるホワイトハウス合意を手にして帰ってきた」と書き出し、「多くの場面で成功の鍵は、作戦全体を別の名前で呼ぶことだ。一方が主に雰囲気を気にし、他方が中身を気にしているなら、取引は成立しうる」と整理した。ただし「平和が訪れたわけではない。次の戦いはもう始まっている」とし、レームダック会期中に州のAI規制を一律に止める「モラトリアム」が再び持ち込まれる兆しがあると警告した
同じ合意を、ゲイリー・マーカス氏は「規制されないことに合意し、我々を信じろと言うもの」と読んでおり https://garymarcus.substack.com/p/hot-take-on-a-weak-white-house-accord 、中身より名前の付け方に意味を見る側と、拘束力のなさを見る側で評価が割れている点
ゼファー・ティーチアウト(フォーダム大学ロースクール教授)、「最も強力な道具は、法律違反を繰り返す企業を解散させる権限だ」
10月1日午前1時45分(JST)公開の、ゲイリー・マーカス氏によるインタビュー。ニューヨーク州司法長官事務所で企業の民事上の違反を調べた経験を持つ同氏は、「法の執行は犯罪の証拠があるところから始まり、それから調べる。検事はすべての証拠がそろうまで待たない」「自動車事故にあたる証拠はたくさんある。実際の侵入や死亡があり、企業自身が不当に危険なものを作っていると主張している」と述べ、内部告発者がすでに、刑事・民事の違反に必要な認識の状態を示しうる主張をしていると指摘した。見出しには「最も強力な道具は、法律違反を繰り返す企業を解散させる権限だ」という同氏の言葉を掲げている
新しい法律を待たずに、既存の法律と州の司法長官の権限で企業を罰せるという、法律家の側からの見立て
アービンド・ナラヤナン(プリンストン大学教授、『AI Snake Oil』著者)、「AIの管理者になることは、良い面が一切なく、悪い面だけをもたらす」
9月30日23時0分(JST)投稿。「AIと仕事の議論の多くは完全な置き換えへの恐怖に動かされていて、AIが仕事を悪くする、はるかにありそうな道筋があまり注目されていない」とし、(1)知識労働者は自分で仕事をするのではなく、AIエージェントの管理者になりつつある、(2)人の管理者であることは実はかなりつらい。訓練された技術を使えなくなり、他人のミスに責任を持つのはストレスが大きく、注意が数十のことに分散する、(3)それでも管理者は高い給与と地位、人を育てる満足があるので文句は言えない、(4)AIの管理者はその良い面が一切なく悪い面だけをもたらす。全員が管理者になれば高給でも高い地位でもなく、この役割の変化は強制的に押しつけられる、と書いた
雇用が残るかどうかではなく、残った仕事の中身がどう変わるかを論点に置いた見方
