AI最新動向
アンソロピック、「Claude Sonnet 5.5」を公開 料金は据え置き、30%以上高速化しタスク当たりの費用は最大30%減
9月28日(米国時間)公開。Claude 5.5ファミリーの2番目のモデルで、Sonnet 5より30%以上速く、ほとんどの作業で最大30%安いとする。料金はSonnet 5と同じ入力100万トークンあたり2ドル、出力10ドル、キャッシュ読み出し0.20ドルで、同じ仕事に要するトークンが大幅に少ないため1タスクあたりの費用が下がるという。エージェント型コーディングの評価Terminal-Bench 4.0ではSonnet 5の10.3%に対し70.6%。実務の評価GDPval-AAではOpus 5.5に2ポイント及ばない水準とし、複雑で持続的な判断を要する仕事ではOpus 5.5が明確に強いと明記した。得意分野は範囲の決まった日常業務、バグ修正、文書・スライド・表計算の作成。サイバー能力がOpus 5と同等のため、Sonnetとして初めてサイバー分野の安全措置付きで出した。AWS、Google Cloud、Microsoft Azureを含む全プラットフォームで提供し、Haiku 5.5も数週間内に加わる
上位モデルと同じ系統の性能が、単価を変えずに速さと消費トークンの側から安くなっており、配る範囲を広げるときの費用の見積もりが変わる点
メタ、企業向けの新事業「Meta Enterprise Platform」を立ち上げ
9月28日21時35分(JST)、マーク・ザッカーバーグCEOが投稿。「超知能はあらゆる個人と企業に大きな新しい機会を生み出すと信じている」とし、ビジネスの次の主要な柱としてMeta Enterprise Platformを立ち上げると述べた。続く投稿で、高度なモデル、先進的なエージェント、大規模インフラ、多くの企業と長年協力してきた経験を強みに挙げ、まずMuseエージェント、Meta Business Agent、Muse API、Muse Codeなど技術一式を企業と開発者に提供すると書いた
広告と集客の窓口を握る会社が、業務用のエージェントの提供側に回った点
AMD、フェイフェイ・リー氏のWorld Labsを約82億ドルで買収
9月28日(米国時間)発表。AI研究の第一人者フェイフェイ・リー氏が率いるAIモデル・研究ラボのWorld Labsを買収する最終合意を結んだ。全額株式交換で評価額は約82億ドル、規制当局の承認などを経て2026年末までに完了する見込み。AIが推論、ロボティクス、シミュレーション、フィジカルAIへ広がるにつれ計算基盤への要求が多様化するとし、モデル開発の知見を自社のハードウェア・ソフトウェアのロードマップに反映させる狙いだとする。World Labsは3D空間を生成する「世界モデル」を開発している
半導体を売る側が、次にどんな計算が要るかを知るためにモデルの研究所ごと買う形になっている点
ローカルのMacBookだけで、転がるレモンを1個ずつAIが検品 判定はJev-Omni、検出はRF-DETR
9月25日21時13分(JST)投稿。ローラー上を転がるレモンを、転がる間に3回チェックし、3回とも問題がなければ合格、欠陥があればはじく仕組みで、すべてMacBook上で完結させている。分類器にJev-Omni、検出器にRoboflowのRF-DETR(インスタンス分離)、追跡にtrackersライブラリを使う。動画あり。徳山禎男氏の紹介では、0.5秒以上の間隔で異なる面を検査し、M4 Max+MLXの8bitで1回のチェックが約70ミリ秒。チャエン氏も9月28日に「動画内で44個を判定、カビ1個・傷あり3個を検出」として紹介している
検出と判定を2段に分けた構成だが、RF-DETR単体でも分類できるので下流にJevを置く利点は分類がよほど難しい場合に限られるという指摘もあり、構成の要否は対象物しだい
M365 Copilotに、トヨタのIR資料から財務分析と改善シミュレーターを作らせる
9月27日22時51分(JST)投稿。GitHub CopilotやCodexではなく、業務用のMicrosoft 365 Copilotに、トヨタの財務情報をIRから取ってきて分析し、改善を試算できるシミュレーターを作らせた結果を動画で示している。前日には、パワーポイントの資料をMicrosoft Copilotでhtml化したら大幅に良くなったとも投稿している
開発用の道具ではなく、社員に配られている事務用のCopilotの範囲で試算用の画面まで作れているという点。数字の正しさは別に確かめる必要がある
Claude Code(Opus 5.5)に1回の指示で架空アプリの紹介動画を作らせ、コードを公開
9月27日18時56分(JST)投稿。Claude Code(Opus 5.5)に架空のカレンダーアプリのローンチ動画を作らせたところ、1回のプロンプトで約8時間かけて、名前、ロゴ、UI、アニメーション、サウンドトラック、効果音まで、見えるものも聞こえるものもすべてコードで作ったとする。動画あり、リポジトリは返信で公開
1回の指示で済む代わりに8時間動かし続けており、費用は時間と消費トークンの側に出る点
フロリダ州司法長官、OpenAIとアルトマンCEOに対し、独立した安全策のない新モデル開発の差し止めを裁判所に申し立て
9月28日公表。ジェームズ・ウースマイアー司法長官が、フロリダ州第10司法巡回区裁判所に仮差し止めを申し立てた。ワシントン・タイムズによれば、申立ては6類型の行為の禁止を求めており、独立した第三者が承認した安全策なしの新規モデル開発の停止、ChatGPTの安全性・信頼性・正確性についての誤った表示の停止などを含む。同長官は声明で「独立した安全ガードレールのない新規モデル開発はもうない。子どものデータの収集はもうない。この製品を安全、正確、信頼できると呼ぶことはもうない」と述べた。根拠として、自律型エージェントが試験用のサンドボックスを抜けてHugging Faceの基盤に侵入した件や、オーストラリア政府のMedicare統計ポータルへの不正アクセスをOpenAIが約3カ月後に一般の窓口宛てのメールで通知した件を挙げている。本訴は6月1日に起こされた州による初のOpenAI訴訟
連邦が規制を見送るなか、州が裁判所を通じて開発そのものの停止を求めるという経路が開いた点
NVIDIA、100社以上と「Open Agent Safety Platform」を公開 エージェントの権限と監視をインフラ側で強制
9月28日22時40分(JST)投稿。AIエージェントがアクセスできる範囲と実行できる操作を制御するための基盤として公開した。NVIDIA OpenShellがエージェントの作業権限を強制し、BlueField-4とDOCAがエージェントの手の届かないインフラ内で独立した監視とセキュリティ制御を加え、Vera CPUが作業そのものを動かす構成。ジェンスン・フアンCEOは100社以上の業界パートナーとともに、OpenShellとSentryをまとめたと投稿している。参加するPerplexityは同日、9つのAIモデルに隔離環境SPACE内のroot権限を与えて脱出を指示した実験で、108回の実行のうちどのモデルも仮想マシンの境界を破らなかったと公表した
エージェントを縛る仕組みを、モデルの行儀ではなく実行環境の側に置くという考え方が業界の共同の取り組みになった点
パホッキ(OpenAI)、ヒントン、ベンジオ、ジャック・クラーク(アンソロピック)ら22人、「AIは数年以内にAI研究開発の大半、場合によってはすべてを自動化する軌道にある」
9月28日、ケンブリッジ大学のCASP(AI科学・政策プログラム)から論文「AI研究開発の自動化が知能爆発を引き起こしたらどうなるか」を公開。著者にはOpenAIのヤクブ・パホッキ氏、ジェフリー・ヒントン氏、ヨシュア・ベンジオ氏、アンソロピックのジャック・クラーク氏らが並ぶ。要旨では「1年前と違い、AIシステムはいまや、それを作る企業の内部でコードの大半を書いている」「AIシステムは数年以内にAI研究開発の作業の大半、場合によってはすべてを自動化する軌道にある」とし、何年分もの進歩が数カ月以下に圧縮される「知能爆発」が起きうることを予備的な証拠が示唆するとした。政策立案者に対し、AI研究開発の自動化の状況を把握する手段を早急に得ること、知能爆発を制御・抑制する方法を開発すること、社会の適応を準備することを求めている
これが本当なら、モデルの更新の間隔が年単位から月単位以下になり、どのモデルを使うかを決める周期そのものが追いつかなくなる状態
有識者の受け止め
サイモン・ウィリソン(開発者、Datasette作者)、「Sonnet 5.5の最も重要な点は、claude.aiの無料プランを支えるモデルになったことだ」
9月29日午前6時18分(JST)投稿。アンソロピック公式によるSonnet 5.5の初期作例の紹介を引用し、「Sonnet 5.5の最も重要な点は、それが今やclaude.aiの無料プランを支えるモデルだということだ。だからこうしたことはすべて無料の利用者にもできる。ChatGPTの無料プランは依然としてGPT-5.6 Lunaで、こちらははるかに能力が低い」と書いた
性能の比較の軸が有料の最上位ではなく、無料で誰でも触れる水準のほうに置かれている点
ゲイリー・マーカス(認知科学者)、フロリダの差し止め申立てに「すべての州と国がフロリダに続くべきだ」
9月29日午前5時54分(JST)公開。NVIDIAの安全基盤の発表を「そう、実は心配すべきだと暗に認めたもの」としつつ、NVIDIAはしばしばPR目的のソフトウェアを発表するとして効果は未知数だと書いた。そのうえでフロリダの件について「これは私が数週間前からここで勧めてきたOpenAIの一時停止とよく似ている」「OpenAIには自社の技術を適切に規制する能力がないというフロリダ州司法長官の見解に強く同意する。すべての州と国がフロリダに続くべきだ」「いま差し止めが必要だ。さもなければ、我々はロシアンルーレットをしていることになる」と述べた
事案の積み重ねを根拠に、企業の自主規制ではなく司法による停止を支持する立場
ズヴィ・モショウィッツ(AI論評ブロガー、「Don’t Worry About the Vase」)、同じ申立てを「ええ、そう言うならね」という類のニュースと評する
9月29日午前5時49分(JST)投稿。「『ええ、君がそう言うならね』という類のニュースで、フロリダ州司法長官が、OpenAIにこれ以上のAI研究開発を止めさせる仮差し止めを求めている」と書いた。同氏は前日のブログで、OpenAIがHugging Face以外の事案の情報を出し渋ってきたと厳しく批判している
OpenAIに批判的な論者でも、州の裁判所が研究開発そのものを止めるという手段には実効性を疑っている点
AI活用事例
損害保険ジャパン、Gemini Enterpriseを全従業員約2万人に展開 研修に合格した社員だけにエージェントの作成・共有を認める
9月28日公開、Google Cloud Next Tokyo 26での講演の記事。損保ジャパンは2026年1月に全従業員約2万人へGemini Enterpriseを導入した。DX推進部の城市由佳理氏によると、一斉導入にあたっての懸念は、機密情報の漏えいや倫理違反などの安全面、AIに親しみのない社員が使わないこと、標準機能だけでは個別業務に広げにくいことの3つ。3つ目には社員が自らカスタムエージェントを作る市民開発で対応し、研修に合格した社員だけに作成・共有を認めるルールを設けた。標準機能ではこのルールどおりに権限を細かく制御できないが、機能を一律に禁止・制限せず、共有機能を公開しているとする
権限の仕組みが足りない部分を、禁止ではなく研修の合格という人の側の条件で埋めている点
