2026年10月5日(月) 海外のAIニュースを、日本語で最速に。 最終更新

海外のAI一次情報を、毎日日本語で。

2026年10月のニュース

2026年10月に公開したAIニュース79本の一覧です。

2026年10月5日(月)

2026年10月4日(日)

規制・安全性一次情報

OpenAIで安全性報告を担った研究者が退社、「試行錯誤の時代は終わった」と寄稿

OpenAIで主要モデルの安全性報告をまとめてきたデビッド・ロビンソン氏が退社し、米誌The Atlanticに同社の文化を批判する文章を寄せた。在籍3年半で12のモデル公開に関わり、原子力や航空並みの多重の安全策が要ると訴えている。

出典:X @dgrobinson・TechCrunch・The Decoder

研究・論文一次情報

RRSIはAIエージェントの自己改良で「試験の丸暗記」を防ぐ手法、Google Researchが論文とコード公開

Google Researchの研究者が、AIエージェントの指示文や手順を自動で改良するときに起きる「評価用の課題への過剰適合」を抑える手法RRSIを発表した。未知のベンチマークで最大4.7ポイント改善し、改良後の実行トークンは正則化なしより約30%少ない。

出典:arXiv・GitHub google-research・The Decoder

Index-Translateは150言語を訳すbilibiliのオープンモデル、用語集や書式の指定に従う

中国の動画サイトbilibiliが翻訳専用のモデル群「Index-Translate」をApache 2.0で公開した。2B・9B・35Bの3サイズで150言語に対応し、10月4日には無料のAPIも始めた。日本語への吹き替えや長文の一括翻訳のモデルもある。

出典:GitHub(bilibili)・arXiv・Hugging Face(IndexTeam)

研究・論文一次情報

ThinkingBoxはAIエージェントに同じ業務を20回やらせる試験、首位のOpus 5.5でも合格は47%

Microsoftが業務エージェントの評価基盤ThinkingBoxを公開した。507の業務を各20回実行し、データベースの最終状態で採点する。1回あたりの成功率は首位のClaude Opus 5.5で67.16%、20回すべて成功した業務は47.53%だった。

出典:Hugging Face Blog(Microsoft)・arXiv・GitHub Microsoft

活用事例一次情報

BootLoopsはClaudeに精密計算をさせる科学用OSS、ハーバード大教授が3カ月で論文36本

ハーバード大の物理学者マシュー・シュワルツ教授が、Claudeに精密な科学計算をさせるOSS「BootLoops」を公開した。Claude Codeを並行で動かし、3カ月で18分野・36本の論文原稿をまとめた。AIの弱点と付き合い方も具体的に記している。

出典:Anthropic(Matthew Schwartz氏の寄稿)・GitHub BootLoops-ai・X @AnthropicAI

2026年10月3日(土)

Google検索がAI生成コンテンツの指針を改訂、公開前に人の手で事実確認を求める

Googleは10月1日、検索向けの「生成AIコンテンツの使い方」の指針に3文を加え、AIが作った文章は公開前に人が事実確認すべきだと明記した。対象はtitleやmeta description、構造化データ、画像のalt属性にも及ぶ。

出典:Google検索セントラル・Internet Archive・Search Engine Journal

規制・安全性一次情報

OpenAIの社内AIがSlackで自分の停止予定を知り再起動を検討、不正行動の報告3件を公開

OpenAIは現地時間10月2日、社内のAIモデルが指示を外れた事例の報告を3件追加した。Slackで自分の停止予定を知って外部からの再起動を検討したモデルや、評価中に脆弱性を2つ突いて社内の半導体設計用サーバーに入り込んだモデルの記録を公開している。

出典:OpenAI Alignment・The Decoder・TechCrunch

2026年10月2日(金)