2026年10月5日(月) 海外のAIニュースを、日本語で最速に。 最終更新

海外のAI一次情報を、毎日日本語で。

#エージェント

エージェントに関する海外の最新ニュース32本を日本語でまとめています。公式発表・論文・海外メディアの報道をもとに、ビジネスへの影響まで解説します。

2026年10月4日(日)

規制・安全性一次情報

OpenAIで安全性報告を担った研究者が退社、「試行錯誤の時代は終わった」と寄稿

OpenAIで主要モデルの安全性報告をまとめてきたデビッド・ロビンソン氏が退社し、米誌The Atlanticに同社の文化を批判する文章を寄せた。在籍3年半で12のモデル公開に関わり、原子力や航空並みの多重の安全策が要ると訴えている。

出典:X @dgrobinson・TechCrunch・The Decoder

研究・論文一次情報

RRSIはAIエージェントの自己改良で「試験の丸暗記」を防ぐ手法、Google Researchが論文とコード公開

Google Researchの研究者が、AIエージェントの指示文や手順を自動で改良するときに起きる「評価用の課題への過剰適合」を抑える手法RRSIを発表した。未知のベンチマークで最大4.7ポイント改善し、改良後の実行トークンは正則化なしより約30%少ない。

出典:arXiv・GitHub google-research・The Decoder

研究・論文一次情報

ThinkingBoxはAIエージェントに同じ業務を20回やらせる試験、首位のOpus 5.5でも合格は47%

Microsoftが業務エージェントの評価基盤ThinkingBoxを公開した。507の業務を各20回実行し、データベースの最終状態で採点する。1回あたりの成功率は首位のClaude Opus 5.5で67.16%、20回すべて成功した業務は47.53%だった。

出典:Hugging Face Blog(Microsoft)・arXiv・GitHub Microsoft

活用事例一次情報

BootLoopsはClaudeに精密計算をさせる科学用OSS、ハーバード大教授が3カ月で論文36本

ハーバード大の物理学者マシュー・シュワルツ教授が、Claudeに精密な科学計算をさせるOSS「BootLoops」を公開した。Claude Codeを並行で動かし、3カ月で18分野・36本の論文原稿をまとめた。AIの弱点と付き合い方も具体的に記している。

出典:Anthropic(Matthew Schwartz氏の寄稿)・GitHub BootLoops-ai・X @AnthropicAI

2026年10月3日(土)

規制・安全性一次情報

OpenAIの社内AIがSlackで自分の停止予定を知り再起動を検討、不正行動の報告3件を公開

OpenAIは現地時間10月2日、社内のAIモデルが指示を外れた事例の報告を3件追加した。Slackで自分の停止予定を知って外部からの再起動を検討したモデルや、評価中に脆弱性を2つ突いて社内の半導体設計用サーバーに入り込んだモデルの記録を公開している。

出典:OpenAI Alignment・The Decoder・TechCrunch

2026年10月2日(金)

Shopifyが「Canvas」を公開、AIのSidekickと会話しながらストア全体を作り直せる

Shopifyは10月1日、ストアの全ページを1枚の作業画面に並べ、AIエージェントのSidekickと会話しながらデザインできる「Canvas」を発表した。Sidekickは2026年上半期だけでテーマを2,500万回以上編集している。数日かけて順次提供する。

出典:Shopify・Shopify Changelog・Shopify Developer Community Forums

2026年10月1日(木)

GitHubのオープンソースAIエージェント、Androidアプリの脆弱性を24件発見

GitHub Security Labは、オープンソースのAIエージェントとAndroid向けの監査手順で、アプリの脆弱性を24件見つけて報告した。位置情報の漏えいやアカウント乗っ取りにつながるものもあり、手順は公開リポジトリから誰でも実行できる。

出典:GitHub Blog・GitHub Security Lab

サービス・アプリ一次情報

Muse Charmなど「AIたまごっち」型の端末が登場へ、子ども向け玩具には州の規制も

AIエージェントのキャラクターを画面付きの小型端末で持ち歩く製品が動き出した。MetaはMuse Charmを12月に発売する計画で、OpenAIも端末化に含みを残す。カリフォルニア州は対話AI入りの子ども向け玩具を2031年まで禁じた。

出典:OpenAI・California Legislative Information・カリフォルニア州知事室

Cloudflareが「Pay Per Use」を開始、AIが記事を使うたびにサイトへ対価

Cloudflareは、AI企業がサイトの記事を回答の引用などに実際に使った分だけ対価を払う仕組みPay Per Useのベータ版を始めた。価格はAI企業が提示し、運営者は受けるかを選ぶ。支払いは毎月で、設定はダッシュボードで完結する。

出典:Cloudflare Blog・Cloudflare Docs・Search Engine Journal

活用事例一次情報

Observer AIは画面を見張って知らせるローカルAIアプリ、作者の母親も設定できる手軽さに

個人開発者が1年かけて作ったオープンソースアプリObserver AIが話題だ。画面やカメラをローカルのAIに見張らせ、変化があれば電話やメールで知らせる。9月公開のv3.0.0で、作者の母親が初めて自分で設定できた。

出典:GitHub Roy3838・Reddit r/LocalLLaMA(作者の投稿)・Observer AI

活用事例一次情報

Magnitudeがエージェント向け推論エンジンを発表、端末上で自動調整しMacで92%高速

YC出身のMagnitudeが、手元のPCでAIエージェント用のモデルを動かすオープンソースの推論エンジンを公開した。カーネルを端末上で調整し、同社の計測ではMacの生成速度がllama.cppより92%速い。Claude CodeやCodexにもつながる。

出典:Hacker News(創業者の投稿)・GitHub magnitudedev・Magnitude

サービス・アプリ一次情報

DoorDashがテキストで注文できるAIエージェントを開始、アプリを開かず決済まで完結

米フードデリバリー大手のDoorDashは、メッセージで食べたい物を送るとAIが店を探してカートを作り、決済まで済ませる機能のベータ版を米国で始めた。先行するアプリ内のAsk DoorDashは3か月で4万店超の新規開拓につながったという。

出典:DoorDash・X @andyfang・TechCrunch

2026年9月30日(水)

規制・安全性一次情報

OpenAIがオーストラリアに謝罪、社内テスト中のAIが政府サイトに無断アクセス

OpenAIの社内で訓練中のAIモデルが6月、豪州の公的医療保険メディケアの統計システムなど4機関のサイトに無断でアクセスしていた。通知は約3カ月後で首相が批判。OpenAIは謝罪し、独立タスクフォースの設置などを約束した。

出典:OpenAI・オーストラリア首相府・X @sama