ChatGPTに服の「試着」ボタン、自分の写真に商品を重ねてお気に入りに保存も
OpenAIはChatGPTの買い物機能に、自分の写真で服や小物を試着できる「Try on」と、商品を保存するFavoritesを加えた。画像はChatGPT Images 2.5で作り、Images 2.0比で最大50%速い生成をうたう。ウェブとモバイルで使える。
出典:OpenAI Help Center・OpenAI・TechCrunch
2026年10月に公開したAIニュース79本の一覧です。
OpenAIはChatGPTの買い物機能に、自分の写真で服や小物を試着できる「Try on」と、商品を保存するFavoritesを加えた。画像はChatGPT Images 2.5で作り、Images 2.0比で最大50%速い生成をうたう。ウェブとモバイルで使える。
出典:OpenAI Help Center・OpenAI・TechCrunch
Microsoft AIが逐次文字起こしのMAI-Transcribe-2-Streamingと音声合成のMAI-Voice-2.1・2.1-Flashを公開した。文字起こしは60言語で年末まで1時間$0.54。音声合成は23言語だが、現時点で日本語の音声はない。
出典:Microsoft AI・Microsoft Learn・X @MicrosoftAI
Ideogramが画像編集モデルIdeogram 4.5を公開した。編集を重ねても色ずれや画質の劣化がたまりにくい設計で、APIでは触れていない画素を元画像からそのまま写す。料金は1枚0.8〜22セントと報じられている。
出典:Ideogram・Ideogram Documentation・X @ideogram_ai
GoogleはGemini Liveに、カメラに映るものを声で説明し、撮り方も「右へゆっくり」などと指示するGuided Visionを追加した。Android 9以降が対象で、日本の視覚障害者コミュニティも開発時の検証に加わった。
出典:Google・Google ヘルプ・Android Authority
GoogleのAI Overviewsが記事を流用し検索流入を奪うとしたCheggとPenske Mediaの独禁法訴訟を、米連邦地裁が9月30日に棄却した。判決文は41ページ。「流入への期待は合意ではない」と退けた。
出典:米ワシントンD.C.連邦地方裁判所(CourtListener)・Engadget・Press Gazette
台湾の統一企業グループの会員サービスuniopenは、投稿審査にAmazon Nova 2 Liteを微調整して使っている。3,391件の会話で学習させ、行動分類の精度を示すF1を0.5852から0.8550に上げた。AWSが10月1日に公開した事例をまとめる。
出典:AWS Machine Learning Blog・AWS Documentation
Shopifyは10月1日、ストアの全ページを1枚の作業画面に並べ、AIエージェントのSidekickと会話しながらデザインできる「Canvas」を発表した。Sidekickは2026年上半期だけでテーマを2,500万回以上編集している。数日かけて順次提供する。
出典:Shopify・Shopify Changelog・Shopify Developer Community Forums
Cloudflareは10月1日、AIエージェントの分岐を確率付きで決める判断モデル「Clef」と軽量版を公開した。Jevと同じAPIで呼べ、軽量版の応答の中央値は38.8ミリ秒。同日にAmazonも2Bの「Strands Decider」を公開している。
出典:Cloudflare Blog・Cloudflare Docs・Strands Agents Blog(AWS)
スペインのIMDEA Networksなどの研究者が、ChatGPT、Claude、Grokなど9つのAIチャットの通信を調べた。Web版9つのうち6つで、会話のURLや自動で付く題名、入力文が広告・計測企業に送られていた。
出典:Oliveira ほか(IMDEA Networks など)・LeakyLM(研究チームのサイト)・スペインデータ保護庁(AEPD)
米コンサルティング大手Bainは年次のテクノロジーレポートで、AIインフラ投資を続けるには2031年に年6兆ドルの売上が必要と試算した。既存の消費者向けと企業向けで賄えるのは最大1.8兆ドルで、残る4.2兆ドルは新市場が必要だという。
出典:Bain & Company・Bain & Company(プレスリリース)・The National
米スポーツ賭博大手DraftKingsが賭けの記録で機械学習モデルを作り、販促後に負けが込みそうな客に特典を多く送っていたとNYTが元従業員40人超への取材で報じた。EFFは自社データだけでも害は防げないとして行動ターゲティング広告の禁止を求めた。
出典:EFF Deeplinks・DiCello Levitt(ボルティモア市の代理人)・DiCello Levitt
Google Researchは画像生成AIの調整手法を一つの数理の枠組みにまとめるDiffusion Controllerを解説した。本体を固定したまま約1,200万パラメータの部品を足し、2つの学習方式で人の好みの指標がLoRAを上回った。
出典:Google Research Blog・arXiv(Tong Yang ほか)・arXiv
NVIDIAは表データの予測モデルKumo Tabularを公開した。ラベル付きの行を渡すだけで、追加学習なしに新しい行の分類や数値を予測する。2,800万〜2億1,500万パラメータの3サイズで、商用利用できる。
出典:Hugging Face Blog(NVIDIA)・Hugging Face・GitHub
小型の言語モデル7種をブラウザだけで動かして比べるMicroLLM Labが公開された。モデルは2600万〜3億6000万パラメーターで、4ビットに圧縮して端末で動かす。作者によると3万6000のIPから30万回超のアクセスがあった。
出典:GitHub robss2020・stateofutopia.com・Hacker News
Cloudflareは9月28〜30日、AIエージェントが使う前提の新機能を相次いで発表した。全APIの3,000超の操作を扱う新CLI「cf」、起動を6倍速くしたContainers、モデルを自動で選ぶAI GatewayのAuto Routerなど5本をまとめる。
出典:Cloudflare Blog・Cloudflare Docs
GitHubはCopilotの研究プレビュー機能HydraFusionを、CLIに続きVS CodeとGitHub Copilotアプリでも使えるようにした。作業ごとに複数のモデルを組み合わせ、GitHubの評価ではOpus 5に近い品質のまま費用を36〜67%抑えた。
出典:GitHub Changelog・GitHub Docs・GitHub Blog
GitHub Security Labは、オープンソースのAIエージェントとAndroid向けの監査手順で、アプリの脆弱性を24件見つけて報告した。位置情報の漏えいやアカウント乗っ取りにつながるものもあり、手順は公開リポジトリから誰でも実行できる。
出典:GitHub Blog・GitHub Security Lab
プログラミング学習のScrimbaが、Hacker Newsのトップページの記事を解説動画で見られるHN.watchを公開した。動画はHTMLのスライドとAI音声で組み立て、数秒で再生が始まる。ナレーションは日本語を含む33言語に対応する。
出典:Hacker News・Scrimba Docs・YouTube @Scrimba
Hugging Faceはオープンソースの音声合成モデルを自動の指標で比べるOpen TTS Leaderboardを公式ブログで紹介した。聞き取りやすさ・速さ・声の再現度を9言語で測り、日本語では10月1日時点で16モデルを比べている。
出典:Hugging Face Blog・Hugging Face(hf-audio)・QwenAudio(GitHub)
AIに1回の指示だけでパックマンを作らせて比べるPac-Benchが公開された。32作品を100点満点で採点し、Claude Opus 5.5が99点で首位、GPT-6.1 Solは91点。最下位は文法エラーの2点だった。
出典:GitHub jonclegg・jonclegg.github.io・Hacker News
開発者のhp6が、4つのAIモデルが8×8マスの盤上で最後の1体になるまで戦うTinyAIArenaを公開した。43試合の成績ではClaude Sonnet 5がElo 1063で首位、DeepSeek V4 Flashは勝ちがない。
出典:GitHub hp6・tinyaiarena.com・Hacker News
開発者のSeamus Cawley氏が、M5Stackの電子ペーパー端末PaperMonoを冷蔵庫の買い物リストにするコードを公開した。約2,400行のC++も手書きせずClaude Codeに作らせ、売り場分けにもClaudeを使う。
出典:GitHub seamusc・Hacker News・M5Stack
AIエージェントのキャラクターを画面付きの小型端末で持ち歩く製品が動き出した。MetaはMuse Charmを12月に発売する計画で、OpenAIも端末化に含みを残す。カリフォルニア州は対話AI入りの子ども向け玩具を2031年まで禁じた。
出典:OpenAI・California Legislative Information・カリフォルニア州知事室
米カリフォルニア州のニューサム知事は、懲戒や解雇の判断をAIだけに頼ることを禁じるSB 947などに署名した。AIの判断を使うなら人が裏付けを確認し、本人に書面で知らせる。2027年7月1日に施行され、違反は1件500ドルの罰金となる。
出典:カリフォルニア州知事室・California Legislative Information・X @GovPressOffice
Cloudflareは、AI企業がサイトの記事を回答の引用などに実際に使った分だけ対価を払う仕組みPay Per Useのベータ版を始めた。価格はAI企業が提示し、運営者は受けるかを選ぶ。支払いは毎月で、設定はダッシュボードで完結する。
出典:Cloudflare Blog・Cloudflare Docs・Search Engine Journal
Micronの9月3日までの四半期の売上は542億ドルで、前年同期の約4.8倍になった。AI向けのHBMやデータセンター用SSDの需要に供給が追いつかず値上げが進み、粗利率は86.8%に達した。2027年は不足がさらに強まるとみる。
出典:Micron Technology・The Information
文章を生成せず選択肢ごとの確率を返す「判断モデル」の公開版が相次いだ。個人開発のJeffは0.8Bで1回22〜28ミリ秒、自宅のGPU1枚で約2時間で学習した。PostHogのJeevesは9Bで、考えてから選ぶ方式で精度を上げた。
出典:GitHub firelex・GitHub PostHog・Hacker News(作者の投稿)
スイスのZeroEx Tsitsipas Labsが運営するLathoaは、AIがわざと間違えた解き方から誤りを探す10〜14歳向けの算数アプリだ。誤りが本当に誤りかを検算と別のモデルで確かめてから出題する。無料プランは1日3問まで。
出典:Lathoa・Hacker News(作者 thanouil1411 の投稿)
大学1年生の開発者が、マイコンESP32-S3を7台つないで言語モデルを動かすクラスターをGitHubで公開した。Qwen2-0.5Bを1.58ビットに量子化し、6台が4層ずつ計24層を分担する。推論中の消費電力は約1.53Wとしている。
出典:GitHub Low-Zi-Hong・Hacker News
オープンソースのASTRABOXが公開された。遊びたいゲームを文章か声で伝えるとCodexが作り、遊んでいる最中に声で直せる。手元のPCで動き、付属の4本のゲームはCodexにログインしなくても遊べる。
出典:GitHub Qualzz・Reddit r/LocalLLaMA・GitHub Colton-z