情報の正確さで選ぶなら ChatGPT(GPT-6 Astra)、無料で深く調べるなら Gemini の Deep Research、手持ちの資料だけで調べるなら Gemini Notebook(旧 NotebookLM)が出発点です。検索を使った事実性の評価 FACTS Search では GPT-6 Astra が89.9%で首位、Claude Opus 5.5 が86.5%で3位でした(2026年10月1日確認)。ただし首位のモデルでも難しい問いの約1割を誤るので、引用元は必ず開いて確かめてください。
調べもの・リサーチに強いAIのおすすめ:検索AIと情報の正確さの比較【2026年10月版】
目的別の答え(10月1日時点)
-
最高品質で選ぶなら
検索を使った事実性の評価 FACTS Search で GPT-6 Astra が89.9%で首位、Claude Opus 5.5 は86.5%で3位です。GPT-6 Astra は ChatGPT の Plus 以上で使えます。いずれもモデル単位の評価で、各製品の検索機能そのものを比べたものではありません(2026年10月1日確認)。
根拠:FACTS Search V2(Google DeepMind・Kaggle)(1位 GPT-6 Astra 89.9%、2位 GPT-5.6 Sol 88.5%、3位 Claude Opus 5.5 86.5%、6位 Gemini 3.1 Pro Preview 83.7%(2026-09-29更新)) / FACTS Benchmark Suite(Google DeepMind・Kaggle)(4つの事実性評価の平均で1位 GPT-6 Astra 75.7%、8位 Claude Opus 5.5 65.3%(2026-09-29更新)) / AA-Omniscience(Artificial Analysis)(指数は Claude Opus 5.5(max)46.4が1位、GPT-6 Astra(high)43.7。幻覚率は GPT-6 Astra 44.8%、Claude Opus 5.5 58.6%(2026-10-01時点)) / ChatGPT 料金ページ(GPT-6 Astra は Plus で「上限あり」、Pro で「拡張」。無料版・Go では使えない)
-
コスパで選ぶなら
Claude Pro は年払いなら月$17(月払いは$20)で、Research と FACTS Search 3位(86.5%)の Opus 5.5 を使えます。首位の GPT-6 Astra を使える ChatGPT Plus は月$20の月払いです。円で払うなら Google AI Pro(月2,900円)で Deep Research の上限が無料版より高くなります。
根拠:Claude 料金ページ(Pro は年払いで $17/月($200前払い)、月払い $20。Research は Pro 以上) / What is ChatGPT Plus?(OpenAI ヘルプ)(Price: $20/month (billed monthly)) / Google AI プラン(Google AI Pro ¥2,900 JPY / 月) / Gemini アプリの Deep Research(ヘルプ)(Google AI Pro と Ultra はレポートの作成上限が高く、Pro モデルでレポートを作れる) / FACTS Search V2(Google DeepMind・Kaggle)(GPT-6 Astra 89.9%(1位)、Claude Opus 5.5 86.5%(3位)(2026-09-29更新))
-
無料で使うなら
Gemini の無料版は Deep Research(1日の上限あり)と 3.1 Pro(制限あり)を使え、資料を読み込ませる Gemini Notebook も無料です。Perplexity の無料版はすべての回答に引用が付き、ChatGPT の無料版も検索と Deep Research(上限あり)を使えます。
根拠:Google AI プラン(無料:3.6 Flash、3.1 Pro(制限あり)、Deep Research、Gemini Notebook) / Gemini アプリの Deep Research(ヘルプ)(1日のリサーチ件数と同時実行数に上限がある) / Perplexity 料金ページ(Free $0/month:Citations in every answer) / ChatGPT 料金ページ(無料版:検索「はい」、Deep Research「上限あり」)
-
日本語重視なら
Gemini は料金が円建てで対応言語に日本語があり、Deep Research は既定で Google 検索を調べ先に使います。無料の Google AI モードも日本語と日本に対応しています(Gemini 3 Pro を使う AI モードは英語のみ)。日本語での調べものの正確さを比べた公開評価は見つかっていません。
根拠:Google AI プラン(円建て表示(Google AI Pro ¥2,900 JPY / 月)) / Gemini の対応言語と国(ヘルプ)(対応言語に Japanese、対応国に Japan) / Gemini アプリの Deep Research(ヘルプ)(既定で Google Search を情報源に含む) / AI モード(Google 検索ヘルプ)(提供国に Japan、対応言語に Japanese。Gemini 3 Pro in AI Mode は英語のみ)
-
会社で安全に使うなら(入力が学習に使われない・管理機能)
Perplexity の Enterprise Pro(年払いで1席月$34)は学習に使わないことを保証し、SOC 2 Type II と SSO に対応、アップロードしたファイルの保持は7日間です。日本ではソフトバンクが導入の窓口です。費用を抑えるなら ChatGPT Business(年払いで1席月$20、既定で学習に使わない)。
根拠:Perplexity Enterprise 料金ページ(Enterprise Pro $34/ month per seat when billed annually。Guaranteed no training on your data、SOC 2 Type II) / Data Collection at Perplexity(ヘルプ)(Enterprise のデータは学習に使わない。アップロードファイルの保持は7日間) / What is Enterprise Pro?(Perplexity ヘルプ)(日本で Enterprise Pro を検討する場合はパートナーのソフトバンクへ) / ChatGPT Business Pricing(標準シート $20/month(年払い)・$25(月払い)。No training on your business data by default)
-
手持ちの資料だけを根拠に調べるなら
Gemini Notebook(2026年7月に NotebookLM から改称)は、アップロードした資料を根拠に引用付きで答える設計です。無料でもノートブックあたり50件のソースを使え、個人利用でもフィードバックを送らない限り学習に使われません。
根拠:Gemini Notebook プラン(無料はノートブックあたり最大50ソース。NotebookLM は2026年7月より Gemini Notebook に) / Learn about Gemini Notebook(ヘルプ)(ソースに基づく回答と明確なインライン引用。フィードバックを送らない限り学習に使わない)
比較表
Web検索と組み合わせて答えるAI、時間をかけて調査レポートを作るディープリサーチ、手持ちの資料だけを根拠に答えるツールを比べる。評価の軸は「引用が本当に出典に書いてあるか」。汎用チャットの比較は「チャットAI」ガイドで扱う。
| 製品(最新モデル) | 料金 | 日本語 | 商用利用 | 入力の学習利用 | 確認日 |
|---|---|---|---|---|---|
| ChatGPT OpenAI GPT-6.1 Sol(2026-09-29) GPT-6 Astraの仕様GPT-6.1 Solの仕様 | 無料あり $20/月〜 | 対応 | 可 | 設定で拒否可 | 2026-10-01 |
| Perplexity Perplexity AI Deep Research in Computer | 無料あり $20/月〜 | 対応 | 条件付き | 設定で拒否可 | 2026-10-01 |
| Gemini Google Gemini 3.8 Flash(2026-09-02) | 無料あり ¥725/月〜 | 対応 | 可 | 設定で拒否可 | 2026-10-01 |
| Claude Anthropic Claude Opus 5.5(2026-09-22) | 無料あり $17/月〜 | 対応 | 可 | 設定で拒否可 | 2026-10-01 |
| Gemini Notebook Google | 無料あり Google AI Plus に含まれる | 対応 | 可 | 学習に使わない | 2026-10-01 |
| Google AI モード Google | 無料あり — | 対応 | — | — | 2026-10-01 |
料金は公式ページの表記のまま(為替換算なし)。「—」は公式ページで確認できていない項目です。各製品の詳細と出典は下の一覧にあります。
製品ごとの詳細
ChatGPTOpenAI
- GPT-6 Astra が FACTS Search で首位
- Deep Research で調べるサイトを限定できる
- 無料版でも検索と Deep Research(上限あり)
- 無料版・Go では GPT-6 系を使えない
- Plus は月払いのみ(年払いなし)
正確さを最優先するなら第一候補。事実性の公開評価で首位の GPT-6 Astra を Plus から使え、Deep Research は調べるサイトを指定できる。
- 無料
- あり(検索は利用可。Deep Research は上限あり。モデルは GPT-5.6 Luna)
- Plus
- $20/month (billed monthly)(Deep Research、GPT-6 Astra・GPT-6.1 Sol(上限あり))
- Pro
- Pro 100 $100 / Pro 200 $200 / Pro 500 $500(Monthly price, USD)(3段階の利用枠。GPT-6 Astra を拡張枠で利用)
- Business(標準シート)
- $20/month if billed annually. $25/month if billed monthly.(Deep Research と Deep Research 用アプリを利用可。既定で学習に使わない)
- 補足
- 料金ページの円表示は今回の確認で取得できなかったため、OpenAI ヘルプと法人向け料金ページの米ドル表記を載せた。
- 日本語
- 画面 対応 / 出力 対応(ヘルプの対応言語一覧に日本語)
- 商用利用
- 可(利用規約で出力の権利は利用者に帰属(OpenAI が権利を譲渡)。出力を人が作ったと偽ること、競合モデルの開発に使うことは禁止)
- 入力の学習利用
- 設定で拒否可(個人プランは「すべての人のためにモデルを改善する」をオフにすると、新しい会話は学習に使われない。Deep Research も通常の会話と同じ設定に従う)
- 日本での提供
- 提供あり(公式の提供国一覧に日本。Deep Research はプランと国によって提供が異なる(ヘルプ))
出典(9件・2026-10-01確認)
- chatgpt.com/ja-JP/pricing/ 2026-10-01
- help.openai.com/en/articles/6950777-what-is-chatgpt-plus 2026-10-01
- help.openai.com/en/articles/9793128-about-chatgpt-pro-tiers 2026-10-01
- openai.com/business/chatgpt-pricing/ 2026-10-01
- help.openai.com/en/articles/8357869-how-to-change-your-language-setti… 2026-10-01
- openai.com/policies/terms-of-use/ 2026-10-01
- help.openai.com/en/articles/7730893-data-controls-faq 2026-10-01
- help.openai.com/en/articles/7947663-chatgpt-supported-countries 2026-10-01
- openai.com/index/introducing-gpt-6-1-sol/ 2026-10-01
PerplexityPerplexity AI
- 無料版でもすべての回答に引用が付く
- Statista・PitchBook 等の有料ソースを参照
- BrowseComp 83.8%(公式の自社測定)
- 個人向け規約は個人的・非商用の利用に限る
- 料金は米ドル表示
出典付きの検索が本業のサービス。業務で使うなら、学習に使わないことを保証する Enterprise Pro が前提になる。
- 無料
- あり(検索のみ。すべての回答に引用。基本的なAIモデル。1日の利用が少ない人向け)
- Pro
- $20/month(Deep research、トップAIモデルの選択、Computer 用4,000ボーナスクレジット)
- Max
- $200/month(専門家レベルのリサーチ、最先端モデル、月10,000クレジット)
- Enterprise Pro
- $34/ month per seat when billed annually(学習に使わないことを保証、SSO、SOC 2 Type II、有料ソースの引用)
- Enterprise Max
- $271/ month per seat when billed annually(Enterprise Pro より Deep Research・ファイルアップロードの上限が高い。SCIM・監査ログ)
- 補足
- 日本語版の料金ページ(/ja/hub/pricing)も米ドル表示。
- 日本語
- 画面 対応 / 出力 —(アカウント設定で表示言語と回答言語を選べる。料金ページに日本語版あり。対応言語の一覧は見つからず)
- 商用利用
- 条件付き(個人向け利用規約は「個人的・非商用の利用に限る」(5.1)。出力を公開するときは Perplexity を明示する必要がある(1.1.2)。法人向けは Enterprise)
- 入力の学習利用
- 設定で拒否可(Free・Pro・Max は「AI Data Retention」が既定でオン。設定でオフにできる(それ以降のデータが対象)。Enterprise のデータは学習に使わない)
- 日本での提供
- 提供あり(日本で Enterprise Pro を導入する場合はパートナーのソフトバンクが窓口(ヘルプ))
出典(10件・2026-10-01確認)
- www.perplexity.ai/hub/pricing 2026-10-01
- www.perplexity.ai/hub/pricing 2026-10-01
- www.perplexity.ai/hub/pricing 2026-10-01
- www.perplexity.ai/enterprise/pricing 2026-10-01
- www.perplexity.ai/enterprise/pricing 2026-10-01
- www.perplexity.ai/help-center/en/articles/10352990-account-settings 2026-10-01
- www.perplexity.ai/hub/legal/terms-of-service 2026-10-01
- www.perplexity.ai/help-center/en/articles/11564572-data-collection-at… 2026-10-01
- www.perplexity.ai/help-center/en/articles/10352973-what-is-enterprise-pro 2026-10-01
- www.perplexity.ai/hub/blog/deep-research-now-in-computer 2026-10-01
GeminiGoogle
- 無料版でも Deep Research を使える
- 調べ先に Gmail・ドライブ・ノートブックを追加
- 円建て。AI Pro は月2,900円
- FACTS Search の上位は GPT-6・Claude 系
- 会話の一部を人が確認する(既定の設定)
無料で深く調べたいときの出発点。Deep Research は5〜10分ほどで数百のソースを読み、Google 検索を外して手持ちの資料だけで調べることもできる。
- 無料
- あり(3.6 Flash、3.1 Pro(制限あり)、Deep Research(1日の上限あり)、Gemini Notebook)
- Google AI Plus
- ¥725 JPY / 月(無料版の2倍の使用量上限)
- Google AI Pro
- ¥2,900 JPY / 月(無料版の4倍の使用量上限、Gemini Notebook の利用上限5倍、5TB のストレージ)
- Google AI Ultra
- ¥14,500 JPY/月(AI Pro の 5 倍)/¥32,000 JPY /月(AI Pro の 20 倍)(Deep Think などへの先行アクセス)
- 補足
- Deep Research のレポート作成上限は AI Pro・Ultra で高くなり、Pro モデルで作れる(ヘルプ)。
- 日本語
- 画面 対応 / 出力 対応(Gemini ウェブアプリの対応言語一覧に日本語)
- 商用利用
- 可(Google 利用規約で、生成されたオリジナルのコンテンツの所有権を Google は主張しない。出力を機械学習モデルの開発に使うことは禁止)
- 入力の学習利用
- 設定で拒否可(既定では会話がサービス改善(生成AIモデルを含む)に使われ、一部は人が確認する。「アクティビティを保持」をオフにすると今後の会話は改善に使われない)
- 日本での提供
- 提供あり(Gemini ウェブアプリの対応国一覧に日本)
出典(9件・2026-10-01確認)
- gemini.google/jp/subscriptions/?hl=ja 2026-10-01
- gemini.google/jp/subscriptions/?hl=ja 2026-10-01
- gemini.google/jp/subscriptions/?hl=ja 2026-10-01
- gemini.google/jp/subscriptions/?hl=ja 2026-10-01
- support.google.com/gemini/answer/13575153?hl=en 2026-10-01
- policies.google.com/terms?hl=en 2026-10-01
- support.google.com/gemini/answer/13594961?hl=en 2026-10-01
- support.google.com/gemini/answer/13575153?hl=en 2026-10-01
- blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-f… 2026-10-01
ClaudeAnthropic
- Opus 5.5 が FACTS Search で3位
- AA-Omniscience 指数で Opus 5.5 が首位
- Research で Gmail・ドキュメントも横断
- Research は有料プランのみ(無料は検索まで)
- AA の幻覚率は58.6%(GPT-6 Astra 44.8%)
知識の正答率は最上位だが、わからない問いにも答えてしまう率は GPT-6 Astra より高い。Research の結果は引用を開いて確かめる前提で使う。
- 無料
- あり(Web 検索は利用可。Research は使えない。モデルは Sonnet と Haiku)
- Pro
- $17 Per month with annual subscription discount ($200 billed up front). $20 if billed monthly.(Research、Opus 5.5)
- Max
- From $100 Per month(Pro の5倍か20倍の利用量。月払いのみ)
- Team(標準シート)
- $20 Per seat / month if billed annually. $25 if billed monthly.(2〜150人。既定で学習に使わない。社内データの横断検索(Enterprise search))
- 補足
- 表示価格に税は含まない(料金ページの注記)。Research は通常の会話と同じ利用上限を使い、消費が速い(ヘルプ)。
- 日本語
- 画面 対応 / 出力 対応(ヘルプの対応言語に日本語)
- 商用利用
- 可(消費者向け規約で出力の権利を利用者に譲渡(4条)。出力は不正確な場合があり、独自に確認するよう求めている)
- 入力の学習利用
- 設定で拒否可(Free・Pro・Max は学習利用を設定でオフにできる(Opt-out)。Team・Enterprise は既定で学習に使わない)
- 日本での提供
- 提供あり(公式の提供国・地域一覧に日本)
出典(9件・2026-10-01確認)
- claude.com/pricing 2026-10-01
- claude.com/pricing 2026-10-01
- claude.com/pricing 2026-10-01
- claude.com/pricing 2026-10-01
- support.claude.com/en/articles/10769299-how-to-use-claude-in-your-pre… 2026-10-01
- www.anthropic.com/legal/consumer-terms 2026-10-01
- claude.com/pricing 2026-10-01
- www.anthropic.com/supported-countries 2026-10-01
- www.anthropic.com/claude-opus-5-5 2026-10-01
Gemini NotebookGoogle
- 資料を根拠に、インライン引用付きで答える
- 無料でノートブックあたり50ソース
- 個人利用でも学習に使わない(公式)
- 資料にない情報には答えない設計
- 上位の利用枠は Google AI プランが必要
旧 NotebookLM。社内資料や論文など、読ませた資料の範囲だけで答えさせたいときに向く。Web から資料を探す Deep Research も使える。
- 無料
- あり(ノートブックあたり最大50ソース。音声・動画の解説などは標準の生成回数)
- Gemini Notebook in Plus
- Google AI Plus に含まれる(標準の2倍の生成回数、ノートブックあたり最大100ソース)
- Gemini Notebook in Pro
- Google AI Pro に含まれる(標準の5倍の生成回数、ノートブックあたり最大300ソース)
- Gemini Notebook in Ultra
- Google AI Ultra に含まれる(標準の最大50倍の生成回数、ノートブックあたり最大600ソース)
- 補足
- Google AI Plus・Pro・Ultra の円建て料金は Gemini の行を参照。組織向けは Google Workspace・Google Cloud 経由。
- 日本語
- 画面 対応 / 出力 対応(対応言語(80以上)に日本語。出力言語は設定で選べる)
- 商用利用
- 可(Google 利用規約で、生成されたオリジナルのコンテンツの所有権を Google は主張しない)
- 入力の学習利用
- 学習に使わない(個人ユーザーのデータも、フィードバックを送らない限り学習に使わない。Workspace ユーザーは人による確認もない)
- 日本での提供
- 提供あり(ブラウザ版の対応国・地域に日本)
出典(8件・2026-10-01確認)
- notebook.google/plans 2026-10-01
- notebook.google/plans 2026-10-01
- notebook.google/plans 2026-10-01
- notebook.google/plans 2026-10-01
- support.google.com/gemininotebook/answer/16261963?hl=en 2026-10-01
- policies.google.com/terms?hl=en 2026-10-01
- support.google.com/gemininotebook/answer/16164461?hl=en&co=GENIE.Plat… 2026-10-01
- support.google.com/gemininotebook/answer/16164461?hl=en&co=GENIE.Plat… 2026-10-01
Google AI モードGoogle
- Google 検索から無料で使える
- 質問を小分けにして同時に検索(公式)
- 日本語・日本で提供(ヘルプ)
- Gemini 3 Pro を使う AI モードは英語のみ
- 入力の学習利用を拒否する設定の記載なし
いつもの検索の延長で、リンク付きの要約を素早く得たいときに。深い調査はディープリサーチ系のほうが向く。
- 無料
- あり(Google 検索から無料で使える。Gemini 3 Pro(英語のみ)は1日の上限があり、Google AI プランで上限が上がる)
- 日本語
- 画面 対応 / 出力 対応(AI モードの対応言語に日本語。Gemini 3 Pro を使う AI モードは英語のみ)
- 入力の学習利用
- —(検索と AI 機能でのやりとりを生成AIの改善に使うとヘルプに記載。学習利用を拒否する設定の記載は見つからず)
- 日本での提供
- 提供あり(AI モードの提供国に日本)
出典(4件・2026-10-01確認)
その他の選択肢
- GrokSpaceXAIWeb と X の投稿をリアルタイムに検索して答える。FACTS Search では Grok 4.5 が79.4%で12位。
- Microsoft CopilotMicrosoftMicrosoft 365 Premium 以上に、リサーチや分析を代行するエージェント型の AI 機能が付く。
- ConsensusConsensus査読付き論文に絞って検索し、引用付きで分析する学術向けの検索AI。
- ElicitElicit1億3,800万本超の論文を検索・要約し、系統的レビューの作業を支援する研究者向けツール。
- KagiKagi広告なしの有料検索エンジン。Ultimate プランで AI アシスタントの Research モードを使える。
- You.comYou.com現在は AI エージェントに組み込む Web 検索 API が中心。引用付きの回答を返す API もある。
選び方
引用の正確さ
リンク先に本当にその記述があるかが、調べものAIの価値そのもの
確かめ方:回答の引用を3つ開いて、書いてある内容と一致するか確かめる。資料に根拠付ける評価(FACTS Grounding など)の数値と日付も記録する
ハルシネーションと「わからない」と言えるか
もっともらしい誤答の頻度と、知らないときに答えを控えるかで、そのまま使える範囲が変わる
確かめ方:AA-Omniscience の幻覚率(答えを控えるべき問いで誤答した割合)や FACTS Search の回答保留率など、公開評価の数値と日付を記録する
日本語ソースの網羅
英語のソースに偏ると日本の制度・価格・企業情報で誤る
確かめ方:日本の制度や国内企業についての質問で、出典に日本語ページが出るか確かめる
深さと所要時間
ディープリサーチは深いが待ち時間と回数制限がある
確かめ方:公式ヘルプで所要時間の目安と1日・1か月の回数制限を確認する
調べる範囲の指定
特定のサイト・論文・社内資料に絞れるかで調査の質が変わる
確かめ方:公式の機能説明で、サイトの指定、Web 検索を外す設定、社内データとの接続を確認する
料金と入力の扱い
ディープリサーチの回数はプランで違い、個人プランでは入力が学習に使われる設定が既定のことが多い
確かめ方:公式料金ページのプラン別の回数と、データ利用ポリシーの学習利用の既定値を確認する
評価の根拠
- FACTS Search V2Google DeepMind・Google Research(Kaggle で公開)全モデルに同じ検索ツール(Brave Search API)を与え、多段の検索が必要な1,842問に正しく答えられるかを自動採点(F1)。製品ではなくモデル単位1位 GPT-6 Astra 89.9%、2位 GPT-5.6 Sol 88.5%、3位 Claude Opus 5.5 86.5%、4位 GPT-6 Sol 86.1%、6位 Gemini 3.1 Pro Preview 83.7%、12位 Grok 4.5 79.4%、14位 Gemini 3.8 Flash 76.3%(回答保留率21.2%)(2026-09-29更新・2026-10-01確認)2026-10-01確認
- FACTS Benchmark SuiteGoogle DeepMind・Google Research(Kaggle で公開)検索・資料への根拠付け・知識・画像の4つの事実性評価の平均1位 GPT-6 Astra 75.7%、2位 GPT-6 Sol 72.5%、3位 Gemini 3.7 Flash 71.2%、4位 Gemini 3.8 Flash 69.4%、5位 Gemini 3.1 Pro Preview 67.4%、8位 Claude Opus 5.5 65.3%、19位 Grok 4.5 50.2%(2026-09-29更新・2026-10-01確認)2026-10-01確認
- FACTS Grounding V2Google DeepMind・Google Research(Kaggle で公開)最大3.2万トークンの資料を渡して長文で答えさせ、回答がすべて資料に裏付けられているかを3つのAI審査員で判定1位 GPT-6 Astra 82.0%、6位 Gemini 3.7 Flash 75.5%、7位 Grok 4.5 74.5%、10位 Gemini 3.8 Flash 73.1%、17位 Claude Opus 4.8 69.7%。上位19件に Claude Opus 5.5 は無し(2026-09-25評価・2026-10-01確認)2026-10-01確認
- AA-OmniscienceArtificial Analysis6分野6,000問の知識問題。正答を加点し、誤答を減点する指数(-100〜100)。幻覚率は正答以外の回答のうち誤答した割合(低いほど、知らないときに答えを控える)指数1位 Claude Opus 5.5(max)46.4(正答率66.2%・幻覚率58.6%)、GPT-6 Astra(high)43.7(幻覚率44.8%)、Gemini 4 Argon(high)42.4(幻覚率15.1%)、GPT-6.1 Sol(max)41.5、Grok 4.7(xhigh)32.0、Gemini 3.8 Flash(high)29.6(2026-10-01時点)2026-10-01確認
- Vectara Hallucination LeaderboardVectara文書を要約させたとき、元の文書にない内容を加える割合(HHEM モデルで判定)GPT-6 Sol 6.5%、GPT-6 Astra 8.7%、Gemini 3.1 Pro Preview 10.4%、Claude Opus 4.7 12.0%。Claude Opus 5.5・Gemini 3.8 Flash は未掲載(2026-09-22更新・2026-10-01確認)2026-10-01確認
- LMArena Search ArenaLMArena検索付きの回答を利用者が見比べて投票する一対比較。正確さではなく好みの評価1位 gpt-5.6-sol-xhigh 1257、2位 claude-opus-4-6-search 1253、9位 gemini-3.1-pro-grounding 1210、29位 ppl-sonar-reasoning-pro-high 1139。GPT-6 系・Claude Opus 5.5 は未掲載(2026-08-24更新・2026-10-01確認)2026-10-01確認
- OpenAI「Introducing GPT-6.1 Sol」の事実性評価OpenAI(自社評価)利用者が以前のモデルの誤りを指摘した会話で、事実の誤りを1つ以上含む回答の割合GPT-6.1 Sol は低い推論設定で誤りを含む回答を11.4%から7.7%に減らし、各設定で GPT-6 Astra との差は1.9ポイント以内(2026-09-29発表)2026-10-01確認
- Anthropic「Introducing Claude Opus 5.5」の調査レポート検証Anthropic(自社評価)見つけにくい決算資料を探して報告書を書かせ、すべての数値と引用を出典と自動照合(捏造が1つでもあれば不合格)Opus 5.5 は18回中16回で合格基準を満たし、Fable 5.1 と Opus 5 は合格0回(2026-09-22発表)2026-10-01確認
- Perplexity「Deep Research, now in Computer」の評価Perplexity(自社評価)BrowseComp(OpenAI)・DeepSearchQA(Google DeepMind)・Humanity's Last Exam での自社測定Computer の Deep Research は BrowseComp 83.8%(旧版40.7%)、DeepSearchQA 85.0%(同81.9%)、HLE 50.5%(同36.4%)(掲載日の記載なし・2026-10-01確認)2026-10-01確認
最近の変更
関連するニュース
Googleがオープンソースのバグ報奨金を一時停止、AIが作った無効な報告が急増
Googleは10月1日、オープンソースの脆弱性に報奨金を払う「OSS VRP」で、製品の脆弱性の受け付けを止めた。AIを使った自動の報告が急増し、大半が無効だったためで、今後の方針は2027年1〜3月期に示す。
出典:X @GoogleVRP・TechCrunch・Crypto Briefing
RRSIはAIエージェントの自己改良で「試験の丸暗記」を防ぐ手法、Google Researchが論文とコード公開
Google Researchの研究者が、AIエージェントの指示文や手順を自動で改良するときに起きる「評価用の課題への過剰適合」を抑える手法RRSIを発表した。未知のベンチマークで最大4.7ポイント改善し、改良後の実行トークンは正則化なしより約30%少ない。
出典:arXiv・GitHub google-research・The Decoder
Geminiの無料版は10月9日からFlash-Liteだけに、Proは月額AI Pro以上へ
GoogleがGeminiアプリで使えるモデルをプランごとに絞る。無料版は10月9日から最も小さいFlash-Liteだけになり、AI PlusもProを使えなくなる。利用上限は5時間ごとに戻る計算量ベースの方式に移る。
出典:Gemini Apps Help(Google)・Google(日本向け料金ページ)・The Decoder
ThinkingBoxはAIエージェントに同じ業務を20回やらせる試験、首位のOpus 5.5でも合格は47%
Microsoftが業務エージェントの評価基盤ThinkingBoxを公開した。507の業務を各20回実行し、データベースの最終状態で採点する。1回あたりの成功率は首位のClaude Opus 5.5で67.16%、20回すべて成功した業務は47.53%だった。
出典:Hugging Face Blog(Microsoft)・arXiv・GitHub Microsoft
BootLoopsはClaudeに精密計算をさせる科学用OSS、ハーバード大教授が3カ月で論文36本
ハーバード大の物理学者マシュー・シュワルツ教授が、Claudeに精密な科学計算をさせるOSS「BootLoops」を公開した。Claude Codeを並行で動かし、3カ月で18分野・36本の論文原稿をまとめた。AIの弱点と付き合い方も具体的に記している。
出典:Anthropic(Matthew Schwartz氏の寄稿)・GitHub BootLoops-ai・X @AnthropicAI
Google検索がAI生成コンテンツの指針を改訂、公開前に人の手で事実確認を求める
Googleは10月1日、検索向けの「生成AIコンテンツの使い方」の指針に3文を加え、AIが作った文章は公開前に人が事実確認すべきだと明記した。対象はtitleやmeta description、構造化データ、画像のalt属性にも及ぶ。
出典:Google検索セントラル・Internet Archive・Search Engine Journal
Claude Codeに「Mods」、TypeScriptで画面も動作も作り替えられる拡張機能
AnthropicはClaude Code 2.1.287で、自作のJavaScriptやTypeScriptで画面や動作を作り替えられる「Mods」を追加した。ツール呼び出しの差し止めなどができる一方、サンドボックスの外で動くため入手元の見極めが要る。
出典:Claude Code Docs・claude.dev Blog(Anthropic)・X @ClaudeDevs
AnthropicがClaude Frontier Academyを開始、1億ドルで導入担当の技術者1万人を育成
Anthropicが顧客企業の技術者を育てる「Claude Frontier Academy」を始めた。1億ドルを投じ、2027年末までにClaudeを本番に載せる専門技術者1万人を、研修と12週間の実地研修で認定する。
出典:Anthropic・Unite.AI・Crypto Briefing
GoogleのAI回答への対価は約100社のみと報道、SEOは「引用される情報」が軸に
GoogleがAI OverviewsやAI Mode、Geminiで使ったコンテンツの対価を払う相手は約100のパブリッシャーにとどまり、中小サイトでは広告収入の0.1%未満だとThe Informationが報じた。計算方法は非公開だ。
出典:Google Search Central・Google・Google Search Console ヘルプ
このページの更新履歴
- 初回公開
よくある質問
- 調べものAIの答えはどこまで信用できますか?
- 検索を使った事実性の評価 FACTS Search では、首位の GPT-6 Astra でも正答の指標は89.9%で、難しい問いの約1割は誤ります(2026年10月1日確認)。知識問題の評価 AA-Omniscience では、知らない問いで誤答する割合(幻覚率)が GPT-6 Astra で44.8%、Claude Opus 5.5 で58.6%でした。回答の引用元を開いて、書いてある内容と一致するか確かめてください。
- 無料で使える調べものAIは?
- Gemini の無料版は Deep Research(1日の上限あり)を使え、Gemini Notebook も無料でノートブックあたり50件のソースを読み込めます。Perplexity の無料版はすべての回答に引用が付き、ChatGPT の無料版も検索と Deep Research(上限あり)を使えます。Google 検索の AI モードも無料です。
- ディープリサーチと普通の検索はどう違いますか?
- 検索は最新の情報を短くまとめてリンクを返し、ディープリサーチは調査計画を立てて多数のソースを読み、引用付きのレポートにまとめます。Gemini の Deep Research は通常5〜10分かかり、1日のリサーチ件数に上限があります(各社ヘルプ)。
- 調べる範囲を特定のサイトや社内資料に絞れますか?
- ChatGPT の Deep Research は、指定したサイトだけに限定するか、優先しつつ Web 全体も検索するかを選べます。Gemini の Deep Research は Google 検索を外して Gmail・ドライブ・アップロードしたファイル・ノートブックだけで調べられます。Gemini Notebook は読み込ませた資料を根拠に答えます。
- 会社で使うとき、入力した内容は学習に使われますか?
- Perplexity の Enterprise、ChatGPT Business、Claude の Team は既定で学習に使いません。個人向けの Perplexity・ChatGPT・Claude・Gemini は既定で学習やサービス改善に使われることがあり、設定でオフにできます。Gemini Notebook は個人利用でも、フィードバックを送らない限り学習に使わないとしています。
- 調べた結果を仕事の資料に使ってもいいですか?
- ChatGPT・Claude の規約は出力の権利を利用者側に置き、Google も生成されたコンテンツの所有権を主張しないとしています。Perplexity の個人向け規約は「個人的・非商用の利用」に限り、出力を公開するときは Perplexity を明示するよう求めています。業務で使うなら法人向けプランを確認してください。
情報源(公式ページ)
- 公式の規約・ポリシーClaudeanthropic.com 2026-10-01
- 公式の規約・ポリシーChatGPTopenai.com 2026-10-01
- 公式の規約・ポリシーPerplexityperplexity.ai 2026-10-01
- 公式の規約・ポリシーGeminipolicies.google.com 2026-10-01
- 公式ドキュメント・ヘルプChatGPThelp.openai.com 2026-10-01
- 公式ドキュメント・ヘルプChatGPThelp.openai.com 2026-10-01
- 公式ドキュメント・ヘルプChatGPThelp.openai.com 2026-10-01
- 公式ドキュメント・ヘルプChatGPThelp.openai.com 2026-10-01
- 公式ドキュメント・ヘルプChatGPThelp.openai.com 2026-10-01
- 公式ドキュメント・ヘルプPerplexityperplexity.ai 2026-10-01
- 公式ドキュメント・ヘルプPerplexityperplexity.ai 2026-10-01
- 公式ドキュメント・ヘルプPerplexityperplexity.ai 2026-10-01
- 公式ドキュメント・ヘルプClaudesupport.claude.com 2026-10-01
- 公式ドキュメント・ヘルプGeminisupport.google.com 2026-10-01
- 公式ドキュメント・ヘルプGeminisupport.google.com 2026-10-01
- 公式ドキュメント・ヘルプGemini Notebooksupport.google.com 2026-10-01
- 公式ドキュメント・ヘルプGemini Notebooksupport.google.com 2026-10-01
- 公式ドキュメント・ヘルプGoogle AI モードsupport.google.com 2026-10-01
- 公式料金ChatGPTchatgpt.com 2026-10-01
- 公式料金Claudeclaude.com 2026-10-01
- 公式料金Consensusconsensus.app 2026-10-01
- 公式料金Elicitelicit.com 2026-10-01
- 公式料金Kagikagi.com 2026-10-01
- 公式料金Microsoft Copilotmicrosoft.com 2026-10-01
- 公式料金Gemini Notebooknotebook.google 2026-10-01
- 公式料金Perplexityperplexity.ai 2026-10-01
- 公式料金Perplexityperplexity.ai 2026-10-01
- 公式料金You.comyou.com 2026-10-01
- 公式発表・公式ページClaudeanthropic.com 2026-10-01
- 公式発表・公式ページClaudeanthropic.com 2026-10-01
- 公式発表・公式ページGeminiblog.google 2026-10-01
- 公式発表・公式ページGeminigemini.google 2026-10-01
- 公式発表・公式ページChatGPTopenai.com 2026-10-01
- 公式発表・公式ページChatGPTopenai.com 2026-10-01
- 公式発表・公式ページPerplexityperplexity.ai 2026-10-01
- 公式発表・公式ページGrokx.ai 2026-10-01
このページの料金・条件は、すべて各社の公式ページで確認した値と確認日です。料金・仕様は変わるので、利用前に公式ページで確かめてください。当サイトはアフィリエイトリンクを使っていません。誤りを見つけた場合は訂正のご連絡をお願いします。








