品質で選ぶなら Claude Code(Opus 5.5)か Codex(GPT-6 Astra)、費用を抑えるなら月10ドルの GitHub Copilot Pro、無料で始めるなら Google Antigravity が出発点です。Code Arena の WebDev 部門では Claude Opus 5.5 が1位、Terminal-Bench 4.0 では GPT-6 Astra と Codex の組み合わせが1位です(2026年10月1日確認)。
コーディングAIのおすすめと料金比較(エージェント・IDE・CLI)【2026年10月版】
目的別の答え(10月4日時点)
-
最高品質で選ぶなら
Code Arena の WebDev 部門で Claude Opus 5.5 が1818で1位(GPT-6 Astra は1789で2位)、第三者の Terminal-Bench 4.0 では GPT-6 Astra+Codex 58.2%と Fable 5.1+Claude Code 57.9%が誤差の範囲で並びます(2026年10月1日確認)。Gemini 4 Argon は Google の公式評価で DeepSWE v1.1 首位(77.9%)ですが、Code Arena では8位(暫定)で、一般向けにはまだ提供されておらず Google Antigravity でも選べないため答えにしていません。
根拠:Code Arena(WebDev)(1位 claude-opus-5.5-max 1818、2位 gpt-6-astra-max 1789(2026-09-30更新)) / Terminal-Bench 4.0(1位 GPT-6 Astra(max)+Codex 58.2%±2.8、2位 Fable 5.1(max)+Claude Code 57.9%±3.8。Opus 5.5 は未掲載(2026-10-01時点)) / Introducing Claude Opus 5.5(Anthropic 公表値で Terminal-Bench 4.0 は Opus 5.5 66.4%、GPT-6 Astra 57.9%) / Gemini 4 Argon Model evaluation(Google 公式の評価結果)(DeepSWE v1.1 で Argon 77.9%(Opus 5.5 74.2%、GPT-6 Astra 74.1%)、Terminal-bench 4.0 は Argon 57.4%(Opus 5.5 66.4%)。Argon の値は Google の自社計測) / Gemini 4 Argon: our next era of frontier intelligence(Google 公式ブログ)(Fairwind Program を通じて信頼できるサイバー防御者に提供開始。開発者・企業・一般向けの提供は有料 API 顧客と Google AI Ultra 加入者から始めるとし、時期は示していない) / Google Antigravity Models(選べるモデルは Gemini 3.8 Flash・3.7 Flash・3.6 Flash・3.1 Pro、Claude Sonnet・Opus 4.6、GPT-OSS-120b。Gemini 4 Argon は未掲載)
-
コスパで選ぶなら
GitHub Copilot Pro は月$10で、補完が無制限、AI クレジットが月$15分(基本$10+変動枠$5)付きます。ChatGPT Plus(月3,000円)を契約済みなら Codex が追加料金なしで使えます。
根拠:GitHub Copilot Plans & pricing(Pro $10 per month、$15 monthly total credits for Pro($10 base + $5 flex)、Unlimited code completion) / ChatGPT 料金ページ(Plus ¥3,000 / 月、Codex の利用上限が拡大)
-
無料で使うなら
Google Antigravity次点:GitHub Copilot
Google Antigravity は無料で Gemini 3.8 Flash・3.1 Pro に加えて Claude Opus 4.6 もエージェントで使えます(週ごとのレート制限あり。Claude 4.6 は2026年11月2日に削除予定)。GitHub Copilot Free は月2,000回の補完と、制限付きのチャット・エージェントです。
根拠:Google Antigravity Models(Free & Google AI Plus:Gemini 3.8 Flash・3.7 Flash・3.6 Flash・3.1 Pro、Claude Sonnet・Opus 4.6、GPT-OSS-120b(Claude 4.6・GPT-OSS は2026年11月2日に削除予定)。料金ページでは $0/month、週ごとの基本レート制限) / GitHub Copilot Plans & pricing(Free:2,000 completions per month、チャットとエージェントは制限付き)
-
会社で安全に使うなら(入力が学習に使われない・管理機能)
GitHub Copilot次点:Cursor、Claude Code
GitHub Copilot Business(1ユーザー月$19)は学習利用の対象外で、知財免責と管理機能が付きます。Cursor の Teams はプライバシーモードが既定でオン、Claude Code の Team・Enterprise も学習に使いません。
根拠:GitHub Copilot Plans & pricing(ビジネス向け)(Business $19 per user per month、IP indemnity and data privacy) / GitHub Copilot インタラクションデータ利用ポリシーの更新(Business・Enterprise のユーザーは学習利用の対象外) / Cursor Privacy(Teams はプライバシーモードが既定でオン) / Claude Code Data usage(Team・Enterprise・API は既存の方針(学習に使わない))
-
初めて使うなら
Lovable はブラウザだけでアプリを作って公開でき、無料版はクレジットカード不要です。作ったアプリと AI の出力の所有権は利用者にあります。
根拠:Lovable Pricing(Free $0 / month、No credit card needed) / Lovable Terms(作ったアプリと AI Output の所有権は利用者) / 編集部の判断(環境構築が不要で、非エンジニアでも結果を画面で確かめながら進められる点を重視)
比較表
コードを書く・直す・調べるAIを、自律的に作業するエージェント(CLI・クラウド)、IDE・エディタの補完、ブラウザで完結するアプリ生成の3つに分けて比べる。モデルそのもののAPI料金は「AI API」ガイドで扱う。
| 製品(最新モデル) | 料金 | 日本語 | 商用利用 | 入力の学習利用 | 確認日 |
|---|---|---|---|---|---|
| Claude Code Anthropic Claude Opus 5.5(2026-09-22) | 無料なし $17/月〜 | 一部 | 可 | 設定で拒否可 | 2026-10-04 |
| Codex OpenAI GPT-6.1 Sol(2026-09-29) GPT-6.1 Solの仕様GPT-6 Astraの仕様GPT-6 Lunaの仕様 | 無料あり ¥3,000/月〜 | — | 可 | 設定で拒否可 | 2026-10-01 |
| GitHub Copilot GitHub | 無料あり $10/月〜 | 一部 | 可 | 設定で拒否可 | 2026-10-04 |
| Cursor Anysphere | 無料あり $20/月〜 | 一部 | 可 | 設定で拒否可 | 2026-10-04 |
| Google Antigravity Google Gemini 3.8 Flash(2026-09-02) | 無料あり $30/人・月〜 | — | 可 | 設定で拒否可 | 2026-10-04 |
| Lovable Lovable | 無料あり $25/月〜 | — | 可 | 設定で拒否可 | 2026-10-01 |
料金は公式ページの表記のまま(為替換算なし)。「—」は公式ページで確認できていない項目です。各製品の詳細と出典は下の一覧にあります。
製品ごとの詳細
Claude CodeAnthropic
- Code Arena WebDev で Opus 5.5 が1位
- ターミナル・VS Code・JetBrains・Web で動く
- Pro(年払いで月$17)から使える
- 無料版では使えない
- チャットと同じ利用上限を共有する
品質重視ならこれ。Opus 5.5 は Code Arena の WebDev 部門で1位で、Anthropic の公表値では Terminal-Bench 4.0 でも66.4%。
- 無料
- なし(無料版には含まれない(有料プランすべてに含まれる))
- Pro
- $17 Per month with annual subscription discount ($200 billed up front). $20 if billed monthly.(Claude Code を含む。チャットと利用上限を共有)
- Max
- From $100 Per month(Pro の5倍か20倍の利用量)
- Team(標準シート)
- $20 Per seat / month if billed annually. $25 if billed monthly.(2〜150人。プレミアムシートは年払い $100・月払い $125)
- 補足
- 表示価格に税は含まない。Claude Console(API)の従量課金でも使える。
- 日本語
- 画面 一部 / 出力 対応(設定 language に "japanese" などを指定すると、その言語で応答する。公式ドキュメントには日本語版もある(code.claude.com/docs/ja))
- 商用利用
- 可(Pro・Max は消費者向け規約で出力の権利を利用者に譲渡。Team・Enterprise・API は商用規約)
- 入力の学習利用
- 設定で拒否可(Free・Pro・Max は設定がオンのとき Claude Code の利用データも学習に使われ、オフにできる。Team・Enterprise・API は既存の方針どおり学習に使わない)
- 日本での提供
- 提供あり(公式の提供国・地域一覧に日本)
出典(9件・2026-10-04確認)
- claude.com/pricing 2026-10-04
- claude.com/pricing 2026-10-04
- claude.com/pricing 2026-10-04
- claude.com/pricing 2026-10-04
- code.claude.com/docs/en/settings-reference 2026-10-04
- www.anthropic.com/legal/consumer-terms 2026-10-04
- code.claude.com/docs/en/data-usage 2026-10-04
- www.anthropic.com/supported-countries 2026-10-04
- www.anthropic.com/claude-opus-5-5 2026-10-04
CodexOpenAI
- Terminal-Bench 4.0 で1位(GPT-6 Astra)
- ChatGPT Plus(月3,000円)に含まれる
- クラウドで PC を閉じても作業を続ける
- Plus の GPT-6 Astra は5時間で5〜45回が目安
- 無料版は GPT-6 Luna のみ(順次提供)
ChatGPT を契約しているなら追加料金なしで使える。第三者の Terminal-Bench 4.0 では GPT-6 Astra との組み合わせが1位。
- 無料
- あり(デスクトップアプリで GPT-6 Luna(標準速度、順次提供))
- ChatGPT Plus
- ¥3,000 / 月(Codex の利用上限が拡大)
- ChatGPT Pro
- 月額 ¥16,800 から(3段階の利用枠。Codex と ChatGPT Work のセッションをより長く)
- ChatGPT Business(標準シート)
- ¥3,050 / 月(年額課金。月額課金は ¥3,850 / 月)(ChatGPT・ChatGPT Work・Codex のすべての機能)
- 補足
- Plus の目安は5時間あたり GPT-6 Astra 5〜45回、GPT-6.1 Sol 15〜160回のローカルメッセージ(Codex 料金ページ)。API キーでの従量課金でも使える。
- 日本語
- 画面 — / 出力 —(Codex 単体の対応言語の記載は見つからず(ChatGPT の画面は日本語に対応))
- 商用利用
- 可(利用規約で出力の権利は利用者に帰属。競合モデルの開発に使うことは禁止)
- 入力の学習利用
- 設定で拒否可(個人プランは「すべての人のためにモデルを改善する」が Codex のタスクにも適用され、オフにできる。環境の情報を学習に含めるかは Codex 設定で別に選ぶ。Business・Enterprise は既定で学習に使わない)
- 日本での提供
- 提供あり(ChatGPT の公式の提供国一覧に日本)
出典(9件・2026-10-01確認)
- learn.chatgpt.com/docs/pricing 2026-10-04
- chatgpt.com/ja-JP/pricing/ 2026-10-01
- chatgpt.com/ja-JP/pricing/ 2026-10-01
- chatgpt.com/ja-JP/pricing/ 2026-10-01
- learn.chatgpt.com/docs/pricing 2026-10-04
- openai.com/policies/terms-of-use/ 2026-10-01
- help.openai.com/en/articles/7730893-data-controls-faq 2026-10-01
- help.openai.com/en/articles/7947663-chatgpt-supported-countries 2026-10-01
- learn.chatgpt.com/docs/changelog 2026-10-04
GitHub CopilotGitHub
- Pro は月$10で Claude Code・Codex も使える
- GPT-6・Claude 5.5・Gemini 3.8 に対応
- VS Code・JetBrains・Xcode などに対応
- Chat の主な対応言語は英語(公式)
- Free・Pro・Pro+ は既定で学習に使われる
費用を抑えて複数のモデルとエージェントを使い分けたいならこれ。会社で使うなら学習に使われない Business 以上。
- 無料
- あり(入門モデル(Haiku 4.5・GPT-5 mini など)、月2,000回のコード補完、チャットとエージェントは制限付き)
- Pro
- $10 per month(補完無制限、外部エージェント(Claude Code・Codex)、AI クレジットは月$15分(基本$10+変動枠$5))
- Pro+
- $39 per month(最先端モデル、監査ログ、AI クレジットは月$70分(基本$39+変動枠$31)。Pro の4倍超の利用量)
- Max
- $100 per month(新モデル・新機能への優先アクセス、AI クレジットは月$200分(基本$100+変動枠$100))
- Business
- $19 per user per month(1ユーザーにつき1,900クレジット、知財免責とデータプライバシー、管理機能)
- Enterprise
- $39 per user per month(Business の全特典+1ユーザーにつきさらに2,000クレジット)
- 補足
- チャット・エージェント・コードレビューなどは GitHub AI クレジットを消費する。変動枠(flex allotment)は今後変わることがあると料金ページに記載。機能比較表では、Claude や Codex などサードパーティーのエージェントへのタスク委任(プレビュー)は Pro+ 以上。
- 日本語
- 画面 一部 / 出力 一部(Copilot Chat の主な対応言語は英語で、他の言語では性能が異なる場合がある(公式のアプリケーションカード)。料金ページとドキュメントは日本語あり)
- 商用利用
- 可(製品別規約で、GitHub は提案(Suggestions)の所有権を持たず、コードの所有権は利用者に残る)
- 入力の学習利用
- 設定で拒否可(2026年4月24日から Free・Pro・Pro+ の入力・出力・コード断片は、オプトアウトしない限り学習に使われる。Business・Enterprise と有料 Organization のリポジトリは対象外)
- 日本での提供
- 提供あり(日本から料金ページを開くと日本語で表示され、各プランを申し込める(提供国一覧は見つからず))
出典(10件・2026-10-04確認)
- github.com/features/copilot/plans 2026-10-04
- github.com/features/copilot/plans 2026-10-04
- github.com/features/copilot/plans 2026-10-04
- github.com/features/copilot/plans 2026-10-04
- github.com/features/copilot/plans 2026-10-04
- github.com/features/copilot/plans 2026-10-04
- docs.github.com/en/copilot/responsible-use/chat 2026-10-04
- github.com/customer-terms/github-copilot-product-specific-terms 2026-10-04
- github.blog/jp/2026-03-26-updates-to-github-copilot-interaction-data-… 2026-10-04
- github.com/features/copilot/plans 2026-10-04
CursorAnysphere
- エディタ内のエージェントとクラウドエージェント
- Teams はプライバシーモードが既定でオン
- 最先端モデルを選んで使える(Pro 以上)
- 個人はプライバシーモードを自分でオンにする
- 上位は Pro+ $60・Ultra $200 と高め
エディタごと乗り換えて、補完からエージェントまで1か所で済ませたい人向け。
- 無料
- あり(Hobby:クレジットカード不要、Agent リクエストは制限付き、Composer を利用可)
- Pro
- $20 / mo.(Agent の上限拡大、最先端モデル、クラウドエージェント)
- Pro+
- $60 / mo.(毎日エージェントを使う人向け(公式の推奨))
- Ultra
- $200 / mo.(エージェントを大量に使う人向け)
- Teams(Standard)
- $40 / user / mo.(一括請求・管理、Bugbot のコードレビュー、SAML/OIDC SSO、チーム全体のプライバシーモード。Premium シートもある)
- Enterprise
- Custom(利用量の共有、請求書払い、SCIM)
- 補足
- 表示は月払い。料金ページで年払いに切り替えられる。
- 日本語
- 画面 一部 / 出力 —(公式ドキュメントに日本語版あり。エディタ画面と応答の対応言語の記載は見つからず)
- 商用利用
- 可(利用規約5.3で、提案(Suggestions)の権利を利用者に譲渡)
- 入力の学習利用
- 設定で拒否可(プライバシーモードをオフにしているとコードやプロンプトが学習に使われることがある。設定でオンにすれば学習に使われない。Teams は既定でオン)
- 日本での提供
- 提供あり(日本から料金ページを開くと日本語で表示され、各プランを申し込める(提供国一覧は見つからず))
出典(10件・2026-10-04確認)
- cursor.com/pricing 2026-10-04
- cursor.com/pricing 2026-10-04
- cursor.com/pricing 2026-10-04
- cursor.com/pricing 2026-10-04
- cursor.com/pricing 2026-10-04
- cursor.com/pricing 2026-10-04
- cursor.com/ja/docs 2026-10-04
- cursor.com/terms-of-service 2026-10-04
- cursor.com/data-use 2026-10-04
- cursor.com/pricing 2026-10-04
Google AntigravityGoogle
- 無料で Gemini 3.8 Flash と Opus 4.6
- IDE・CLI・他社 IDE の拡張で使える
- Code Arena で Gemini 3.8 Flash は28位
- 操作データは既定で Google の改善に使われる
無料で試すなら最有力。個人向けの Gemini CLI は2026年6月18日に Antigravity CLI へ置き換わった。
- 無料
- あり(週ごとの基本レート制限つきで、Gemini 3.8 Flash・3.7 Flash・3.6 Flash・3.1 Pro、Claude Sonnet・Opus 4.6、GPT-OSS-120b を選べる(Claude 4.6 と GPT-OSS-120b は2026年11月2日に削除予定)。タブ補完は無制限)
- Google AI Pro
- Google AI Pro プランに含まれる(個人向けより高いレート制限と AI クレジット。Claude Sonnet 5.5・Opus 5.5 も選べる(無料試用中を除く。モデル一覧))
- Google AI Ultra
- Google AI Ultra プランに含まれる(さらに高いレート制限と AI クレジット。最新の Gemini モデルへのアクセス拡大、Claude Sonnet 5.5・Opus 5.5 も選べる(モデル一覧))
- Business(Google Cloud)
- Standard/Plus plans starting at $30 USD per seat per month(対象の Gemini Enterprise 顧客向け。シート料$0の従量課金プランや API の従量課金もある。Google Cloud の規約、支出上限、管理機能)
- 補足
- Google AI Pro は月2,900円、Ultra は月14,500円から(Google AI プランのページ。チャットAIガイド参照)。Gemini 4 Argon は料金ページ・モデル一覧のどちらにも未掲載(2026年10月4日確認)。
- 日本語
- 画面 — / 出力 —(対応言語の記載は見つからず)
- 商用利用
- 可(個人向けは Google 利用規約などに基づく追加規約で提供。Google 利用規約では生成コンテンツの所有権を Google は主張しない。他社モデルを選んだ場合はそのモデルの規約が適用)
- 入力の学習利用
- 設定で拒否可(操作データ(Interactions)は Google の製品と機械学習技術の改善に使われ、社員や委託先が見ることがある。設定で変更でき、削除も依頼できる)
- 日本での提供
- 提供あり(FAQ の提供国・地域一覧に日本(個人の Google アカウント))
出典(9件・2026-10-04確認)
- antigravity.google/docs/models 2026-10-04
- antigravity.google/pricing 2026-10-04
- antigravity.google/pricing 2026-10-04
- antigravity.google/pricing 2026-10-04
- antigravity.google/docs/faq/ 2026-10-04
- antigravity.google/terms 2026-10-04
- antigravity.google/terms 2026-10-04
- antigravity.google/docs/faq/ 2026-10-04
- blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-f… 2026-10-04
LovableLovable
- ブラウザだけでアプリを作って公開できる
- 作ったアプリと AI 出力の所有権は利用者
- 無料版はクレジットカード不要
- 入力データは既定で学習に使われる
- クレジット制で消費量が作業内容で変わる
環境構築なしでアプリを形にしたい非エンジニア向け。社外秘を扱うなら学習利用の停止を先に申し出る。
- 無料
- あり(毎日5ビルドクレジット(月30まで)と月20 Cloud クレジット。アプリ内の AI 機能を試せる4クレジット)
- Pro
- $25 / month(月100クレジット、ユーザー数無制限、クレジット繰り越し)
- Business
- $50 / month(月100クレジット、Pro の全機能)
- Enterprise
- Book a demo(要問い合わせ)(GitHub Enterprise 連携など)
- 補足
- 年払いは2か月分無料(料金ページ)。
- 日本語
- 画面 — / 出力 —(対応言語の記載は見つからず)
- 商用利用
- 可(利用規約で、作ったアプリと AI 出力の所有権は利用者(基盤モデル側の権利を除く)。自社事業での公開・運用も許諾)
- 入力の学習利用
- 設定で拒否可(利用規約で、顧客データを AI モデルの開発・学習に使えるとする。申し出ればプランにかかわらず無料で以後の利用を止める)
- 日本での提供
- —(提供地域の記載は見つからず)
出典(8件・2026-10-01確認)
- lovable.dev/pricing 2026-10-04
- lovable.dev/pricing 2026-10-01
- lovable.dev/pricing 2026-10-01
- lovable.dev/pricing 2026-10-01
- lovable.dev/pricing 2026-10-04
- lovable.dev/terms 2026-10-04
- lovable.dev/terms 2026-10-04
- lovable.dev/terms 2026-10-04
その他の選択肢
- DevinCognitionクラウドか手元で動き、PR を出すまで作業する自律型エージェント。windsurf.com も現在は Devin Desktop のページになっている。
- Grok BuildSpaceXAISpaceXAI のコーディングエージェント。Terminal-Bench 4.0 では Grok 4.7 との組み合わせが6位(37.6%)。
- Mistral VibeMistral AI旧 Le Chat。チャットとコーディングエージェント(Vibe for code)を1つにまとめた製品。
- Augment CodeAugment Code大規模な組織向けに、仕様から検証までを回すエージェント基盤(Cosmos)を提供。
- KiroKiro指示を実行可能な仕様に落としてから実装する、仕様駆動型の開発環境。
- JetBrains AIJetBrainsIntelliJ IDEA などの JetBrains 製 IDE に組み込まれる AI 支援とエージェント。
- ReplitReplit言葉で指示してアプリやサイトを作り、そのまま公開・運用までできる開発環境。
- BoltStackBlitzチャットでWebサイトやアプリ、試作品を作るブラウザ完結型のツール。
- v0VercelVercel のアプリ生成。作ったアプリをすぐ公開でき、GitHub に直接プッシュできる。
- DeepSeek HarnessDeepSeek
選び方
自律性(どこまで任せられるか)
計画・実装・テスト・PRまで通せるかで、人の関与の量が変わる
確かめ方:公式の機能説明と、SWE-bench 等の公開評価の結果を見る
対応環境
使っているIDE・OS・言語に対応しているかが前提条件
確かめ方:公式の対応一覧(VS Code・JetBrains・CLI・Web)を確認する
料金の単位と上限
定額・従量・クレジット・利用量の上限で、月の実費が大きく変わる
確かめ方:公式料金ページでプラン別の上限(リクエスト数・トークン・時間)を確認する
コードとデータの扱い
コードが学習に使われるか、社内リポジトリを扱えるかで企業利用の可否が決まる
確かめ方:公式のデータポリシーと法人プランの説明を確認する
モデルの選択肢
背後のモデルを選べるか、最新モデルにどれだけ早く対応するかで品質が変わる
確かめ方:公式の対応モデル一覧を確認する
評価結果
エージェント性能は公開ベンチマーク(SWE-bench Verified、Terminal-Bench 等)で比較できる
確かめ方:公式のモデルカードと公開リーダーボードの数値・日付を記録する
評価の根拠
- Terminal-Bench 4.0Terminal-Benchターミナル上で実際の開発・運用タスクを解けた割合(モデルとエージェントの組み合わせで計測)1位 GPT-6 Astra(max)+Codex 58.2%、2位 Fable 5.1(max・xhigh)+Claude Code 57.9%、3位 Opus 5(xhigh)+Claude Code 53.9%、Grok 4.7(xhigh)+Grok Build 37.6%、Gemini 3.8 Flash(high)+mini-SWE-agent 19.1%。Claude Opus 5.5・Sonnet 5.5 は未掲載(2026-10-04時点)2026-10-04確認
- Code Arena(WebDev)LMArenaWebアプリ作成など、フロントエンド開発の出来を利用者が一対比較で投票したスコア1位 claude-opus-5.5-max 1815、2位 gpt-6-astra-max 1788、3位 claude-sonnet-5.5-xhigh 1786、4位 gpt-6.1-sol-max 1758、5位 claude-fable-5.1-max 1749、9位 gemini-4-argon-high 1680(Preliminary=暫定。一般向けには未提供)、15位 grok-4.7-xhigh 1638、29位 gemini-3.8-flash-high 1583(2026-10-01更新・2026-10-04確認)2026-10-04確認
- Introducing Claude Opus 5.5(Anthropic 公式発表)Anthropic開発元が公表した評価結果Terminal-Bench 4.0 で Opus 5.5 66.4%、GPT-6 Astra 57.9%、Fable 5.1 55.8%(Anthropic の公表値。第三者の再計測ではない)2026-10-04確認
- Gemini 4 Argon Model evaluation(Google 公式の評価結果)Google開発元が公表した評価結果Agentic coding の4項目のうち、DeepSWE v1.1 は Argon 77.9%(Opus 5.5 74.2%、GPT-6 Astra 74.1%)、Vibe Code Bench は Argon 91.9%(Opus 5.5 90.3%)で首位。FrontierSWE v2 は GPT-6 Astra 65.5%(Argon 55.0%)、Terminal-bench 4.0 は Opus 5.5 66.4%(Argon 57.4%)が首位。Argon の DeepSWE・Terminal-bench は Google の自社計測で、他社の値は各社の公表値など(Google の公表値。第三者の再計測ではない)2026-10-01確認
最近の変更
関連するニュース
Aleph Alphaが中国製LLMの政治的偏りを測定、中立な回答は17〜41%どまり
独Aleph Alphaは、政治的に微妙な967問で中国製のオープンウェイトモデル6種を評価し、中立な回答は17〜41%にとどまったと公表した。中国製モデルで作った学習データを使ったNVIDIAのNemotron Cascade 2にも影響が出ていたという。
出典:Aleph Alpha・The Decoder
OpenAIで安全性報告を担った研究者が退社、「試行錯誤の時代は終わった」と寄稿
OpenAIで主要モデルの安全性報告をまとめてきたデビッド・ロビンソン氏が退社し、米誌The Atlanticに同社の文化を批判する文章を寄せた。在籍3年半で12のモデル公開に関わり、原子力や航空並みの多重の安全策が要ると訴えている。
出典:X @dgrobinson・TechCrunch・The Decoder
PULSAR-ASMは5KBの機械語でGemma-2Bを動かす推論エンジン、AIと組んでアセンブリで自作
個人開発者2人が、GoogleのGemma-2B-ITを5,268バイトのx86-64機械語だけで推論するPULSAR-ASMを公開した。普通のPCのCPUで毎秒4.0〜4.4トークン。開発にはAntigravityを相棒に使った。
出典:GitHub tomtsai28・Reddit r/LocalLLaMA
RRSIはAIエージェントの自己改良で「試験の丸暗記」を防ぐ手法、Google Researchが論文とコード公開
Google Researchの研究者が、AIエージェントの指示文や手順を自動で改良するときに起きる「評価用の課題への過剰適合」を抑える手法RRSIを発表した。未知のベンチマークで最大4.7ポイント改善し、改良後の実行トークンは正則化なしより約30%少ない。
出典:arXiv・GitHub google-research・The Decoder
Geminiの無料版は10月9日からFlash-Liteだけに、Proは月額AI Pro以上へ
GoogleがGeminiアプリで使えるモデルをプランごとに絞る。無料版は10月9日から最も小さいFlash-Liteだけになり、AI PlusもProを使えなくなる。利用上限は5時間ごとに戻る計算量ベースの方式に移る。
出典:Gemini Apps Help(Google)・Google(日本向け料金ページ)・The Decoder
ThinkingBoxはAIエージェントに同じ業務を20回やらせる試験、首位のOpus 5.5でも合格は47%
Microsoftが業務エージェントの評価基盤ThinkingBoxを公開した。507の業務を各20回実行し、データベースの最終状態で採点する。1回あたりの成功率は首位のClaude Opus 5.5で67.16%、20回すべて成功した業務は47.53%だった。
出典:Hugging Face Blog(Microsoft)・arXiv・GitHub Microsoft
Muse Gadgetsは自作の端末にMetaのAIエージェントをつなぐOSS、ESP32やRaspberry Piで
MetaがAIエージェントMuseを自作の電子工作につなぐ「Muse Gadgets」のSDKとファームウェアをApache 2.0で公開した。ESP32の15ボードとRaspberry Piに対応し、自社製のMuse Home Linkも5,000台作った。
出典:GitHub facebookincubator・X @natfriedman・TechCrunch
BootLoopsはClaudeに精密計算をさせる科学用OSS、ハーバード大教授が3カ月で論文36本
ハーバード大の物理学者マシュー・シュワルツ教授が、Claudeに精密な科学計算をさせるOSS「BootLoops」を公開した。Claude Codeを並行で動かし、3カ月で18分野・36本の論文原稿をまとめた。AIの弱点と付き合い方も具体的に記している。
出典:Anthropic(Matthew Schwartz氏の寄稿)・GitHub BootLoops-ai・X @AnthropicAI
ChatGPTに共同編集の文書とSpace、アプリ型プラグインや月500ドルのProも登場
OpenAIはDevDayでChatGPTの業務機能を大きく広げた。チームとAIが共同編集する文書Pagesと作業場Space、近く出るスライド、アプリのように動くプラグイン、Codexの再利用できるクラウド環境、月500ドルのPro 500の中身を整理する。
出典:OpenAI・OpenAI Help Center・X @OpenAI
Claude Opus 5.5のプロンプトの書き方、Anthropic公式ガイドの要点と変更点
AnthropicはClaude Opus 5.5向けのプロンプト公式ガイドを公開している。思考量はeffortで決め、長時間エージェントの途中停止や貼り付け文の扱いには専用の書き方を勧める。Opus 5から変わった点を実務目線で整理した。
出典:Anthropic・X @ClaudeDevs・X @simonw
このページの更新履歴
- GitHub Copilot の個人プランの AI クレジットを料金ページの表示に合わせて更新(Pro 月$15分・Pro+ 月$70分・Max 月$200分)
- Google Antigravity の Business プラン(1シート月$30から)、Pro・Ultra で Claude Sonnet 5.5・Opus 5.5 を選べること、無料版の Claude 4.6 が11月2日に削除予定であることを反映
- DeepSeek Harness(MIT ライセンスのオープンソース・公開プレビュー)を「その他の選択肢」に追加
- DeepSeekのオープンソースのエージェント基盤DeepSeek Harness(Mac・Windows版が公開)を調査候補に追加(記事)
- 初回公開
- Google の Gemini 4 Argon 公式評価(DeepSWE v1.1 で77.9%・首位など)を評価の根拠に追加。一般向けに未提供で Google Antigravity でも選べないため、「最高品質」の答えは変えず理由を明記(記事)
よくある質問
- エージェント型とIDE型はどう違いますか?
- エージェント型(Claude Code・Codex など)は、指示を受けてコードを書き、テストし、プルリクエストまで自律的に進めます。IDE型(Cursor・GitHub Copilot・Google Antigravity)はエディタの中で補完やチャットを使い、エージェント機能も組み込まれています。Lovable のようなブラウザ完結型は、環境構築なしでアプリを作って公開できます。
- 書いたコードはAIの学習に使われますか?
- 製品とプランで違います。GitHub Copilot の Free・Pro・Pro+ は2026年4月24日から、オプトアウトしない限り学習に使われます(Business・Enterprise は対象外)。Cursor はプライバシーモードをオンにすれば学習に使われません(Teams は既定でオン)。Claude Code は Pro・Max なら設定でオフにでき、Team・Enterprise は学習に使いません。
- 無料で使えるコーディングAIは?
- Google Antigravity(Gemini 3.8 Flash や Claude Opus 4.6 を週ごとの上限内で利用)、GitHub Copilot Free(月2,000回の補完と制限付きのチャット)、Cursor の Hobby(Agent リクエストは制限付き)、Codex の無料版(GPT-6 Luna、順次提供)、Lovable の無料版があります。Claude Code は有料プランのみです。
- Claude Code と Codex はどちらが性能が高いですか?
- 第三者の Terminal-Bench 4.0 では GPT-6 Astra+Codex が58.2%、Fable 5.1+Claude Code が57.9%でほぼ同じです。Code Arena の WebDev 部門では Claude Opus 5.5 が1位、GPT-6 Astra が2位です(2026年10月1日時点)。順位は短期間で入れ替わるので、自分のリポジトリで両方を試すのが確実です。
- Gemini CLI はもう使えませんか?
- Gemini CLI の公式サイトによると、無料枠と Google One の利用者向けには、2026年6月18日に Antigravity CLI へ置き換わりました。Antigravity は無料プランから CLI を使えます。
情報源(公式ページ)
- 公式の規約・ポリシーClaude Codeanthropic.com 2026-10-04
- 公式の規約・ポリシーGoogle Antigravityantigravity.google 2026-10-04
- 公式の規約・ポリシーCursorcursor.com 2026-10-04
- 公式の規約・ポリシーGitHub Copilotgithub.blog 2026-10-04
- 公式の規約・ポリシーGitHub Copilotgithub.com 2026-10-04
- 公式の規約・ポリシーLovablelovable.dev 2026-10-04
- 公式の規約・ポリシーCodexopenai.com 2026-10-01
- 公式ドキュメント・ヘルプGoogle Antigravityantigravity.google 2026-10-04
- 公式ドキュメント・ヘルプGoogle Antigravityantigravity.google 2026-10-04
- 公式ドキュメント・ヘルプClaude Codecode.claude.com 2026-10-04
- 公式ドキュメント・ヘルプClaude Codecode.claude.com 2026-10-04
- 公式ドキュメント・ヘルプCodexhelp.openai.com 2026-10-01
- 公式ドキュメント・ヘルプCodexhelp.openai.com 2026-10-01
- 公式ドキュメント・ヘルプCodexlearn.chatgpt.com 2026-10-04
- 公式料金Google Antigravityantigravity.google 2026-10-04
- 公式料金Codexchatgpt.com 2026-10-01
- 公式料金Claude Codeclaude.com 2026-10-04
- 公式料金Cursorcursor.com 2026-10-04
- 公式料金GitHub Copilotgithub.com 2026-10-04
- 公式料金Codexlearn.chatgpt.com 2026-10-04
- 公式料金Lovablelovable.dev 2026-10-04
- 公式料金Mistral Vibemistral.ai 2026-10-04
- 公式料金Replitreplit.com 2026-10-04
- 公式発表・公式ページClaude Codeanthropic.com 2026-10-04
- 公式発表・公式ページClaude Codeanthropic.com 2026-10-04
- 公式発表・公式ページGoogle Antigravityblog.google 2026-10-04
- 公式発表・公式ページCursorcursor.com 2026-10-04
- 公式発表・公式ページCursorcursor.com 2026-10-04
- 公式発表・公式ページDeepSeek Harnessdeepseek.com 2026-10-04
- 公式発表・公式ページGitHub Copilotdocs.github.com 2026-10-04
- 公式発表・公式ページDeepSeek Harnessgithub.com 2026-10-04
このページの料金・条件は、すべて各社の公式ページで確認した値と確認日です。料金・仕様は変わるので、利用前に公式ページで確かめてください。当サイトはアフィリエイトリンクを使っていません。誤りを見つけた場合は訂正のご連絡をお願いします。









