2026年7月に出たAIモデル29件まとめ|GPT-5.6・Claude Opus 5・Gemini 3.6 で何が変わったか
この記事の要点
- Claude Opus 5 は難問の正答率が前世代の 21.1%から43.3%へ倍増しました
- Gemini 3.6 Flash は返事の長さが 17%短くなりました。待ち時間もお金も減ります
- GPT-5.6 は3種類まとめて登場。複数のAIを同時に動かす「ultra」が追加されました
- 7月に出た29件のうち 27件が「じっくり考える」機能つき。もう当たり前の装備になりました
- 値段は $0.03 から $10 まで333倍の差。新しいかどうかと値段は関係ありません
2026年7月にAPIへ追加されたモデルは29件でした。
そのうち大きかったのは3つです。OpenAI が GPT-5.6 を3種類まとめて、Anthropic が Claude Opus 5、Google が Gemini 3.6 Flash。 同じ月に主要3社が新しいものを出しました。
何ができるようになったのかを順に見ていきます。
7月に出た3つの大きなモデル
Claude Opus 5(7月24日)|難問の正答率が倍になった
Anthropic の新しい上位モデルです。いちばん目立つのは、難しい問題の正答率が前の世代の2倍になったことでした。
| 前の Opus 4.8 | 今回の Opus 5 | |
|---|---|---|
| 難問(Frontier-Bench v0.1) | 21.1% | 43.3% |
100万トークンの長い文書のどこかに事実を1つ埋めておいて、それを探させる試験では100%正解しています。長い資料を渡しても、見落とさないということです。
もうひとつ、考える深さを5段階から選べます。 簡単な用事は浅く、難しい相談は深く指定できます。深く考えさせるほど時間もお金もかかるので、使い分ける前提の作りです。
「Fast」という速い版もあります。値段は2倍で、速さは約2.5倍。 賢さは同じで、返ってくるのが早いだけです。待たされたくない場面のための選択肢です。
GPT-5.6(7月9日)|3種類が同じ日に出た
OpenAI は1日で6件を発表しました。中身は Sol・Terra・Luna の3種類と、それぞれのPro版です。
| 名前 | 位置 | 得意なこと |
|---|---|---|
| Sol | いちばん上 | プログラム、込み入った推論、自動作業 |
| Terra | まんなか | 前世代のGPT-5.5と同じくらいの実力を、半額で |
| Luna | いちばん下 | 速さと安さ |
Sol・Terra・Luna は世代を表す名前ではありません。「どのくらいの実力か」を表す名前で、今後それぞれが別々に新しくなっていきます。GPT-5.6 の部分が世代です。
APIでできることも増えました。
- 複数のAIを同時に動かせます(ultraモード)。難しい作業を分担させられます
- プログラムを書いて、道具の呼び出し方を自分で制御できます
- 画像を縮小せずにそのまま渡せます。細かい字が読めるようになりました
- 同じ文章を繰り返し使うとき、どこまでを使い回すか指定できます
あわせて ChatGPT Work という仕組みも出ました。質問に答えるのではなく、仕事をまるごと引き受けることを狙ったものです。
Gemini 3.6 Flash(7月21日)|返事が17%短くなった
Google の新しい標準モデルです。性能の数字より目を引いたのは、同じ質問に答えるのに使う文字数が17%減ったことでした。
短くなると、待ち時間が減り、お金も減ります。出力の値段自体も $9.00 から $7.50 へ下がりました。
会議の録音や動画を、そのまま渡せます。 上の3つの中でこれができるのは Gemini だけです。文字起こしを別の道具でやってから渡す、という手間が要りません。
ただしGemini でなければできないわけではありません。 追跡している326モデルのうち、音声を渡せるものは23件、動画は46件あります。音声を渡すだけなら $0.10 のモデルがあり、Gemini 3.6 Flash の15分の1です。
くわしくはGemini 3.6 Flash の解説記事にまとめました。
3社を並べると
| Claude Opus 5 | GPT-5.6 Sol | Gemini 3.6 Flash | |
|---|---|---|---|
| 出た日 | 7月24日 | 7月9日 | 7月21日 |
| 動画を渡せる | できない | できない | できる |
| 音声を渡せる | できない | できない | できる |
| 一度に読める量 | 100万 | 105万 | 105万 |
| 一度に書ける量 | 12.8万 | 12.8万 | 6.5万 |
| 考える深さの段階 | 5段階 | 6段階 | 4段階 |
| 入力 /100万トークン | $5.00 | $5.00 | $1.50 |
| 出力 /100万トークン | $25.00 | $30.00 | $7.50 |
読ませられるものが違います。 動画や音声を扱いたいなら Gemini、それ以外なら3つとも似た使い方ができます。
一度に書ける量も違います。 長い文書を一気に書かせたい場合、Gemini は他の半分です。
「じっくり考える」はもう当たり前になった
7月に出た29件のうち、27件がじっくり考える機能を備えていました。 割合にすると93%です。
追跡している全326モデルで見ると62%なので、新しく出るものほど、この機能が当たり前になっているとわかります。
長い文章を読める機能も同じです。全体では26%ですが、**7月に出たものだけなら62%**でした。
少し前まで「じっくり考えられます」「長い文章を読めます」はモデルの売り文句でした。7月に出たものを見ると、もうほとんどが備えています。できるかどうかで選ぶ時期は終わり、何がどこまでできるかで選ぶ時期になりました。
値段は333倍ちがう
7月に出たモデルの入力の値段です。桁が大きく違うので、対数の目盛で並べています。
いちばん安い $0.03 と、いちばん高い $10 で 333倍の開きがあります。まん中は $0.74 でした。
どれも同じ「2026年7月に出た最新モデル」ですが、かかるお金は300倍以上ちがいます。新しいかどうかは、値段の目安になりません。
入力が長いと値上がりするものがあります
7月に出たうち8件は、渡す文章が長くなると1トークンあたりの値段が上がります。 GPT-5.6 の6件すべてと、Grok 4.5、Qwen3.7 Flash です。
たとえば Qwen3.7 Flash はこうなっています。
| 渡した量 | 入力の値段 /100万トークン |
|---|---|
| 32,000トークン未満 | $0.03 ← 一覧に出る値 |
| 32,000トークン以上 | $0.10 |
| 256,000トークン以上 | $0.20 |
長い文章を渡す使い方だと、一覧の値段の6.7倍になります。「100万トークン読めて $0.03」と読むと、見積もりが大きく狂います。
7月に出た全29モデル
| 出た日 | モデル | 入力 /1M | 出力 /1M | 読める量 | |
|---|---|---|---|---|---|
| 07-02 | Poolside: Laguna XS 2.1 | $0.06 | $0.12 | 262K | 公開 |
| 07-02 | Poolside: Laguna XS 2.1 (free) | 無料 | 無料 | 262K | 公開 |
| 07-06 | Tencent: Hy3 | $0.132 | $0.528 | 262K | 中国・公開 |
| 07-07 | AionLabs: Aion-3.0 | $3 | $6 | 131K | |
| 07-07 | AionLabs: Aion-3.0-Mini | $0.7 | $1.4 | 131K | |
| 07-08 | xAI: Grok 4.5 | $2 | $6 | 500K | 長文で値上がり |
| 07-09 | OpenAI: GPT-5.6 Sol | $5 | $30 | 1.05M | 長文で値上がり |
| 07-09 | OpenAI: GPT-5.6 Sol Pro | $5 | $30 | 1.05M | 長文で値上がり |
| 07-09 | OpenAI: GPT-5.6 Terra | $1 | $6 | 1.05M | 長文で値上がり |
| 07-09 | OpenAI: GPT-5.6 Terra Pro | $1 | $6 | 1.05M | 長文で値上がり |
| 07-09 | OpenAI: GPT-5.6 Luna | $0.1 | $0.6 | 1.05M | 長文で値上がり |
| 07-09 | OpenAI: GPT-5.6 Luna Pro | $0.1 | $0.6 | 1.05M | 長文で値上がり |
| 07-10 | Kwaipilot: KAT-Coder-Pro V2.5 | $0.74 | $2.96 | 256K | 中国 |
| 07-10 | Kwaipilot: KAT-Coder-Air V2.5 | $0.15 | $0.6 | 256K | 中国 |
| 07-16 | Meta: Muse Spark 1.1 | $1.25 | $4.25 | 1.05M | |
| 07-16 | MoonshotAI: Kimi K3 | $3 | $15 | 1.05M | 中国・公開 |
| 07-17 | Auto Router (Beta) | 変動 | 変動 | 2.00M | |
| 07-17 | Thinking Machines: Inkling | $1 | $4.05 | 1.05M | 公開 |
| 07-20 | Meituan: LongCat 2.0 | $0.3 | $1.2 | 1.05M | 中国・公開 |
| 07-21 | Google: Gemini 3.5 Flash Lite | $0.3 | $2.5 | 1.05M | |
| 07-21 | Google: Gemini 3.6 Flash | $1.5 | $7.5 | 1.05M | |
| 07-21 | Poolside: Laguna S 2.1 | $0.09 | $0.18 | 1.05M | 公開 |
| 07-21 | Poolside: Laguna S 2.1 (free) | 無料 | 無料 | 262K | 公開 |
| 07-23 | Ling-3.0-flash (free) | 無料 | 無料 | 262K | |
| 07-24 | Claude Opus 5 | $5 | $25 | 1.00M | |
| 07-24 | Claude Opus 5 (Fast) | $10 | $50 | 1.00M | |
| 07-27 | Qwen: Qwen3.7 Flash | $0.03 | $0.13 | 1.00M | 中国・長文で値上がり |
| 07-30 | Thinking Machines: Inkling Small | $0.5 | $1.2 | 524K | 公開 |
| 07-31 | DeepSeek: DeepSeek V4 Flash 0731 | $0.09 | $0.18 | 1.05M | 中国・公開 |
「公開」は中身(重み)が公開されていて、自分のパソコンやサーバーでも動かせるものです。中国発が8件、公開が10件、無料が3件でした。
次号について
このシリーズは毎月発行します。 8月分は9月初旬に出します。
月の途中で確認したい場合は新着モデル一覧をご覧ください。新しいモデルが出た当日に反映されます。
データについて
- 料金・読める量・機能の有無は OpenRouter の公開API(
/api/v1/models)から、2026-08-03 時点で取得 - ベンチマークの数値は各社の公式発表から。Google / Anthropic / OpenAI
- 「出た日」はモデルがAPIの一覧に現れた日です。各社の公式発表日とは数日ずれることがあります
- 性能は当サイトで測っていません。 ベンチマークの点数と、実際の仕事での使い勝手は別物です
- 掲載している単価は OpenRouter 経由のものです。各社と直接契約した場合の定価とは異なることがあります(GPT-5.6 系で差がありました)
料金は頻繁に変わります。契約前には各社の公式ページでご確認ください。誤りを見つけた場合はお問い合わせからご連絡ください。