私は開発で、Claude Code と Codex を併用しています。
時期によっては、Codex をメインにしていたこともあります。
9月に、両方の新しいモデルが出ました。
Anthropic の Claude Opus 5.5 と、Codex で使える OpenAI の GPT-6 Astra です。
GPT-6 Astra も非常に優秀です。
そのうえで、私はメインを Opus 5.5 にしました。Codex は引き続き併用しています。
理由は2つあります。
- 性能が大きく改善した。 指示どおりに作業が進み、業務ツールの開発には十分すぎるほどです。
- 使用量が減りにくい。 5時間ごとの枠も週の上限も、前よりはっきり余裕があります。
1つ目は体感です。2つ目は、手元のログと公式の料金表で確かめられます。
この記事では、2つ目の根拠を数字でまとめます。
先に結論
- 私のログでは、AIが処理したトークンの 約98%が「すでに読んだものの読み直し」 でした。
- こういう使い方で効くのは、出力の単価よりも 読み直し(キャッシュ読み込み)の単価 です。
- Opus 5.5 はこの単価が Opus 5 の 5分の2(0.50ドル→0.20ドル)に下がりました。
- 同じログに料金表を当てはめると、Opus 5.5 は Opus 5 の 約53% で済みます(試算)。
- GPT-6 Astra は性能が高い一方、単価は Opus 5.5 の約2.5倍です。メインは Opus 5.5 にし、Codex は併用しています。
この記事の数字の出どころ
数字は3種類あるので、分けて書きます。
| 種類 | 中身 |
|---|---|
| 実測 | 私の Claude Code の作業記録(2026年9月23〜27日、Opus 5.5 の4セッション・579回の応答。9月27日時点) |
| 公式 | Anthropic と OpenAI の API 料金表(2026年9月27日に確認) |
| 試算 | 実測のトークン数に公式の単価を掛けた金額。実際の請求ではありません |
用語を2つだけ補います。
- API:ほかのソフトからAIを呼び出して使う方法です。使った量に応じて料金がかかります。
- セッション:AIとの一続きの作業のことです。
定額プランで「減らない」のは、単価だけが理由ではない
私は Claude Code を、月額の定額プラン(サブスクリプション)で使っています。
使用量の減り方が緩やかになった理由は、公式発表から2つ読み取れます。
- 5時間枠の上限そのものが引き上げられた。 Anthropic は Opus 5.5 の公開(2026年9月22日)にあわせて、Pro・Max・Team などのプランで5時間枠の上限を引き上げると発表しています。
- モデルの動かし方が安くなった。 同じ発表で、Opus 5.5 は Opus 5 より少ない計算資源で動き、標準設定の典型的な作業では Opus 5 より40%安くなる、と説明されています。
定額プランの使用量がどう計算されているかは、公開されていません。
なので、私の体感がどちらの理由でどれだけ変わったのかは切り分けられません。
週の上限に余裕が出たことは、5時間枠の引き上げだけでは説明がつきません。 単価の側が効いているのでは、というのが私の推測です。
以下では、確かめられる側、つまり API料金に当てはめた場合 を数字で見ていきます。
開発を任せると、AIの処理量の大半は「読み直し」になる
AIに開発を任せる道具(Claude Code や Codex)は、1回の指示で終わりません。
「ファイルを読む→直す→確かめる」を何十回も繰り返します。
そのたびに、AIはそれまでの会話と読んだファイルをもう一度読み直します。
毎回まっさらに読むと高くつくので、一度読んだ部分は キャッシュ(読んだ内容の一時保存)から安く読み直す仕組みです。
作業記録を数えると、この読み直しが圧倒的でした。
| 種類 | トークン数(Opus 5.5・4セッション) | 割合 |
|---|---|---|
| キャッシュからの読み直し | 2億2,931万 | 98.1% |
| キャッシュへの書き込み(初めて読んだ分) | 372万 | 1.6% |
| AIが書いた出力 | 61万 | 0.3% |
| キャッシュを使わない入力 | 1,170 | ほぼ0% |
トークンは、AIが文章を数える単位です。
Opus 5 を使っていた8月7日〜9月23日の56セッションでも、読み直しの割合は約97%でした。
作業の中身は、どちらも業務ツールの開発と記事づくりです。
モデルが変わっても、開発を任せる使い方は「読み直し中心」になる 傾向がありそうです。
Opus 5.5 で下がったのは、ちょうど「読み直し」の単価
公式の料金表を並べます(100万トークンあたり、米ドル)。
| モデル | 入力 | キャッシュ読み込み | キャッシュ書き込み(1時間) | 出力 |
|---|---|---|---|---|
| Claude Opus 5 | 5.00 | 0.50 | 10.00 | 25.00 |
| Claude Opus 5.5 | 4.00 | 0.20 | 8.00 | 20.00 |
| GPT-6 Astra | 10.00 | 1.00 | 12.50 | 50.00 |
出典:Anthropic の料金表/GPT-6 Astra のモデル情報(OpenAI)
入力と出力は2割安くなっただけです。
ところがキャッシュ読み込みは、入力単価の10分の1から 20分の1 に変わりました。
0.50ドルから0.20ドル、つまり 6割引き です。
読み直しが大半を占める使い方では、この差がそのまま効きます。
同じ4日分を、単価だけ変えて計算すると
実測のトークン数に、各モデルの単価を掛けました。試算です。
キャッシュの書き込みは、1時間保存の単価で計算しています。
| 単価の当てはめ先 | 読み直し | 書き込み | 出力 | 合計 |
|---|---|---|---|---|
| Opus 5 の単価 | 114.7ドル | 37.2ドル | 15.1ドル | 約167ドル |
| Opus 5.5 の単価 | 45.9ドル | 29.8ドル | 12.1ドル | 約88ドル |
Opus 5.5 は Opus 5 の 約53% です。
差のおよそ79ドルのうち、69ドルが読み直しの単価から来ています。
公式の「典型的な作業で40%安い」とも、おおむね同じ方向の結果です。
見出しで目立つ「入力・出力が2割安い」だけを見ると、2割引きに見えます。
実際の使い方に当てはめると、ほぼ半額になります。
単価表は、自分の使い方の内訳を掛けてから読む のが大事です。
GPT-6 Astra と比べる場合の注意
同じトークン数に GPT-6 Astra の単価を掛けると、約306ドルになります。
ただし、これは機械的な計算です。参考程度に留めてください。
- OpenAI と Anthropic では、文章をトークンに区切る方法が違います。同じ作業でもトークン数は変わります。
- 同じ仕事を何回の往復で終えるかも、モデルごとに違います。
言えるのは「単価の水準が約2.5倍」というところまでです。
GPT-6 Astra も、併用する価値は十分ある
誤解のないように書きます。メインを替えたのは、GPT-6 Astra に不満があったからではありません。
OpenAI の発表では、Codex で使う Astra は、会話の区切りをまたいでメモを残す 仕組みを試験的に持っています。
長い作業の途中でも、前に決めた要件やテスト結果を探し直せる、という機能です。
何時間も続く作業を任せる場面では、はっきりした強みになります。
GPT-6 Astra は2026年9月上旬に公開されました。
ChatGPT の Plus・Pro・Business・Enterprise と、API で使えます。
ChatGPT や Codex での利用は、既存のサブスクリプションの枠に含まれると案内されています。
私の使い分けの基準
メインは Opus 5.5 ですが、Codex をやめたわけではありません。
性能がどちらも十分なら、振り分ける基準は 「その作業は、何回読み直すか」 です。
| 作業の形 | 向いている選び方 | 理由 |
|---|---|---|
| 要件を詰めながら、画面や文言を何十回も直す | Opus 5.5 | 読み直しの回数が多く、読み込み単価の差が一番効く |
| 決まった仕様で、まとまった実装を一気に進める | どちらでも。性能と枠の残りで選ぶ | 往復が少なく、単価の差が出にくい |
| 何時間も続く長い作業で、途中の経緯を保ちたい | GPT-6 Astra も候補 | 区切りをまたぐメモの仕組みが効く |
9月26日に公開した 引き継ぎラボ は、まさに1つ目の形でした。
業務の引き継ぎを、ゲーム仕立てで体験できるデモです。
画面と文言を、指示→確認→直しの往復で仕上げています。
Opus 5.5 は、指示に対して作業がうまく進みました。
そのうえで、使用量の減り方が緩やかでした。
性能の改善と使用量の減りにくさ。この2つがそろったことが、メインを Opus 5.5 にした理由です。
これは、業務の自動化で道具を選ぶときの考え方と同じです。
単価の表より先に、自分の業務の「量の内訳」を数える。
内訳が分かれば、どの単価が効くかは自然に決まります。
自分の作業記録で確かめる方法
Claude Code は、会話の記録を手元に残しています(~/.claude/projects/ の中の .jsonl ファイル)。
記録の中の usage という欄に、次の4つが入っています。
cache_read_input_tokens:キャッシュからの読み直しcache_creation_input_tokens:キャッシュへの書き込みoutput_tokens:出力input_tokens:キャッシュを使わない入力
これをモデル名(message.model)ごとに足し上げると、自分の使い方の内訳が出ます。
1つの応答が複数の行に分けて記録され、同じ usage が行ごとに入っている点に注意してください。message.id で重複を除かないと、2倍前後に膨らみます。
ただし、この記録は既定で30日たつと消えます(設定の cleanupPeriodDays で変えられます)。
比べたい期間があれば、早めに集計してください。
よくある質問
Q:Claude Opus 5.5 の料金は?
A:API では100万トークンあたり、入力4ドル・出力20ドル・キャッシュ読み込み0.20ドルです(2026年9月27日時点)。Opus 5 は入力5ドル・出力25ドル・キャッシュ読み込み0.50ドルでした。
Q:Claude Opus 5.5 はいつ公開されましたか?
A:2026年9月22日です。同時に、Pro・Max・Team などのプランで5時間枠の上限が引き上げられました。
Q:Claude Code の定額プランでも、使用量は減りにくくなりますか?
A:私の環境では、5時間枠・週の上限とも減り方が緩やかになりました。5時間枠の引き上げは公式発表があります。定額プランの使用量の計算方法は公開されていないため、単価との関係は推測です。
Q:GPT-6 Astra の料金は?
A:API では100万トークンあたり、入力10ドル・キャッシュ済み入力1ドル・キャッシュ書き込み12.5ドル・出力50ドルです(2026年9月27日時点)。
Q:どちらを選べばいいですか?
A:性能はどちらも十分です。私はメインを Opus 5.5 にし、Codex を併用しています。修正の往復が多い作業ほど、キャッシュ読み込みが安い Opus 5.5 が有利です。長時間の作業を一続きで任せるなら、GPT-6 Astra も候補になります。
おわりに
新しいモデルが出るたびに、性能比較の表が話題になります。
でも実務で効くのは、自分の使い方に単価を当てはめた結果 のほうです。
ママゴトラボでは、業務の自動化も同じ順番で考えます。
まず作業の量と内訳を数え、それから道具を選びます。
「自社の業務のどこを自動化すべきか整理したい」「AIの使いどころを決めたい」というご相談を承っています。
業務の流れを整理して「何を作るか」を決めるところ(要件定義)から、運用後の保守まで対応します。
- ホームページ:https://mamagotolab.com
- ご依頼(クラウドワークス):https://crowdworks.jp/public/employees/6942778
関連記事
- Claude CodeがAGENTS.mdに対応──CLAUDE.mdとの違いと、Codexと指示ファイルを共有する方法
- 2.8兆パラメータのAIが出た。でも現場が変わらない理由は「業務の切り分け」にある
ママゴトラボは、業務の自動化ツールを「何を作るか」を決めるところ(要件定義)から設計してつくる開発ラボです。
属人化した業務の見える化から、自動化ツールの開発・保守まで承っています。
👉 ママゴトラボ|業務自動化の開発ラボ
その業務、自動化できるかもしれません
「毎回手でやっている作業」を、「何を作るか」を決めるところ(要件定義)から見直してツールにします。GAS・Python・VBAでの自動化のご相談を承っています。
クラウドワークスで相談する →