事務の仕事でAIに投げる文章は、思っているより短い。議事録1本、請求書1枚、問い合わせメール1通。この量なら、いちばん高いモデルを選んでも月の支払いは数百円で収まる。
実際に計算してみたら、そうなった。以下の単価は、3社の公式の料金ページを2026年9月20日に開いて写したものだ。価格はドル表記で、100万トークンあたりの金額になっている。
3社の単価を並べる
| モデル | 入力 | 出力 | キャッシュ読み取り |
|---|---|---|---|
| Claude Fable 5.1 | 10.00 | 50.00 | 0.25 |
| Claude Opus 5 | 5.00 | 25.00 | 0.50 |
| Claude Sonnet 5 | 2.00 | 10.00 | 0.20 |
| Claude Haiku 4.5 | 1.00 | 5.00 | 0.10 |
| GPT-6 Astra | 10.00 | 50.00 | 1.00 |
| GPT-5.6 Terra | 2.00 | 12.00 | 0.20 |
| GPT-5.6 Luna | 0.20 | 1.20 | 0.02 |
| Gemini 3.8 Flash | 0.75 | 3.75 | 記載を確認していない |
Gemini 3.8 Flashの0.75ドルと3.75ドルには期限がある。公式ページには「2026年12月31日まで。2027年1月1日から1.50ドル、7.50ドル」と書かれている。年明けに倍になる。GPT-5.6 Solも「少なくとも2026年11月21日まで」という条件つきの価格で、こちらは入力4.00ドル、出力20.00ドルだ。
目に付くのは、出力が入力の5倍前後という点だ。どのモデルでもこの比率は変わらない。文章を書かせる仕事と、読んで判定させる仕事で、効いてくる単価が違うということになる。
出力が高いのは、1つずつ作っているから
入力の文章は、モデルがまとめて読み込める。並列に処理できるので1トークンあたりの計算量が少ない。
出力は違う。1トークン出すたびに、そこまでの全体を見て次の1トークンを決める。100トークンの返事なら100回この処理が回る。だから出力のほうが高い。
キャッシュ読み取りという列があるのは、同じ前置きを何度も送る使い方への割引だ。社内規程を毎回添付して質問する、といった場合、2回目以降は前置きのぶんが安くなる。Claude Sonnet 5なら入力2.00ドルが0.20ドル、10分の1になる。
議事録20本で月いくらか
1本の会議を入力8,000トークン、返ってくる要約を出力1,500トークンとする。月に20本。入力の合計は16万トークン、出力の合計は3万トークンだ。
| モデル | 月額(ドル) | 1ドル150円として |
|---|---|---|
| Gemini 3.8 Flash | 0.23 | 約35円 |
| Claude Haiku 4.5 | 0.31 | 約47円 |
| Claude Sonnet 5 | 0.62 | 約93円 |
| GPT-5.6 Terra | 0.68 | 約102円 |
| Claude Fable 5.1 | 3.10 | 約465円 |
| GPT-6 Astra | 3.10 | 約465円 |
為替は1ドル150円と置いた。当日のレートは確認していないので、円の欄は目安として見てほしい。
請求書の仕分けも計算した。1件を入力1,200トークン、出力80トークンとして月300件。入力36万トークン、出力2.4万トークンになる。いちばん安いGPT-5.6 Lunaで0.10ドル、Claude Haiku 4.5で0.48ドル、GPT-6 Astraで4.80ドル。最高級のモデルを使っても月720円ほどだ。
この桁を見て決まることがある。事務の量では、料金でモデルを選ぶ意味がほとんどない。月に数百円の差なら、間違いが少ないほうを選んだほうが得になる。仕分けを1件間違えて後から直す手間のほうが、はるかに高くつく。
用途で見る単価が変わる
| 仕事の種類 | トークンの比率 | 見るべき単価 |
|---|---|---|
| 議事録の要約、案内文の下書き | 出力が多い | 出力の単価 |
| 仕分け、抽出、可否の判定 | 入力が多く出力は短い | 入力の単価 |
| 同じ規程や手順書を毎回添付する | 前置きが繰り返される | キャッシュ読み取りの単価 |
判定の仕事なら、出力は数十トークンしかない。出力単価が5倍でも、金額にはほとんど響かない。逆に議事録のように長い文章を作らせるなら、出力単価がそのまま効く。
判定だけを速く安く返す専用のモデルも出てきた。文章を返さないかわりに、選択肢と確率だけを返す。その仕組みは文章を書かないAIのJevに書いた。
読み違えやすいところ
期限つきの価格をそのまま年間の見積もりに使うと外れる。Gemini 3.8 Flashの入力は2027年1月1日から倍になると公式ページに書かれている。12か月分を0.75ドルで計算した表を稟議に出すと、年明けから実際の請求が合わなくなる。期限のある価格は、期限の日付を表の脚注に書いておく。
もう1つは、月額プランとAPIの混同だ。Claudeの個人向けプランは月20ドル(年払いなら月17ドル相当)で、ブラウザの画面から使う。上で計算したAPIの料金とは別の契約になる。事務の量だけならAPIのほうが桁違いに安いが、APIは呼び出す仕組みを自分で用意しなければならない。画面に貼り付けて使うだけなら、プランのほうが手間がかからない。プランの上限と使い分けはClaudeの料金と上限の記事に書いた。
3つ目は、トークン数の見積もりだ。日本語は英語より多くのトークンを使う。何倍になるかはモデルごとのトークナイザで変わり、私は数えていないので倍率は書かない。見積もりを出すときは、実際に1本流して請求額を見てから月数を掛けるほうが確実だ。
急がない仕事は半額になる
請求書の仕分けも、議事録の要約も、10秒で返ってくる必要はない。夜にまとめて流して、朝に結果を見れば足りる。
Anthropicの公式ドキュメントには、まとめて投げる仕組み(Message Batches API)について「費用を50%削減し、ほとんどのバッチは1時間以内に完了する」と書かれている。1回に出せるのは10万件または256MBまで。24時間で完了しなかった分は期限切れになる。上の請求書300件の例なら、Claude Haiku 4.5の0.48ドルが0.24ドルになる。
Geminiには無料の枠もある。公式の料金ページでは、Gemini 3.8 Flashの無料枠は入力も出力も「Free of charge」で、そのかわり送った内容が製品の改善に使われると明記されている。社外に出せない書類を流す場所ではない。試すだけなら使えるが、業務の書類は有料の枠に置く。
見積もりの出し方
単価の表から先に計算すると、たいてい外れる。トークン数の見積もりが合わないからだ。順番を逆にする。
1本だけ実際に流して、管理画面で請求額を見る。その1本の金額に、月の件数を掛ける。これで済む。議事録なら1本、仕分けなら10件ほど流せば、1件あたりの金額が出る。
このとき、いちばん高いモデルといちばん安いモデルの両方で同じものを流しておく。金額の差と、結果の差が同時に見える。事務の量なら金額の差は月数百円なので、結果の差が少しでもあれば高いほうを選ぶことになる。
安いモデルを選んで損をする境目
料金差より、間違いを直す時間のほうが高くつくことがある。仮に請求書300件で、安いモデルの誤りが5%(15件)、高いモデルが1%(3件)だとする。1件直すのに3分なら、45分と9分で36分の差だ。人件費を時給1,500円とすると900円になる。
上で計算した料金差は、Haiku 4.5とGPT-6 Astraで月4.32ドル、1ドル150円として648円だった。誤りの差が4%あるなら、高いモデルを使ったほうが安い計算になる。
誤り率の5%と1%は、説明のために置いた仮の数字だ。自分の書類で50件試して、実際の誤り率を数えてから当てはめてほしい。数えるのは1回でいい。1回数えれば、その後は料金表を見ずに決められる。
どれを選ぶか
判定や仕分けが中心なら、安いモデルから試す。Gemini 3.8 FlashかClaude Haiku 4.5で50件流して、手で答え合わせをする。間違いが許せる範囲なら、そのまま使えばいい。
文章を作らせるなら、出力単価の高いモデルを選ぶ価値がある。議事録20本で月465円と月93円の差は、月に372円だ。この差で要約の質が上がるなら、高いほうを選んだほうが安い。
社内の規程や手順書を毎回添付する使い方をするなら、キャッシュ読み取りの単価を見る。Claude Fable 5.1は入力10.00ドルに対してキャッシュ読み取りが0.25ドルで、40分の1になる。前置きが長い使い方ほど、この割引が効く。
出典(すべて2026年9月20日確認): Anthropicの料金ページ、Anthropicの公式ドキュメント「Batch processing」、OpenAIのAPI料金ページ、Google「Gemini API pricing」。月額の計算は私が上の単価で行ったもので、実際の請求書と突き合わせた数字ではない。



