AIの「トークン」という言葉は、料金ページや利用状況の画面で目にします。文字数のことだろうと思って読み進めると計算が合わない、という状態のままAIを使っている方は多いところです。
先に書くと、トークンは文字数ではありません。「1トークンが何文字にあたるか」は、AIの提供元によっても、使う言語によっても変わります。そのため「文字数×単価」で料金を読もうとすると、どこかで必ずずれます。
この記事では、トークンの定義から、料金がどの場所で増えるのか、そして2026年8月17日に適用が始まった「使う時間帯で単価が変わる」という料金の形までを順に整理します。無料でアプリを使っているだけの方にも関わる話は、独立した見出しで扱います。
- トークンは文字数ではなく「AIが文章を切り分ける単位」。料金は「入力」「出力」「キャッシュが効いたか」の3か所で決まり、そこに「使う時間帯」という4つ目が加わり始めました。
- 出力の単価は入力より高い(DeepSeek公式の単価表では約3倍・2026年9月1日時点)
- 同じ入力でも、キャッシュが使われるかどうかで単価に約31倍の開きがある
- アプリを無料で使うだけなら請求は来ないが、「入力と出力の合計上限」という形でトークンは関係してくる
AIのトークンとは?文字数との違いを整理
トークンは、AIが文章を処理するときに使う最小の単位です。人は読むときに「文字」や「単語」で区切りますが、AIは受け取った文章を独自のルールで細かく切り分け、その一つひとつをトークンとして扱います。
GoogleのGemini API公式ドキュメント(2026年9月1日確認)には、1トークンはおよそ4文字に相当し、100トークンで英語の約60〜80単語にあたる、と書かれています。
切り分け方についても「長い単語は複数のトークンに分割される」と説明されており、1文字だけでトークンになることもあれば、短い単語がまるごと1トークンになることもあります。
一方、Anthropicの公式用語集(同じく2026年9月1日確認)では、Claudeでは1トークンが英語の約3.5文字に相当し、正確な数は使用言語によって変わる、とされています。同じ「1トークンは何文字か」という問いに、公式同士で違う数字が並んでいます。
これは矛盾ではありません。文章をどう切り分けるかのルールは提供元ごとに違うため、数字が一致しないほうが自然です。押さえるべきなのは「◯文字」という一つの数字ではなく、トークン数は文字数から直接は決まらない、という点です。
よくある疑問:では、文字数を数えても意味がないのでしょうか。
長さのおおよその目安としては使えます。ただし請求額や上限を正確に読む道具にはなりません。3つの数え方の違いを並べると、役割の差がはっきりします。
| 数え方 | 何を基準に区切るか | 料金・上限との関係 |
|---|---|---|
| 文字数 | 1文字ずつ | 人が長さを測るのに便利。料金の単位ではない |
| 単語数 | 単語の切れ目 | 英語圏でよく使われる目安。日本語では区切りが曖昧 |
| トークン数 | 提供元ごとのルール | 料金と上限は、こちらの数で決まる |
Gemini API公式ドキュメントには、入力も出力も、テキスト以外のものを含めてトークンに分解される、とも書かれています。
DeepSeekの料金ページにも、画像は寸法に応じてトークンへ変換され、テキストのトークンとあわせて入力として課金されるという注記があります(2026年9月1日確認)。画像を貼っただけでもトークンは増えます。
これも文字数の感覚とずれる理由の一つです。
AIの料金はどこで増える?入力・出力・キャッシュの3か所
次の表は、DeepSeekの公式API料金を2026年9月1日に確認したものです。オフピーク時間帯・100万トークン当たりの米ドル単価です。ピーク時は別単価になるため、後の時間帯表とあわせて読んでください。
| モデル | 入力:キャッシュヒット | 入力:キャッシュミス | 出力 |
|---|---|---|---|
| deepseek-v4-flash | $0.007 | $0.22 | $0.66 |
| deepseek-v4-pro | $0.022 | $0.66 | $1.98 |
キャッシュ(=前に送った内容の処理結果を使い回せる仕組み)が効いた場合を「キャッシュヒット」、効かなかった場合を「キャッシュミス」と呼びます。この表からは、料金が増える場所が3つ読み取れます。
- 出力は入力より高い:v4-flashは入力(キャッシュミス)$0.22に対して出力$0.66で約3倍。v4-proでも$0.66に対して$1.98で約3倍です
- 同じ入力でもキャッシュ次第で桁が変わる:v4-flashは$0.007と$0.22で約31倍、v4-proは$0.022と$0.66で30倍の開きがあります
- モデルのグレードでも変わる:v4-flashとv4-proは、どの項目でもおよそ3倍の差です
ここで比較したモデルでは、出力の単価が入力より高く設定されています。
GoogleのGemini API公式料金ページ(2026年9月1日確認)でも、Gemini 3.5 Flashは入力$1.50に対して出力$9.00、Gemini 3.5 Flash-Liteは入力$0.30に対して出力$2.50です。
個別のサービスごとの料金の見方は、Gemini 3.6 Flashの解説記事でも扱っています。
さらにGemini 2.5 Proには、送るプロンプトが20万トークン以下か、それを超えるかで単価の区分そのものが変わるという設定もあります(20万トークン以下は入力$1.25・出力$10.00、超えると入力$2.50・出力$15.00)。
長く書くとトークンが増えるだけでなく、単価まで上がる場合があります。

要点は、AIに長く答えさせるほど費用が増えるということです。まずここだけ押さえてください。
2026年8月17日から適用|使う時間帯で料金が変わる仕組み
ここまでは「何を送るか」で料金が決まる話でした。2026年8月17日、そこに「いつ使うか」という条件が加わった例が出ています。
DeepSeekの公式発表は、新料金を2026年8月16日16:00 UTC、日本時間では8月17日午前1時から適用すると案内しています。現在の料金はピーク/オフピークに分かれるため、比較するときは同じ時間帯の単価をそろえてください。
公式ページのピーク時間帯は月〜金曜のUTC 01:00〜04:00と06:00〜10:00です。日本時間では同じ曜日の10:00〜13:00と15:00〜19:00にあたります。それ以外の時間と土日はオフピークです。
祝日を別扱いする記載は確認できないため、曜日とUTCの条件で判断してください(2026年9月1日確認)。
次の表は、いずれも100万トークンあたりの米ドル表記です。ピーク時の単価はオフピークのちょうど2倍で、公式ページにも「オフピークはピークの半額」と明記されています。同じ質問を同じモデルに投げても、時間帯によって支払いが倍になります。
| 項目 | モデル | オフピーク | ピーク |
|---|---|---|---|
| 入力:キャッシュヒット | v4-flash | $0.007 | $0.014 |
| 入力:キャッシュヒット | v4-pro | $0.022 | $0.044 |
| 入力:キャッシュミス | v4-flash | $0.22 | $0.44 |
| 入力:キャッシュミス | v4-pro | $0.66 | $1.32 |
| 出力 | v4-flash | $0.66 | $1.32 |
| 出力 | v4-pro | $1.98 | $3.96 |
注意したいのは、これがDeepSeekという1社のAPI料金の改定である点です。AIサービス全体が同じ方向へ進むと決まったわけではなく、アプリやWeb版の料金が変わったという話でもありません。ただし、使う時間帯によって単価が変わる付け方が現れたのは事実です。
同じ公式ページには、価格は変わることがあり、DeepSeekは調整する権利を留保する、という趣旨の記載もあります。料金は確認した日付とセットで見てください。
日本語はトークンを多く使う?よく見る倍率の数字をどう扱うか
「日本語は英語よりトークンを多く消費する」という説明を見かけます。この点について公式ドキュメントが明記しているのは、1トークンあたりの文字数は使う言語によって変わることがある、というところまでです(Anthropic公式用語集・2026年9月1日確認)。
一方、ネット上で見かける倍率は情報源によって幅があります。2〜4倍と書かれていることもあれば、1.5〜3倍、約3倍と書かれていることもあり、どれを採るべきか判断できません。
この記事では、その倍率を示しません。今回確認できた公式の資料に、日本語について具体的な倍率を明記したものがなかったためです。
代わりに押さえておきたいのは、次の3点です。
- 日本語はトークン数が増えやすい傾向がある、と言われている
- ただし何倍になるかは、提供元の切り分け方と文章の中身によって変わる
- したがって料金は「文字数×単価」では読めない
正確な数が必要なときは、提供元が用意しているトークン数の確認手段を使ってください。実際に自分が送る文章で数えたほうが、感覚で見積もるより確実です。



倍率を覚えるより、同じ内容でも書き方でトークン数が変わると知っておくほうが実用的です。
無料で使っているだけなら関係ない?コンテキストウィンドウの話
よくある疑問:アプリを無料で使っているだけなら、トークンは気にしなくてよいのでしょうか。
請求という意味では、そのとおりです。ここまでの単価はAPIを使う場合の料金で、アプリやWebの無料プランを使うだけなら、トークンごとの請求は発生しません。無料で使える生成AIの選び方を押さえておけば、費用をかけずに日常の用途はこなせます。
それでもトークンは関係します。理由はコンテキストウィンドウ(=1回のやり取りで扱える入力と出力の合計上限)です。Gemini API公式ドキュメントには、モデルごとに扱えるトークン数の上限があり、コンテキストウィンドウは入力と出力を合わせた上限を定める、と書かれています。
Anthropicの用語集では、これを文章を作るときにさかのぼって参照できる文章の量、つまりモデルの作業用の記憶と説明しています。そのうえで、小さいと長いプロンプトを扱ったり長い会話でつじつまを保ったりする力が制限されることがある、とも書かれています。
長い会話で前半を踏まえなくなる理由の一つがコンテキスト上限です。ただしアプリ側の履歴の要約・省略やモデルの特性も影響するため、すべての見落としが上限だけで説明できるわけではありません。APIでは入力上限・出力上限をモデルごとに確認します。
Googleの料金ページが示すデータ利用の区分はGemini APIの無料枠/有料枠に関するものです。一般向けGeminiアプリや他社サービスの全プランにそのまま当てはめることはできません。機密情報や個人情報を送る前に、利用する製品・契約のデータ利用条件を確認してください。
有料という理由だけで、あらゆるデータを送ってよいわけではありません。勤務先の規則、送信できる情報の範囲、保存期間、管理者の設定もあわせて確認してください。
料金を抑える方法と、課金そのものを避ける選択肢
ここまでの単価表から導ける工夫を5つ整理します。特別な技術ではなく、料金の仕組みから自然に出てくる内容です。
- 長い返事を求めない:出力の単価は入力の約3倍です。「詳しく全部書いて」より「箇条書きで3点」のほうが費用は抑えられます
- 同じ前提文は使い回す形にする:キャッシュが使われると入力側が大きく下がります(ヒットとミスで約30倍の差)
- 軽い作業に重いモデルを使わない:同じ提供元でも、グレードの違いで約3倍の差があります
- 使う時間帯も条件になり得る:DeepSeekのように、時間帯で単価が変わる料金体系が登場しました
- 1本の会話を延々と続けない:コンテキストウィンドウは入力と出力の合計上限です。会話が長くなるほど、毎回さかのぼって送り直す分が増えます
料金の話そのものを避ける選択肢もあります。公開されているモデルを自分のPCで動かす方法です。この場合、トークンごとの請求は発生しません。
ローカルで動かす場合は、モデルのライセンス・ファイル容量・必要RAM・対応する実行ソフトを確認します。GPUで処理するならVRAMも関わりますが、CPU実行やCPUとGPUの併用に対応する実行ソフトもあります。
モデルと実行方法を先に決める順番で、GPUだけが必須というわけではありません。考え方はローカルLLMに必要なVRAMとGPUの選び方と、利用するモデルの公式資料をあわせて確認してください。



まず動かしたいモデルと実行ソフトを決め、RAM・VRAM・OSの対応を確認してください。ローカル実行では外部APIへのトークン課金を避けられる一方、PC代・電気代・設定や保守の手間はかかります。
\AIを自宅で動かすならGPU搭載機/
まとめ
最後に、この記事の要点を整理します。
- トークンは文字数ではなく、AIが文章を切り分ける単位。1トークンが何文字かは提供元と言語で変わる
- 料金が増える場所は「入力」「出力」「キャッシュが効いたか」の3か所。出力の単価は入力より高い
- 2026年8月17日から、DeepSeekでは使う時間帯によって単価が2倍になる料金体系が適用された
- 無料でアプリを使うだけなら請求は来ないが、入力と出力の合計上限という形でトークンは関係する
- 課金そのものを避けるなら、自分のPCでモデルを動かす方法もある。判断材料はモデルの要件・RAM・VRAM・対応ソフト
料金は変わります。DeepSeekの公式ページにも価格を調整することがあると明記されており、実際に2026年8月17日にその改定が適用されました。単価を確認するときは、提供元の公式料金ページでその日の表示を見てください。
この記事の数字は、すべて2026年9月1日時点で各社の公式ページを再確認したものです。
仕組みが分かれば、AIの料金は見積もれます。長く答えさせない、同じ前提は使い回す、軽い作業に重いモデルを使わない。この3つを意識するだけでも、支払いの見通しは立てられます。
- トークンは文字数と同じですか?
-
違います。トークンはAIが文章を切り分ける単位で、切り分け方のルールは提供元ごとに異なります。1トークンが何文字にあたるかについて、Googleの公式ドキュメントは約4文字、Anthropicの公式用語集は英語の約3.5文字と、別々の数字を示しています(いずれも2026年9月1日確認)。
- 無料でアプリを使うだけでもトークンは関係ありますか?
-
通常の無料アプリ利用では、APIのトークン従量料金と同じ請求は生じません。ただし入力・出力の上限やアプリ独自の利用制限はあります。長い会話での見落としには、コンテキスト上限以外に履歴の要約やモデルの特性も関係します。
- 入力と出力ではどちらの料金が高いですか?
-
出力です。
DeepSeek公式の単価表(2026年9月1日確認)では、100万トークンあたりでdeepseek-v4-flashが入力(キャッシュミス)$0.22に対して出力$0.66、deepseek-v4-proが$0.66に対して$1.98と、いずれも約3倍でした。
長い返答を求めるほど費用は増えます。
- 画像を送るとトークンは増えますか?
-
増えます。Gemini API公式ドキュメントには、テキスト以外のものもトークンに分解されると書かれています。DeepSeekの料金ページにも、画像は寸法に応じてトークンへ変換され、テキストのトークンとあわせて入力として課金されるという注記があります(2026年9月1日確認)。
- 料金はどこで確認すればいいですか?
-
各提供元の公式料金ページです。DeepSeekの公式ページには価格を調整することがあると明記されており、実際に2026年8月17日午前1時(日本時間)から新料金が適用されました。単価は確認した日付とセットで見てください。
関連記事




確認日:2026年9月1日。
確認元:DeepSeek現行API料金、DeepSeek V4-Pro正式提供・料金改定告知、Geminiトークン数の公式説明、Gemini API公式料金、Claude公式用語集、llama.cpp公式 CPU・GPU実行対応。
料金・提供状況は変更されるため、利用前に公式案内を確認してください。









