AI Log

AIの基本 / ニュースに出る言葉

速さ(返事までの時間・1秒あたりのトークン):「書き出すまで」と「書く速さ」は別の物差し

出典を確かめた日 2026年10月1日(木) / 約7分で読めます

一言で

AI の返事の速さは、指示を送ってから返事が来るまでの時間(レイテンシ)や、最初のトークンが出てくるまでの時間(TTFT)、1秒あたりに処理するトークンの数などで表されます。どれを測っているかで、同じ「速い」でも意味が変わります。

このページで分かること

先に知っておく言葉

速さを表す言葉

速さが何で変わるか

待つ時間を短くする工夫(ストリーミング)

両社とも、ストリーミングを挙げています。Anthropic は、使う人が感じる反応の速さが大きく良くなりうる、としています。OpenAI は、待つ時間を1秒以下にできる一番効く方法としたうえで、使う人が読み終えるのが早くなるので、アプリと人を合わせて見れば全体の時間も本当に縮む、と説明しています。

速さを上げる有料の段

国の文書での扱い

デジタル庁の、政府で生成AI を調達して使うときのガイドライン(DS-920、2026年6月12日)は、生成AI の仕組みを企画する担当が、使い始める前の準備として、実際に使う仕組みの目的や使い方を、モデル上の制約なども含めて使う人に知らせることを挙げています。その例の1つに、プロンプトのトークンの上限などと並んで「応答速度」が入っています。

ニュースでの出方

関連する言葉

出典

  1. デジタル庁「DS-920 行政の進化と革新のための生成AIの調達・利活用に係るガイドライン」6.3.3 2026年6月12日 digital.go.jp ↗
  2. Anthropic「Glossary」の Latency・TTFT の項 platform.claude.com ↗
  3. Anthropic「Reducing latency」 platform.claude.com ↗
  4. Anthropic「Fast mode (research preview)」 platform.claude.com ↗
  5. OpenAI「Latency optimization」 developers.openai.com ↗
  6. OpenAI「Ultrafast mode」 developers.openai.com ↗

確認メモ:2026年10月1日に、上の出典を開いて確かめました。デジタル庁のガイドラインは PDF から文字を取り出し、6.3.3 の、使う人に知らせる内容の例の部分を読みました。Anthropic は、用語集の Latency と TTFT の項、レイテンシを減らす手引き、Fast mode の説明を読みました。OpenAI は、レイテンシの手引きの前半(7つの考え方)と、Ultrafast の説明を読みました。出典ごとに測り方の言葉が違い、Anthropic の用語集は返事を受け取るまでの遅れと TTFT、手引きは基準のレイテンシと TTFT、OpenAI の手引きは1分・1秒あたりのトークンで説明しているため、それぞれ出典の名前を付けて並べました。速さの具体的な数字(どのモデルが1秒に何トークンか)は、各社の公式の説明に共通した一覧が無いため、ニュースの記事に出た数字だけを挙げています。OpenAI の手引きにある、速さを上げるほかの方法(指示をまとめる・並べて動かす・言語モデルを使わない方法を選ぶ等)は、この言葉の説明から外れるため載せていません。「ストリーミング」の言い換えは Anthropic の手引きの説明をもとに、「API」「モデル」の言い換えはふつうの意味を一言で添えたものです。国の文書は公共データ利用規約にもとづき、内容を言い換えて使っています(出典:デジタル庁「DS-920 行政の進化と革新のための生成AIの調達・利活用に係るガイドライン」を加工して作成)。