一言で
ハルシネーションは、文章などを作る AI が、もっともらしく、自信を持った形で、事実と違う内容を出してしまうことです。
このページで分かること
- ハルシネーションが何を指すか(出典ごとの説明)
- なぜ起きるのか(公的機関の説明)
- 呼び方が複数あること(confabulation など)と、その理由
先に知っておく言葉
- 生成AI:文章や画像などを作り出す AI(→ 別ページ)
- 大規模言語モデル:大量の文章で学習した、文章を読み書きするモデル(→ 別ページ)
- トークン:AI が文章を区切って扱う単位(→ 別ページ「トークン」)
出典ごとの説明
- NIST(米国の国立標準技術研究所):生成AI のリスクをまとめた文書(NIST AI 600-1、2024年7月)で、この現象を「confabulation(作話)」と呼んでいる。自信を持って示された、誤った・偽りの内容を作り出すことで、使う人が誤解したりだまされたりしうるもの、としている。指示や入力と食い違う出力や、同じ流れの中で前に言ったことと矛盾する出力も含む、と説明している
- Google の機械学習の用語集:生成AI のモデルが、現実の世界について述べているかのように、もっともらしいが事実と違う出力を作ること、としている。例として、オバマ元大統領が1865年に亡くなったと言うモデルを挙げている
- 文部科学省の生成AI のガイドライン(Ver.2.0、2024年12月26日):誤った出力(ハルシネーション)は、モデルの性質上、完全に防ぐのはきわめて難しいとされている、と書いている
なぜ起きるのか
NIST の文書は、こう説明しています。
- 生成AI のモデルは、学習したデータの統計的な傾向に近い出力を作るように作られている。たとえば大規模言語モデルは、文の中の次のトークンや単語を予測する
- この予測は、事実として正しく、つじつまの合った出力を作ることもあるが、事実と違う出力や、中で矛盾した出力を作ることもある
- そのため、ハルシネーションは生成モデルの作りから自然に起きるもの、としている
- 特に、自由に長く答えさせる指示や、その分野の専門の知識が要る場面で問題になりやすい、としている
何が困るのか
NIST の文書は、返事が自信を持った形で出てくるため、使う人が誤った内容を信じて、それにもとづいて動いたり広めたりしてしまうことをリスクとしています。例として、医療で患者の記録の要約が誤っていると、医師の診断や治療の判断を誤らせうることを挙げています。
呼び方が複数ある理由
「ハルシネーション(幻覚)」は広く使われている呼び方ですが、NIST の文書は「confabulation」という言葉を使っています。NIST によると、「hallucination」「fabrication」という言葉は生成AI を人のように見立てている、という指摘があり、人でないものに人の性質を当てはめること自体が、生成AI にまつわるリスクの1つだからです。
抑える方法として挙がっているもの
文部科学省のガイドラインは、誤った答えを抑える技術の例として、検索拡張生成(RAG。外の情報を探してから答えさせる仕組み → 別ページ)を挙げています。ただし同じ文書は、完全に防ぐのはきわめて難しいとしています。
関連する言葉
- 生成AI・大規模言語モデル・RAG・ベンチマークと評価(→ この欄の別ページ)
出典
- NIST「NIST AI 600-1:Artificial Intelligence Risk Management Framework: Generative Artificial Intelligence Profile」2024年7月 doi.org ↗
- Google for Developers「Machine Learning Glossary」の hallucination の項 developers.google.com ↗
- 文部科学省 初等中等教育局「初等中等教育段階における生成AIの利活用に関するガイドライン(Ver.2.0)」2024年12月26日 mext.go.jp ↗
確認メモ:2026年10月1日に、上の3つの出典の原文を開いて確かめました。NIST の文書は、2.2節「Confabulation」と、リスクの一覧・脚注の該当部分を読みました。文部科学省のガイドラインは、生成AI のリスクと技術的な対策の段落を読みました。「作話」は confabulation のふつうの訳語を添えたものです。AIログのニュースでは、この言葉はまだ出てきていないため、「ニュースでの出方」の節は置いていません。対策の具体的な手順(指示の書き方など)は、確かめた出典に共通して書かれていなかったため載せていません。国の文書は公共データ利用規約にもとづき、内容を言い換えて使っています(出典:文部科学省「初等中等教育段階における生成AIの利活用に関するガイドライン(Ver.2.0)」を加工して作成)。