ハルシネーション
はるしねーしょん ・ 別表記: hallucination / 幻覚
ハルシネーションとは、生成AIが事実と異なる内容を、もっともらしい文章として出力してしまう現象です。意味・起きやすい場面・確認のポイントを解説します。
ハルシネーションとは
ハルシネーションとは、生成AIが事実と異なる内容を、もっともらしい文章として出力してしまう現象のことです。
簡単に言うと、AIが確かでないことを、あたかも正しい情報のように答えてしまう状態を指します。ハルシネーションは、AIモデルが生成する、誤った、または誤解を招く結果を指す言葉です。
ハルシネーションは何のための言葉か
生成AIは、与えられた文章に続く自然な言葉を予測する仕組みで動いています。このとき、出力した内容が事実かどうかを必ず確認しているわけではありません。
そのため、もっともらしいけれど誤った情報が出てくることがあります。こうした誤りをほかの単なる入力ミスなどと区別して扱うために、ハルシネーションという言葉が使われます。利用者にとっては、AIの回答をそのまま信用してよいかを判断するための重要な観点になります。
ハルシネーションの主な特徴
文章としては自然に見える
誤った内容でも、文法や言い回しは自然なため、一見すると正しい回答のように見えます。
事実確認をしないと気づきにくい
出力だけを読んでも誤りかどうか判断できないことが多く、元の情報源と照らし合わせて初めて気づける場合があります。
質問の内容によって起きやすさが変わる
最新の出来事、細かい数値、専門性の高い事柄など、AIが確かな情報を持ちにくいテーマで起きやすい傾向があります。学習データが不足していたり偏っていたりすることが、原因の一つと説明されています。
どのような場面で使われるのか
- AIが生成した文章を業務の資料や記事に使うとき
- AIに調べものや要約を任せるとき
- AIの回答をそのまま外部に共有する前の確認をするとき
これらの場面では、ハルシネーションが起きていないかを確かめることが、情報の正確さを保つうえで重要になります。
具体的な例
存在しない出典を挙げる
AIが、実在しないWebページへのリンクを作り出してしまう場合があります。文章を要約させた際に、実際には存在しない論文名やURLを、もっともらしい形で回答に含めてしまうことがあります。
元の文章にない情報を加える
ニュース記事を要約させたときに、元の記事には書かれていない内容を付け足したり、情報を作り出したりしてしまうことがあります。
関連する用語
LLM(大規模言語モデル)
大量の文章から学習し、次に続く言葉を予測して文章を作るAIのことです。生成AIの中心となる仕組みで、ハルシネーションはこの予測の過程で起こります。
プロンプト
AIに対して出す指示や質問のことです。「分からないことは分からないと答える」のように求める内容を具体的に伝えると、誤った回答を減らす助けになる場合があります。
RAG(検索拡張生成)
AIが回答する前に、信頼できる資料を検索して参照する仕組みです。外部のデータでモデルの回答を裏づける(グラウンディングする)手法で、ハルシネーションを減らす助けになりうる方法の一つですが、これだけで誤りが完全になくなるわけではありません。
利点と注意点
注意点
- AIの回答は、重要な内容ほど元の情報源で確認する
- 数値・日付・固有名詞は特に誤りが含まれやすいため注意する
- 「確認できない」と断った回答と、断定した回答を区別して扱う
まとめ
ハルシネーションとは、生成AIが事実と異なる内容を、もっともらしく出力してしまう現象です。
主に、AIの回答を資料や記事に使う場面で、その内容を信用してよいかを判断するために使われます。
初心者のうちは、「AIの答えは自然に見えても間違っていることがあるので、重要な内容は必ず確認する」と理解しておけば問題ありません。