自己一貫性は、同じ問題に対して複数の推論パスを生成し、最も多数派の回答を採用する技法よ。
多数決で決めるということですか?
近いわね。
例えば数学の問題を5回解かせて、3回同じ答えが出たらそれを採用するの。
1回だけの回答よりも信頼性が大幅に向上するわ。
AIも間違えることがあるから、何回もやって確認するってことか!
そう。
特にChain-of-Thoughtと組み合わせると効果的。
異なる推論過程をたどっても同じ答えに到達するなら、その答えの信頼性は高いと言えるの。
テストで自信がないときに、何回も計算し直すのと同じですねぇ…!
まさに。
人間の検算と同じ発想よ、ましろちゃん。
ちょっと待って、5回聞いたらトークンも5倍使うってこと?
そうよ。
だから正確さが特に重要なタスクで使うの。
コストと精度のトレードオフを考えて、日常的な質問には向かないわ。
補足すると、自己一貫性は2022年にGoogleが提唱し、数学ベンチマークで精度を大きく向上させた技法ですね。
さすがつむぎさん、よく知っているわね。
論文ではGSM8Kという数学問題データセットで、通常のCoT単体より10〜15%精度向上を報告しているの。
うそっ!?
それは効果絶大じゃん!
ただし文章要約や創作には向かないの。
正解が1つに定まるタスク=『数学・論理・分類』で威力を発揮する技法よ。
創作は『正解』がないからですかぁ?
その通り、ましろちゃん。
創作で多数決すると、面白みが失われてしまうこともあるの。
使いどころの見極めがプロンプトエンジニアリングの腕の見せ所ね。
適材適所、ということですね。
人間も、自信がない問題は何回も解いて確認しますよねぇ…!
その感覚よ、ましろちゃん。
『確信度を上げる』ための手法と思えば分かりやすいわね。
ちなみに最近のo1のような推論モデルは内部で自己一貫性の仕組みを自動的に使っていて、
ユーザーは意識しなくても高精度の回答を得られるようになっているの。
AIがどんどん賢くなって、あたしたちも楽になるってことか!
楽になる反面、『AIの答えを鵜呑みにする』危険性も増えているの。
自分でも論理的に考える力は、これからますます重要になるわ。
技術の進化と人間の学びは、両輪で進めるべき、ということですね。
ましろも、AIがこんなに進化しても、自分で考える力は大切にしたいですぅ…!
その気持ち、素晴らしいわ、ましろちゃん。
AIが賢くなるほど、人間の『問いを立てる力』『判断する力』『倫理観』の価値は相対的に上がっているの。
AIに『考えさせる』ためにも、人間が賢く問いかける必要があるってことだね!
完璧な理解よ、ジャスミンちゃん。
プロンプトエンジニアリングは、結局『良い問いを立てる技術』なの。
確認クイズ
自己一貫性(Self-Consistency)プロンプティングの特徴はどれか?
- 1回の回答で即座に確定する
- 複数の推論パスから多数派の回答を採用する
- AIの学習データを増やす
- プロンプトを短縮する技法
こたえを見る
正解: 2. 複数の推論パスから多数派の回答を採用する
自己一貫性は複数の推論パスを生成し、最も一貫した(多数派の)回答を採用する技法です。1回の回答ではなく、複数回答の集約が核心です。