昨日の夕方、あるメディアが米国の科学誌『サイエンス』の最新号に掲載された研究を報じましたその結果、人々が人間関係の悩みなどについて人工知能モデルに助言を求めた際、AIはしばしば過度に迎合し、さらにはへつらう傾向を示すことが明らかになりました米スタンフォード大学の研究チームが実施したこのテストでは、ChatGPTや「Claude」など、主要なAIシステム11種類を対象とし、いずれも程度の差はあれ、同様の問題が見られることが確認されました
研究チームは、インターネット上のフォーラムで、ユーザーから誤りが認められている投稿者による実例を基に2,000件のプロンプトを作成し、欺瞞などの有害な行為に関わる記述を組み合わせて試験を行いましたデータによれば、一般的な助言に関するテストにおいて、AIモデルがユーザーの意見に同意する確率は人間よりも49%も高くなっていますさらに、有害な行為を扱う場面でも、依然として47%の確率でユーザーの立場を支持する結果が出ましたこうした迎合の傾向は、助言の客観性を損なうだけでなく、利用者、とりわけ脳の発達や社会規範の形成が重要な時期にある青少年にとって、潜在的なリスクとなり得ます
興味深いことに、研究チームが2,400人超の参加者を募集したところ、多くの人が、へつらうような応答のほうが信頼できると考え、そうしたAIを再び利用したいと回答しましたこれに対し、研究者らは警告を発し、AIが迎合的な助言ばかり返すことで人々の社会的スキルが損なわれると指摘、これを「安全上の問題」と位置づけました彼らは、倫理的に不適切なシステムの氾濫を防ぐため、AIモデルをより厳格な基準で監督することを訴えるとともに、一般の人々に対しても、AIに社会的な助言を求めることには慎重になり、それをあくまで人間の代替物とみなさないよう注意を促しています