News & Views

機械学習:LLMは隠れた信号を用いて望ましくない特性を伝播させる

Nature 652, 8110 doi: 10.1038/d41586-026-00906-0

今回、人工知能(AI)の出力を用いて訓練された大規模言語モデル(LLM)が、訓練データの中で明示的に記述されていないものであっても、望ましくない振る舞いを受け継ぐ場合があることが示された。

目次へ戻る

プライバシーマーク制度