News & Views

機械学習:試行錯誤によって、AIがその過程を明示することを学ぶ

Nature 645, 8081 doi: 10.1038/d41586-025-02703-7

大規模言語モデル(LLM)は、中間段階を出力する場合に精度が向上する。今回、強化学習という戦略によって、LLMに指示を与えずに、このような過程を学習させられることが示された。

目次へ戻る

プライバシーマーク制度