News & Views 機械学習:試行錯誤によって、AIがその過程を明示することを学ぶ 2025年9月18日 Nature 645, 8081 doi: 10.1038/d41586-025-02703-7 大規模言語モデル(LLM)は、中間段階を出力する場合に精度が向上する。今回、強化学習という戦略によって、LLMに指示を与えずに、このような過程を学習させられることが示された。 Full Text PDF 目次へ戻る