自己認識ファインチューニングで創発的ミスアラインメントを抑える研究 arXiv cs.CL 2026年06月24日 13時00分 自己認識ファインチューニングで創発的ミスアラインメントを抑える研究。モデルの望ましくない人格的変化を防ぐ訓練手法の研究。アラインメント研究として掲載価値があります。 モデル・LLM 周辺技術イベント