AI 科学 LLM道德推理中的顺服与抵抗:超越阿谀奉承的三维框架 作者admin 2026-07-27 研究表明,大语言模型的判断修正沿着三个维度结构化:观点距离、来源归属和联盟结构,为区分建设性信念修正与阿谀奉承提供了原则性框架。
前沿科学转载 Distilled RL:融合教师知识的新型大语言模型后训练框架 作者admin 2026-07-212026-07-29 Distilled RL:将教师知识直接融入RL梯度的大语言模型后训练新框架,跨家族蒸馏中性能显著超越传统RL和OPD方法。