“Reasoning” 只是行业术语,推理模型不是在像人一样思考。 @sophiamyang & @rasbt 在这场 69m 访谈里拆解了推理模型的工程本质: · RLVR 如何用可验证奖励训练模型 · 蒸馏的伦理边界在哪 · 循环 Transformer 是否真的会隐藏思维链 他们认为:推理模型没有魔法,只有方法。 https://t.co/tTK3govJG0

Sebastian Raschka 与 Sophia Yang 在一场 69 分钟访谈中,把"推理模型"从概念神话拉回工程现实——它只是会写思维链的模型,能力来自 RLVR、蒸馏和推理时扩展这些具体方法。理解这些方法,比争论"模型是否在思考"更有实用价值。








