新智元报道 编辑:KingHZ DeepSeek-R1 引爆了 LLM 推理革命,人们几乎形成了共识:推理能力越强,LLM 越好。但多位华人参与的研究揭示:思维链 CoT 分散模型「注意力」,可能是性能崩塌的导火索。 DeepSeek-R1 火了,推理模型火了,思维链(Chain-of-Though 本文链接