Search Agent 是最难训练、也最难评测的一类模型。它要在真实网络里边搜边读边推理,还得自己判断什么时候证据够了、可以停下来作答。小红书 AllSpark 团队刚刚开源的 Iris,把这件事往前推了一步:35B 的体量,在 BrowseComp 上拿到 82.2 分,逼近 Kimi-K2.6 本文链接