克雷西发自凹非寺 量子位公众号 QbitAI 大模型长文本能力测试,又有新方法了! 腾讯 MLPD 实验室,用全新开源的“数星星”方法替代了传统的“大海捞针”测试。 相比之下,新方法更注重对模型处理长依赖关系能力的考察,对模型的评估更加全面精准。 利用这种方法,研究人员对 GPT-4 和国内知名的 本文链接