据 The Information 报道,谷歌正在研发内部代号为 Frozen v2 的服务器芯片,希望通过把 Gemini 模型的部分架构固化进硬件,减少推理时的计算量与数据传输。谷歌工程师预计,它的单位功耗 Token 处理能力可达到最新一代 TPU 的 6 至 10 倍。 Frozen v2 本文链接