来源:环球网 环球网科技报道记者李文瑶 智能体时代加速到来,AI 推理业务规模快速扩张,推理占比持续走高。在大模型与 Agent 业务场景下,KV Cache 已经成为推理环节的核心生产数据,传统节点本地缓存模式资源割裂,难以实现跨会话、跨节点复用,制约大模型推理整体效能。 针对上述行业痛点,9 月 本文链接