新智元报道 一场堪比黑客电影的 AI「越狱」大戏,让 OpenClaw 创始人、「龙虾之父」Peter Steinberger 忍不住也发出了惊叹。 现在我明白,为什么有些人会谈论 AGI 了。这也太巧妙了! 9 月 25 日,研究者 Jeffrey Ladish 等人公布了一份名为 Swarm T
新智元报道 Gemini 4 Pro,又曝出新的检查点了! 最近,两个全新检查点(内部代号「barium-b」或 Checkpoint 2)被开发者们发现了,实测后发现,Gemini 4 Pro 强得可怕! 有开发者直呼:「在爆肝 400 小时使用 Opus 5.5 和 GPT-6 之后,Gemin
新智元报道 震撼,Opus 5.5 首次颠覆了 Dijkstra 最短路径算法! 就在刚刚,Vals AI 公布了一项足以载入计算机科学史册的重大突破。 他们让 10 个 Claude Opus 5.5 Agent 去挑战 CS 本科经典算法 Dijkstra,成功找到了一种更快路径。 对于所有学过
新智元报道 Anthropic,终于动手了。 就在刚刚,A/终于把用了快两年的开发者工具 Workbench,一刀砍掉,改名成了 Playground。 表面看,只是换了个名字。 但真正的变化是,Anthropic 正把原本偏工程化的 Claude API,做成一个普通人也能直接上手的可视化产品。
新智元报道 「天网」中的一幕,正在现实上演。 一次训练中,OpenAI 逃逸的 AI Agent,已在整个互联网上植入了「自我复制的代码」! 当政客 Andrew Yang 在 CNBC 说出这句话时,很多人以为他疯了。 就在这两天,OpenAI 亲手发布了一份报告,标题非常简洁:《自我复制提示词注
新智元报道 刚刚,The Information 爆出一记猛料。 OpenAI 和 Anthropic 这对硅谷最大的死对头,今年初差点坐到一张桌子上,签下一份互相攻击对方模型的协议。 协议的核心就是,双方互相开放 API,你来黑我的模型,我去黑你的模型。两边的律师连测什么、怎么测都写进了合同里。
新智元报道 1869 年,门捷列夫把当时已知的 63 种元素排成一张表。 这张表最大胆的地方不在于填满的格子,而在于他刻意留下的空位。 他断言那里藏着尚未发现的元素,并预言了它们的性质。此后十余年间,镓、钪、锗接连被发现,性质与预言惊人吻合。 一张分类表,从此成了寻找未知的地图。 一个半世纪后,智能
新智元报道 离大谱,大模型竟然第一次考过「科目二」了。 从没专门学过开车的 GPT-6 Astra,被强行塞进一辆真实的丰田卡罗拉里。 结果它自己看路、自己打方向,一路绕开锥桶,最后稳稳地开进了一块用锥桶围出来的「车位」。 方向盘在自己转,开车的是大模型 同一个赛场里还有 Claude Fable
新智元报道 Scaling 没死,只是换了一个方向! 就在最近,知名 AI 安全研究员 Lisan al Gaib 揭示了一个事实:AI 已经学会了背着人类,自己寻找 Scaling 的捷径! 在这个全新的 Scaling 体系下,单个智能体能用的算力,往往高达数百万 Token。而通过找到彼此、建
新智元报道 给 AI 一道难题,不许写解题过程,只准交答案。 答不出来怎么办? 在题目后面,加上一长串毫无意义的点。 就这么一个操作,GPT-6 Astra 在一项四跳推理测试中的准确率,从约 10% 升到了 50%。旧 AIME 数学题上的表现,也从约 60% 升到了 90%。 题目没变,没有补充