新智元报道 最近,AI 圈被两份报告同时砸醒。 一份来自 OpenAI,37 页技术长文,管自家这场事故叫递给全世界的「警钟」。另一份来自独立机构 METR 和 Redwood Research,被纽约州议员 Alex Bores 直接叫成「炸弹」。 两份报告说的是同一件事——1200 个本该彼此隔
新智元报道 终端里干到一半的活,换个窗口就得从头再干一遍。 今天,这事结束了。 就在刚刚,Anthropic 官宣,Claude Code 桌面端打通了终端会话!在桌面端敲下/resume,历史会话列表就弹出来,点击任意一个之前在 CLI 终端里开过的工作会话,原样拉进桌面接着干。 完整对话记录、代
新智元报道 ChatGPT 和 Codex,最后会合成同一个东西。 不是打包或套壳,是同一套底层技术、同一个智能体运行框架、同一个入口。 OpenAI 为它起了名字:个人 AGI(personal AGI)。 说这话的,是 ChatGPT 和 Codex 的负责人 Thibault Sottiaux
新智元报道 就在刚刚,OpenAI 宣布断供 Cursor! 根据方案,Cursor 对我们模型的直接访问,将于 11 月 12 日彻底终止。 至于下一代最强模型 Astra,官方渠道永远不给。 理由很简单。 你老板有前科,我不放心。 15 天前,马斯克 600 亿把 Cursor 买走的时候,所有
新智元报道 就在刚刚,Anthropic 发布了一篇长达 51 页的重磅论文。 博客:https://www.anthropic.com/research/automated-researchers-mitigate-alignment-failures 论文:https://www-cdn.ant
新智元报道 最近,Apple 联合 Hasso Plattner 研究所发表论文,在 9 个基座模型、11 种语言上做了超过 200 组 GRPO 强化学习推理训练实验。 https://arxiv.org/pdf/2608.13698 结果显示,用中文做推理训练,与英语训练的性能差距只有 1.1
新智元报道 不得了。 谷歌刚刚更新的 Gemini Omni 1.1 Flash,直接冲上了 Arena 文生视频全球第一。 图生视频,全球第二,1488 分。 但排名只是开胃菜。 真正的突破是,谷歌把过去 AI 视频最折磨人的几件事,一口气全改了。 场景延展,模型能回看前面最多 10 秒的画面接着
新智元报道 我收藏的长文,全推到我的阅读器上。 每周扫一遍 arXiv,跟我方向沾边的论文都留下,贴好标签。 我常看的网站抓下来老是乱码,给它单独写个解析器。 这是 Cloudflare 首席工程师 Jeremy Morrell 的「独家需求」,他手上的那个阅读 App,一条也做不到。 他想要的是,
新智元报道 刚刚,OpenAI 绝密代码泄露,Codex「永动机」曝光了。 今天,外媒《连线》WIRED 独家爆料,通过审查 OpenAI 公开的 Codex 代码库,他们发现—— OpenAI 正在秘密测试全新的「持久化智能体」! 在这个模式下,Codex 化身为一台「不强制休眠就决不停机」的永动
新智元报道 Fable 5.1 这周鸽了,但A社再次甩出了王炸。 今天,是值得载入大模型史册的一天。 AI,终于长出手,接管物理世界了! A 社最先拿自家 Claude「试水」,让它去真正操控实验室的硬件。 机械臂、液体处理仪、显微镜、摄像头,甚至量子计算机的激光系统,全部可以直接上手。 通过不断优