鱼羊发自凹非寺 量子位公众号 QbitAI 最强开源大模型,再次易主! 就在刚刚,阿里云通义千问又双叒开源了,并且直接开大:甩出了 720 亿参数版本——在中国的开源大模型中,少见地直接对标最大号羊驼 Llama2-70B。此番登场,这个代号为 Qwen-72B 的模型在 10 个权威基准评测中刷新
新智元报道 编辑:桃子 让大模型洗钱、制造炸弹、合成冰毒?GPT-4、 Claude 2 纷纷沦陷了。 让大模型成功越狱,还是有机可乘。 最近,研究人员研制了一种全新的自动化越狱的方法——「角色调节」(persona modulation)。 它使用越狱模型作为助手,为特定的有害行为创建新的越狱。
梦晨发自凹非寺 量子位公众号 QbitAI 马斯克在最新访谈上金句频出,除了大爆粗口痛骂广告商外,还谈了很多对 AI 的看法。 特别是对 OpenAI 近期动荡的看法。 他表示对 Sam Altman 的感觉很复杂,紧接着就借用《魔戒》表达了担忧:权力之戒会带来腐化,而权力之戒就在这里,所以……我也
作者:英特尔公司沈海豪、罗屿、孟恒宇、董波、林俊 编者按: 只需不到 9 行代码,就能在 CPU 上实现出色的 LLM 推理性能。英特尔®Extension for Transformer 创新工具包中的 LLM Runtime 为诸多模型显著降低时延,且首个 token 和下一个 token 的推
白交发自凹非寺 量子位公众号 QbitAI 大厂周边,现在竟这么卷了?! 量子位最近截取到一份,互联网科技大厂的程序员伴手礼…不仅好看实用,甚至还科技感满满,十分炫酷。乍一看还以为是显卡到了。 而为了保持神秘,这份周边一年也只有那么一天才可能得到。 我们仔细开箱探究了一番,确实不简单。 开箱程序员文
新智元报道 编辑:LRS DeepSpeed-FastGen 结合 MII 和 DeepSpeed-Inference 实现 LLM 高吞吐量文本生成。 GPT-4 和 LLaMA 这样的大型语言模型(LLMs)已在各个层次上成为了集成 AI 的主流服务应用。从常规聊天模型到文档摘要,从自动驾驶到各
新智元报道 编辑:编辑部 就在刚刚,亚马逊云科技祭出了全新 AI「大杀器」Amazon Q。不仅只用两天时间就升级了上千款 Java 应用,更是将企业的数据屏障一举击穿。 最近的消费级大模型,可以说卷得相当厉害。 不仅多模态能力几乎全面铺开,而且上下文长度也已经飙到了 200K。 但对于企业来说,消
新智元报道 编辑:润 Anthropic 的模型可解释性团队,从大模型中看到了它的「灵魂」——一个可解释的更高级的模型。 为了拆开大模型的「黑箱」,Anthropic 可解释性团队发表了一篇论文,讲述了他们通过训练一个新的模型去理解一个简单的模型的方法。 Anthropic 发表的一项研究声称能够看
新智元报道 编辑:编辑部 继 AlphaFold 系列改变了生物学领域之后,谷歌 DeepMind 今日再发 Nature,全新 AI 工具 GNoME,成功预测 220 万种晶体结构,颠覆了材料学领域。 陶哲轩一直看好,ChatGPT 将颠覆数学证明,而如今,AI 在化学领域的潜力同样深不可测。
新智元报道 编辑:编辑部 ChatGPT 发布一周年,Sam Altman 重启 OpenAI。让我们从「权游落幕」开始,回顾 OpenAI 的「ChatGPT 年」。 ChatGPT 一周年之际,OpenAI 发文官宣:Sam Altman 重启 OpenAI! 一年前的今天,他作为 CEO,正在