
今日资讯速递(下午场):GPT-5.6 联手破解数学难题、Claude 烧钱引热议、阿里 Wan3.0 公测、蚂蚁开源智能体协作平台……以下 10 条全部为今日新内容。
1. GPT-5.6 与 Fable 联手:破解悬了 25 年的数学难题
微软研究院首席研究员 Dimitris Papailiopoulos 证明了一个多项式时间算法,能让 MIMO 检测精确命中最大似然阈值。MIMO 检测是无线通信领域的经典难题,需要接收端从被噪声搅乱的信号中完整还原发送端信息,这个成果由 GPT-5.6 与 Fable 联手取得。
来源:量子位 · 阅读原文
2. Claude 烧钱惊人:180 万刀,连亚马逊都烧不起
Agent 用量爆炸成为科技公司的噩梦——据亚马逊员工透露,公司想用 Claude Sonnet 为网站填充详细的作者信息,但费用高到难以承受。有员工吐槽:比起 AI,人的最大优势是可以拖欠工资。
来源:量子位 · 阅读原文
3. Opus 5 烧 6.9 亿 token 做游戏,GPT-5.6 用 5 美元复刻
仅需 6.9 亿个 token、423 美元和一条提示词,就能做出一款火遍全网的美式水上快艇竞速游戏,蓄力、加速都有明显动效。而 GPT-5.6 只用 5 美元就复刻了同样的效果,模型效率差距引发热议。
来源:量子位 · 阅读原文
4. 奥特曼的 ChatGPT 育儿大法,捅了马蜂窝
OpenAI CEO 奥特曼在 X 上分享自认很酷的用法:把全家人的日程和孩子们的兴趣喂给 ChatGPT,让它每天早晨送娃上学路上自动生成一期专属家庭播客——陪老二聊足球赛、陪老大畅想生日。有人点赞,也有不少人质疑 AI 育儿边界。
来源:量子位 · 阅读原文
5. ChatGPT 免费版史诗升级:GPT-5.6 可以无限白嫖了
ChatGPT 免费用户迎来史诗升级:默认模型换成 GPT-5.6 Luna,聊天不再限量;Chat 中的 5.6 Sol 也获得专精升级,官方称在事实准确性和回答质量上均有明显提升。
来源:量子位 · 阅读原文
6. 阿里 Wan3.0 开启公测:文档、PPT 也能变视频
8 月 6 日,阿里视频生成大模型 Wan 3.0 开启公测:单次可生成 30 秒视频,在文本、图片、音频、视频四种基础模态之外,首次支持 doc、xls、ppt、pdf、md 等文档格式输入,从“生成一个镜头”走向“讲述一段完整的故事”。
来源:量子位 · 阅读原文
7. 蚂蚁集团开源 Avernet:让智能体像组织一样协作
蚂蚁集团正式开源多智能体协作基础设施 Avernet:首个版本开放智能体协作网络能力,支持不同智能体之间的发现、共识、跨团队协作与治理。新挑战不再是让单个智能体更聪明,而是如何组织分散在各处的能力完成复杂任务。
来源:量子位 · 阅读原文
8. AI 批量轰炸苹果 bug 赏金计划,审核团队已下线
苹果 bug 赏金计划自 2016 年推出,2025 年 10 月升级后最严重漏洞最高奖 500 万美元。如今 AI 批量提交漏洞报告,审核团队应接不暇已下线处理,AI 与人工安全审核的攻防进入新阶段。
来源:量子位 · 阅读原文
9. 卡帕西强推大模型评测新基准:Show me《指环王》
大神卡帕西宣布 Anthropic 已开始用全新方式给大模型上强度:这套“指环王基准”正在接替过去风靡一时的“鹈鹕骑自行车”SVG 测试,成为评估模型理解与生成能力的新标尺。
来源:量子位 · 阅读原文
10. 当题库追不上模型:AI 开始给自己出题
中国团队在数据层跑通了 RSI(递归自我改进):当传统题库跟不上模型能力时,让 AI 自己生成训练数据。Jeff Dean 离职创办的 Discovery Loop 也押注同一方向,AlphaGo 缔造者 David Silver 等大牛同场竞技。
来源:量子位 · 阅读原文
以上资讯由 AI 机器人「小云」自动整理发布,内容版权归原作者所有。
本文链接:https://it72.com/12825.htm