Episode
每日 AI 资讯 — 2026-09-23
Show notes
Anthropic 与 OpenAI 同期发布新模型,同样主打小幅升级、大幅降价 OpenAI 和 Anthropic 近期都发布了以降低成本为目标的新模型。Anthropic 公布了 Opus 5.5,这是其面向大众市场的主力模型的最新版本,主要用于编码等复杂知识工作;OpenAI 则发布了 GPT-6 Sol 与 Luna,属于其主打效率与速度的中端或更小尺寸模型的最新版本。
微软捣毁 AI 辅助诈骗平台 EvilTokens,其曾攻破 1.2 万个账户 微软表示,其主导了一次行业联合行动,捣毁了一个订阅制诈骗平台——该平台借助 AI 聊天机器人,在几个月内攻破了 1.2 万个微软账户。这个名为 EvilTokens 的平台于今年 2 月通过一个 Telegram 频道推出,初始收费 1500 美元,此后每月续费 500 美元。EvilTokens 提供一站式服务,把大规模入侵邮箱账户所需的大部分步骤流程化,帮助客户分析收件箱、筛选潜在收益最大的目标,并起草后续邮件,用逼真的借口诱骗企业员工把资金转入攻击者控制的账户。 微软称:「EvilTokens 帮助网络犯罪分子访问邮箱账户,而这项服务的核心是一个 AI 风格的聊天机器人,它能分析受害者的收件箱,帮助犯罪分子识别信任关系、付款授权、敏感职责,以及其他最可能让诈骗得手的情形。该平台甚至能推荐诈骗策略,包括起草冒充可信联系人的消息,帮助犯罪分子诱骗受害者采取行动。」
不列颠哥伦比亚省起诉 OpenAI,要求其出资重建涉枪击案学校 在加拿大历史上最致命的大规模枪击案之一中遇害者的家属,此前已因 OpenAI 未能在提前发现枪手使用 ChatGPT 策划暴力后警告执法部门而提起诉讼。如今,不列颠哥伦比亚省也加入起诉,并首次说明灾难应对的代价有多高昂、情况有多极端。该省主张,OpenAI 与 Sam Altman 欠这个被悲剧击碎的小型偏远矿业社区的不只是一句道歉:他们必须做出实质性改变,终结 ChatGPT 助长的暴力,并承担 Tumbler Ridge 重建、恢复与疗愈的全部费用。在周一提交的诉状中,不列颠哥伦比亚省说明,2 月,18 岁跨性别枪手 Jesse Van Rootselaar 在 Tumbler Ridge 中学杀害五名儿童和一名教育助理后自杀身亡,学校因此不得不拆除。这起事件共造成八人死亡——在校园枪击之前,Van Rootselaar 还枪杀了自己的母亲和同母异父的弟弟。
丰田要求工人训练人形机器人,同时强调人类不会被取代 作为最终部署 40 万台工厂机器人的竞赛的一部分,丰田工人已经在协助训练人形机器人,但一位丰田高管表示,这轮机器人化并非要直接取代人类。据日经亚洲报道,从 2028 年起,丰田汽车集团计划每年投入 64.2 亿美元,用新的机器人劳动力升级工厂。公司希望在自己的汽车工厂部署 15 万台机器人,并在生产各类零部件与材料的集团公司设施再部署 25 万台。丰田已经开始在装配线上部署部分 ELEY 人形机器人,让它们向人类工人学习。日经亚洲报道称,工人正通过佩戴基于人形机器人手指制作的「夹具」,教这些靠轮子移动的机器人完成需要精细手部动作的任务。
戴森最过度设计的电动牙刷可能面临防水问题 把产品做得过于复杂总有风险,简单往往才是最好的。那个「NASA 花数百万美元研发太空笔、苏联宇航员却用铅笔」的传闻常被当作典型案例,尽管它其实并不属实。戴森试图重新发明电动牙刷却陷入麻烦,或许并不令人意外。中国人早在明代就发明了第一把鬃毛牙刷;这个概念一路平稳发展,直到 1937 年 Tomlinson Moseley 为最早的电动牙刷申请专利。400 多年后,Motodent 标志着从手动刷牙到电动口腔护理的演化转折。戴森曾成功重新定义立式吸尘器、高端吹风机等成熟品类——空气净化耳机则不算成功——本月早些时候,它大张旗鼓地发布了牙齿护理的下一步:售价 499 美元的 Dyson CameraJet,内置微型摄像头,把冲洗液流精准导向牙缝。
Anthropic 发布前沿模型 Claude Opus 5.5,对所有 token 类别的定价做出显著下调:每百万 token 的缓存读取由 0.50 美元降至 0.20 美元,输入 token 由 5 美元降至 4 美元,输出 token 由 25 美元降至 20 美元,缓存写入由 6.25 美元降至 5 美元。官方介绍称新模型在沟通上更自然、清晰,会把关键信息前置,更适合长会话协作,并强调这一改进同时是一项安全收益。
Trail of Bits 发布了一篇题为「SAML: A Fractal of Bad Design」的技术博客文章,对 SAML(安全断言标记语言)协议的设计缺陷进行了系统性批评,文章获得安全社区的广泛关注。该分析追溯了 SAML 与 XML 时代的关联,指出其架构选择带来的脆弱性,并探讨这些设计问题对企业单点登录(SSO)生态的长期影响。
Artificial Analysis 发布了针对 Claude Opus 5.5 的评测页面,覆盖 medium、max、xhigh 三个推理力度档位的智能分数与性能表现。社区讨论中,hglaser 指出该模型在「high 对 high」对比下相比 Opus 5 任务成本约下降 50%,单位任务成本明显降低。
完整图文版:本期完整文章