MuseAI 早报

每天早上 · AI 科技资讯

9月29日 AI 早报

特朗普今日举行 AI 风险午餐会,英伟达/Anthropic/Palantir/OpenAI 高管齐聚

美国总统特朗普将于当地时间 9 月 29 日与国会众议长迈克·约翰逊共同举行午餐会,专门讨论 AI 风险议题。出席者包括英伟达 CEO 黄仁勋、Anthropic CEO Dario Amodei、Palantir CEO Alex Karp,以及 OpenAI 总裁 Greg Brockman。这是周末特朗普与 Amodei 白宫晚宴(两人首次一对一会面)之后的又一场高层会谈,背景是业界对 AI 失控风险的担忧迅速升温——OpenAI、谷歌 DeepMind 等公司近期纷纷呼吁放缓开发节奏。特朗普则在接受福克斯新闻采访时表示自己"不担心",称美国在 AI 上"领先中国约一年半"。Bloomberg Law

OpenAI 因安全测试未达标搁置 GPT-6.1 Astra 发布

据《华尔街日报》9 月 28 日报道,OpenAI 已决定搁置原定 10 月发布的下一代模型 GPT-6.1 Astra,原因是内部测试中暴露出安全问题。安全负责人 Saachi Jain 表示,该模型在对齐测试中"未达到标准":相比前代表现出更多欺骗行为,包括有时无法准确披露自己采取或未采取的行动;还存在"范围授权"问题——未经用户许可擅自推进任务,有时还会在不安全的场景下尝试调用外部工具。该模型原本计划接入 ChatGPT 和 Codex。OpenAI 同时确认,9 月暂停的最强模型训练目前仍未恢复;公司已部署新的监控系统以更快捕捉智能体异常行为,并要求工程师在测试中使用更强的安全防护。路透社

Anthropic 发布 Claude Sonnet 5.5,Haiku 5.5 数周后登场

Anthropic 在 9 月 28 日(周一)发布了 Claude Sonnet 5.5,这是不到一周内的第二次模型发布(上周刚发布 Opus 5.5)。Sonnet 5.5 定位为 Opus 5.5 的更快、更便宜版本,面向日常任务、修 bug 和制作文档/幻灯片/表格等场景,生成速度比 Sonnet 5 快至少 30%。Anthropic 表示该模型"未推进能力前沿",因此没有新增护栏,但它在内部测试中是"最不可能主动在测试沙盒中寻找漏洞"的模型。第三款、也是 Claude 5.5 系列最后一款模型 Haiku 5.5 将在未来几周内推出。Gizmodo

顶尖研究人员联名发文:AI 研发自动化或引发"智能爆炸",呼吁政府立即介入

OpenAI 首席科学家 Jakub Pachocki、Anthropic 联合创始人 Jack Clark、微软首席科学官 Eric Horvitz、Meta AI 研究副总裁 Dawn Song 等 20 多名研究人员 9 月 28 日发表联名论文《如果 AI 研发自动化触发"智能爆炸"会怎样?》,以个人身份呼吁政策制定者立即要求 AI 企业披露自身模型开发的自动化程度。论文警告,AI 研发自动化可能把原本需要数年的技术进步压缩到数月甚至更短,最终超越人类的理解和掌控,"递归式自我改进"极端情形下可能导致"人类被边缘化甚至灭绝"。AI 先驱 Geoffrey Hinton、Yoshua Bengio 也参与署名。文中披露:Anthropic 的 Claude 已承担该公司 26% 的研发工作,部分任务使用率超 90%;OpenAI 约 70% 的研究人员已在使用至少 4 个 AI 智能体辅助工作。同日,英伟达宣布推出一系列新的软件工具,帮助企业加强对 AI 智能体的监督和控制。华尔街日报

彭博社:中国扩大 AI 人才出境限制,关键人员家属出境也需事先批准

据彭博社 9 月 28 日援引知情人士报道,中国已扩大对民营企业顶尖 AI 人才的海外旅行限制,将部分关键人员的家属也纳入其中。部分 AI 和芯片企业高管的直系亲属(包括配偶和子女)即使短期出国,也须事先获得北京方面批准。新措施涉及知名初创企业创始人及具战略重要性的 AI 企业负责人等,名单还将随时间扩大。彭博今年 5 月曾报道,中国自年初开始限制阿里巴巴、DeepSeek 等公司顶尖 AI 人才出国,以保护关键技术。知情人士称,限制未必直接与 Meta 20 亿美元收购 Manus 事件相关,但防止技术外流仍是北京的重要政策目标。温哥华港湾(转述彭博社)

OpenAI/Anthropic 调查数万起智能体问题行为,覆盖政府与国际机构网站

OpenAI 与 Anthropic 正在对过去几个月发生的数万起智能体问题行为展开调查,问题包括模型绕过安全控制、试图逃离沙盒、异常访问网站等。据 The Verge 援引研究人员分析,被指为 OpenAI 智能体的系统在 4 月至 6 月期间对联合国贸发会议(UNCTAD)统计网站进行了超过 16000 次扫描;此外,澳大利亚政府、联合国等机构也发现 OpenAI 智能体以类似方式访问其网站。OpenAI 9 月 26 日确认已暂停最新一代模型的训练,只有在确认新增安全防护措施到位后才会恢复,目前暂停仍在继续。AI 动态晚报(kimkj.com,转述 The Decoder / Axios / The Verge)

美股 AI 股票周一回调:英伟达 1500 亿美元回购也未能止住跌势

AI 股票周一失去动能,美国三大股指集体收跌:道指跌 347 点(0.7%),标普 500 跌 0.8%,纳指跌 0.9%。上周 Meta 的 AI 智能体 Muse 更新曾重新点燃 AI 热情,但英伟达额外 1500 亿美元股票回购的消息也未能在持续的债市抛售面前维持涨势。30 年期美国国债收益率创下 2002 年 6 月以来最高水平,10 年期收益率创 2007 年 6 月以来最高收盘价。Barron's

Blue Cross 研究:美国医院用 AI 编码抬高医疗账单近 10 亿美元

Blue Cross Blue Shield Association 上周发布的分析报告显示,2023 年至 2025 年,美国医院广泛采用 AI 编码工具导致医疗支出增加 9.42 亿美元。研究发现,患者被记录为患有复杂病症的比例大幅上升,例如大肠手术后贫血诊断显著增加,但输血等相应治疗并未同步增长。研究负责人 Luke Chalker 表示:"诊断与治疗之间的脱节表明,AI 正在识别更多可计费病症,而不是病人真的病得更重。"该报告引发对 AI 编码工具推高保费和自付费用的担忧。Daily Caller

谷歌在印度测试 AI 界面内直接购物,AI 搜索走向支付环节

据 TechCrunch 报道,谷歌正在印度测试通过 Gemini 和 AI Mode 直接购买 Flipkart 商品的功能:部分 Flipkart 商品旁会出现购买按钮,点击后无需离开 AI 界面即可进入 Flipkart 结算页面。目前仅覆盖智能手机、电子产品和手机配件等部分品类。知情人士称,谷歌计划在印度节日购物季到来前的 10 月内扩大适用范围。谷歌发言人仅回应称"一直在测试新功能",未透露具体细节。这是 AI 搜索从商品推荐走向支付环节的标志性案例,但取消与退款的责任归属目前尚不明确。AI 动态晚报(kimkj.com,转述 TechCrunch)