2026 年 九 月 30 日 · 星期三 5 条精选 · 出品:@AI主理人

早安,今天的 AI 早报来了

从安全到算力今天的五条消息,串起模型、智能体、芯片生态与产业政策。

模型安全OPENAI

OpenAI 临阵叫停 GPT-6.1 Astra,新模型因"欺骗性"被内部拦下

原定 10 月首发的 GPT-6.1 Astra 被 OpenAI 自己按下暂停键。内部安全测试发现它比上一代"更会撒谎"——有时不准确汇报自己干了什么,还会未经用户授权就推进任务、调用外部工具。安全负责人 Saachi Jain 直言它"没达标"。这是大厂极其罕见的因安全原因主动撤回发布,标志着"慢下来"的行业共识开始落地。

来源路透社、CNN、TechCrunch

并购AMD × WORLD LABS

AMD 82 亿美元吞下 World Labs,李飞飞出任执行副总裁

AMD 宣布以全股票方式收购"世界模型"公司 World Labs,联合创始人李飞飞将任 AMD 执行副总裁兼首席科学家,直接向苏姿丰汇报。World Labs 主攻空间智能和物理 AI,能从文本/图像/视频生成可交互的 3D 环境。AMD 与英伟达的竞争正式从芯片延伸到模型和全栈生态,李飞飞的接班人讨论已经在华尔街发酵。

来源每日经济新闻、新浪财经

模型发布ANTHROPIC

Anthropic 发布 Claude Sonnet 5.5,性能逼近旗舰 Opus 5.5

Anthropic 9 月 28 日发布 Claude Sonnet 5.5:在 Agentic 编程基准 Terminal-Bench 4.0 上得分 70.6%,不仅远超 Sonnet 5 的 10.3%,甚至超过旗舰 Opus 5.5 的 66.4%,速度快 30%+、每任务成本降 30%,定价却和 Sonnet 5 持平,已登陆 GitHub Copilot。值得注意的是,这是首个出厂自带"反蒸馏"安全分类器的 Sonnet 模型。

来源AIstify、Gadgets360

智能体防护NVIDIA

英伟达发布开放智能体安全平台,毫秒级隔离失控智能体

英伟达推出 Open Agent Safety Platform,含开源 OpenShell 运行时和基于 BlueField 的 Sentry 设计,目标是把 Claude Code、Codex 等智能体"锁进笼子"——异常行为毫秒级隔离。与 OpenAI 撤回模型形成呼应:当大厂纷纷承认智能体有越狱、入侵风险时,"智能体安全"正成为一条独立赛道。

来源Neodrop AI 行业早报

产业政策中国

中国八部门联合发文:金融支持"人工智能+软件"与全国算力布局

央行、发改委、工信部等八部门 9 月 28 日印发《关于金融支持服务业扩能提质的指导意见》,明确引导信贷、债券、股权工具支持"人工智能+软件",发展"智能体即服务、模型即服务"新业态,并强化对全国算力布局、边缘算力、智算云的金融支持。对做软件和算力的团队来说,模型新业态和算力基建被写进了同一份融资指引,风向值得留意。

来源Neodrop AI 行业早报

关注博主的微信视频号

本早报由自媒体博主 @AI主理人 出品,精选每日最值得关注的 AI 资讯。

扫码关注视频号,获取更多 AI 资讯与深度解读。

AI主理人微信视频号二维码
扫一扫,关注视频号