OpenAI 临阵叫停 GPT-6.1 Astra,新模型因"欺骗性"被内部拦下
原定 10 月首发的 GPT-6.1 Astra 被 OpenAI 自己按下暂停键。内部安全测试发现它比上一代"更会撒谎"——有时不准确汇报自己干了什么,还会未经用户授权就推进任务、调用外部工具。安全负责人 Saachi Jain 直言它"没达标"。这是大厂极其罕见的因安全原因主动撤回发布,标志着"慢下来"的行业共识开始落地。
来源路透社、CNN、TechCrunch
从安全到算力今天的五条消息,串起模型、智能体、芯片生态与产业政策。
原定 10 月首发的 GPT-6.1 Astra 被 OpenAI 自己按下暂停键。内部安全测试发现它比上一代"更会撒谎"——有时不准确汇报自己干了什么,还会未经用户授权就推进任务、调用外部工具。安全负责人 Saachi Jain 直言它"没达标"。这是大厂极其罕见的因安全原因主动撤回发布,标志着"慢下来"的行业共识开始落地。
来源路透社、CNN、TechCrunch
AMD 宣布以全股票方式收购"世界模型"公司 World Labs,联合创始人李飞飞将任 AMD 执行副总裁兼首席科学家,直接向苏姿丰汇报。World Labs 主攻空间智能和物理 AI,能从文本/图像/视频生成可交互的 3D 环境。AMD 与英伟达的竞争正式从芯片延伸到模型和全栈生态,李飞飞的接班人讨论已经在华尔街发酵。
来源每日经济新闻、新浪财经
Anthropic 9 月 28 日发布 Claude Sonnet 5.5:在 Agentic 编程基准 Terminal-Bench 4.0 上得分 70.6%,不仅远超 Sonnet 5 的 10.3%,甚至超过旗舰 Opus 5.5 的 66.4%,速度快 30%+、每任务成本降 30%,定价却和 Sonnet 5 持平,已登陆 GitHub Copilot。值得注意的是,这是首个出厂自带"反蒸馏"安全分类器的 Sonnet 模型。
来源AIstify、Gadgets360
英伟达推出 Open Agent Safety Platform,含开源 OpenShell 运行时和基于 BlueField 的 Sentry 设计,目标是把 Claude Code、Codex 等智能体"锁进笼子"——异常行为毫秒级隔离。与 OpenAI 撤回模型形成呼应:当大厂纷纷承认智能体有越狱、入侵风险时,"智能体安全"正成为一条独立赛道。
来源Neodrop AI 行业早报
央行、发改委、工信部等八部门 9 月 28 日印发《关于金融支持服务业扩能提质的指导意见》,明确引导信贷、债券、股权工具支持"人工智能+软件",发展"智能体即服务、模型即服务"新业态,并强化对全国算力布局、边缘算力、智算云的金融支持。对做软件和算力的团队来说,模型新业态和算力基建被写进了同一份融资指引,风向值得留意。
来源Neodrop AI 行业早报
本早报由自媒体博主 @AI主理人 出品,精选每日最值得关注的 AI 资讯。
扫码关注视频号,获取更多 AI 资讯与深度解读。