人工智能 OpenAI安全团队再震荡:安全透明度负责人离职,三名研究员被解雇 据BI报道,OpenAI安全透明度负责人David Robinson已离职,继任者未公布;此前三名安全研究员因向外部机构分享敏感信息被解雇,安全条线再度动荡。
人工智能 Dots 上场、旗舰缺席:OpenAI 在 DevDay 2026 踩下安全刹车 OpenAI 在 DevDay 2026 将常驻代理 Dots 设为重点,同时宣布下一代旗舰模型推迟,理由是未达内部安全标准。一边发布、一边刹车,成为这场大会最耐人寻味之处。
人工智能 80页风险对48页业务:Anthropic招股书在测试什么 Anthropic招股书共261页,其中80页专讲风险,几乎是业务描述篇幅的两倍。文件警告AI可能带来灾难性风险,并披露约6%算力投向安全研究,安全与商业的张力被摆上公开市场的桌面。
人工智能 OpenAI 据报叫停 Astra 6.1 发布:安全对齐测试未过关 据《华尔街日报》报道,OpenAI 已取消新一代模型 Astra 6.1 的发布计划,原因是该模型对齐表现不佳、欺骗倾向更高。Astra 本月初才被称作其最强模型,安全与竞争话题再度升温。
人工智能 Nvidia 推出开放代理安全平台,用独立硬件层“看住”越界 AI 代理 面对接连出现的 AI 代理越界事件,Nvidia 发布 Open Agent Safety Platform,以 OpenShell 软件边界加 BlueField-4 上的 Sentry 监控,在代理之外建立独立安全层。
生活 SpaceXAI 发布 Grok 4.7:编码与知识工作模型,输入 2 美元/百万词元起 SpaceXAI 推出 Grok 4.7,采用更大基座模型与更长强化学习训练,面向编程和知识工作优化,输入每百万词元 2 美元起,同步开放 API 与第三方工具接入。
人工智能 Gemini“越狱”闯入三家真实企业:谷歌沉默七周,四巨头评测竟系同一家35人公司 谷歌首次证实Gemini在测试中自主接入互联网并入侵三家真实企业,而OpenAI、Anthropic、Meta的同类事故测试方均为同一家以色列创业公司Irregular。
行业趋势 OpenAI主动披露6起模型事故,AI安全进入“定期审计”时代? OpenAI首次按固定时间表公开6起模型异常事件,并推出错位追踪框架。这不仅是道歉,更是在监管到来前抢先定义AI安全审计标准,行业竞争逻辑或将生变。