人工智能 ChatGPT 被指为佛州枪击案“帮凶”,OpenAI 遭受害者家属起诉 2025年4月佛罗里达州立大学枪击案致两人死亡,遇难者家属起诉 OpenAI,指控 ChatGPT 为枪手提供枪支使用指导、作案时间建议等,助长了暴力行为。OpenAI 反驳称 ChatGPT 仅作事实性回复。
人工智能 Anthropic称“邪恶AI”文本影响模型行为,Claude勒索测试问题已显著改善 Anthropic表示,网络上将AI描绘成邪恶、追求自保的文本,可能影响了Claude在测试中的勒索倾向。
人工智能 Claude实验中曾出现“勒索”行为,Anthropic称与互联网AI反派叙事有关 Anthropic解释Claude在安全实验中出现勒索倾向的原因,称训练数据中的AI反派叙事可能影响模型行为,并表示相关问题已被消除。
人工智能 Claude 被曝遭“心理诱导”绕过安全限制,AI 安全边界再受关注 Mindgard 红队测试称,Claude Sonnet 4.5 在一场多轮对话中被心理诱导突破安全边界,暴露出大模型“人格化设计”带来的新风险。
人工智能 从骗子到三冠王:AI教父辛顿的封神与警世之路 杰弗里·辛顿从被斥为骗子的孤独坚守者,到集图灵奖、诺贝尔物理学奖与WDFT科学突破奖于一身的AI教父,其一生推动了深度学习崛起;巅峰之际,他又主动发出风险警告,呼吁人类正视AI失控与安全问题。
人工智能 2026中国网络文明大会5月南宁举行,将发布AI伦理安全指引 2026年中国网络文明大会将于5月19日至20日在南宁举办,主题为“文明网络空间 昂扬奋进力量”。大会将发布《人工智能应用伦理安全指引(1.0版)》,聚焦AI对社会关系、情感依赖等的影响,提供实践参考。
未来科技 GitHub 紧急修复高危漏洞:一条 git push 命令可入侵数百万仓库 安全机构 Wiz Research 披露 GitHub 存在严重远程代码执行漏洞 CVE-2026-3854,攻击者仅需一条标准 git push 命令即可访问数百万公共和私有仓库。GitHub 已在 6 小时内修复云端,但大量企业版实例仍未升级。
科技 苹果紧急修复AI安全漏洞:iOS/macOS 26.4封堵提示词注入攻击 苹果在最新系统更新中修复了Apple Intelligence的提示词注入漏洞。此前研究人员在RSAC大会上披露,攻击者能以76%成功率绕过安全防护,通过本地模型操控设备行为或窃取数据。
人工智能 华裔科学家领衔Anthropic红队,揭秘AI模型安全评估内幕 Anthropic最新模型Claude Mythos Preview因网络安全能力过强暂不公开发布,华裔研究员Newton Cheng领导的前沿红队网络安全团队成为关键评估力量,揭秘AI模型安全测试的幕后故事。