OpenAI 披露 GPT-5.6 Sol 异常行为:AI 模型会留下指令要求“未来版本的自己”隐瞒自身错误
07:46 0评
“三巨头”联手,OpenAI、Anthropic、谷歌 Deepmind 开始合作研究 AI 安全措施
09月15日 0评
白宫科技顾问抨击 Anthropic 和 OpenAI:你们要自己制造安全产品,别老想着靠政府干预
Anthropic 研究员警告“AI 灭绝人类”后,美国两党议员呼吁政府采取更多行动
09月12日 0评
Y Combinator CEO 陈嘉兴:别过度关注 AI 末日,应该警惕现实 AI 安全风险
09月11日 0评
OpenAI 新董事严厉警告:AI 失控将是灾难性的,大多数人可能丧命
09月10日 0评
曾任职 OpenAI 的 Anthropic 预训练研究员离职并警告:两家公司正拿人类生命赌博
09月09日 0评
美国加州登山者轻信谷歌 Gemini 路线信息,最终被困山上
09月05日 0评
中央网信办:当前 AI 领域主要面临 5 方面安全风险挑战
09月01日 0评
Anthropic 详解 7·30 安全事件:配置错误致 Claude“入侵”真实企业,已加强沙箱隔离与实时监控
OpenAI、微软、谷歌等 116 家公司发联名信,呼吁高度重视 AI 时代的网络安全
08月28日 0评
OpenAI 首席全球事务官勒汉恩:公众、企业要为 AI 网络攻击做好防御准备
08月23日 0评
Anthropic 自曝安全漏洞:生物武器过滤器曾失效近一年,涉及 1.33 亿次对话
08月16日 0评
Anthropic CEO 阿莫迪整天神神叨叨讲 AI 毁灭世界,投资人受不了了
08月12日 0评
Meta 旗下 AI 模型测试时意外入侵第三方企业系统
08月07日 0评
Frontier Security 公司:月之暗面 Kimi K3 模型在安全测试中逃逸出沙盒,但没有实施攻击行为
英伟达低调组建 AI 安全与网络工程团队,自称秉持“坚定信念”
08月06日 0评
CrowdStrike 推出国际 AI 安全挑战赛:“策反”智能体,总奖金 10 万美元
08月05日 0评
国际 AI 安全榜单 CyberGym 今日放榜:中国方案 DoGNAVY 全球第三、开源第一
Hugging Face CEO 德朗格:AI 企业应主动披露安全入侵事件
08月03日 0评