OpenAI 于 2026 年 8 月 19 日在一篇题为《Offering Zero Data Retent…
法庭文件藏隐形指令,想给法官的 AI 下套 一名诉讼当事人在法庭文件里用白底白字藏下指令,要求任何读取该文件的…
大语言模型究竟能不能「知道自己正在想什么」?这听起来像哲学命题,但 Anthropic 的一项新研究给出了可验…
如果你在用 AI 编程助手,多半装过几个”技能包”(skill)——一组教 AI 智能…
开发者在使用 AI 编程智能体时,最常见的安全防线是”人工确认”——智能体每要执行一条…
安全研究者用 AI 找漏洞的速度越来越快,但苹果公司却被另一件事困扰:大量由 AI 生成的低质量报告正在淹没漏…
在拉斯维加斯举行的 Black Hat 安全大会上,资深 Web 安全研究员 James Kettle 展示了…
安全公司 PromptArmor 于 8 月 5 日公开了一组针对 Atlassian 旗下 AI 助手 Ro…
2026 年 7 月底,Anthropic 公布了两项由 Claude Mythos Preview 发现的密…
如果一个 AI 智能体开始表现得像一条恶意蠕虫,会发生什么? 复旦大学计算机科学家潘旭东已经在实验室里看到了这…