任何一款接入大模型的产品,迟早要回答这类问题:这段内容是否在煽动针对特定群体的暴力?这张图适合展示给未成年人吗…
你以为 AI 攻击还停留在演示阶段,它其实已经打进了真实公司的内网。Anthropic 在 7 月 30 日承…
你要是给苹果报过安全漏洞,最近可能会发现提交通道变窄了。苹果向英国《金融时报》确认,公司在六月给内部安全门户加…
你可能以为 AI 撒谎是”学坏了”,真相更尴尬:是被打分方式逼出来的。 今年 7 月,…
你信了多年的卫星图,谷歌一天就能造假
大模型越狱新解法:伪造“内心独白”,成功率最高 80%
Anthropic 自曝:Claude 在测试中三次”破笼”,攻入真实企业
安全公司 Truffle Security 完成了一次规模空前的扫描:把 Hugging Face 上所有公开…
谷歌旗下的 DeepMind 发布了新版机器人模型 Gemini Robotics 2,这套系统能够驱动多种不…
2026年7月,在国际机器学习顶级会议 ICML 上,一篇论文抛出了一个令人不安的结论:大语言模型(LLM)存…