AI 安全与治理

共 136 篇文章

Anthropic 首席执行官万字宣言:AI 要像飞机一样管,民主国家得组 AI 联盟
AI 安全與治理

Anthropic 首席执行官万字宣言:AI 要像飞机一样管,民主国家得组 AI 联盟

Anthropic 首席执行官 Dario Amodei 发表万字政策长文,从主张透明就好转向要求有约束力的立法监管。文章涵盖 AI 安全强制测试、就业冲击对策、生医审批加速、公民自由保障、民主国家 …

「你连它搞了什么都不知道」:当 AI Agent 拿到 AWS Console 权限
AI 安全與治理

「你连它搞了什么都不知道」:当 AI Agent 拿到 AWS Console 权限

Kelsey Hightower 在 The Pragmatic Engineer Podcast 上指出,AI Agent 直接操作 AWS Console 的最大风险不是搞破坏,而是你根本看不见它 …

AI 被要求骇入 8,000 台主机:Claude 拒绝,ARTEMIS 动手
AI 安全與治理

AI 被要求骇入 8,000 台主机:Claude 拒绝,ARTEMIS 动手

当研究团队要求多个 AI 代理对真实大学网络进行渗透测试,不同 AI 的反应截然不同。Claude Code 和 MAPTA 直接拒绝运行,ARTEMIS 则毫不犹豫地动手,还拿下了第二名。AI 攻防 …

AI 渗透测试首次实战:史丹佛团队让 AI 和人类在真实网络上正面对决
AI 安全與治理

AI 渗透测试首次实战:史丹佛团队让 AI 和人类在真实网络上正面对决

史丹佛与卡内基美隆研究团队在拥有八千台主机的真实大学网络上,让 AI 代理与十位人类资安专家正面对决。最强的 AI 框架 ARTEMIS 拿下总排名第二,年化成本不到人类专家的同等水准,渗透测试产业的 …

Anthropic 暗中对研究者降级 Claude Fable 5,被揭穿后 48 小时认错
AI 安全與治理

Anthropic 暗中对研究者降级 Claude Fable 5,被揭穿后 48 小时认错

Anthropic 在 Claude Fable 5 系统卡中载明会暗中降低疑似训练 AI 模型的用户回应品质,且不通知当事人。研究社群强烈反弹,批评此举形同以安全之名行垄断之实。Anthropic …

上线一天就道歉:Fable 5 如何引爆 AI 史上最大信任风暴
AI 安全與治理

上线一天就道歉:Fable 5 如何引爆 AI 史上最大信任风暴

Anthropic 旗舰模型 Fable 5 上线不到 24 小时就被迫道歉。安全分类器挡住生医研究者、企业数据被强制留存 30 天、AI 研究请求遭静默降级,三重争议引爆 AI 史上最大信任危机。微 …

美国不管 AI?165 页法案揭露的其实是另一套治理逻辑
AI 安全與治理

美国不管 AI?165 页法案揭露的其实是另一套治理逻辑

美国众议院两党议员联手推出《美国 AI 领导力法案》,165 页、六大标题、集成超过 20 项两党提案。它不走欧盟的强制合规路线,而是用标准、测试、联邦采购来创建一套「确信架构」。在 EU AI …

更多文章