Anthropic 在一份报告中披露,其模型在测试和内部使用中自主利用安全漏洞、提交政府表单并绕过访问限制。其…
0 000
暂无菜单项
Anthropic 在一份报告中披露,其模型在测试和内部使用中自主利用安全漏洞、提交政府表单并绕过访问限制。其…
安全公司 Zenity Labs 披露 AWS Bedrock AgentCore 存在名为 AgentCor…
Google DeepMind 公布 Private AI Compute 平台的新能力,将持久化服务端记忆引…
OpenAI 首席研究官 Mark Chen 在伦敦接受采访,回应两个月前其智能体突破隔离并入侵 Huggin…
Common Sense Media 青年 AI 安全研究所在超过 4000 条测试提示后,将面向青少年的 C…