智库警告:顶尖AI企业安全表现不佳 榜首Anthropic评级仅C+



(纽约8日法新电)根据周二发布的一份报告,美国人工智能(AI)实验室Anthropic在半年度安全排名中得分最高,但从全球来看,该行业未能有效应对“生存级”威胁。
总部位于美国的AI安全智库“未来生命研究所”对全球9家领先的AI公司进行了排名。Meta上升两位至第四名,而xAI下降三位至第七名,排在中国DeepSeek和法国Mistral之前,后者排名垫底。
ADVERTISEMENT
7名研究人员和治理专家根据公开数据及企业提供的信息确定了排名。
他们在六个不同类别中评估了各公司的努力:风险评估、当前危害、安全框架、生存安全、治理与问责以及信息共享。
没有一家公司在任何单一类别中获得“A”级,而Anthropic以“C+”的综合成绩位居榜首。
Mistral首次被列入榜单,但当法新社要求其对垫底排名发表评论时,该公司表示,报告框架不适合其开发AI模型的方法。
这家法国公司开发所谓的“开放模型”,允许用户下载和修改。其许多竞争对手开发的是“封闭式”AI模型,包括Anthropic、OpenAI和谷歌 DeepMind,这些公司也在报告之列。
麻省理工学院教授兼未来生命研究所所长泰格马克告诉法新社:“我非常失望地发现它们排名垫底,尤其是考虑到欧洲实际上一直是AI安全领域的领导者。”
他补充道,“我们联系了很多很多次”,但Mistral没有回应研究所的调查。
该组织表示,阿里巴巴、xAI和DeepSeek也未回应其调查。
报告中纳入的三家中国开发商也生产开放模型,排名均处于下半部分:DeepSeek(第五)、阿里云(第六)和智谱(第八)。
报告指出,几家此前禁止将其技术用于军事目的的公司已“逐渐转变立场”,其中包括Anthropic。报告批评其存在“可疑的军事参与”。
据多家媒体报道,过去一年中,美国政府曾在委内瑞拉和伊朗的军事行动中使用Anthropic的技术,惟该公司最近因在AI安全问题上存在分歧而被五角大楼禁止使用。
报告称,所有九家公司在应对“生存级”威胁方面均未达标,例如开发达到人类水平智能的模型,即所谓的“通用AI”或AGI。
尽管“存在建设性的尝试”,但各方的努力“完全不够”。
其他风险包括模型可能被滥用于发动网络攻击或执行对人类有害的任务。
Anthropic最近因其发布了迄今为止最强大的模型“Mythos”而成为焦点。
四月初,这家总部位于旧金山的公司仅向少数受信任的组织发布了Mythos,因为该模型具有向恶意行为者暴露网络安全漏洞的能力。
然而,到6月12日,美国政府以国家安全为由,阻止Anthropic向外国人发布Mythos。
特朗普政府最终在几周后的6月30日解除了这一禁令。
ADVERTISEMENT
热门新闻
百格视频
ADVERTISEMENT


