Anthropic引入埃森哲评估人员,测试先进AI模型安全性
产联社编译

图片由AI生成
9月18日,据彭博社报道,人工智能公司Anthropic正在与管理和技术咨询公司埃森哲(Accenture)合作,由埃森哲评估人员直接进入Anthropic内部,对其先进人工智能模型进行安全测试。
Anthropic周五表示,埃森哲的评估人员将对公司最新的模型开展攻击性测试,检查模型的安全防护措施,并评估模型的行为是否符合人类设定的目标。评估人员在Anthropic内部获得的信息和系统访问权限,将与Anthropic员工大致相当。
埃森哲表示,其驻场评估人员将密切跟踪人工智能模型在训练中的演变过程,并观察Anthropic公司在开发其技术时的幕后决策过程。
Anthropic表示,评估人员可以借此检查公司的运营方式,核实其是否履行安全承诺,发现可能被忽视的风险,并报告安全事件,从而帮助公众更全面地了解人工智能带来的收益和风险。
Anthropic称,公司与埃森哲预计将在这一领域投入至少10亿美元,用于扩大相关评估能力。
埃森哲与Anthropic此前已建立密切合作关系。去年,埃森哲与Anthropic达成一项多年期合作协议,帮助企业部署人工智能。双方组建了一支3万人的团队,团队成员将接受Claude相关培训,以协助客户扩大人工智能系统的应用规模。今年3月,埃森哲还发布了由Anthropic旗下Claude模型支持的安全解决方案Cyber.AI。
不过,鉴于埃森哲与多家大型人工智能初创企业关系密切,外界可能会质疑埃森哲在此次合作中能否真正发挥“第三方”评估机构的作用。今年早些时候,埃森哲预计,未来一年,公司与Anthropic、OpenAI和Palantir等主要人工智能合作伙伴开展的业务规模将增长一倍以上。
近期,市场对先进人工智能模型安全风险的担忧进一步升温。Anthropic首席执行官达里奥·阿莫代伊(Dario Amodei)此前在一篇约3800字的文章中呼吁放慢先进人工智能模型的开发速度,并表示将采取新的安全措施,以降低人工智能模型在开发和应用过程中可能带来的风险,包括引入第三方评估人员。
除了阿莫代伊外,OpenAI首席执行官萨姆·奥尔特曼(Sam Altman)等多名人工智能公司负责人近日也呼吁放慢技术开发速度,以应对人工智能风险日益难以预测的问题,但各方对具体应对方式仍存在分歧。
商务合作,请联系侯经理 18801065284(微信同号)
报料及内容合作,请联系chanlianshe2026(微信号)
特别声明:本文仅供参考,不构成任何投资建议,未经允许不得转载。

