Anthropic与埃森哲Faculty合作,嵌入人工智能安全评估员
此次合作将独立审计员直接引入公司开发实验室,标志着人工智能安全领域的一种新方法。


PENN Explainer
Hear this story explained in 90 seconds.
人工智能行业迎来重大举措,Anthropic宣布与埃森哲(Accenture)旗下的Faculty部门建立新的合作伙伴关系,以加强其前沿模型的安全性和对齐性。该协议于2026年9月18日敲定,建立了一个框架,使独立评估员能够直接在Anthropic的研究和部署团队中工作。此举旨在为先进的人工智能系统在向公众发布之前提供更高水平的透明度和严格测试。两家公司已承诺在未来五年内各投入至少10亿美元来支持这项工作。这笔资金将专门用于红队测试、对齐评估和全面的保障测试。通过引入这些评估员,Anthropic旨在确保其开发流程与其既定的安全目标保持一致。评估员将获得员工级别的权限,可以接触公司的培训和部署决策,从而实现实时监督。这种级别的访问权限旨在帮助识别仅靠外部审计可能忽略的潜在风险。Anthropic首席执行官达里奥·阿莫迪(Dario Amodei)此前在其关于人工智能开发的论文中强调了这种内部进度控制和监督的重要性。该合作伙伴关系是非排他性的,Anthropic表示目前正在与其他组织(包括非营利组织METR)试行类似的安排。这一战略反映了领先的人工智能实验室在安全方面采取更主动和协作方式的增长趋势。随着人工智能模型能力不断增强,该行业正面临来自监管机构和公众的更大压力,要求证明这些系统是安全可靠的。此举被视为对在快速发展的生成式人工智能领域建立更稳健治理需求的回应。通过将独立专家整合到其核心运营中,Anthropic希望为该行业的问责制树立新标准。预计此次合作将提供宝贵的数据和见解,有助于塑造未来全行业的安全协议。随着项目的进展,这些嵌入式评估员的研究结果可能会影响其他公司开发强大人工智能技术的方式。
Ask the Author
Subscribers can ask the journalist a question about this story. Subscribe to ask.
中立性说明
Auto-harvested from global news wires and presented neutrally by PENN.
to vote
Comments
No comments yet — be the first to share your thoughts.



