动察 Beating AI 快讯,Hugging Face CEO Clement Delangue 宣布成立 Open Alignment Initiative,由联合创始人 Thomas Wolf 牵头,并公开申请加入 Anthropic 刚提出的「嵌入式评估员」计划。如果获批,Hugging Face 的评估人员可以长期驻场,拿到接近员工级的访问权限,直接检查模型训练和安全措施。
Delangue 称,AI 对齐不能继续关在少数前沿实验室内部解决,需要让更多外部研究者参与。Anthropic 已承诺向第三方开放这类权限,包括工位、门禁、公司电脑和接近内部风险团队的工具,并允许评估方独立公布结论。
币须知道