红队测试

  • 马斯克提议AI巨头发布前交叉测试:同行评审能否成为模型安全新防线?

    大模型发布前的安全测试多由开发企业自评,发布时间表和内部目标可能影响评估结果。马斯克9月15日在All-In峰会提议,AI巨头可在模型发布前开放受控API,由同行交叉测试,把安全验证从内部流程推向外部审查。但该建议目前只是个人倡议;OpenAI与Anthropic的联合评估显示技术可行,却无法自动解决竞争利益与责任归属,API开放也不等于对模型安全的独立证明。同行评审能否成为模型发布前的新防线?

    2026年9月16日
    13