随着 AI 系统声称具有道德行为,买家缺乏验证这些说法的途径。一个框架可以运行标准化的场景测试,根据声明的原则衡量实际系统响应。出售给在受监管行业部署 AI 的企业。从针对常见对齐失败的测试用例开始。挑战在于随着模型的快速发展,保持测试的相关性。
aiethicscompliance
AI 对齐审计框架
创建标准化测试,以评估 AI 系统在多大程度上遵循其声明的道德准则。帮助组织验证对齐声明。
为什么是现在
对未经检查的 AI 对齐声明日益增长的担忧,产生了对验证工具的需求。
- 做给谁
- 企业 AI 买家
- 商业模式
- 许可审计
- 投入量级
- 几个月