公司正在部署强大的 AI,但安全性测试缺乏标准化。每个团队都在重复发明评估方法。
一个提供可配置测试套件的平台,用于检测有害输出、偏见、越狱等。将提供可跨模型比较的分数。
AI 实验室愿意为彻底的测试付费。监管机构可能会采纳作为标准。
MVP:为文本生成模型提供一套基础测试。
风险:需要深厚的安全专业知识来创建有效的测试。
创建一套标准化的测试来评估 AI 模型安全性,提供跨不同风险类别的可复现基准。
随着 AI 能力的增长,系统化安全测量的需求也随之增加。
公司正在部署强大的 AI,但安全性测试缺乏标准化。每个团队都在重复发明评估方法。
一个提供可配置测试套件的平台,用于检测有害输出、偏见、越狱等。将提供可跨模型比较的分数。
AI 实验室愿意为彻底的测试付费。监管机构可能会采纳作为标准。
MVP:为文本生成模型提供一套基础测试。
风险:需要深厚的安全专业知识来创建有效的测试。