AI 对齐领域的研究人员不断寻求更好的工具来评估其模型的行为并使其与人类价值观保持一致。专用研究工具可以帮助简化他们的评估并改善结果。来自学术机构或专注于 AI 安全的公司提供的资金可以支付其开发费用。最小版本可以包括基本的评估指标。最大的风险是 AI 和人类价值观对齐的复杂性。
airesearchethics
AI 对齐评估研究工具
创建工具以协助 AI 对齐研究。目标用户是从事 AI 伦理和安全研究的研究人员。
为什么是现在
随着 AI 对齐变得至关重要,对有效研究工具的需求日益增长。
- 做给谁
- AI 研究人员和伦理学家
- 商业模式
- 补助金或订阅
- 投入量级
- 几个月