开发人员花费数天时间测试本地模型。创建跨硬件配置的速度/准确性的标准化基准测试。通过专业测试套件获利。先从 Llama 2/Mistral 的比较开始。风险:快速的模型迭代会使基准测试过时。
aiprivacy
本地 AI 模型基准测试工具
构建一个工具,用于在消费级硬件上比较离线 LLM 的性能。面向注重隐私的专业人士。
为什么是现在
随着本地 AI 选项的增多,用户需要帮助来选择合适的模型。
- 做给谁
- AI 开发者
- 商业模式
- 专业功能
- 投入量级
- 一个周末
构建一个工具,用于在消费级硬件上比较离线 LLM 的性能。面向注重隐私的专业人士。
随着本地 AI 选项的增多,用户需要帮助来选择合适的模型。
开发人员花费数天时间测试本地模型。创建跨硬件配置的速度/准确性的标准化基准测试。通过专业测试套件获利。先从 Llama 2/Mistral 的比较开始。风险:快速的模型迭代会使基准测试过时。