Span-01:专门用于监测和评估其他AI输出的模型
监测AI出错不用再调用GPT逐字打分了,Span-01一次运算直接出结果,完整版每百万词元才0.02美元,还有免费Lite版可试。
Span-01 是一款专用于 AI 质检的模型,将推理和判定合并在一次运算中完成,直接输出结果概率,避免了调用 GPT 这类大型模型逐字打分带来的高成本与慢速度。它能同时核对多条规则,也支持开发人员临时给出的全新判定规则。在越狱攻击、隐私泄露、胡言乱语和工具调用错误的测试中,其综合得分超过同类专用小模型和部分主流大型模型。定价上提供免费的 Span-01 Lite,完整版每百万输入词元收费 0.02 美元。
Span-01:专门用来监测和评估其他AI的模型
质检专用版Jev。
以往监测 AI 是否犯错,很多团队习惯直接调用 GPT 这样的大型语言模型来逐字打分,或者使用传统的分类程序。传统的分类程序运行速度快,但面对未见过的全新问题时容易失误;大型通用模型虽然判断准确,但逐字输出的机制导致运行速度慢,花费也很高。
Span-01 解决了这个问题。它把推理和判定合在了一次运算中完成,直接输出结果概率。就算面对开发人员临时给出的全新判定规则,Span-01 也能一边看懂长对话记录,一边同时核对多条规则。
在针对 AI 实际表现的测试中,Span-01 在发现越狱攻击、隐私泄露、胡言乱语以及工具调用错误等问题上的表现,综合得分超过了同类的专用小模型,也超过了部分主流大型模型。
费用方面,官方推出了完全免费的 Span-01 Lite 版本,而完整版 Span-01 每百万输入词元的调用费用为 0.02 美元。
怎么一下子冒出好多这种模型?
官方介绍:https://t.co/K6Y0Jc3b3u