跳到正文
原文
arXiv 机器学习· Amir Rafe, Subasish Das·· 5 小时前AI 评分36

面向自动决策门控评测 System One 决策模型与语言模型

Benchmarking System One decision models against trained classifiers and language models for automated decision gates

AI 导读

一项新研究针对自动化决策门控场景,评测了包括托管模型 Jev 在内的 System One 决策模型与监督分类器、生成式语言模型的性能表现。结果显示,有任务标签时小型训练分类器在意图识别上最准确,无标签时多数决策模型优于零样本蕴含分类器。采用意图训练的初级模型级联至 Jev,可在满载 GPU 下以 0.43 的成本匹配其准确率。

来源:arXiv 机器学习 · arxiv.org