热点事件观察中
个人评测小型置信度打分决策模型 Jev 与 Laya
1 篇报道1 个报道来源1 天前更新
先了解这件事
AI 综述
2026 年 9 月 30 日,一位作者在 Reddit r/MachineLearning 发布对两款小型置信度评分模型的自建基准对比。这两款模型不做文本生成,只对候选标签输出置信度评分:一款是 TypeSafe AI 托管的 Jev 1.13.0,另一款是开源替代品 Laya。评测结果显示,Jev 校准良好,ECE 为 0.013;在 90% 置信度过滤下,将支持意图分类的准确率从 92.3% 提升到 97.6%,覆盖 82% 的案例。而未调优的 Laya ECE 为 0.486,校准明显较差。以上为该报道目前披露的全部事实,事件暂无后续进展。
AI 根据报道生成 · 2 小时前更新
最新进展9月30日 20:41
作者发布自建基准,显示 Jev 校准(ECE 0.013)显著优于未调优的 Laya(ECE 0.486)。报道时间线
沿着报道,了解事件的不同侧面。
9月30日
- Reddit r/MachineLearning小型置信度评分模型 Jev 与 Laya 自测基准对比
作者对两款不做文本生成、只对候选标签输出置信度评分的小型分类模型做了自建评测:TypeSafe AI 托管的 Jev 1.13.0 和开源替代品 Laya。Jev 校准良好(ECE 0.013),在 90% 置信度过滤下支持意图分类准确率从 92.3% 提升到 97.6%,覆盖 82% 案例;未调优的 Laya ECE 为 0.486。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。