Jev introduces a new shape of LLM
5 hours ago
- TypeSafe AI 发布了 Jev,一种新的“System One”决策模型,它输出用于分类、是/否答案和评分的浮点数,并带有置信度分数,而不是生成文本。
- Jev 非常快速且便宜:输入成本为每百万 tokens 0.042 美元,输出免费,使其比 GPT-5 Nano 更便宜。
- 它回答三种问题类型:是/否(Noul)、选择(从带有概率分布的选项中选择一个)和评分(在带有描述的数字量表上评分)。
- 应用包括分类任务,如垃圾邮件检测、标记、优先级排序和搜索重排序(例如,对 100 个 BM25 结果进行相关性评分)。
- 顾虑包括其黑盒性质、缺乏可解释性和潜在偏见;在部署前进行严格的评估至关重要。
- 社区已经使用 Jev 构建了非常规工具,例如一个糟糕的聊天模型(jevchat)、一个左填充实现(jev-leftpad)和一个 2048 游戏玩家(jev-2048)。
- 在发布后的一周内,出现了基于 Qwen 3.5 的 Kev 等开放权重复现,以及 JevBench 基准测试。