1. Jev 的基本概念
定位:Jev 不是聊天模型,而是专为程序的“判断题和选择题”打造的极速小模型/判断助手。
背景与团队:由旧金山创业公司 TypeSafe 开发(创始人为前 OpenAI 员工、InstructGPT 论文作者之一 Diogo Almeida)。
特点与命名:闭源(仅提供云端 API),名字来源于经济学家 William Stanley Jevons。
2. 核心功能与优势
支持题型:仅做判断题(Noul)、选择题(Choice,最多 255 个选项)和打分题(Score),不编写长文本或聊天。
高效并行:支持一次读取材料,多题并行处理,响应仅需几毫秒至几百毫秒。
极致性价比:大多数情况下响应速度为 100ms,价格为 1M token 仅需 4 美分,相比传统大模型“100 倍快,400 倍便宜”。
3. 技术路径与核心原理
限制输出空间:区别于传统大模型的自回归逐字生成,Jev 直接限制输出空间(仅计算选项/分数/布尔值的概率分布),大幅提速(70-500ms)。
核心技术:采用概率校准(RLCD),提升输出预测的精准度,补齐 AI 的“System 1”(高速直觉判断)能力。
4. 应用场景与调用方式
典型应用:适用于自动化流程(如新闻真伪)、客服系统工单分类、Agent 路由控制、浏览器 Agent、游戏决策及安全检测等。
接入途径:可以通过官网排队(typesafe.ai)、Vercel AI Gateway、Cloudflare AI 接入,也可借助 Claude/Cursor 编写代码。
5. 局限性与未来愿景
当前短板:数载/算数/日期推算不准、多级推理容易出错、中文准确率较低、存在 Prompt Injection 风险,且不适合退款/亲属确认等高风险操作。
未来趋势:未来的 AI 调用架构将是“大模型当导师,小模型当传令兵”。#jev