- 文集信息
- 目录大纲
- 最新文档
- 知识宇宙
文集详情
文集导读
Jev 决策编程
把大模型变成软件里的"智能 if 语句":状态进,判断出,概率随行。
这本教程讲什么
本教程系统讲解 Jev——TypeSafe AI 于 2026 年 9 月发布的首个 System One 模型(系统一模型)。
Jev 不是聊天模型。它的用法是一次函数调用:输入程序状态(state)与一组带类型的约束问题(questions),输出每个问题一个类型安全的答案,附带着校准过的概率与置信度。它专为软件里的判断型决策设计——分类、路由、评分、排名、验证、护栏——而不是写文章、写代码、聊天。官方与社区把它概括为"一条智能 if 语句":你代码里所有 if 只能判断机器可计算的条件,Jev 把"这封邮件是否紧急""这条 shell 命令是否危险"这类需要理解语义的判断也变成了可以放进 if 的表达式。
本教程基于官方博客、官方文档与多篇独立评测整理编写(事实来源清单见文末),全教程按"理解 → 使用 → 应用 → 生产化"四篇推进,示例代码覆盖 curl、Python、Node、LangChain 与 Vercel AI SDK,全部内嵌在小节 markdown 中,随读随拷。
重要说明:Jev 处于早期访问阶段(发布于 2026-09-15),API 细节、限速与模型行为可能变动;教程中性能数字(快 193.6 倍、便宜 444.6 倍等)为厂商自报的评测上界。批判性观点集中在第 10 章——约束输出的形状,不约束判断的正确性,这句话值得在写第一行代码之前记住。
学习路径一览
全教程四篇十一章,遵循「理解 → 使用 → 应用 → 生产化」的主线:
你也可以按需要跳读:
- 只想"10 分钟跑通第一个调用"→ 看 第 4 章(前置:第 3 章的问题类型);
- 手头有个分类/路由/护栏需求 → 直接看 第 6~7 章 对应模式;
- 准备上生产 → 重点读 第 8~9 章(影子模式、校准验证);
- 技术选型、评估要不要用 → 读 第 1、2、10 章;
- 已在用,想查参数/限制 → 附录 B(API 速查表)。
章节目录
导览
第 0 章 导览(2 节)
Jev 的三十秒版本、这本教程的定位与读者、学习路线与使用约定。
第一篇 · 理解 Jev
第 1 章 背景与由来
"模型聊天超越人类多年,自动化在哪里"——TypeSafe AI 的出发问题;Jevons 悖论与卡尼曼"系统一"两个名字的深意;关键词/小分类器/LLM 三种现有办法各自的困境。
第 2 章 核心心智模型
输入与输出(状态+问题 → 约束答案+概率);"选牌不报牌"——判断题与生成题的分界;Jev 与 LLM 是互补的系统一/系统二,而非替代。
第 3 章 三种问题类型
Noul(是非题)、Choice(单选题)、Score(刻度评分)三种原语的设计准则与反例,以及"遇到判断先选型"的决策树。
第二篇 · 使用 Jev
第 4 章 快速开始
从 curl 裸调协议,到 Python/Node 官方 SDK,再到 LangChain 与 Vercel AI SDK 集成——五种环境跑通同一个决策。
第 5 章 核心机制
并行求值与"投机性扇出"经济学;RLCD(面向校准决策的强化学习)为什么让概率第一次可以作为工程契约;概率、置信度与门控阈值。
第三篇 · 应用 Jev
第 6 章 分类、路由、评分
三大基础应用模式:工单分类的选项表设计、意图与模型路由、多维复合评分——每节含完整可运行代码。
第 7 章 排名、验证、护栏
三大进阶应用模式:逐项打分再排序、LLM 输出的多闸门验证、Agent 工具调用的命令护栏——每节含完整可运行代码。
第四篇 · 生产化
第 8 章 工程化生产
状态设计与请求纪律、影子模式四步上线法、成本速算与限速、超时重试与版本钉死等可靠性工程。
第 9 章 评测与校准
回归集(Jev 开发的"单元测试"循环)、可靠性曲线与 ECE 的完整实现、用代价函数选门控阈值——别信任何模型的校准宣传,包括 Jev 的。
第 10 章 边界、批判与生态
Jev 明确不擅长的事(数学、计数、日期、对抗文本…);核心批评"约束形状≠约束判断"与 schema 设计方法论;与规则引擎/传统分类器/LLM 的选型对比;SDK、集成与社区资源。
附录
- 附录 A 术语表:System One、Noul/Choice/Score、RLCD、校准、ECE……
- 附录 B API 速查表:端点、请求/响应结构、限制、价格、错误码。
- 附录 C 练习题:8 道概念/实践/设计题,附提示。
说明
- 运行环境:示例以 Python ≥ 3.10、Node ≥ 20 为主;需要环境变量
TYPESAFE_API_KEY(console.typesafe.ai 申请,早期访问阶段)。 - 代码分发:全部代码内嵌于对应小节,文件名在代码块首行注释标注;第 9 章校准脚本内置 MOCK 模式,无 Key 可本地演示。
- 时效:信息截至 2026-09-21;性能数字为厂商自报上界,独立复现仍在早期。
- 立场:本教程既讲能力也讲边界——第 10 章的批判不是泼冷水,而是把"schema 设计成为一等编程技能"这件事讲清楚。
参考来源
- TypeSafe AI 官方发布博文:Introducing System One Models & Jev — typesafe.ai/blog/introducing-system-one-models-and-jev
- LangChain:What Is Jev? / Building a Harness with Jev — langchain.com/blog/building-a-harness-with-jev
- Flavio Copes:Jev 深度评测(API 细节、实测数据、失败模式) — flaviocopes.com/jev
- DataCamp:System One Models & Jev — datacamp.com/blog/system-one-models-jev
- Anthony Maio(Substack):"Jev constrains the shape of the output. It does not constrain the judgment." 批评出处
- Sean Goedecke(pearpages):Jev, Sorted: What TypeSafe's 'System One' Model Actually Is
- TypeSafe AI 官方文档与快速开始 — docs.typesafe.ai
- dev.to / aihubmix / mindstudio / cloudraft / tensorplay / aisignal 等独立解读与实测
- Kahneman《思考,快与慢》;Jevons 悖论相关经济学文献
目录大纲
最新文档
知识宇宙
正在加载知识图谱...