JEV 邀请函 ¥11:下单时留下你自己的邮箱,邀请发到你的邮箱里,账号由你自己注册持有。说明白一点:typesafe.ai 的候补名单本身是免费的,这里省的是排队时间。ClaudeMax 不是 TypeSafe 官方或授权渠道。去下单 · 先看它适合做什么

一句话:它是一次函数调用,不是一次对话

TypeSafe AI 在 2026 年 9 月 15 日发布了他们称为 System One Models 的新模型类别,以及第一个公开模型 Jev。 官方给它的定义是:把非结构化状态输入、把类型化的概率判断输出,像调用一个函数那样使用前沿智能。

名字来自卡尼曼对快思考与慢思考的划分。他们的判断是:软件里绝大多数决策其实是「系统一」式的快速判断——这属于哪一类、要不要升级处理、这条消息急不急—— 而我们一直在为这些判断租用「系统二」。

和现有 LLM 的逐项对照

下面这张表直接来自官方发布博文里的对照,左列是现有 LLM,右列是 Jev:

维度现有 LLMSystem One + Jev
训练目标RLHF / RLVR:人类偏好、可程序化验证的结果RLCD(Reinforcement Learning for Calibrated Decisions):带诚实概率的判断
输入非结构化数据,偏重连续对话消息非结构化数据,偏重结构化程序状态
输出字符串。灵活但需解析与校验,且可能跑偏类型安全的结构化值,结构预先定义,不会产生类型错误,每个答案附校准概率与置信度
采样串行,逐 token 生成并行,一次查询生成全部输出
成本输入 $0.20–$10 / 百万 token;输出约为输入的 5 倍输入 $0.042 / 百万 token;输出免费
端到端延迟3–329 秒70ms–500ms
置信度即使要求给出置信度,也常常过度自信且不一致每个输出都带置信度,且是校准的:置信度越高准确率越高

最后一行是最容易被略过、但对工程落地最关键的一条。官方的说法很直白:如果一个模型 95% 的情况能做对,却不告诉你什么时候落在那 5% 里,你就没法把这件事自动化。校准置信度的意义在于你可以设阈值:高于多少自动执行,低于多少转人工。

三种问题原语

按 Cloudflare 的模型文档与 Pydantic AI 的集成说明,Jev 回答三类类型化问题,并且三类可以共用同一次请求

原语问什么典型用途
Noul是否为真(带概率)这条请求有没有害?这个订单符不符合退款政策?
Choice从你给定的选项里挑一个这张工单属于哪个分类?该路由给哪个团队?
Score在你定义的量表上给一个位置紧急程度打几分?内容风险有多高?

Pydantic AI 的文档里给了一句很实用的补充:多加字段几乎是免费的——所有字段在同一次请求里一起出去, 一个只在部分输入上才需要的字段,成本体现在 token 上而不是时间上。换句话说,一次问清所有判断,比分几次问划算得多。

它明确不做什么

  • 不生成文本。不写聊天回复、不写代码、不写文案。
  • 不解释答案。它给判断和概率,不给理由。需要理由的场景要另外安排。
  • 不做摘要、不填自由文本字段。

所以它不是 ChatGPT 或 Claude 的替代品,而是把系统里那部分「本来就该是判断、却被迫用生成模型来做」的活儿接走。 哪些活儿属于这一类、怎么算清换过去省多少,见 Jev 实战:哪些判断该换、怎么接进系统

四条需要你自己验证的说法

  1. 基准是厂商自测。官方演示里 Jev 用 0.114 秒、花费 $0.000081,GPT-5.6 Terra 用 8.566 秒、花费 $0.013880,TypeSafe 据此称快 193.6 倍、便宜 444.6 倍。第三方报道明确指出这些数字来自 TypeSafe 自己的工作流评测。拿你自己的数据跑一遍再下结论。
  2. 架构未公开。没有公布权重、参数量,也没有自托管方案,目前只有托管 API。
  3. 上下文 32,000 token,且仅文本。不少真实负载装不下,长文档、多模态场景直接出局。
  4. 仍是早期访问。候补名单制,服务稳定性与定价都可能变化。

把这四条写清楚不是唱反调。恰恰相反:一个只给判断、还诚实告诉你自己有多确定的模型,如果数字属实,对工程化是很有价值的。 但「如果属实」这四个字得由你的数据来回答。

怎么拿到访问权限

官方途径:免费。去 typesafe.ai 点 Join Waitlist 加入候补名单。官方在发布博文里写明正在「尽快把开发者从候补名单放出来」。 这一步不花钱,如果你不着急,这就是标准做法。

不想等:ClaudeMax 上架了「JEV 邀请函」(¥11)。下单时留下你自己的邮箱,邀请发到你的邮箱里, 之后账号由你自己注册和持有。按站内邮件类商品的口径,通常 10–30 分钟内发送到你填写的邮箱;付款后规定时间内未交付全额退款。

两点要说在前面:候补名单本身免费,这笔钱买的是排队时间,值不值取决于你多急着开工; 另外 TypeSafe 的使用条款写明站点使用许可「仅供个人使用、不可转让」,所以务必把邀请发到你自己要用的那个邮箱,账号自己注册,不要去买别人已经在用的账号。 ClaudeMax 不是 TypeSafe 官方,也不是其授权渠道——这一点和我们对其他产品的口径一致,见 代理商尽调清单

拿到之后先做什么

  1. 找一个你系统里已经在用 LLM 做判断的地方:分类、路由、风险打标、优先级排序。
  2. 把同一批真实输入同时跑 LLM 与 Jev,比三件事:准确率、端到端延迟、单次成本。
  3. 看校准是否成立——把结果按置信度分桶,检查高置信度桶的准确率是不是真的更高。这是决定能否自动化的关键。

具体的决策盘点方法、成本算例,以及通过 Pydantic AI 与 Cloudflare Workers AI 接入的写法,见 实战篇

一句话总结

Jev 把「判断」从生成模型里拆了出来:输出类型安全、带校准概率、并行返回、输出免费、延迟毫秒级。 它不替代 ChatGPT 和 Claude,它替代的是你系统里那些本不该由生成模型来做的判断。 候补名单免费,着急就买张邀请函省时间。