9 月 15 日,前 OpenAI 研究员 Diogo Almeida 创办的 TypeSafe AI 发布 Jev。它不生成文字,只做判断。两周内,同类动向集中出现:OpenAI 在开发者日推出 Decisions API,Cloudflare 于 10 月 1 日开源 Clef,亚马逊发布 Strands Decider。国内,上海人工智能实验室开源多模态决策模型 Intern-Decision;9 月 30 日,成立不到五个月的上海公司 StartLux(原点星辉)发布开源的 StartLux-Decision,并称在公开评测中超过 Jev,其掌舵人是盛大网络联合创始人陈大年。

TypeSafe 把 Jev 称为 System One 模型,名字来自卡尼曼《思考,快与慢》。过去两年大模型多在系统二方向投入,但 Agent 跑起来之后,密集出现的是琐碎判断:工单分给谁、命令能否放行、下一步点哪个按钮、任务是否完成。这些判断此前要么由大模型顺带生成再解析,要么写成固定规则。Jev 只回答带预设选项的问题,返回带概率的结构化结果,每百万输入 token 定价 0.042 美元,输出免费。Vercel 披露,Jev 上线 24 小时内,其 AI Gateway 上 13% 的付费用户开始使用,是此前任何模型发布时的两倍。不过 Jev 闭源托管,没有公开权重,也不能本地部署。
这个缺口成了后来者的入口。Intern-Decision 开源 0.8B、2B、4B 三档,主打多模态,团队称推理速度比 Jev 快 2 到 3 倍。StartLux 则给出 0.8B 到 27B 五档规格,配齐量化文件,面向本地部署。按其公布的数据,27B 版本在 Decision Index 0.2.1 的 38 项测试中有 31 项高于 Jev 1.13,综合分 63.88 对 57.91,另有一组国际象棋对弈 36 局赢下 35 局。这些是团队基于公开工具、对照 9 月 28 日榜单快照完成的自测。StartLux 发布次日,Cloudflare 即称 Clef 在同一榜单上领先。
比起排名,中国团队大多选择开源与本地化更值得留意。Jev 只能走云端,对数据敏感或有跨境调用顾虑的开发者构成门槛,开源权重正好补位。另一处细节是,Cloudflare 的 Clef 基于 Qwen 后训练,亚马逊 Strands Decider 与 APUS 的方案也以 Qwen 为底座。








