Jev 之后,中国团队开源决策模型抢位
速览
- Jev 把「判断」从「生成」中剥离,只回答单选、打分或是否题,返回带概率的结构化结果
- 两周内 OpenAI、Cloudflare、亚马逊相继跟进,决策模型从首发走向群战
- 国内团队几乎一致选择开源与本地化,补上 Jev 闭源、仅云端调用的缺口
- StartLux 由陈大年任 CEO、郭权玮任 CTO,定位本地模型与个人 AI 系统
- StartLux 称 3 天完成决策模型,归功于其 Auto Research 体系
- 郭权玮承认长任务稳定性、异常恢复、上下文管理比跑通模型更难
- StartLux 首个面向公众的本地智能体验版本计划年内推出
9 月 15 日,前 OpenAI 研究员 Diogo Almeida 创办的 TypeSafe AI 发布决策模型 Jev,它不生成文字,只回答带预设选项的问题,返回带概率的结构化结果,定价为每百万输入 token 0.042 美元、输出免费。两周内,OpenAI 在开发者日推出 Decisions API,Cloudflare 于 10 月 1 日开源 Clef,亚马逊放出 Strands Decider。国内方面,上海人工智能实验室开源多模态决策模型 Intern-Decision,提供 0.8B、2B、4B 三档,称推理速度比 Jev 快 2 到 3 倍;成立不到五个月的上海公司 StartLux(原点星辉)于 9 月 30 日开源 StartLux-Decision,覆盖 0.8B 到 27B 五档并配齐量化文件,宣称 27B 版本在 Decision Index 0.2.1 的 38 项测试中 31 项高于 Jev 1.13,综合分 63.88 对 57.91。StartLux 由盛大网络联合创始人陈大年任 CEO、郭权玮博士任 CTO,主打本地部署,其 4B 版本 Q4 量化后约 2.71GB,与原始权重决策一致率 98.3%。值得注意的是,Cloudflare 的 Clef、亚马逊 Strands Decider 与 APUS 方案均基于 Qwen 后训练。
关键事实
- 9 月 15 日 TypeSafe AI 发布 Jev,定价每百万输入 token 0.042 美元、输出免费,上线 24 小时内 Vercel AI Gateway 上 13% 的付费用户使用,是此前任何模型发布的两倍
- OpenAI 在开发者日推出 Decisions API,Cloudflare 于 10 月 1 日开源 Clef,亚马逊放出 Strands Decider
- 上海人工智能实验室开源 Intern-Decision,提供 0.8B、2B、4B 三档,称推理速度比 Jev 快 2 到 3 倍
- StartLux 于 9 月 30 日开源 StartLux-Decision,27B 版本在 Decision Index 0.2.1 的 38 项测试中 31 项高于 Jev 1.13,综合分 63.88 对 57.91
- StartLux 4B 版本 Q4 量化后约 2.71GB,与原始权重决策一致率 98.3%
- Cloudflare Clef、亚马逊 Strands Decider 与 APUS 方案均基于 Qwen 后训练
为什么值得关注
对开发者而言,决策模型把高频判断做成廉价基础设施,本地部署方案让数据敏感场景有了替代选择;但品类两周即可被复制,壁垒可能不在模型层,而在把模型组装成产品的能力。
背景与影响
决策模型源自卡尼曼「系统一/系统二」框架,TypeSafe 将 Jev 称为 System One 模型,针对 Agent 运行中大量琐碎判断而非深度推理的需求。Jev 闭源托管、无公开权重、不能本地部署,为开源与本地化方案留出空间。这一轮热潮中,Qwen 成为中国开源基座,被 Cloudflare、亚马逊等全球玩家用于后训练。
本文整理自公开报道,版权归原作者所有;文中观点仅供参考,不代表本站立场。如有版权问题,请联系我们。