首页 / 资讯 / ChatGPT联合创始人的新Jev模型摒弃文本,实现AI决策速度提升200倍
AI模型

ChatGPT联合创始人的新Jev模型摒弃文本,实现AI决策速度提升200倍

2026年9月20日6 分钟阅读
ChatGPT联合创始人的新Jev模型摒弃文本,实现AI决策速度提升200倍

新闻摘要

一家由ChatGPT背后研究人员之一创立的初创公司推出了一款AI模型,该模型完全跳过自然语言,转而返回结构化的概率决策而非文本——早期测试者表示,在其针对的任务上,它比主流大语言模型快得多、便宜得多。这款名为Jev的模型来自TypeSafe AI,该公司由Diogo Almeida创办,他曾是OpenAI的研究员,被誉为基于人类反馈的强化学习(RLHF)的共同发明人,这一训练技术被广泛认为使ChatGPT及其后续产品得以大规模可用。

TypeSafe AI宣布了什么

TypeSafe AI在2026年9月16日星期二美国东部时间结束了为期两年的隐身工作,揭晓了其所谓的“系统一模型”。与GPT风格的大语言模型逐词生成对话文本不同,Jev被设计为直接由其他软件消费:它接收结构化输入并返回带类型、带概率评分的输出——例如,对请求进行分类、对记录评分或标记政策违规——完全不生成任何文字。该公司表示已筹集4000万美元资金,以追求Almeida所描述的“AI研究的另一条路径,专注于机器原生AI”。

Jev与传统LLM有何不同

Jev使用TypeSafe称为“校准决策强化学习”(RLCD)的技术进行训练,该公司将其定位为当前大多数面向聊天模型所依赖的RLHF和RLVR(基于可验证奖励的强化学习)方法的继任者。Jev不是逐词按顺序预测输出,而是在单次查询中并行采样其所有可能的输出。由于开发者预先定义了固定的输出模式,TypeSafe表示该模型在数学上被约束为不会产生畸形或“幻觉”结果——它只能返回符合所给模式的值。

Almeida将此次发布定位为解决他所看到的行业空白:“模型在聊天方面已经超人多年,那么所有的自动化在哪里?”其卖点在于,大多数软件仍然依赖脆弱的、手写的规则或缓慢、昂贵的LLM调用来做决策,如路由请求、排序内容或筛查输出是否存在越狱尝试——TypeSafe认为这些任务更适合由专门构建的决策引擎而非通用聊天机器人来完成。

性能与定价声明

TypeSafe发布了基准对比,显示Jev的响应时间大约在70到500毫秒之间,该公司称这在可比的结构化决策任务上比前沿聊天模型快40到200倍。在一项演示中,该公司让Jev通过向其输入结构化的游戏状态数据而非图像来玩经典电子游戏《毁灭战士》;TypeSafe表示Jev在约0.114秒内响应,而在相同测试设置下,定位相当的OpenAI模型大约需要8.566秒。

在定价方面,TypeSafe将输入词元定为每百万词元0.042美元,输出词元免费提供,该公司将这一结构与对话式LLM典型的按输入和输出计费的定价形成对比。TypeSafe引用了内部工作流评估,声称在某些生产级自动化工作流上,Jev比可比的大语言模型方法快约193.6倍、便宜约444.6倍,不过这些数字来自该公司自己的基准测试,而非独立的第三方测试。

开发者反响

早期采用者的反应异常热烈。Vercel的工程师报告称,在其部分基础设施中将OpenAI对话模型替换为Jev后,结果快了5到18倍,同时保持或提高了准确性。Bryo AI的工程师表示,他们发现Jev比Google Gemini系列的可比产品便宜约10到20倍,同时还提供了真正校准的概率分数,使得构建可靠的工作流自动化逻辑更加容易,而不必从自由文本响应中解析信号。

发布后的需求如此强劲,以至于TypeSafe表示其API一度无法跟上涌入的流量,该公司将这次中断直接归因于开发者兴趣的规模,而非任何计划内的容量限制。

为何这一定位很重要

TypeSafe为Jev取的名字致敬了19世纪经济学家William Stanley Jevons,其悖论认为,随着使用某种资源的成本下降,该资源的总消费量往往会上升而非下降。Almeida引用这一理念来描述他对AI决策走向的愿景:不是少数处理所有任务的超大通用聊天模型,而是大量小型、快速、廉价的决策模型嵌入整个软件基础设施。“我们认为,智能软件将无处不在,以一种涌现和分布的方式出现,”Almeida说,并将系统一模型描述为对驱动对话式AI产品的大语言模型的补充——而非替代。

接下来会怎样

TypeSafe主要将Jev定位用于后端和基础设施用例:模型路由、内容审核与安全筛查、工作流自动化以及大规模数据分类,而非面向消费者的聊天应用。由于该模型的输出是模式约束的而非开放式文本,它并不打算直接与聊天机器人或写作助手竞争。独立研究人员和竞争对手实验室尚未发布第三方基准来证实TypeSafe的性能声明,而系统一这一类别在更广泛的真实生产工作负载中——超出TypeSafe自身强调的用例之外——表现如何,仍有待更多开发者将该模型投入生产后才能见分晓。

AI模型TypeSafe AI