2026-09-22
最火哑巴模型Jev加上微信,直接治好了我的低情商
文 | 字母AI 谷歌的哑巴模型Jev突然爆火。 它不聊天,不写代码,不写文案,也不解释,你问它什么,它一个字都不生成。它只做一件事——判断。 发布没几天,从Hacker News,再到中文技术社区,几乎所有人都在讨论它。但大家讨论的不是它有多聪明,而是它有多反常。 诚然,一个不会说话的模型能火,这事本身就已经够反常的了。 大家最先讨论的,是它的落地场景。一个不会说话的模型能放在哪里?答案是微信。 微信要回消息、要管群、要盯风控,怎么看都该交给一个“会说话”的大模型。 怎么想怎么不合理的事情,却就这么合理地发生了。 不过具体是什么情况,还是得先从Jev本身开始说起。 Jev到底是个什么东西 TypeSafe AI在2026年9月16日发布了Jev。 这是一家旧金山的公司,创始人是GPT-4论文共同作者,前OpenAI研究人员迪奥戈·阿尔梅达(Diogo Almeida)。公司隐身研发了两年,出来时带着DCVC领投的4000万美元种子轮。 Jev给自己贴的标签叫系统一模型(System One Model)。 这个名字来自卡尼曼的《思考,快与慢》。其中,系统一指的是那种不过脑子的直觉判断,系统二是慢下来一步步推理。 TypeSafe的说法是,这几年所有人都在造系统二,会思考、会写长文、会解释。可软件里真正需要的判断,大多数是系统一。 Jev和ChatGPT、Claude的区别在于,Jev只会答选择题,其他模型会写作文。 Jev的用法是这样的,你给它一段状态,比如一封邮件、一行日志、一条工单、一段程序状态,然后再给它几个事先定好类型的问题,它一次性把答案全部返回,每个答案附一个概率,外加一个“我有几成把握”的置信度。 它只会答三种题。 Choice:从最多255个选项里选一个。 Score:在一个2到10级的刻度上给分。 Noul:给出一个0到1的是/否概率。 三种题可以混在同一个请求里,而且是并行算的。官方说,问一个问题还是问四个问题,延迟几乎一样。 Jev的特点是快和便宜。 普通大模型是一个字一个字往外写,写多久取决于要写多长。Jev不写字,答案的范围事先就定死了,算一遍每个选项的概率就完事。 根据Jev的官方数字,端到端响应70到500毫秒,输入每百万token收0.042美元,输出免费。它上线Vercel的AI Gateway后,24小时内被接近13%的Vercel付费团队都用上了Jev,是Vercel平台采用速度最快的新模型。 它不能聊天、不能写代码、不能写文案、不能看图、也不能解释理由。你问它“为什么不选这个”,它不回答,它只给数。 Jev还有个特点,幻觉率为0%。 这指的是它绝不会给出你选项之外的答案,绝不会拼错字段。但它完全可以选错一个选项。这一点,TypeSafe的CEO迪奥戈自己也承认过。 Jev这个名字来自杰文斯悖论。 蒸汽机效率提高、每吨煤更便宜,煤炭的总消耗反而涨了,因为便宜的动力被用到了更多地方。 以前用不起AI,是因为调一次大模型又贵又慢,为了一个芝麻大的小判断去调一次,不划算。现在Jev把单次判断压到了万分之一美元 它的训练方法叫RLCD,Reinforcement Learning for Calibrated Decisions。RLHF追求“人类爱看”,RLVR追求“程序能验证对错”,RLCD追求“概率要诚实”。 如果RLCD说有70%的把握,那就是在数学验证上有70%的概率是对的。 Jev成了微信的插件 Jev爆火后,社区拿它用的最多的,便是作为微信的插件了。 微信最难的地方就在于,如何精准触达对方的想法。比如经典的“你看着办”。那到底是该怎么办?是小改一下?是放着不管?还是大刀阔斧? 于是Jev的作用就体现出来了。 这条消息要不要回? 要不要 @ 对方? 这条是不是广告? 要不要把人踢出群? 这条要不要转人工? 这个人是不是想退款? 这段话有没有违规? 每一件,都是“从有限选项里挑一个”,而且要在几百毫秒内出结果。而这正好是Jev的形状。 那为什么不用大模型? 三个原因。 第一,慢。大模型回一条要3到30秒。微信群里的消息是滚动的,你30秒后回复,对方可能不耐烦了。Jev 70到500毫秒,够你在消息还没滚出屏幕之前接上。 第二,贵。 微信机器人通常跑在便宜的常开服务器或轻量服务器上,一次判断的成本必须低到可以忽略。用大模型逐条判断,几十万条消息就是一笔真金白银。Jev输入0.042美元每百万token、输出免费,把单条判断压到万分之一美元的量级。 第三,也是微信插件最怕的,它不能说错话。 一个自由生成的大模型塞进聊天框,随时可能冒出一句不该说的话,轻则社死,重则触发风控、直接封号。Jev根本不生成文本,它只从你给的选项里挑,从结构上就“说不出格”。 微信插件的老大难,是“自动回复”和“转