OpenAI前核心成员造出只会做选择题的大模型
TypeSafe AI创始人Diogo Almeida曾是OpenAI核心成员,参与创造RLHF和InstructGPT,2024年初离职创业,两年后推出全新模型Jev。该模型只做一件事:高频决策。它无法聊天、写代码或生成文字,是纯粹的通用分类器。

开发者Marcel Pociot用Jev做了浏览器插件,过滤X上不想看的内容,如引战、加密货币、政治争论等。每条帖子Jev在后台判断是否命中分类,平均仅需380毫秒。传统大模型即使开JSON Output也很慢,开思考则需十几秒甚至几十秒,而Jev只需快速给出Yes或No。

Jev砍掉文字生成后,速度快20至200倍,逼近实时,打游戏时一秒可决策10次;成本低40至400倍,0.042美元/百万Token,输出Token免费。网友已用它玩马里奥、操控浏览器查航班、搭建交易机器人等。

TypeSafe将Jev定义为System One Model,源自卡尼曼《思考,快与慢》中的快思考系统。当前GPT、Claude等推理模型更像系统2,而Jev赌的是海量无需长篇推理的智能任务。为此他们重做模型架构、并行Sampler,并采用RLCD训练方法,即面向校准决策的强化学习。RLHF优化人类偏好,RLVR优化答案可验证性,RLCD优化决策是否正确、置信度是否真实。若Jev置信度大于0.90可自动执行,0.7至0.90交给更强模型复核,低于0.7交给人决策。校准才是核心。
Jev支持一次性并行提问,如判断一条AI新闻是否相关、是否广告、是否融资、归何分类、是否推荐等,可一口气完成,速度极快,类似拥有世界知识和语义理解能力的超级if。
目前可在TypeSafe官网申请资格,Vercel已首发接入。作者用AIHOT预筛任务测试,100道题中GLM-5.3 Flash全对但最慢最贵;Jev准确性第二且便宜很多,因国内网络延迟耗时被拉高;Qwen 3.7 Flash最便宜但精准率与DeepSeek V4.1 Flash一样差些。在同事件聚簇判定任务上,Jev维持第二准确,因内容量大成为最快。在并行判断任务中,Jev取得最高准确率、最快速度、第二低成本。追求精度的分类判断场景中,Jev是目前性价比最高的解。
Jev名字源自杰文斯悖论:19世纪蒸汽机效率提高,煤炭消费量反而上升。TypeSafe赌智能也会发生杰文斯悖论——当判断便宜到接近免费,世界会怎样?AI为什么一定要生成东西?智能当然可以用来创造。
更多推荐阅读

谷歌DeepMind成立AGI研究所,诺奖得主挂帅
几周前,GPT-6 Astra横空出世,OpenAI首次官宣AGI实现。今天,谷歌DeepMind火速成立全新机构——DeepMind研究院(DMI),由Demis Hassabis、Shane Legg与James Manyika联手挂帅。以前的DeepMind只想搞出AGI,现在问题升级为:AGI真的来了以后,全人类到底拿什么接招? DMI专门研究“超级智能”对经济和社会的颠覆性影响,目标是...
2026-09-18
中国电信通用Agent杀入IDC实测前三
IDC发布国内首份《中国企业级通用Agent产品技术评估》,中国电信TeleAgent进入前三。此次评估未采用大模型Benchmark,而是用近百道非公开任务考察Agent在真实办公环境中的端到端执行能力。TeleAgent常规任务得分3.49分、复杂任务3.36分,九项能力中任务表现获满分,成本效率为评测最高分。该产品今年4月内部试用,7月推出V1.0,一个多月用户规模已接近120万。 IDC...
2026-09-18
1300张卡击败GPT-6!前OpenAI副总裁造出材料大模型
前OpenAI研究副总裁Liam Fedus在X上发布Periodic Labs首个模型Periodic Neon:仅用1300张H200,加上数月实验数据,在自研XRD分析基准上超过GPT-6 Astra。Neon约1T参数,在134道高难度X射线衍射分析题组成的FrontierXRD上成功率达55.3%,领先GPT-6 Astra和Claude Fable 5.1。Astra据传总参数数万亿、...
2026-09-18
国产AI存储刷新全球纪录,焱融全栈布局曝光
智东西9月17日报道,9月1日,MLCommons发布MLPerf Storage v3.0基准测试榜单。焱融全闪AI存储F9000X在多项测试中拿下第一,验证其在极限AI训练负载下对高速网络带宽的高效利用能力。 随着AI从模型训练走向规模化推理,存储需处理的数据和任务持续增加。训练阶段要持续向GPU供给海量数据,并快速保存和恢复模型Checkpoint;推理阶段需管理不断膨胀的KV Cache...
2026-09-18
AI短片斩获威尼斯双奖,千万级创作大赛开启
十天前,AI超创DiDi_OK的《网站》在2026年威尼斯Reply AI Film Festival上斩获评审大奖与观众选择奖双料大奖。该片从76个国家3100多部作品中脱颖而出,评委包括奥斯卡得主和《狮子王》联合导演。影片用十来分钟探讨“观看能否改变现实”,凭借画面与叙事功力成为本届唯一同时获得两项大奖的作品。这类会讲故事的AI创作者,正是当下AI行业最稀缺的人才。 今天,虎鲸文娱集团正式启...
2026-09-18
奥特曼曝后Astra模型已超越全球顶尖数学家
在和Salesforce CEO Marc Benioff的对谈中,奥特曼剧透了OpenAI内部模型的最新进展。他判断:“GPT-5.5的水平大概相当于一个普通的数学教授。GPT-5.6,大概能比肩全球排名前1%到2%的顶尖数学教授。”随后他曝出重磅消息:“在这个代号为Astra的模型之后,我们还有一个内部模型(Post-Astra)。它已经能够解决世界上最顶尖数学家都束手无策的难题。”OpenA...
2026-09-18