一文看懂外网爆火的哑巴模型jev,10个实测案例分享!成本几乎为零...

一文看懂外网爆火的哑巴模型jev,10个实测案例分享!成本几乎为零...

AI 测评 来源:新闻/公众号 发布时间:2026-09-21 更新于 2026-09-21 预计阅读 2 分钟

一文看懂外网爆火的哑巴模型jev,10个实测案例分享!成本几乎为零...

最近,一个不会说话的大模型在网上火了。

它叫 Jev,不能写文章,不能写代码,也不能和你聊天。

这么一个哑巴模型,发布不到 36 小时就有 14 万开发者冲进去内测。

几天内造出了几百个玩法,恐怖如斯...

为什么这么多人上头?因为 Jev 只做判断,不生成文字。

少了逐字生成答案这一步,它反倒比大语言模型更快,也更便宜。

一次判断只要 70 到 500 毫秒,部分场景比大语言模型快近 200 倍。

输出直接免费,有开发者实测审核 1000 个代码提交只花 7 美分。

连句完整的话都不用说了,这是要掀桌子啊?

听起来有点离谱,让我们来看看 Jev 的实测表现。

一、Jev 实测表现

(1)游戏操控

先看下 Jev 在游戏里的表现。

以前我们用大语言模型打游戏,可以明显感觉到它们的反应特别慢。无论是移动还是放技能,都要先写小作文,才能抉择。

Jev 并不需要这一步。

开发者 Max Blade 同时开了 50 局地铁跑酷,让 Jev 实时操控游戏。

Jev 不仅没撞车,而且越跑越快。速度从每秒 25 米一路飙到 48 米,全局无伤通过。

50 局跑完,总共花了不到一美分。

还有人让 Jev 自己和自己打《任天堂明星大乱斗》,同时控制场上全部 4 个角色进行战斗。

Jev 打得有来有回的,每个角色都有自己的战术。

没有用到任何视觉模型或截图,纯用代码就能达到这样的效果。

整场比赛消耗了超过 2200 万 token,同样只花了几美分。

那如果让 Jev 和大语言模型直接对打呢?

日本开发者 niwacis 让 Jev 和 Claude Haiku 4.5 同时操控俄罗斯方块小游戏,看谁先清掉 20 行。

跑了 10 次统计下来,两者准确率几乎一样,Haiku 甚至还多赢了一次。

但 Jev 通关平均 19 秒,Haiku 要 8...

标签: AI 测评 AI

更多推荐阅读

曝 Claude 跳过 5.2,直奔 Opus 5.5

曝 Claude 跳过 5.2,直奔 Opus 5.5

上周还在传 Opus 5.2,新一轮爆料已经把名字改成了Opus 5.5。 有人晒出汽车3D模型,有人声称它超过 GPT-6 Sol。 新品尚未官宣,“3D 之王”的王冠已经有人提前戴上了。 ◈模型还没发,王冠先戴上了 就在今天早上,X 账号 Lyra 抛出消息:Anthropic 正在测试claude-opus-5-5,内部代号为claude-wafer-eap,计划周二发布。 随后,...

2026-09-21
当用户越多可能亏得越快,AI 应用创业者应该怎么做增长?

当用户越多可能亏得越快,AI 应用创业者应该怎么做增长?

AI应用的增长,正在变成一件越来越难算的事。 前两年,一个新模型出来,创业公司接得够快,就有机会拿到第一批用户;做个新功能、冲一次榜、找几个KOL,也可能让曲线突然抬头。 现在,这些办法都还有效,但有效期越来越短。 模型公司不断把能力往应用层拓展,创业公司刚做出来的功能,下一次模型升级可能就成了基础能力;超级平台又握着流量,不断抢占入口。 图源:AI生成 更麻烦的是,AI产品和上一轮互联...

2026-09-21
Claude Code下半年:格式投降OpenAI,功能借鉴DeepSeek

Claude Code下半年:格式投降OpenAI,功能借鉴DeepSeek

Claude向OpenAI格式投降了。 Claude Code从9月19日起原生支持AGENTS.md。 这是OpenAI在2025年8月推出的一种项目指令文件格式,此前Claude Code一直坚持只读自己的CLAUDE.md。 现在兼容了,隔壁OpenAI加的Tibo也来围观支持。 大概在5月,Agents.md的使用数量就已经超越了Claude.md。 就在更新这一天,有人搞了个抽...

2026-09-21
汉化组,可能是世界上最不怕AI冲击的一群人。

汉化组,可能是世界上最不怕AI冲击的一群人。

前段时间,我刷到一篇文章说,在AI的冲击下,字幕组要死透了。 文章里写了版权、官方字幕和AI给字幕组的生存空间带来的挤压,读完之后我开始好奇一个问题。 当观众打开视频,一键AI就能直接配好中文字幕,打开漫画,AI也能直接翻译图片,那些做汉化的字幕组、漫画组,会怎么看待这件事? 于是,我陆陆续续找了一些做汉化的朋友聊了聊,做字幕和漫画汉化的都有。我原本以为,大家会担心自己被替代,会有些抵触AI...

2026-09-21
WebCraftBench:给 AI 生成的网页来一场「实测大考」

WebCraftBench:给 AI 生成的网页来一场「实测大考」

如何评价 AI 写出的网页?我们尝试让 AI 自己来打分。 腾讯混元团队联合清华大学、北京大学的研究者提出 WebCraftBench ,把软件测试的方法引入网页生成评测:让智能体真正操作网页,用代码覆盖率帮助查漏,再从美观度、易用性和需求符合度三个维度打分。在 197 组经复核的应用对比中,它与人类偏好的判断一致率达到 85.3%。 论文标题:WebCraftBench: Evaluatin...

2026-09-21
刚刚,稚晖君同款机器人来了!发售即发货,下线一台只需2.5分钟

刚刚,稚晖君同款机器人来了!发售即发货,下线一台只需2.5分钟

堪比iPhone Duo发布会! 26499元你是买Apple首款折叠屏顶配iPhone Duo,还是买人生第一台人形机器人?还是稚晖君同款可DIY的个人机器人! 9月20日,上纬新材料科技股份有限公司(下称「上纬新材」)旗下消费级具身智能品牌启元机器人在上海举办「我和我的个人机器人」主题新品发布会,正式发售启元Q1、启元T1两款个人机器人,并同步公布品牌、技术、产品与生态战略。 此次发布会...

2026-09-21
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部