神秘模型Union Alpha首日狂烧20亿Token,实测性能直逼Astra

神秘模型Union Alpha首日狂烧20亿Token,实测性能直逼Astra

AI 资讯 来源:新闻/公众号 发布时间:2026-09-17 更新于 2026-09-17 预计阅读 5 分钟

当地时间9月16日,OpenRouter上线匿名模型Union Alpha,称其为面向研究、编程和智能体工作流的多模态模型,具备“前沿级性能”。该模型未公布开发团队、参数规模、训练方法和基准测试成绩,以免费形式开放,供开发者盲测。

神秘模型 Union Alpha 突袭!上线首日跑掉20亿Token,部分网友实测称性能直逼 Astra

OpenRouter披露,Union Alpha上线首日处理Token约20亿,截至发稿前消耗总量已超1000亿。其定位仍为平台和提供方描述,尚无完整可复现的第三方测试结果。

神秘模型 Union Alpha 突袭!上线首日跑掉20亿Token,部分网友实测称性能直逼 Astra

Union Alpha拥有约256K上下文窗口,单次最大输出131072 Token,支持文本和图片输入、文本输出,以及工具调用、工具选择和JSON格式输出,目标场景包括代码库分析、研究任务和连续调用工具的智能体工作流。目前在OpenRouter上输入输出价格均为零。OpenRouter将其标记为预览阶段Stealth Model,由匿名第三方提供商开发运营,OpenRouter仅负责路由。OpenCode已接入该模型,限时免费,并称服务商遵循零数据保留政策。

神秘模型 Union Alpha 突袭!上线首日跑掉20亿Token,部分网友实测称性能直逼 Astra

Union Alpha与Ox Alpha相似:匿名上线、免费试用,强调编程、长周期智能体任务和多模态输入,最大输出均为131072 Token。但Union Alpha上下文窗口为256K,小于Ox Alpha的1048576 Token。OpenRouter称其重点在推理、编程和工具使用能力。

“前沿级性能”是Union Alpha最引人注意的表述,但OpenRouter未公布具体数据,模型页面无SWE-bench、Terminal-Bench、GPQA、ARC-AGI等基准成绩,也无与GPT-6 Astra、Claude Opus 5或Fable 5.1的直接对比。架构、参数数量、是否MoE、训练数据截止时间及推理资源配置均未公开。因此,更准确判断是:Union Alpha被定位为面向前沿任务的模型,但尚不能仅凭介绍认定其已达头部闭源模型水平。

模型发布后在x、Reddit等平台引发热议。有用户称其聪明、有视觉能力、说话风格像GPT;也有用户称速度极慢,在DeepSWE中性价比略优于Opus 5和GLM-5.3。x用户Mike Gannotti团队运行SMF Official A测试,Union Alpha得分136/157(86.6%),零错误,成本0美元,认为推理和工具方面完美,问题在代码编写。部分早期测试者认为其在生成完整应用、理解图片和连续修改代码方面表现不错。用户Ananth称其在DeepSWE得分74,与GPT-6 Astra匹配,Terminal-Bench v4约50%,每任务成本1.5至2美元。也有用户对其实际智能体能力持保留态度,称在真实任务中表现令人沮丧,或在OpenCode中一直停留思考状态。

Union Alpha真实身份引发猜测,常见猜测包括未发布的Claude Opus更新、OpenAI测试中的GPT-6 Sol、Mistral新旗舰等。有用户猜测其为OpenAI的GPT-6 Luna,理由包括风格像GPT、有视觉能力、时间点与Sam Altman预告及DevDay吻合,且通过system提示可使其回答ChatGPT、OpenAI。反对者认为OpenAI不太可能免费试运行旗舰模型,且Union Alpha未表现OpenAI模型常见识别特征。另一批网友猜测其为Qwen 4.0 27B或GLM系列,但均未获证实。

标签: AI 资讯 AI

更多推荐阅读

谷歌让AI“做梦”训练,破解自我改进算力难题

谷歌让AI“做梦”训练,破解自我改进算力难题

AI要学会自己改进自己,谷歌打算先让它做个“梦”。这场“梦”瞄准的是AI行业热议的RSI,即递归自我改进:让AI改进自身,改进后的系统再继续改进自己,一轮接一轮。但这个循环有一道坎:换一种做事方法究竟有没有用?如果每调整一次探索策略都要把整轮实验重跑一遍,AI变强的速度不好说,算力账单倒是先涨起来了。 谷歌研究团队在新论文《Dream-RSI》中给出思路:让AI先在“梦里”试。所谓“做梦”,就是...

2026-09-17
手机背面成AI硬件新战场,创业者扎堆涌入

手机背面成AI硬件新战场,创业者扎堆涌入

录音卡、副屏、电子纸、AI 宠物……过去一年,AI 硬件创业者开始扎堆手机背面。 Plaud 的 AI 录音卡累计出货突破百万台。2026 年 6 月,Plaud 宣布 ARR 达到 1 亿美元、服务超过 200 万专业用户;截至 9 月,全球用户数已超过 250 万。做磁吸电子纸屏的阅星曈完成近 5000 万元 A 轮追加融资,顺为、经纬、博裕和小红书等老股东继续跟投;极稚科技称其无源墨水屏手...

2026-09-17
AI手机只会答题还不够,vivo想让它真正替你办事

AI手机只会答题还不够,vivo想让它真正替你办事

AI能力更强,并不意味着手机用户体验更好。航班延误通知弹出后,AI能总结内容、回答晚点多久,但真要继续处理改签、酒店、会议等一连串任务,事情立刻复杂起来。它还未必记得你的习惯:愿不愿意坐凌晨航班、在不在意多花几百块、第二天会议能否迟到。想在手机上开发应用,还要考虑接口、MCP等问题。于是AI好像什么都会一点,但真遇到事,最后常还是得自己动手。 这解释了AI手机越来越明显的落差:模型能力上涨,Be...

2026-09-17
开口使唤AI干活,这款299元硬件真能让你当甲方?

开口使唤AI干活,这款299元硬件真能让你当甲方?

想象一下,你正在赶PPT,突然想让AI把一张产品图改成海报。过去需要打开AI窗口、输入提示词、上传素材,再把结果复制回设计软件。现在有人想把这一整套操作压缩成一个动作:开口说话。为此,他们做了一款硬件——Vibe Key AI键盘麦,由优篮子Ulanzi与腾讯WorkBuddy联合推出,售价269至299元。它看起来像一个麦克风、三颗按键加一颗旋钮,更像给AI配的“指挥棒”:按一下,说句话,就能调...

2026-09-17
腾讯内测AI语音助手Chatterfly:语音即可成文

腾讯内测AI语音助手Chatterfly:语音即可成文

当行业都在把AI能力往输入法壳子里做增量,腾讯正在做一套独立的AI原生输入工具。腾讯正低调开启AI原生语音助手Chatterfly的内测,需内测码才可使用。现阶段开放macOS、Windows两大桌面客户端下载,移动端尚未上线,处于即将发布状态。 Chatterfly定位AI原生表达辅助工具,基础能力覆盖语音输入、全场景AI打字,同时提供场景化深度润色、AI指令执行;适配弱网、嘈杂、轻声等现实录...

2026-09-17
前OpenAI研究员造出“闭嘴”模型,2400万人围观

前OpenAI研究员造出“闭嘴”模型,2400万人围观

前 OpenAI 研究员 Diogo Almeida 结束两年隐身,发布新模型 Jev。他曾是 InstructGPT 论文共同作者,参与早期 RLHF 与 GPT-4 工作,但离开后开始怀疑“聊天能力是否真是软件自动化的核心”。TypeSafe 推出的首款 System One Model Jev 放弃自由文本生成,官方称速度提升 20-200 倍,成本最高降至 1/400,输出 Token 免...

2026-09-17
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部