反超Seedance 2.0!RunningHub增强版H3一秒仅一毛

反超Seedance 2.0!RunningHub增强版H3一秒仅一毛

AI 资讯 来源:新闻/公众号 发布时间:2026-09-30 更新于 2026-09-30 预计阅读 5 分钟

7月底MiniMax H3开源时,Artificial Analysis视频编辑榜Elo 1130分,直冲全球第一。但量产场景下短板明显:多镜头一长角色走样,商品多拍几组轮廓不准,十几个镜头连跑后面越来越不像同一部片子。从“跑得通”到“生产能用”,差的是工程。

9月29日,RunningHub发布H3 RH Enhanced,基于MiniMax H3开源基座做深度后训练的增强模型。RunningHub是海马云旗下一站式创作平台,全球最大AIGC开发者创作者社区,聚集500万以上专业创作者,覆盖140多个国家和地区。

反超Seedance 2.0!RunningHub发布增强版H3,1秒只要0.1 元

通过2000组实测,H3 RH Enhanced多镜头长时序叙事能力显著优于Seedance2.0,整体直追Seedance2.5。一秒一毛钱即可直接产出成片。这意味着开源后训练模型做到了闭源效果,成本仅为同等闭源模型的十分之一。H3 RH Enhanced已登陆MiniMax,面向全球B端创作者公开调用,可在RunningHub限时免费体验。

2000组盲测按业务场景铺开:人物连续特写、多场景转场运镜、多角色互动、16镜头以上完整叙事,四类各500组。关键结果在多镜头长叙事:8到16镜连续生成,人物身份一致性、场景元素留存、指令约束留存三项指标全部显著领先Seedance 2.0。

反超Seedance 2.0!RunningHub发布增强版H3,1秒只要0.1 元

实测中,15秒赛博机车追逐,同一参考图、14镜提示词,RH Enhanced两辆车始终是参考图那两辆,女主四种机位同一张脸同一套服装,声音画面同步生成。Seedance 2.0单帧不差,但镜头一多就松:第4镜车辆变风格,第5镜换城穿模,第6镜服装退化。十个镜头后,RH Enhanced还认得参考图,Seedance 2.0开始凭印象重画。

电商15镜香水片,RH Enhanced全程瓶子一致,模特同一张脸同一件礼服。Seedance 2.0电梯镜中瓶子悬在掌心上方。16镜以上,Seedance 2.0角色遗忘集中爆发,RH Enhanced崩坏率降低60%以上。

反超Seedance 2.0!RunningHub发布增强版H3,1秒只要0.1 元

18镜五世界测试,RH Enhanced四次正面特写同一张脸,黄雨衣、红伞、黑包始终在线,第1镜街角时钟第16镜仍在。Seedance 2.0中段崩坏:帽子时戴时摘,红伞消失近4秒3个镜头。另一条18镜东方奇幻,RH Enhanced女剑仙、黑甲将军、灵兽三主体稳定,收尾天宫半塌碎石掉落位置清楚。Seedance 2.0将军近景只有盔甲没有脸,天宫大门完好“半塌”未发生。

RH Enhanced靠自研RH长程记忆引擎,在模型架构层面钉住跨帧信息,让第14镜还记得第1镜的五官、服装和道具。上线以来日均生成接近100万秒视频,相当于每天6.7万条15秒短视频或3300多集5分钟短剧。

RunningHub做了五层工程改造。第一层场景定向后训练,基于H3单流Omni-Transformer架构和MM-RoPE多模态位置编码,搭“场景SFT→一致性优化→少步蒸馏”链路,训练数据围绕短剧、电商、漫剧真实业务构建,盯死不换脸、有参考图就要像、动作做完整、运镜不乱跳四件事。第二层分辨率感知适配,按宽高比、帧数、时长分桶对齐交付规格,人脸、商品轮廓、服饰结构区域加权。第三层少步蒸馏,教师—学生轨迹蒸馏,静态镜头少步、大幅运动多步。第四层注意力与缓存协同加速,SageAttention2、自研Cache-DiT Dual Block缓存、torch.compile,多卡用TP2+Ulysses4混合并行,适配PCIe普通多卡环境。第五层批量服务调度,相似任务分桶组batch,参数预热和编译缓存复用,按实时负载调度,考核GPU时间、合格成片率和批量吞吐,落到每条合格成片交付成本,算下来一秒一毛钱。海马云十年GPU工程底子,加速和超分同步就位。

标签: AI 资讯 AI

更多推荐阅读

Manus 2.0发布:AI应用只剩三件事

Manus 2.0发布:AI应用只剩三件事

昨夜,Manus发布2.0版本,堪称超级全家桶。技术层面推出新agent架构Cascade、云电脑和自动化;面向工作创作场景的Manus Studio支持剪视频、生视频、做在线多人游戏、远程遥控电脑;以及One More Thing:Cue。 我第一时间上手试了Cue。先连接Gmail、GitHub、Notion、Instagram、Oura等账号,补充Codex记忆备份和几条即刻,构成较完整的...

2026-09-30
GPT-6上线后,鹈鹕骑车测试为何突然爆火

GPT-6上线后,鹈鹕骑车测试为何突然爆火

开源项目CodexRadar发起人Lambda在GPT-6 Astra发布后,收到大量“鹈鹕骑单车”视频,于是在社区发起“鹈鹕杯”比赛,参赛者围绕“画一只骑自行车的鹈鹕”用模型生成作品。9月14日上午,比赛页面PV达7000多。 每次新模型上线,都有人用鹈鹕骑自行车测试模型能力。这个任务简单直观,能一眼看出腿和踏板是否对位、车轮是否跟着动、动作是否穿帮、前后是否一致;同时又足够复杂,涉及动作理解...

2026-09-30
Opus 5.5代码直出MV,马斯克连转惊呼AGI

Opus 5.5代码直出MV,马斯克连转惊呼AGI

Opus 5.5代码直出音乐MV火了。马斯克多次转发,并给出“嚯!”“史诗级!”“这次我真切感受到了AGI”等评价。 这些MV中,人物、歌词、拼贴、颗粒和转场贴着节拍轮番轰炸。两分钟速通《谷歌来时路》,动画越切越快,配乐越顶越燃。另一支纪念乔布斯的MV,从车库创业拍到改变个人计算,23种转场踩着120 BPM配乐,被剪成一部硅谷英雄片。还有博主把2011年录的木吉他老歌用Suno重编成Techn...

2026-09-30
AI写算子让Kimi K3推理快3倍,TPU反超英伟达

AI写算子让Kimi K3推理快3倍,TPU反超英伟达

上一周,vLLM原班人马创办的Inferact开源了TPU Megakernels,把Kimi K3的92个MoE层写进同一个程序,在16颗谷歌TPU v7上运行:开启投机解码,单用户输出达709 tokens/s;同样16块英伟达GB200用vLLM跑为452 tokens/s。关闭投机解码,在1到8并发下,它也是GB200的1.4到2倍。而TPU v7显存带宽7380GB/s,还低于GB200...

2026-09-30
10个Claude通宵15小时,证明122年物理数学难题

10个Claude通宵15小时,证明122年物理数学难题

球面上的7个电子,难住了人类数百年。今天,10个Claude Sonnet 5.5通宵15小时,互发1270条消息,写出17895行Lean代码,完成了汤姆逊问题N=7的证明。没有人类介入,没有预设分工,10个Claude自己建群、讨论、选算法、合并代码。证明通过了Lean内核和独立内核nanoda的双重验证,改一个整数,nanoda立刻报错。 1904年,J.J.汤姆逊提出“葡萄干布丁”原子模...

2026-09-30
GPT-6.1 Sol深夜突袭:1/5价格逼近Astra

GPT-6.1 Sol深夜突袭:1/5价格逼近Astra

在OpenAI开发者大会上,GPT-6.1 Sol突袭上线,并已接入Codex和ChatGPT Work。据称原定的GPT-6.1因对齐回归问题被紧急暂停,OpenAI转而推出这款“干活特化版”。官方口号是“以五分之一的价格,获得接近Astra的智能水平”。 价格方面,GPT-6.1 Sol的API标准价为输入2美元/百万Token、输出10美元/百万Token,恰好是GPT-6 Astra(输...

2026-09-30
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部