多模型分工省额度,还能接入JEV玩红警
上周文章提到 WebCodex 可把网页版额度用起来,随后有读者问:能否让不同模型干不同的活?这其实也是我的需求。主力工具是 Codex,但也买了别家 API,套餐余额分散,Codex 额度仍不够用。此前介绍的 Codex++ 虽能接入第三方模型,但一个任务只能用一个模型。我真正想要的是:把所有模型 API 接到一起,收到任务后先让高智商模型判断难度,再结合各模型能力和余额,把任务拆给不同助手。难活给强模型,普通工作给便宜够用的模型,最后由主模型检查整合,省去挨家开工具、重复交代背景的麻烦。
本来打算自己做,结果 Codex 告诉我已有人做了,叫 OpenCodex。WebCodex 是让你把网页额度用起来,OpenCodex 则是让你用 Codex 时能省就省,目的都是节省 Codex 额度。嫌麻烦可把项目地址交给 Codex 安装,复制一段安装指令即可,剩下交给 Agent。过渡期仍可按传统教程手动操作。

以 Windows 为例,先准备可用的 Codex 和一家模型 API 或编程套餐。安装 Node.js LTS 版,打开 PowerShell,依次运行 node -v、npm -v 查看版本,再执行 npm install -g @bitkyc08/opencodex,随后 ocx --version、ocx start。浏览器打开 localhost:10100,若终端显示其他地址以它为准。提示禁止运行 npm.ps1 就把 npm 换成 npm.cmd,ocx 同理。找不到命令先重开终端。
接入 API:左侧点提供方,添加提供方,搜索厂商。以智谱编程套餐为例,搜索 Zhipu,选带 Coding Plan、标 openai-chat 的项。主要填接口地址、API 密钥、模型名称。密钥去购买平台控制台创建后粘贴,别发评论区。核对预设地址,本例为 open.bigmodel.cn/api/coding/paas/v4,默认模型 glm-5.3,改成 glm-5.3-flash。普通 API 和编程套餐别混。保存后检查模型页,没有就确认账号可用后添加自定义模型,并检查左侧模型未被隐藏。默认主模型仍保留 Codex 官方 GPT,OpenAI(Codex login)也照旧。装完一个测试没问题再装下一个,完事重启 Codex。

配置好后可给不同模型设任务条件。子代理标签中高级按钮展开有 V1、V2、Base 选项。V1 适合多厂商模型混用;V2 是更新的多 Agent 协作机制,并发更强但有跨厂商兼容限制;Base 交给 Codex 按官方默认规则自动选择。建议先用 V1。
以我的需求跑一次:智谱套餐月底到期,先做普通工作;豆包余额宽裕,多做执行;DeepSeek 留作复核;官方 GPT 负责判断、难题和验收。OpenCodex 负责接通模型,派活仍由主模型结合规则判断,不会自动知道余额,需告知倾向。也可直接让 Codex 按意图配置调度。跑任务时可在 Codex 里看到分工,在 OpenCodex 面板查看用量。

常用命令:ocx service 配置后台运行,首次按提示安装,已有服务先用 ocx service status 查看。完成后运行 ocx service status、ocx status 确认服务可用、代理在线。Windows 路线在用户登录后启动,关掉管理网页不影响使用。想退出,任务完成后输入 ocx stop 停止代理并恢复原生 Codex 路由;只想恢复路由保留代理则用 ocx restore。再次使用,已装后台服务运行 ocx service start,否则 ocx start;若仅用过 ocx restore,则用 ocx restore back 接回。
其他亮点:号池可集中管理多账号、查额度、按设置轮换;助手不可用可配置失败接替;用量可看请求数、模型消耗和统计覆盖率,页面费用是估算,实际看厂商账单。Ollama、LM Studio 本地模型也能接,先开本地服务再从添加提供方→本地选择。还可配置联网搜索或图片描述补足能力,也会增加消耗。第三方模型也能用 Codex 的 Computer Use,实测 DeepSeek 4.1 Flash 画小狗虽抽象但功能可用。集成页还列有其他 AI 工具,部分可复用接好的模型,另有模型组轮换、模型隐藏、磁盘占用查看、Windows 托盘控制等,图片生成需另配服务另算费用。这些小功能用到再折腾,不必一次全开。
上一篇 WebCodex 让 AI 替我们做事,这一篇接着问:活有了,能不能分得合理一点?我觉得没必要对 SOTA 模型过于执念,不是所有活都得让最强模型干。
更多推荐阅读

ICLR 2027投稿量突破6万,超过历年总和
今年 ICLR 的摘要提交量达到 6 万+,已超过 ICLR 从 2013 年到 2026 年历年投稿总和。第一届 ICLR 收到 67 篇投稿,ICLR 2026 涨到 19525 篇,2013 至 2026 年十四届会议全部加起来约 5.6 万篇。如今一届 ICLR 2027 就超过了这个数字。 有网友算了一笔账:即使按 20% 录用率,6 万篇也对应 1.2 万篇论文。上一届 ICLR 2...
2026-09-22
清华教授押注机器人ICL:我看到了Scaling Law的信号
本周「十字路口」嘉宾是清华叉院助理教授徐梦迪。她本科读清华车辆工程,后赴Johns Hopkins、CMU,再到Stanford吴佳俊、李飞飞组做博士后,2024年初回国加入清华交叉信息研究院。她的核心命题是机器人的In-Context Learning:让机器人到新环境后,通过一两次交互当场学会新任务,且越学越快。 节目录完第二周,Generalist发布GEN-1.5,只给机器人看3-12秒...
2026-09-22
AI算力不靠堆卡,浪潮信息如何破局?
AI算力的竞争,多年来就一个字——堆。堆卡、堆机柜、堆发电机,似乎计算卡足够多、集群足够大,就能站在食物链顶端。但算力「够不够用」已不再能单靠堆卡解决,它开始分化出越来越多的层面。 第一个问题关于智能上限,即算力能撑起多强的智能。前沿模型的参数规模、上下文长度、推理深度同时变大,Agent可能连续运行几小时甚至几天。模型装不装得下、跑得快不快、长时间稳不稳,都需重新考量。另一个问题是智能规模——...
2026-09-22
实测Qwen3.8-Omni-Flash:全模态Agent价格暴降90%
Qwen推出全模态模型Qwen3.8-Omni-Flash,在WildClawBench-MM等30项评测中平均得分比上一代Qwen3.5-Omni-Plus高出26%,音频能力整体超越Gemini 3.8 Flash,音视频能力接近Gemini。API价格大幅下降:相比上一代,每小时音频输入价格下降超98%,每小时音视频联合输入价格下降超93%。现价为每百万Token输入0.8元、输出2.7元,...
2026-09-22
腾讯混元招募外部专家共建AI大模型
腾讯推出面向外部行业人才的专家平台“混元智囊团”,Slogan为“聚智为谋,引领未来”。该平台隶属于腾讯混元旗下,通过连接各领域顶尖实战专家与真实AI训练问题,以高质量数据集生产、专业内容编写、知识审核为核心工作,产出的专家资源与专业数据服务于混元大模型持续迭代优化。 简言之,腾讯混元通过接单付费的任务模式,招募金融、法律、医疗、前端设计美学、代码等各领域专业人才,帮忙优化混元大模型能力,为AI...
2026-09-22
马斯克交卷Grok 4.7,这次吹牛吹大了
AI 圈没有假期。从 OpenAI、Anthropic 到 xAI,各家巨头集中抢位。SpaceXAI 正式发布 Grok 4.7,官方定位为目前最强的编程与知识工作模型,已进入 Cursor、Grok Build 和 Grok API,也将通过第三方编程工具、模型路由平台与云服务提供。发布比马斯克最初预告晚了不少,从 7 月下旬开始吹风,一再推迟。 Grok 4.7 使用比 Grok 4.6 ...
2026-09-22