神秘模型 Union Alpha 突袭,上线首日跑掉20亿Token,部分网友实测称性能直逼 Astra

继上个月智谱以匿名模型Ox Alpha“深藏功与名”收割全网流量后,AI圈再度迎来一款身份成谜的前沿模型。当地时间9月16日,OpenRouter正式宣布上线匿名模型Union Alpha,官方将其定位为面向研究、编程及智能体工作流的多模态模型,宣称其可在广泛通用任务中提供“前沿级性能”。与Ox Alpha一致,Union Alpha并未公开开发团队、参数规模、训练方法、架构细节及基准测试成绩,而是以免费形式向全球用户开放盲测,同时承诺零数据保留,用户的提示词与输出不会被用于模型训练。

神秘模型 Union Alpha 突袭,上线首日跑掉20亿Token,部分网友实测称性能直逼 Astra

智谱再玩匿名盲测套路 Union Alpha突袭OpenRouter

该模型同步在OpenCode平台上线,官方透露当前容量为5万亿Token/天,后续还可能扩容。参数配置上,Union Alpha支持图片输入与工具调用,上下文窗口为256K,最大输出长度达131K,重点强化推理、编程及工具使用能力,上下文窗口规模小于此前Ox Alpha的1048576 Token。OpenRouter披露,Union Alpha上线首日处理的Token数量已达约20亿,截至发稿前累计Token消耗总量已突破1000亿,上线即冲上平台调用量前列。目前该模型在OpenRouter及OpenCode上均免费开放,用户可直接切换使用,也可通过API接入各类Agent工具,模型ID为stealth/union-alpha,API格式与OpenAI兼容。

网友盲测两极分化 编码能力获赞速度成槽点

模型上线后迅速在X、Reddit等平台引发大规模测试热潮,反馈呈现明显分化:

  • 正面评价集中于专业任务表现:有用户测试后表示模型“十分聪明,具备视觉能力,对话风格与GPT系列高度相似”;测试者Ananth透露,Union Alpha在DeepSWE基准测试中得分74,与GPT-6 Astra成绩匹配,在Terminal-Bench v4上的表现约为50%,每任务成本仅1.5-2美元;另有开发者使用Union Alpha搭配OpenCode搭建完整应用,全程未产生任何Token费用;Cline社区也已接入该模型,标注其支持256K上下文、图像输入及智能体编程。
  • 负面反馈则主要集中在响应速度:多名用户吐槽模型“极其缓慢”,有用户称发送一句“你好”等待回复耗时超过2分钟,还有用户在OpenCode中调用时模型一直停留在思考状态,未返回任何结果。
    此外也有测试者指出,模型在普通问答、代码生成中表现尚可,但仅凭几轮对话难以判断其能否稳定完成长周期智能体任务,真实场景下的表现仍待验证。另有对比测试显示,Union Alpha在编码、数学、推理类任务上表现优于Ox Alpha,而Ox Alpha的写作能力更强、上下文窗口更长。

匿名发布搅动AI圈 调用量≠能力榜评测缺位引争议

与传统的“先公布跑分、技术报告再开放用户验证”的发布逻辑不同,匿名模型的选择是“先开放试用、后公开身份”,这种模式既可以收集大规模真实工作负载下的用户反馈,也能测试模型脱离品牌光环后的真实市场评价,但同样存在明显问题。目前OpenRouter仅以“前沿级性能”描述Union Alpha,未公布任何支撑该结论的具体数据,模型页面未展示SWE-bench、Terminal-Bench、GPQA、ARC-AGI等常见基准测试成绩,也没有与GPT-6 Astra、Claude Opus 5、Fable 5.1等头部模型的直接对比,模型架构、参数规模、是否采用MoE架构、训练数据截止时间、推理资源配置等核心信息均未公开。
第三方评测平台Artificial Analysis的散点图显示,Union Alpha在Terminal-Bench v4.0的得分约为55%,预期定价约1美元/任务,性价比高于得分约58%的GPT-6 Astra高配版(每任务4美元)、得分约57%的Claude Fable 5.1高配版(每任务30美元),但DeepSeek最新发布的DeepSeek V4.1 Flash未纳入该榜单,无法直接对比。业内观点指出,免费Token带来的高调用量并不直接等同于模型能力领先,免费本身即为极强的流量激励,模型最终能否获得市场认可,仍需依靠严格评测下的实际性能支撑。

匿名模型成发布新潮流 厂商谍战预热搅动行业格局

Union Alpha上线后,除性能讨论外,“猜爹”也成为社区热门话题,有用户猜测其为MiniMax M3.1、Kimi K3.1,也有用户认为是智谱的新一代GLM产品,还有人推测是GPT系列匿名测试版本,但目前均未获得官方证实。
事实上,匿名免费测试已成为近期大模型厂商预热的主流打法:此前智谱的Ox Alpha匿名上线6天后公开身份,终结了DeepSeek连续56天的OpenRouter调用量霸榜纪录;同期OpenCode还上线了另一款匿名模型Omen Alpha,同样疑为智谱旗下新品;Arena竞技场也疑似出现新的Kimi K3检查点;与此同时OpenAI调整计费规则,GPT-6 Astra在Codex中支持105万Token上下文且免除长上下文加价。这种谍战式发布模式既降低了厂商的预热成本,也能在最小化信息披露的情况下测试市场反应,成为当前AI圈模型发布的新趋势。