Ox Alpha
一个新的“隐身”LLM Ox Alpha 通过 OpenRouter 免费提供,之所以引人关注,是因为其创建者未公开,但提供方会保留提示词和完成内容用于分析,尽管据称不会用于训练。用户猜测它可能是中国来源的 GLM 5.x 变体或多模型混合,并通过向它提出天安门、台湾和西藏等政治敏感问题来推断审查模式,并将其护栏与美国实验室进行比较。虽然许多人认为它出奇地强大——尤其擅长创意工作且速度很快——但也有人担忧其来源不透明、隐私风险、许可证影响,以及前沿 AI 模型整体上日益缺乏透明度的趋势。
模型身份与行为
- 许多人认为 Ox Alpha 是一个中国模型,很可能是 GLM 5.x(可能是 5.3,也可能是支持视觉的或 “Air” 变体);也有人认为它可能是 DeepSeek 或小米的模型。
- 有人声称,它的行为和思维链风格与 GLM 非常相似,提示词/回复模式也与 GLM 5.3 的输出一致。
- 也有少数人根据不同用户得到的不一致回答,推测它可能是一个使用多个后端的模型路由器。
护栏、审查与政治
- 用户会用“中国 1989 / 天安门广场”、西藏和台湾相关问题来试探,作为判断中文审查的晴雨表。
- 报告相互矛盾:有人说它会拒绝天安门内容,但会提供有攻击性的网络安全帮助;也有人说它会自由描述天安门并批评中共。
- 关于审查究竟是在模型训练层面还是在服务端点进行、以及未来系统是否会把审查直接写入权重,存在争论。
- 还有几位将中国政治红线(如天安门、西藏)与西方实验室对毒品/恶意软件/生物学的拒答进行比较,认为两者都是针对特定主题的安全限制。
隐私、数据使用与“隐身”担忧
- Ox Alpha 是一个“隐身模型”:OpenRouter 知道提供方,但不公开;提示词/完成内容会被保留,但(据称)不会用于训练。
- 一些人对此非常怀疑;他们认为“不会用于训练”的承诺无法验证,并怀疑存在法律上的文字游戏(例如将数据用于 RLHF/分析)。
- 也有人认为这在行业里很常见:如果你在意保密,就不要向“神秘端点”发送任何敏感内容。
- 更广泛的担忧是,所有大型实验室都会训练它们能拿到的任何数据,尽管官方政策另有说法,这背后是数据稀缺与竞争压力。
- 有些人更偏好中国的开源权重模型,因为它们可以自托管,或者选择带有严格保留策略的可信托管服务。
能力、使用场景与 UX
- 一些人觉得 Ox Alpha 在创意/“软”任务上非常强,甚至能超过一些广受好评的模型,不过在视觉推理和前端/CSS 工作上较弱。
- 对速度的评价不一:有人称它“快得可疑”,也有人说 GLM 5.3 在真实任务中通常比顶级美国模型更慢。
- 知识截止时间估计在 2025 年中期左右。
- 免费访问和较低的速率限制被视为实验室烟雾测试模型、收集使用分析、测试基础设施/容量,并在不承担公关风险的情况下获取市场立足点的一种方式。