在 ChatGPT 中改进 GPT‑5.6 Sol,并向免费用户扩展 GPT‑5.6 Luna 访问

OpenAI 将其新的 GPT‑5.6 “Luna” 模型及可选推理能力在 ChatGPT 中向免费用户开放,被视为既是面向普通用户的一次重大能力升级,也是 AI 市场价格与性能竞争加剧的信号。评论者争论这是否实际上意味着偶尔获得高端模型的机会被削弱,批评繁琐的模型与“推理等级”选择,并质疑随着基础模型商品化,慷慨的免费层是否具有可持续性。这些变化也再次引发关于当前系统是否已经构成“AGI”、它们将如何变现(广告、数据、集成),以及人们对这类工具的广泛依赖将如何影响文化与工作的争论。

Luna 免费档与整体变化

  • 许多人认为“免费无限 Luna + Think 按钮”相较于此前较弱的免费模型(例如 5.5 Instant / mini,且限制很紧)是一次重大升级。
  • 也有人认为这比免费用户此前短暂获得的更强模型体验(5.x 之后自动降级)还要退步,因为 Luna 被描述为“nano tier”。
  • 一些人怀疑 Luna 的效率已经提升到足以让慷慨的免费使用在经济上说得通,并能带来更多训练数据和使用指标。

模型质量:Luna、Terra、Sol 与竞争对手

  • 看法分歧很大:
    • 有人说 Terra “糟透了”,只推荐 Luna Max 或 Sol Medium/High。
    • 也有人通过 Copilot 觉得 Terra 很强,甚至“远超”一些竞品模型。
    • Luna 被广泛认为以其价格而言出人意料地能打,但知识面较少,带有“小模型”感觉;最适合 agentic/web 任务。
    • Sol High/XHigh 是复杂工作的首选;Ultra/Max 被视为昂贵且大材小用,除非其他模型都不行。
  • 与外部模型(DeepSeek、Kimi、Gemini、Claude、Grok)的比较表明,这是一个拥挤且快速商品化的领域。

推理模式、滑块与 UX 摩擦

  • 很多人不喜欢大量努力等级(Instant/Low/Medium/High/XHigh/Max,Pro/Ultra),觉得这很混乱,甚至“疯狂”。
  • 一些人希望系统自动选择或先提出澄清问题,而不是把旋钮都暴露给用户;另一些人则喜欢在长而深的任务中手动控制。
  • 有人担心用户因为害怕出错而默认选“high”,可能增加 token 消耗;也有人怀疑存在把流量暗中路由到更便宜模式的 dark pattern。
  • 对同名的多个 Sol“版本”(Chat vs Work/Codex)感到困惑。

商业模式、竞争与广告

  • 线程指出商品化压力极其强烈;市场底部被认为正在塌缩成免费。
  • 有人猜测免费 Luna 是在对标 Google 的 AI Overviews 和其他慷慨的免费档位。
  • 讨论围绕 Google 的垂直整合和定制硬件是否会主导低端市场展开,尽管当前模型质量仍受诟病。
  • 一些人预计会通过画像和广告变现;另一些人则质疑在 LLM 推理成本下广告经济是否可行。

AGI 术语与能力

  • 提到 AGI 的使命宣言引发了争论:
    • 一些人认为当前模型在合理意义上已经可以算作 AGI(通用、广泛有用)。
    • 另一些人坚持它们仍然过于容易出错,缺乏具身理解,也达不到强图灵测试式标准。
  • 讨论提到“jagged intelligence”:在某些基准上表现极佳(数学、编程、智商测试),但在其他领域又出奇地弱。

免费 vs 付费体验与限制

  • 付费用户抱怨默认聊天常常无声地使用与免费版相同的廉价“Instant”模型,而努力滑块被隐藏或重置。
  • 一些人认为这是 dark pattern;另一些人则认为这是以延迟为导向的设计。
  • 重度用户强调,付费方案的真正价值在于编码代理/API(Codex/Claude Code),而不是聊天额度。