Mejorando GPT‑5.6 Sol en ChatGPT, ampliando el acceso a GPT‑5.6 Luna para usuarios gratuitos

La decisión de OpenAI de hacer disponible gratuitamente en ChatGPT su nuevo modelo GPT‑5.6 “Luna”, con razonamiento opcional, se percibe tanto como una gran mejora de capacidades para usuarios ocasionales como una señal de intensificación de la competencia en precio y rendimiento en el mercado de IA. Los comentaristas debaten si esto realmente degrada el acceso ocasional a modelos de gama alta, critican las confusas opciones de modelo y de “nivel de razonamiento”, y cuestionan cuán sostenibles son los niveles gratuitos generosos a medida que los modelos fundacionales se convierten en commodities. Los cambios también reavivan los argumentos sobre si los sistemas actuales ya califican como “AGI”, cómo se monetizarán (anuncios, datos, integraciones) y qué podría significar para la cultura y el trabajo la dependencia generalizada de estas herramientas.

Nivel gratuito de Luna y cambio general

  • Muchos ven “Luna gratis e ilimitado + botón Think” como una mejora importante frente a los modelos gratuitos débiles anteriores (p. ej., 5.5 Instant / mini con límites estrictos).
  • Algunos sostienen que es una degradación frente al breve impulso de modelos más potentes que los usuarios gratuitos recibieron antes (5.x y luego degradación automática), ya que Luna se describe como de “nivel nano”.
  • Varios sospechan que la eficiencia de Luna ha mejorado lo suficiente como para que un uso gratuito generoso ahora tenga sentido económico y genere más datos de entrenamiento y métricas de uso.

Calidad del modelo: Luna, Terra, Sol y competidores

  • Las opiniones divergen drásticamente:
    • Algunos dicen que Terra es “terrible” y recomiendan solo Luna Max o Sol Medium/High.
    • Otros encuentran Terra potente vía Copilot y “muy por delante” de algunos modelos rivales.
    • Luna es ampliamente visto como sorprendentemente capaz para su precio, pero con menos conocimiento y sensación de “modelo pequeño”; mejor para tareas agenticas/web.
    • Sol High/XHigh es la opción preferida para trabajo complejo; Ultra/Max se consideran caros y excesivos salvo cuando los demás fallan.
  • Las comparaciones con modelos externos (DeepSeek, Kimi, Gemini, Claude, Grok) muestran un panorama abarrotado y que se está commoditizando rápidamente.

Modos de razonamiento, deslizadores y fricción de UX

  • A muchos no les gusta la proliferación de niveles de esfuerzo (Instant/Low/Medium/High/XHigh/Max, Pro/Ultra) y les resulta confusa o “una locura total”.
  • Algunos quieren que el sistema elija automáticamente o haga preguntas aclaratorias en lugar de exponer controles; otros valoran el control manual para tareas largas y profundas.
  • Preocupa que los usuarios elijan “alto” por miedo a errores, lo que podría aumentar el uso de tokens; algunos sospechan enrutamiento con patrón oscuro hacia modos más baratos.
  • Confusión acerca de múltiples “versiones” de Sol (Chat vs Work/Codex) bajo el mismo nombre.

Modelo de negocio, competencia y anuncios

  • El hilo señala una intensa presión de commoditización; la parte baja del mercado se percibe como hundiéndose hacia lo gratuito.
  • Se especula que Luna gratis apunta a Google AI Overviews y a otros niveles gratuitos generosos.
  • Hay debate sobre si la integración vertical de Google y su hardware personalizado dominarán el segmento de gama baja, pese a las quejas actuales sobre la calidad del modelo.
  • Algunos esperan monetización mediante perfiles y anuncios; otros cuestionan si la economía publicitaria funciona con los costos de inferencia de LLM.

Terminología de AGI y capacidades

  • La declaración de misión que menciona AGI provoca debate:
    • Algunos creen que los modelos actuales califican razonablemente como AGI (generales, ampliamente útiles).
    • Otros insisten en que siguen siendo demasiado propensos a errores, carecen de comprensión encarnada y no cumplen estándares fuertes tipo test de Turing.
  • La discusión señala una “inteligencia desigual”: excelente en algunos benchmarks (matemáticas, programación, tests de CI) pero extrañamente débil en otras áreas.

Experiencia gratuita vs. de pago y límites

  • Los usuarios de pago se quejan de que el chat predeterminado usa silenciosamente el mismo modelo barato “Instant” que el gratuito, con los deslizadores de esfuerzo ocultos o reiniciados.
  • Algunos ven esto como un patrón oscuro; otros, como un diseño orientado a la latencia.
  • Los usuarios avanzados subrayan que el verdadero valor de los planes de pago está en los agentes de programación/API (Codex/Claude Code) más que en los límites del chat.