Las últimas actualizaciones de Bard: acceso global a Gemini Pro y generación de imágenes

La última mejora de Google para Bard, que añade acceso a Gemini Pro y generación de imágenes, es vista ampliamente como decepcionante en comparación con GPT‑4 de OpenAI y otros competidores. Los comentaristas destacan la disponibilidad irregular (en particular, la exclusión de Canadá y de la generación de imágenes en gran parte de Europa), la censura y los filtros de seguridad excesivamente estrictos, y un comportamiento inconsistente que mina la utilidad en el mundo real. Muchos ven estos problemas como síntomas de la cautela regulatoria de Google y de una desalineación interna, lo que plantea dudas sobre si la empresa podrá alcanzar a los modelos de lenguaje grandes pese a su ventaja temprana en investigación de IA.

Disponibilidad y despliegue “global”

  • Muchos comentaristas señalan que Bard sigue sin estar disponible en Canadá, a pesar de que Google etiqueta el acceso como “global”.
  • La generación de imágenes (Imagen 2) también está bloqueada en el EEE, Suiza y el Reino Unido según el soporte de Google, lo que provoca confusión entre usuarios que recibieron anuncios de funciones pero no pueden usarlas.
  • Se debatieron explicaciones: proyectos de ley canadienses (C‑18, C‑27), la Ley 64 de Quebec, comisionados de privacidad investigando a OpenAI, argumentos de “mercado pequeño” e incertidumbre regulatoria general.
  • Otros responden que Bard funciona en jurisdicciones mucho más estrictas (la UE), que OpenAI/Microsoft operan en Canadá y que Google no ha articulado claramente sus razones.

Calidad del modelo frente a GPT-4 / benchmarks

  • Varios usuarios informan que Bard/Gemini Pro rinde por debajo de GPT‑4 y, con frecuencia, incluso por debajo de GPT‑3.5 en razonamiento, programación y tareas complejas; las alucinaciones y las respuestas “burocráticas” son quejas habituales.
  • Algunos consideran que Bard es mejor para escritura creativa o borradores de estilo jurídico, y señalan que el GPT‑3.5 gratuito es “basura” en comparación con GPT‑4 de pago.
  • La sólida posición de Gemini Pro en la clasificación de LMsys se mira con escepticismo por algunos, que sospechan sobreajuste a benchmarks o variantes especiales; otros lo atribuyen a un ajuste fino actualizado y al acceso a internet, y advierten contra sobredimensionar un solo leaderboard.
  • Ultra (el modelo pensado para competir directamente con GPT‑4) aún no está disponible, así que algunos reservan su juicio.

Generación de imágenes y filtros de seguridad

  • Se elogia la velocidad de generación de imágenes de Bard, pero la calidad suele considerarse inferior a DALL‑E 3 y Midjourney, con un rango estilístico limitado y problemas con composiciones complejas.
  • Los filtros de seguridad se describen como inusualmente agresivos e inconsistentes: bloquean bikinis, tristeza, cuchillos, ciertos descriptores raciales y, a veces, cualquier persona o animal.
  • Los usuarios informan cambios de comportamiento con el tiempo (a veces “no puede generar imágenes”, a veces solo muy restringidas).
  • Se menciona la marca de agua SynthID de Google; no está clara la disponibilidad de herramientas públicas de detección.

Censura, seguridad y UX

  • Bard rechaza con frecuencia tareas (redacción legal, código de API, traducciones con profanidades, tablas técnicas de par de torsión), citando seguridad, responsabilidad o política.
  • Muchos consideran que esto es más duro que en la competencia; otros señalan problemas similares con Bing y GPT‑3.5.
  • Son comunes las peticiones de indicadores transparentes de versión del modelo y de despliegues menos confusos (pruebas A/B, lanzamientos por fases).

Estrategia de Google y posición competitiva

  • Los comentaristas debaten si el retraso de Google se debe a mala gestión, al temor de canibalizar su negocio de búsqueda/anuncios o a una mayor tolerancia al riesgo legal/reputacional.
  • Algunos predicen un declive a largo plazo a medida que los usuarios migran a GPT‑4/Perplexity/Bing; otros señalan que la escala, la infraestructura y el enfoque cauteloso de Google son racionales, aunque más lentos.