Una prueba de cinco preguntas publicada el 17 de septiembre de 2026 encontró diferencias notables entre ChatGPT, Claude y Gemini al responder sobre novedades tecnológicas. ChatGPT y Gemini identificaron los iPhone más recientes y reconocieron una integración de IA en Google Home; Claude respondió con información más antigua en esas preguntas. Los tres, eso sí, acertaron las cuestiones sobre el Mundial de 2026 y Siri AI.

El resultado importa por una razón muy concreta: activar la búsqueda web o usar un modelo reciente no garantiza que cada respuesta esté al día. La actualidad depende también de que el asistente encuentre, interprete y aplique la información correcta a la pregunta.

Una prueba de cinco preguntas encuentra respuestas desiguales

La comparación preguntó a ChatGPT, Claude y Gemini por cinco asuntos recientes: los nuevos iPhone de Apple, el modelo insignia más reciente de Anthropic, el ganador del Mundial de 2026, la gran función de Siri en iOS 27 y la integración de asistentes de terceros en Google Home.

En la pregunta sobre Apple, ChatGPT y Gemini identificaron como novedades el iPhone 18 Pro, el iPhone 18 Pro Max y el iPhone Duo. Claude respondió que la serie iPhone 17 era la más reciente.

La diferencia se repitió al preguntar por Anthropic. ChatGPT respondió con Claude Fable 5.1, mientras Claude y Gemini dieron nombres de modelos más antiguos o respuestas con un alcance diferente. El dato relevante aquí no es confirmar esos nombres como catálogo actual, sino que los tres asistentes no recuperaron la misma respuesta ante una pregunta idéntica sobre actualidad.

Dónde falló Claude y dónde acertaron los tres

Claude también quedó por detrás en la pregunta sobre Google Home: ChatGPT y Gemini reconocieron la integración de inteligencia artificial de terceros, mientras Claude no la identificó.

En cambio, la prueba no fue un tropiezo generalizado. Los tres asistentes respondieron correctamente a la pregunta sobre el ganador del Mundial de 2026 y señalaron Siri AI como la gran novedad de iOS 27. La fotografía, por tanto, es irregular: un sistema puede acertar una novedad y fallar otra que pertenece al mismo momento informativo.

Conviene leer el resultado como una observación concreta de cinco preguntas, no como una clasificación general de inteligencia, redacción o calidad. Cinco aciertos o errores no bastan para coronar a un asistente para todos los usos.

Por qué un modelo nuevo no siempre sabe lo más reciente

La búsqueda web ayuda a consultar información reciente, pero no convierte automáticamente cada respuesta en una respuesta actualizada. El asistente debe localizar el dato adecuado, distinguir una versión antigua de una nueva y responder exactamente a lo que se pregunta. En esta prueba, esa cadena funcionó de manera desigual.

También pesa el tipo de pregunta. Los nombres de productos y modelos cambian rápido, y una respuesta aparentemente segura puede arrastrar información anterior. Las preguntas sobre Siri AI y el Mundial fueron más estables para los tres sistemas; las relativas a lanzamientos y catálogos exigían una actualización más precisa.

La lección práctica es sencilla: cuando preguntes por un lanzamiento, una versión de software o el modelo más reciente, comprueba especialmente la fecha y el nombre exacto. Una respuesta fluida no es una marca de actualidad.

Qué permite concluir esta comparación

La prueba de actualidad no designa un ganador absoluto, pero sí dibuja diferencias útiles para elegir herramienta.

  • Para escribir y editar: Claude fue favorecido en varias comparaciones prácticas por su seguimiento de instrucciones, ajuste de tono y trabajo con textos largos.
  • Para un uso general: ChatGPT aparece como la opción más amplia por la combinación de voz, generación de imágenes, búsqueda web y distintas integraciones.
  • Para investigar dentro del ecosistema de Google: Gemini encaja mejor con Google Search, NotebookLM y herramientas como Gmail, Docs, Drive, Sheets y Meet.
  • Para programar: los resultados son mixtos. Claude Code fue valorado en trabajos profesionales, mientras una comparación con tareas idénticas favoreció a Gemini 3.1 Pro por consistencia de código.

Así que la respuesta a «¿cuál es mejor?» depende del trabajo. Claude puede ser la elección más cómoda para redactar; ChatGPT, la más versátil; y Gemini, la más natural si tu flujo pasa por Google y documentos voluminosos. La prueba del 17 de septiembre añade una condición importante: para asuntos que cambian deprisa, ninguno merece confianza automática solo por responder con seguridad.