Ein Test mit fünf Fragen zu aktuellen Produkten, Softwarefunktionen und Ereignissen liefert ein klares, aber begrenztes Ergebnis: ChatGPT und Gemini beantworteten mehrere Aktualitätsfragen treffender als Claude. Bei der Frage nach Apples neuesten iPhones nannten beide iPhone 18 Pro, iPhone 18 Pro Max und iPhone Duo, während Claude die iPhone-17-Serie als aktuellste Reihe angab.
Das ist kein allgemeines Qualitätsranking. Es ist ein konkreter Blick darauf, wie drei Assistenten mit neueren Informationen umgehen – und ein Hinweis darauf, dass eine aktivierte Websuche nicht automatisch jede Antwort aktuell macht.
Eine Prüfung mit fünf Fragen findet unterschiedliche Trefferquoten
Die Fragen betrafen neue iPhone-Modelle, die aktuelle Claude-Generation, die Fußball-WM 2026, Siri AI in iOS 27 und eine Drittanbieter-KI-Integration für Google Home. Bei den iPhones lagen ChatGPT und Gemini vorn. ChatGPT nannte außerdem Claude Fable 5.1 als neuestes Flaggschiffmodell von Anthropic; Claude und Gemini lieferten dazu ältere oder anders abgegrenzte Modellangaben.
Bei zwei weiteren Themen waren alle drei auf demselben Stand: Sie beantworteten die Frage zur Fußball-WM 2026 mit Spanien als Sieger und erkannten Siri AI als wichtigste neue Funktion von iOS 27. ChatGPT und Gemini wussten zudem von der Drittanbieter-KI-Integration in Google Home, Claude nicht.
Wo Claude zurücklag – und wo alle drei richtig lagen
Die auffälligste Abweichung betraf die iPhone-Frage. Claude nannte die iPhone-17-Serie, obwohl in der Prüfung bereits die iPhone-18-Reihe mit iPhone 18 Pro, iPhone 18 Pro Max und iPhone Duo als neueste Generation galt. Die Antwort war damit bei genau dieser Frage nicht aktuell.
Bei der Modellfrage zeigte sich ein ähnliches Muster, allerdings mit einer wichtigen Einschränkung: ChatGPT nannte Claude Fable 5.1, während die Antworten von Claude und Gemini ältere oder anders gefasste Modellinformationen enthielten. Daraus folgt, wie die jeweilige Antwort in diesem Test ausfiel – nicht, dass ein bestimmter Modellname dauerhaft verfügbar oder offiziell die aktuelle Anthropic-Spitze ist.
Dass alle drei bei der WM- und Siri-Frage richtig lagen, ist ebenso relevant. Aktualität ist kein Schalter, der für jede Themenkategorie gleichzeitig auf „an“ steht. Ein Assistent kann bei einem Produktstart danebenliegen und wenige Zeilen später ein anderes aktuelles Thema korrekt einordnen.
Warum ein neues Modell nicht automatisch alles Aktuelle kennt
Ein neueres Modell und aktuelle Recherchefunktionen lösen unterschiedliche Probleme. Das Modell bringt Wissen, Sprachverständnis und Schlussfolgerungen mit; eine Suche kann zusätzliche Informationen einbeziehen. Ob daraus eine treffende Antwort entsteht, hängt außerdem davon ab, welche Information gefunden, erkannt und in die Antwort übernommen wird.
In der Prüfung blieb Claude bei der iPhone-Frage bei der älteren Generation, obwohl die Suche aktiviert war. Das macht die Funktion nicht nutzlos – es zeigt aber, dass „mit Websuche“ keine Garantie für eine korrekte Aktualitätsantwort ist. Bei Nachrichten, Produktstarts und Softwarefunktionen solltest du deshalb die konkrete Antwort und den zeitlichen Bezug prüfen, statt dich allein auf das Vorhandensein eines Suchsymbols zu verlassen.
Welcher Assistent ist insgesamt der beste?
Einen allgemein besten Kandidaten ergibt der Vergleich nicht. Die breiteren Praxistests verteilen die Stärken je nach Aufgabe:
- Claude wird häufig für natürliches Schreiben, Tonanpassung, Befolgen genauer Anweisungen und professionelle Programmierarbeit bevorzugt.
- ChatGPT wird als vielseitige Option mit Sprachfunktion, Bildgenerierung, Websuche und einem breiten Funktions-Ökosystem beschrieben.
- Gemini passt besonders zu Recherche mit Google-Bezug, multimodalen Aufgaben und sehr großen Dokumenten. Für Nutzer, die Gmail, Docs, Drive, Sheets, Meet oder NotebookLM verwenden, ist die direkte Einbindung in dieses Umfeld ein wichtiger Faktor.
Beim Programmieren fallen die Einschätzungen auseinander: Einige Praxistests bevorzugen Claude Code oder ChatGPT mit Codex, während ein anderer Vergleich Gemini 3.1 Pro bei der Konsistenz von Coding-Aufgaben vorne sah. Unterschiedliche Prompts, Modellversionen und Testumgebungen machen daraus keinen universellen Sieger.
Für die Auswahl zählt damit weniger ein Gesamtsieg als der konkrete Arbeitsablauf: Wer vor allem Texte überarbeitet, findet bei Claude häufig die passendere Arbeitsweise. Wer viele unterschiedliche Funktionen in einem Dienst bündeln möchte, landet eher bei ChatGPT. Wer tief im Google-Ökosystem arbeitet oder große, multimodale Rechercheaufgaben bearbeitet, hat mit Gemini den direkteren Ansatz.