AWS gab am 28. September 2026 bekannt, dass Grok 4.7 auf Amazon Bedrock verfügbar ist. Das Modell von xAI lässt sich dort über regionsübergreifende Inferenz nutzen: AWS führt dafür die Profile us.xai.grok-4.7 und global.xai.grok-4.7. xAI hatte Grok 4.7 bereits am 21. September vorgestellt.

Was Grok 4.7 auf Bedrock bietet

Grok 4.7 hat auf Amazon Bedrock ein Kontextfenster von 500.000 Token. Das Modell verarbeitet Text und Bilder als Eingabe und erzeugt Text. Die Schlussfolgerungsfunktion ist standardmäßig aktiv; als Aufwandseinstellung ist high voreingestellt. Zur Auswahl stehen außerdem low, medium und xhigh.

Geo und Global: zwei Inferenzprofile

Regionsübergreifende Inferenz bedeutet, dass Modellaufrufe über AWS-Regionen hinweg verarbeitet werden. Das Geo-Profil ist auf die US-Regionen ausgerichtet; das Global-Profil ist als globale Option ausgewiesen. AWS nennt folgende Standardtarife je eine Million Token, in US-Dollar:

InferenzprofilKennungEingabe je 1 Mio. TokenAusgabe je 1 Mio. TokenCache-Lesezugriff je 1 Mio. Token
Geo, regionsübergreifendus.xai.grok-4.72,20 US$6,60 US$0,55 US$
Global, regionsübergreifendglobal.xai.grok-4.72,00 US$6,00 US$0,50 US$

Für die Prioritätsstufe berechnet AWS das 1,75-Fache des Standardpreises, für Flex die Hälfte. Die reservierte Stufe wird für Grok 4.7 nicht unterstützt.

APIs und Bedrock-Funktionen

AWS führt vier Schnittstellen für Grok 4.7 auf: Responses, Chat Completions, Converse und Invoke. Sie laufen über bedrock-runtime. Unterstützt werden außerdem unter anderem Antwort-Streaming, implizites Prompt-Caching, strukturierte Ausgaben und Guardrails. Anwendungs-Inferenzprofile sind mit Invoke und Converse nutzbar.

Serverseitige Tool-Nutzung, intelligentes Prompt-Routing und Tokenzählung unterstützt Grok 4.7 auf Bedrock nicht. Anwendungs-Inferenzprofile funktionieren zudem nur mit Invoke und Converse.

AWS-Region Frankfurt

AWS listet Frankfurt (eu-central-1) für die Global-Inferenz von Grok 4.7.