AWS und OpenAI kündigten Amazon Bedrock Managed Agents am 28. April 2026 als begrenzte Vorschau an. AWS führt den Dienst in seiner aktuellen Entwicklerdokumentation als öffentliche Vorschau. Er verbindet OpenAI-Modelle mit Inferenz über Amazon Bedrock und führt Werkzeuge in einer vom Kunden bereitgestellten Umgebung aus.

Was Amazon Bedrock Managed Agents macht

Der Dienst verwaltet Agentensitzungen, die den Gesprächskontext über mehrere Nachrichten hinweg behalten. Eine Sitzung legt das Modell, die Anweisungen, die verfügbaren Werkzeuge, eine IAM-Rolle und die Ausführungsumgebung fest. IAM steht für AWS Identity and Access Management und regelt hier die Berechtigungen des Dienstes.

Amazon Bedrock Managed Agents nutzt OpenAI-Modelle und den OpenAI-Agenten-Harness, den AWS als Codex-Harness bezeichnet. Ein Agenten-Harness bildet die technische Grundlage, auf der ein Agent seine Aufgaben bearbeitet.

Inferenz und Werkzeugausführung laufen in unterschiedlichen Umgebungen

Die Modellinferenz – also die Verarbeitung einer Anfrage durch das Modell – läuft über Amazon Bedrock. Werkzeuge werden dagegen in der Ausführungsumgebung ausgeführt, die der Kunde bereitstellt. Dafür nennt AWS entweder selbst betriebene Rechenkapazität oder Amazon Bedrock AgentCore Runtime. AWS stellte AgentCore als Standardumgebung vor; die Entwicklerdokumentation nennt auch selbst betriebenes Compute als Option.

Diese Aufteilung ist für die Architekturplanung relevant: Modellaufrufe und Werkzeugausführung finden nicht zwangsläufig in derselben Umgebung statt. Die konkrete Ausführungsumgebung gehört zur Konfiguration der jeweiligen Sitzung.

Sitzungen, Skills und MCP

Sitzungen behalten Kontext über Nachrichten hinweg. Wiederverwendbare Skills liefern dem Agenten Anweisungen; Server für das Model Context Protocol (MCP) können zusätzliche Werkzeuge bereitstellen.

Regionen und Kosten

AWS führt Endpoints in drei US-Regionen auf: US East (N. Virginia, us-east-1), US West (Oregon, us-west-2) und US East (Ohio, us-east-2). Die Verfügbarkeit einzelner Modelle kann laut AWS je nach Region und Konto variieren.

Abgerechnet werden Modellinferenz und die verwendeten AWS-Ressourcen. Im Beispiel mit AgentCore können Speicher- und Netzwerkkosten auch dann weiter anfallen, wenn gerade keine Agenteninteraktion läuft.

AWS weist darauf hin, dass sich Funktionen und APIs während der Vorschau ändern können. Das Löschen einer Sitzung löscht keine Dateien, die in den S3-Buckets des Kunden oder auf dessen Host gespeichert sind.