9 października 2026 r. Postman opisał architekturę Agent Mode korzystającego z Amazon Bedrock: system zawęża katalog ponad 170 narzędzi do około 15 dopasowanych do zadania, a osobne ścieżki przygotowują kontekst dla agenta. Amazon Bedrock zapewnia w tej implementacji inferencję modeli, natomiast Agent Mode jest funkcją platformy Postman.

Czym jest Postman Agent Mode

Anglojęzyczny samouczek pokazuje generowanie testów API, debugowanie żądań i tworzenie konfiguracji CI/CD.

Postman to platforma do pracy z API, a Agent Mode to zintegrowana z nią funkcja wspierająca m.in. testowanie, dokumentowanie, odkrywanie i wdrażanie API. Bedrock pełni inną rolę: dostarcza dostęp do modeli i obsługuje ich inferencję. To odrębne elementy, a nie dwie nazwy tego samego agenta.

31 marca 2026 r. Postman ogłosił Claude jako domyślnego dostawcę modeli Agent Mode za pośrednictwem Amazon Bedrock. Opis techniczny przedstawia wybór spośród obsługiwanych modeli Claude zależnie od rodzaju obciążenia.

Nie należy utożsamiać Agent Mode z Amazon Bedrock Managed Agents — to osobny produkt AWS, opisany w artykule o Amazon Bedrock Managed Agents.

Jak Postman dobiera narzędzia do zadania

W opisywanym przepływie agent nadrzędny przeszukuje katalog liczący ponad 170 narzędzi. Wyszukiwanie semantyczne w bazie wektorowej wybiera około 15 pasujących do konkretnego zadania, a następnie przekazuje je agentowi podrzędnemu działającemu w odizolowanym kontekście. Dzięki temu podagent pracuje z mniejszym zestawem narzędzi zamiast dostawać cały katalog naraz.

Postman podaje, że podczas jego testów błędy wyboru narzędzi nasilały się, gdy widoczny dla modelu zestaw przekraczał około 40 pozycji. Większe lub nowsze modele ograniczały ten problem, ale go nie usuwały. To obserwacja dotycząca opisanego procesu testowego, nie uniwersalny próg dla każdego agenta.

Jak kontekst i dane trafiają do agenta

Agent Mode korzysta z dwóch ścieżek kontekstowych. Pierwsza automatycznie zbiera szerokie, lecz ogólne informacje, takie jak aktywna karta i stan obszaru roboczego. Druga obejmuje materiały wskazane przez użytkownika — na przykład przez przeciągnięcie elementu, wzmiankę lub odnośnik „Ask AI” — i pozwala skupić się na konkretnym zasobie. Osobne handlery przetwarzają typy elementów, takie jak kolekcje, foldery, żądania, przykłady, mocki i monitory.

Opisy żądań tworzone przez użytkowników, specyfikacje OpenAPI i payloady mogą zapełniać okno kontekstu. Dlatego częścią tej architektury jest ograniczanie i skracanie danych przekazywanych modelowi. Postman wskazuje, że w jego doświadczeniu niepełny kontekst powodował więcej problemów niż brak dostępnych funkcji.

Dla uporządkowanych danych z API Catalog Postman opisuje zapytania oparte na schemacie do bazy ClickHouse. Zamiast tworzyć osobne, wąskie narzędzie dla każdego pytania, agent może korzystać z jednego narzędzia odczytu dostosowanego do struktury danych.

Routing inferencji i zatwierdzanie działań

Postman opisuje wybór profilu inferencji Amazon Bedrock dla danego obciążenia. Profil geograficzny kieruje żądania między obsługiwanymi regionami w określonym obszarze, a profil globalny może korzystać z obsługiwanych regionów na całym świecie.

Agent Mode może wysyłać żądania w tle, bez otwartej karty. Jeśli działanie zmienia stan aplikacji, przed jego wykonaniem wymagane jest zatwierdzenie użytkownika. To dotyczy również aktualizacji testów: Agent Mode może zaproponować zmiany i przygotować asercje, które użytkownik sprawdza przed akceptacją.

Postman opisuje także Amazon Bedrock Guardrails do redagowania danych osobowych, zanim trafią do modelu językowego. Administratorzy korporacyjni mogą włączyć tę funkcję w ustawieniach zabezpieczeń Agent Mode.

Retencja i cache zależne od modelu

Postman podaje, że dla obsługiwanych modeli ustawił data_retention_mode na none. Dostępność tej opcji i jej działanie zależą od modelu.

Architektura rozdziela również stabilną część promptu od bardziej zmiennego kontekstu. Dla tej pierwszej Postman opisuje godzinowy punkt cache, a dla drugiej — pięciominutowy. Obsługa cache zależy od modelu, a dłuższy punkt powinien poprzedzać krótszy.

Co Postman opisuje w swojej implementacji

To podejście łączy dobór narzędzi z przygotowaniem kontekstu, routingiem inferencji i zatwierdzaniem działań zmieniających stan aplikacji. Liczba 40 mln odnosi się do społeczności deweloperów Postman, nie do użytkowników Agent Mode. Postman opisuje swoją implementację jako zastrzeżoną i nie udostępnia jej w publicznym repozytorium przykładowym.