Le 9 octobre 2026, Postman a détaillé l’architecture de production d’Agent Mode, une fonctionnalité de sa plateforme d’API qui utilise Amazon Bedrock pour l’inférence des modèles. Son approche associe une sélection d’outils par tâche, plusieurs méthodes de préparation du contexte et des réglages qui varient selon le modèle. Les 40 millions de développeurs cités désignent la communauté de Postman, et non les utilisateurs d’Agent Mode.

Ce que fait Postman Agent Mode

Postman détaille l’architecture d’Agent Mode sur Amazon Bedrock
Un tutoriel en anglais montre Agent Mode générant des tests API à partir d’une consigne, aidant à déboguer une requête et préparant un workflow CI/CD.

Postman est une plateforme consacrée au travail sur les API ; Agent Mode y est intégré pour aider à les tester, les documenter, les découvrir et les mettre en œuvre. Dans l’architecture décrite, Agent Mode orchestre les outils et le contexte liés à l’espace de travail, tandis qu’Amazon Bedrock fournit l’accès aux modèles et leur inférence. Bedrock Managed Agents est un produit distinct d’Agent Mode, comme l’explique notre présentation d’Amazon Bedrock Managed Agents.

Comment Postman sélectionne les outils selon la tâche

Plutôt que de présenter tout son catalogue à l’agent, Postman décrit une recherche qui réduit plus de 170 outils à environ 15 outils pertinents pour la tâche. Un sous-agent isolé reçoit cette sélection et travaille dans un contexte distinct. Cette organisation vise à limiter le bruit : l’agent n’a pas à choisir parmi l’ensemble des outils à chaque étape.

Postman rapporte aussi que les erreurs de sélection augmentaient dans ses tests lorsque l’ensemble visible dépassait environ 40 outils. Ce constat explique l’intérêt de réduire la sélection, sans fournir un seuil universel applicable à tous les modèles ou à tous les agents.

Comment le contexte et les données structurées sont préparés

Postman décrit deux voies pour alimenter l’agent. Le contexte général est recueilli automatiquement à partir de l’espace de travail et ramené aux éléments utiles au prompt. Le contexte ciblé est choisi par l’utilisateur, puis traité par des gestionnaires adaptés à chaque type d’objet, comme une collection ou une requête. Le premier donne une vue d’ensemble ; le second permet de se concentrer sur un élément précis.

Pour les données structurées de l’API Catalog, Postman décrit des requêtes tenant compte du schéma dans ClickHouse, plutôt qu’un outil étroit différent pour chaque question. Une requête d’exemple porte sur une fenêtre de sept jours et filtre une latence p95 inférieure à 100 ms. Ces valeurs définissent les conditions de cette requête illustrative, pas des mesures de performance d’Agent Mode.

Routage de l’inférence et approbation de l’utilisateur

Postman décrit le choix d’un profil d’inférence Amazon Bedrock selon la charge de travail. Un profil géographique répartit les requêtes entre des régions prises en charge dans une zone définie ; un profil global peut les acheminer entre des régions prises en charge à l’échelle mondiale.

Le 31 mars 2026, Postman a annoncé Claude comme fournisseur de modèles par défaut pour Agent Mode sur Bedrock. Sa description technique évoque la sélection de modèles Claude compatibles selon la charge de travail : cela ne signifie pas que chaque requête utilise un modèle unique. Agent Mode peut aussi envoyer des requêtes sans qu’un onglet soit ouvert, mais une approbation de l’utilisateur reste nécessaire pour les actions qui modifient l’état de l’application.

Rétention et cache dépendent du modèle

Postman indique avoir réglé data_retention_mode sur none pour les modèles compatibles avec Agent Mode. La disponibilité et le comportement de ce réglage varient selon le modèle. L’entreprise décrit également un point de mise en cache d’une heure pour le contenu stable du prompt et un autre de cinq minutes pour le contexte plus variable ; la prise en charge dépend là aussi du modèle.

Postman indique enfin que les administrateurs d’entreprise peuvent activer Amazon Bedrock Guardrails pour masquer les données personnelles identifiables avant leur transmission au modèle. Ces réglages — rétention, cache et garde-fous — correspondent à des contrôles distincts, dont l’application dépend du modèle ou de la configuration choisie. Postman précise que son implémentation de production est propriétaire et ne fait pas l’objet d’un dépôt public d’exemple.