Secondo quanto riferito il 30 settembre 2026, le aziende potrebbero usare Kimi K3 attraverso Codex con Baseten per l’inferenza, cioè l’elaborazione delle richieste al modello. L’uso potrebbe essere conteggiato negli impegni di spesa OpenAI già esistenti, senza un contratto separato con il fornitore.
La via enterprise passa da Baseten
In questo percorso, Codex è l’interfaccia per chi sviluppa, mentre Baseten fornisce l’inferenza. La formula di spesa descritta riguarda gli impegni OpenAI esistenti: è una strada aziendale distinta dalla configurazione diretta dell’API Kimi.
Le altre novità di Codex e delle API annunciate a DevDay 2026 sono raccontate nel precedente articolo di NeoTeo.
La configurazione diretta di Kimi K3 in Codex
Moonshot AI documenta un collegamento diretto: Codex chiama il modello kimi-k3 tramite la Responses API all’endpoint https://api.moonshot.ai/v1. Per questa configurazione serve una chiave API della Kimi Open Platform, da fornire tramite la variabile d’ambiente KIMI_API_KEY.
La guida imposta una finestra di contesto di 1.048.576 token, in linea con la finestra da 1 milione di token indicata per Kimi K3. Codex CLI e Codex Desktop condividono la configurazione utente; dopo aver configurato l’app, va riavviata.
Gli input di Codex CLI
Nella configurazione descritta, Codex CLI supporta input di testo e immagini, ma non ha un canale nativo per ricevere video. Il limite riguarda gli input di Codex CLI.