Em setembro de 2026, uma amostra de cerca de 120 mil empresas associadas à OpenRouter apontou gastos aproximadamente equilibrados com OpenAI e Anthropic. Em um recorte separado, a Ramp registrou uma breve liderança da OpenAI em meados do mês, seguida por uma pequena vantagem da Anthropic no fim daquela semana. São fotografias diferentes do gasto empresarial — e as tarifas oficiais por token ajudam a entender os custos, mas não revelam quanto custa concluir uma tarefa.
Gastos ficaram próximos em uma amostra de setembro
A análise atribuída à OpenRouter acompanhou cerca de 120 mil empresas que usavam ferramentas da OpenAI e da Anthropic. O gasto com os dois fornecedores ficou aproximadamente equilibrado em setembro; no começo de 2026, a Anthropic representava cerca de três quartos do total daquele recorte. A amostra reunia sobretudo startups nativas de IA, além de empresas de tecnologia mais estabelecidas e grandes corporações.
| Amostra | Escopo descrito | Período | Padrão de gastos relatado |
| OpenRouter | Cerca de 120 mil empresas que usavam ferramentas da OpenAI e da Anthropic; predominavam startups nativas de IA | Setembro de 2026; comparação com o começo do ano | Gastos aproximadamente equilibrados em setembro; a Anthropic concentrava cerca de três quartos do total no começo do ano |
| Ramp | 70 mil clientes, sobretudo empresas de tecnologia em alto crescimento; a amostra não incluía desenvolvedores individuais | Meados de setembro de 2026; até o fim daquela semana | Breve liderança da OpenAI, seguida por uma pequena vantagem da Anthropic |
Os períodos e as populações não são os mesmos: a Ramp observou sua base de clientes em meados de setembro, enquanto o recorte da OpenRouter descreveu os gastos de setembro e os comparou com os do começo do ano.
O que mostram as tarifas oficiais de API
Na API, tokens são unidades de texto processadas pelo modelo. A cobrança separa os tokens enviados como entrada daqueles gerados como saída; por isso, a quantidade de cada tipo influencia a conta. A tabela de preços da OpenAI lista o GPT-5.6 Sol a US$ 4 por milhão de tokens de entrada e US$ 20 por milhão de tokens de saída em contexto curto. A documentação de preços da Anthropic lista o Claude Opus 5.5 pelos mesmos valores.
| Provedor e modelo | Condição | Entrada por milhão de tokens | Saída por milhão de tokens |
| OpenAI — GPT-5.6 Sol | Contexto curto | US$ 4 | US$ 20 |
| Anthropic — Claude Opus 5.5 | Tarifa listada | US$ 4 | US$ 20 |
Com um milhão de tokens de entrada e um milhão de saída, a soma dessas tarifas dá US$ 24 para cada modelo. É uma conta por volume de tokens, não por tarefa concluída. A documentação da Anthropic informa que modelos Claude 4.7 e posteriores podem gerar cerca de 30% mais tokens para o mesmo texto, com variação conforme o conteúdo e a carga de trabalho.
As tarifas mudam conforme o modelo e a condição. Para o GPT-5.6 Sol, a OpenAI lista US$ 8 por milhão de tokens de entrada e US$ 30 de saída em contexto longo; a página informa que os preços promocionais ficam disponíveis pelo menos até 21 de novembro de 2026. Para o GPT-5.6 Terra, a tarifa listada é de US$ 2 para entrada e US$ 12 para saída por milhão de tokens; para o GPT-5.6 Luna, US$ 0,20 e US$ 1,20, respectivamente. Na Anthropic, o Claude Sonnet 5.5 aparece a US$ 2 por milhão de tokens de entrada e US$ 10 de saída. O Claude Haiku 5.5 custa US$ 0,10 e US$ 0,50, nessa ordem, para prompts de até 100 mil tokens.
Custo, dependência e retenção de dados
O custo influenciou decisões de empresas específicas, sem produzir uma escolha única para todo o setor. David Zhu, cofundador e CEO da Reevo, atribuiu a mudança da empresa dos modelos da Anthropic para os da OpenAI tanto ao custo quanto à vontade de reduzir a dependência de um único fornecedor. Zhu também disse que a preferência poderia mudar novamente.
David Hsu, fundador e CEO da Retool, afirmou que a empresa passou a usar mais os modelos da OpenAI e estimou gastar cerca de 20% menos com eles do que com modelos da Anthropic. Essa estimativa se refere à operação da Retool.
Hsu também apontou como preocupação uma retenção de dados de usuários por 30 dias atribuída ao Fable 5. A Retool trabalhava com dados sensíveis e, segundo Hsu, não usou esse modelo por não conseguir garantir a exclusão de dados que esperava em seus contratos.
Reduções de preço e novos modelos no fim de setembro
Relatos atribuíram à OpenAI reduções de 80% no preço do GPT-5.6 Luna e de 20% no GPT-5.6 Terra pouco depois do lançamento da linha GPT-5.6, no verão de 2026. A Anthropic começou a distribuir a família Claude 5.5 no fim de setembro.