mapa

Tabela de preços

Cada mundo, com o preço às claras

Últimas 24 horas: 83,3% de 48 requisições respondidas, primeiro token em 442 ms (mediana de 40 medições). Medido neste gateway com requisições reais e a sonda programada.

459 mundos com preço, pelo custo de um token (três de entrada para um de saída) e pelo quanto cada um comporta. Mais 7 sem preço publicado estão na lista, não no eixo. De 466 mundos no total. A lista abaixo tem todos eles, com busca.

margem sobre o provedor

+10%

O preço publicado pelo provedor mais 10%. Essa é a margem inteira, em cada mundo.

Igual para todas as contas. Adicionar crédito não tem taxa: o que você envia é o que é creditado. Não é mais barato que comprar direto e não finge ser: é o preço do provedor mais isto, por uma única chave, um só protocolo e todos os mundos.

mundos
466
com preço
459
fabricantes
64

41 a 80 de 295 mundos (de 466)

  • Meta: Llama Guard 4 12Bmeta-llama/llama-guard-4-12bvisão164k de contexto
    Ent. / 1M$ 0,198prov. $ 0,18
    Saída / 1M$ 0,198prov. $ 0,18
    Margem+10%$ 0,018 de saída
    1º tokensem medição
  • PrismML: Ternary Bonsai 2 27Bprism-ml/ternary-bonsai-2-27bvisãoferramentas, declaradojson, declarado262k de contexto
    Ent. / 1M$ 0,0825prov. $ 0,075
    Saída / 1M$ 0,55prov. $ 0,5
    Margem+10%$ 0,05 de saída
    1º tokensem medição
  • Qwen: Qwen3 VL 32B Instructqwen/qwen3-vl-32b-instructvisãoferramentas, declaradojson, declarado131k de contexto
    Ent. / 1M$ 0,1144prov. $ 0,104
    Saída / 1M$ 0,4576prov. $ 0,416
    Margem+10%$ 0,0416 de saída
    1º tokensem medição
  • Mistral: Ministral 3 14B 2512mistralai/ministral-14b-2512visãoferramentas, declaradojson, declarado262k de contexto
    Ent. / 1M$ 0,22prov. $ 0,2
    Saída / 1M$ 0,22prov. $ 0,2
    Margem+10%$ 0,02 de saída
    1º tokensem medição
  • NVIDIA: Nemotron 3.5 Content Safetynvidia/nemotron-3.5-content-safetyvisão131k de contexto
    Ent. / 1M$ 0,22prov. $ 0,2
    Saída / 1M$ 0,22prov. $ 0,2
    Margem+10%$ 0,02 de saída
    1º tokensem medição
  • OpenAI: GPT Luna Latest~openai/gpt-luna-latestvisãoferramentas, declaradojson, declarado1,1M de contexto
    Ent. / 1M$ 0,11prov. $ 0,1
    Saída / 1M$ 0,55prov. $ 0,5
    Margem+10%$ 0,05 de saída
    1º tokensem medição
  • OpenAI: GPT-6 Lunaopenai/gpt-6-lunavisãoferramentas, declaradojson, declarado1,1M de contexto
    Ent. / 1M$ 0,11prov. $ 0,1
    Saída / 1M$ 0,55prov. $ 0,5
    Margem+10%$ 0,05 de saída
    1º tokensem medição
  • OpenAI: GPT-6 Luna Proopenai/gpt-6-luna-provisãoferramentas, declaradojson, declarado1,1M de contexto
    Ent. / 1M$ 0,11prov. $ 0,1
    Saída / 1M$ 0,55prov. $ 0,5
    Margem+10%$ 0,05 de saída
    1º tokensem medição
  • Qwen: Qwen3 VL 8B Instructqwen/qwen3-vl-8b-instructvisãoferramentas, declaradojson, declarado262k de contexto
    Ent. / 1M$ 0,1287prov. $ 0,117
    Saída / 1M$ 0,5005prov. $ 0,455
    Margem+10%$ 0,0455 de saída
    1º tokensem medição
  • OpenAI: GPT-5.6 Luna Pro (batch)openai/gpt-5.6-luna-pro:batchvisãoferramentas, declaradojson, declarado1,1M de contexto
    Ent. / 1M$ 0,11prov. $ 0,1
    Saída / 1M$ 0,66prov. $ 0,6
    Margem+10%$ 0,06 de saída
    1º tokensem medição
  • OpenAI: GPT-5.6 Luna (batch)openai/gpt-5.6-luna:batchvisãoferramentas, declaradojson, declarado1,1M de contexto
    Ent. / 1M$ 0,11prov. $ 0,1
    Saída / 1M$ 0,66prov. $ 0,6
    Margem+10%$ 0,06 de saída
    1º tokensem medição
  • Qwen: Qwen3.8 Flashqwen/qwen3.8-flashvisãoferramentas, declaradojson, declarado1M de contexto
    Ent. / 1M$ 0,165prov. $ 0,15
    Saída / 1M$ 0,517prov. $ 0,47
    Margem+10%$ 0,047 de saída
    1º tokensem medição
  • Qwen: Qwen3.8 Omni Flashqwen/qwen3.8-omni-flashvisãoferramentas, declaradojson, declarado1M de contexto
    Ent. / 1M$ 0,165prov. $ 0,15
    Saída / 1M$ 0,517prov. $ 0,47
    Margem+10%$ 0,047 de saída
    1º tokensem medição
  • OpenAI: GPT-5.4 Nano (batch)openai/gpt-5.4-nano:batchvisãoferramentas, declaradojson, declarado400k de contexto
    Ent. / 1M$ 0,11prov. $ 0,1
    Saída / 1M$ 0,6875prov. $ 0,625
    Margem+10%$ 0,0625 de saída
    1º tokensem medição
  • Z.ai: GLM 5.3 Flashz-ai/glm-5.3-flashvisãoferramentas, declaradojson, declarado1M de contexto
    Ent. / 1M$ 0,165prov. $ 0,15
    Saída / 1M$ 0,55prov. $ 0,5
    Margem+10%$ 0,05 de saída
    1º tokensem medição
  • Mistral: Mistral Small 4mistralai/mistral-small-2603visãoferramentas, declaradojson, declarado262k de contexto
    Ent. / 1M$ 0,165prov. $ 0,15
    Saída / 1M$ 0,66prov. $ 0,6
    Margem+10%$ 0,06 de saída
    1º tokensem medição
  • OpenAI: GPT-4o-miniopenai/gpt-4o-minivisãoferramentas, declaradojson, declarado128k de contexto
    Ent. / 1M$ 0,165prov. $ 0,15
    Saída / 1M$ 0,66prov. $ 0,6
    Margem+10%$ 0,06 de saída
    1º tokensem medição
  • OpenAI: GPT-4o-mini (2024-07-18)openai/gpt-4o-mini-2024-07-18visãoferramentas, declaradojson, declarado128k de contexto
    Ent. / 1M$ 0,165prov. $ 0,15
    Saída / 1M$ 0,66prov. $ 0,6
    Margem+10%$ 0,06 de saída
    1º tokensem medição
  • Qwen: Qwen3 VL 30B A3B Instructqwen/qwen3-vl-30b-a3b-instructvisãoferramentas, declaradojson, declarado262k de contexto
    Ent. / 1M$ 0,165prov. $ 0,15
    Saída / 1M$ 0,66prov. $ 0,6
    Margem+10%$ 0,06 de saída
    1º tokensem medição
  • Google: Gemini 3.1 Flash Lite (batch)google/gemini-3.1-flash-lite:batchvisãoferramentas, declaradojson, declarado1M de contexto
    Ent. / 1M$ 0,1375prov. $ 0,125
    Saída / 1M$ 0,825prov. $ 0,75
    Margem+10%$ 0,075 de saída
    1º tokensem medição
  • Meta: Llama 4 Maverickmeta-llama/llama-4-maverickvisãoferramentas, declaradojson, declarado1M de contexto
    Ent. / 1M$ 0,2062prov. $ 0,1875
    Saída / 1M$ 0,7177prov. $ 0,6525
    Margem+10%$ 0,06525 de saída
    1º tokensem medição
  • DeepSeek: DeepSeek V4 Flash Vision Expdeepseek/deepseek-v4-flash-vision-expvisãoferramentas, declaradojson, declarado1M de contexto
    Ent. / 1M$ 0,2372prov. $ 0,2156
    Saída / 1M$ 0,7115prov. $ 0,6468
    Margem+10%$ 0,06468 de saída
    1º tokensem medição
  • OpenAI: GPT-5 Mini (batch)openai/gpt-5-mini:batchvisãoferramentas, declaradojson, declarado400k de contexto
    Ent. / 1M$ 0,1375prov. $ 0,125
    Saída / 1M$ 1,10prov. $ 1,00
    Margem+10%$ 0,1 de saída
    1º tokensem medição
  • OpenAI: GPT-4.1 Mini (batch)openai/gpt-4.1-mini:batchvisãoferramentas, declaradojson, declarado1M de contexto
    Ent. / 1M$ 0,22prov. $ 0,2
    Saída / 1M$ 0,88prov. $ 0,8
    Margem+10%$ 0,08 de saída
    1º tokensem medição
  • Qwen: Qwen3.5-35B-A3Bqwen/qwen3.5-35b-a3bvisãoferramentas, declaradojson, declarado262k de contexto
    Ent. / 1M$ 0,165prov. $ 0,15
    Saída / 1M$ 1,10prov. $ 1,00
    Margem+10%$ 0,1 de saída
    1º tokensem medição
  • Qwen: Qwen3.6 35B A3Bqwen/qwen3.6-35b-a3bvisãoferramentas, declaradojson, declarado262k de contexto
    Ent. / 1M$ 0,165prov. $ 0,15
    Saída / 1M$ 1,10prov. $ 1,00
    Margem+10%$ 0,1 de saída
    1º tokensem medição
  • Mistral: Mistral Large 3 2512 (batch)mistralai/mistral-large-2512:batchvisãoferramentas, declaradojson, declarado262k de contexto
    Ent. / 1M$ 0,275prov. $ 0,25
    Saída / 1M$ 0,825prov. $ 0,75
    Margem+10%$ 0,075 de saída
    1º tokensem medição
  • Mistral: Mistral Medium 3.1 (batch)mistralai/mistral-medium-3.1:batchvisãoferramentas, declaradojson, declarado131k de contexto
    Ent. / 1M$ 0,22prov. $ 0,2
    Saída / 1M$ 1,10prov. $ 1,00
    Margem+10%$ 0,1 de saída
    1º tokensem medição
  • Mistral: Mistral Small 3.1 24Bmistralai/mistral-small-3.1-24b-instructvisãoferramentas, declaradojson, declarado128k de contexto
    Ent. / 1M$ 0,3861prov. $ 0,351
    Saída / 1M$ 0,6105prov. $ 0,555
    Margem+10%$ 0,0555 de saída
    1º tokensem medição
  • Qwen: Qwen3.6 Flashqwen/qwen3.6-flashvisãoferramentas, declaradojson, declarado1M de contexto
    Ent. / 1M$ 0,2062prov. $ 0,1875
    Saída / 1M$ 1,238prov. $ 1,125
    Margem+10%$ 0,1125 de saída
    1º tokensem medição
  • Google: Gemini 2.5 Flash (batch)google/gemini-2.5-flash:batchvisãoferramentas, declaradojson, declarado1M de contexto
    Ent. / 1M$ 0,165prov. $ 0,15
    Saída / 1M$ 1,375prov. $ 1,25
    Margem+10%$ 0,125 de saída
    1º tokensem medição
  • Google: Gemini 3.5 Flash Lite (batch)google/gemini-3.5-flash-lite:batchvisãoferramentas, declaradojson, declarado1M de contexto
    Ent. / 1M$ 0,165prov. $ 0,15
    Saída / 1M$ 1,375prov. $ 1,25
    Margem+10%$ 0,125 de saída
    1º tokensem medição
  • MiniMax: MiniMax-01minimax/minimax-01visão1M de contexto
    Ent. / 1M$ 0,22prov. $ 0,2
    Saída / 1M$ 1,21prov. $ 1,10
    Margem+10%$ 0,11 de saída
    1º tokensem medição
  • StepFun: Step 3.7 Flashstepfun/step-3.7-flashvisãoferramentas, declaradojson, declarado262k de contexto
    Ent. / 1M$ 0,22prov. $ 0,2
    Saída / 1M$ 1,265prov. $ 1,15
    Margem+10%$ 0,115 de saída
    1º tokensem medição
  • OpenAI: GPT-5.6 Lunaopenai/gpt-5.6-lunavisãoferramentas, declaradojson, declarado1,1M de contexto
    Ent. / 1M$ 0,22prov. $ 0,2
    Saída / 1M$ 1,32prov. $ 1,20
    Margem+10%$ 0,12 de saída
    1º tokensem medição
  • OpenAI: GPT-5.6 Luna Proopenai/gpt-5.6-luna-provisãoferramentas, declaradojson, declarado1,1M de contexto
    Ent. / 1M$ 0,22prov. $ 0,2
    Saída / 1M$ 1,32prov. $ 1,20
    Margem+10%$ 0,12 de saída
    1º tokensem medição
  • Z.ai: GLM 4.6Vz-ai/glm-4.6vvisãoferramentas, declaradojson, declarado131k de contexto
    Ent. / 1M$ 0,33prov. $ 0,3
    Saída / 1M$ 0,99prov. $ 0,9
    Margem+10%$ 0,09 de saída
    1º tokensem medição
  • OpenAI: GPT-5.4 Nanoopenai/gpt-5.4-nanovisãoferramentas, declaradojson, declarado400k de contexto
    Ent. / 1M$ 0,22prov. $ 0,2
    Saída / 1M$ 1,375prov. $ 1,25
    Margem+10%$ 0,125 de saída
    1º tokensem medição
  • Perceptron: Perceptron Mk1perceptron/perceptron-mk1visãojson, declarado33k de contexto
    Ent. / 1M$ 0,165prov. $ 0,15
    Saída / 1M$ 1,65prov. $ 1,50
    Margem+10%$ 0,15 de saída
    1º tokensem medição
  • Perceptron: Perceptron Mk1.5perceptron/perceptron-mk1.5visãoferramentas, declaradojson, declarado37k de contexto
    Ent. / 1M$ 0,165prov. $ 0,15
    Saída / 1M$ 1,65prov. $ 1,50
    Margem+10%$ 0,15 de saída
    1º tokensem medição

“prov.” é a tarifa que o provedor publica, lida do catálogo dele. Se uma etiqueta tem marca, uma sonda nesta implantação mediu que funciona; se não tem, é o que o provedor declara. Primeiro token é a mediana medida aqui na última semana, com tráfego real e sondas. Os preços seguem o provedor: quando ele muda uma tarifa, esta lista e a cobrança mudam junto.

Calculadora

Quanto custa uma requisição

Os três mundos mais baratos da lista como ela está filtrada agora. Adicione até quatro de sua escolha com Comparar. Calculado com a mesma função que o gateway usa para cobrar. Você define os tokens; as tarefas são números redondos para começar.

quantas
Custo de mil (1.200 tokens de entrada, 350 de saída) em cada mundo
MundoAntimatterMargem
inclusionAI: Ling 3.0 Flash VLinclusionai/ling-3.0-flash-vl$ 0,0514$ 0,004676
Nex AGI: Nex-N2.5-Mininex-agi/nex-n2.5-mini$ 0,0715$ 0,006500
Qwen: Qwen3.7 Flashqwen/qwen3.7-flash$ 0,0897$ 0,008150

Mil requisições de 1.200 tokens de entrada e 350 de saída. Um token de prompt em cache custa menos onde o provedor publica uma tarifa de cache.

Por necessidade

O mundo mais barato para cada necessidade

Os mundos que leem imagens, suportam um contexto longo, chamam ferramentas ou devolvem JSON, ordenados pelo custo de uma mensagem típica a estes preços.

Piloto automático

Deixe o roteador escolher

Um id de piloto automático escolhe um mundo a cada requisição e é cobrado pelo preço desse mundo nesta lista, com a mesma margem. A resposta nomeia o mundo em x-antimatter-model.

  • antimatter/autoEquilibrado: preço, velocidade medida e qualidade medida, pontuados juntos.
  • antimatter/auto:cheapO menor preço combinado do catálogo.
  • antimatter/auto:fastO menor tempo medido até o primeiro token.
  • antimatter/auto:codeChamadas de ferramenta com funcionamento medido e um contexto dimensionado para código.
  • antimatter/auto:longUma janela de contexto longa, segundo o catálogo.
  • antimatter/auto:visionUm mundo que recebe imagens como entrada.
  • antimatter/auto:toolsUm mundo cujas chamadas de ferramenta foram medidas e funcionam.
  • antimatter/auto:jsonUm mundo cuja saída estruturada foi medida e é válida.
As chaves são grátis. Uma cota gratuita vitalícia de $ 0,25 cobre as primeiras requisições de uma conta que nunca fez depósito.
Só stablecoins, sem cartões: USDG em Robinhood Chain; USDC em Base; USDC ou USDT em Arbitrum One. Envie e depois resgate a transação na ponte; o que chega é o que é creditado.
Agentes usam uma chave criada pela assinatura de uma carteira. O pagamento por requisição com x402 não está ativado aqui. Como
O que a API guarda, por quanto tempo e como apagar: retenção de dados.
Antimatter