mapa

Tabela de preços

Cada mundo, com o preço às claras

Últimas 24 horas: 83,3% de 48 requisições respondidas, primeiro token em 442 ms (mediana de 40 medições). Medido neste gateway com requisições reais e a sonda programada.

459 mundos com preço, pelo custo de um token (três de entrada para um de saída) e pelo quanto cada um comporta. Mais 7 sem preço publicado estão na lista, não no eixo. De 466 mundos no total. A lista abaixo tem todos eles, com busca.

margem sobre o provedor

+10%

O preço publicado pelo provedor mais 10%. Essa é a margem inteira, em cada mundo.

Igual para todas as contas. Adicionar crédito não tem taxa: o que você envia é o que é creditado. Não é mais barato que comprar direto e não finge ser: é o preço do provedor mais isto, por uma única chave, um só protocolo e todos os mundos.

mundos
466
com preço
459
fabricantes
64

1 a 40 de 417 mundos (de 466)

  • Mistral: Mistral Nemomistralai/mistral-nemoferramentas, medidojson, medido131k de contexto
    Ent. / 1M$ 0,0209prov. $ 0,019
    Saída / 1M$ 0,033prov. $ 0,03
    Margem+10%$ 0,003 de saída
    1º token361 ms
  • inclusionAI: Ling 3.0 Flash VLinclusionai/ling-3.0-flash-vlvisãoferramentas, medidojson, medido262k de contexto
    Ent. / 1M$ 0,0231prov. $ 0,021
    Saída / 1M$ 0,06776prov. $ 0,0616
    Margem+10%$ 0,00616 de saída
    1º token726 ms
  • inclusionAI: Ling 3.0 Flashinclusionai/ling-3.0-flashferramentas, medidojson, medido262k de contexto
    Ent. / 1M$ 0,0231prov. $ 0,021
    Saída / 1M$ 0,0693prov. $ 0,063
    Margem+10%$ 0,0063 de saída
    1º token612 ms
  • OpenAI: gpt-oss-20bopenai/gpt-oss-20bferramentas, medidojson, medido131k de contexto
    Ent. / 1M$ 0,0198prov. $ 0,018
    Saída / 1M$ 0,099prov. $ 0,09
    Margem+10%$ 0,009 de saída
    1º token399 ms
  • IBM: Granite 4.0 Microibm-granite/granite-4.0-h-microjson, medido131k de contexto
    Ent. / 1M$ 0,0187prov. $ 0,017
    Saída / 1M$ 0,1232prov. $ 0,112
    Margem+10%$ 0,0112 de saída
    1º token355 ms
  • Sao10K: Llama 3 8B Lunarissao10k/l3-lunaris-8bjson, medido8k de contexto
    Ent. / 1M$ 0,044prov. $ 0,04
    Saída / 1M$ 0,055prov. $ 0,05
    Margem+10%$ 0,005 de saída
    1º token273 ms
  • Nex AGI: Nex-N2.5-Mininex-agi/nex-n2.5-minivisãojson, declarado262k de contexto
    Ent. / 1M$ 0,0275prov. $ 0,025
    Saída / 1M$ 0,11prov. $ 0,1
    Margem+10%$ 0,01 de saída
    1º token2,3 s
  • OpenAI: gpt-oss-20b (batch)openai/gpt-oss-20b:batchferramentas, declaradojson, declarado131k de contexto
    Ent. / 1M$ 0,0264prov. $ 0,024
    Saída / 1M$ 0,1232prov. $ 0,112
    Margem+10%$ 0,0112 de saída
    1º tokensem medição
  • Qwen: Qwen3.7 Flashqwen/qwen3.7-flashvisãoferramentas, declaradojson, declarado1M de contexto
    Ent. / 1M$ 0,033prov. $ 0,03
    Saída / 1M$ 0,143prov. $ 0,13
    Margem+10%$ 0,013 de saída
    1º token590 ms
  • OpenAI: gpt-oss-120b (batch)openai/gpt-oss-120b:batchferramentas, declaradojson, declarado131k de contexto
    Ent. / 1M$ 0,03256prov. $ 0,0296
    Saída / 1M$ 0,1496prov. $ 0,136
    Margem+10%$ 0,0136 de saída
    1º tokensem medição
  • Meta: Llama 3.1 8B Instructmeta-llama/llama-3.1-8b-instructferramentas, declaradojson, declarado131k de contexto
    Ent. / 1M$ 0,055prov. $ 0,05
    Saída / 1M$ 0,088prov. $ 0,08
    Margem+10%$ 0,008 de saída
    1º token415 ms
  • Mistral: Mistral Small 3mistralai/mistral-small-24b-instruct-2501json, declarado33k de contexto
    Ent. / 1M$ 0,055prov. $ 0,05
    Saída / 1M$ 0,088prov. $ 0,08
    Margem+10%$ 0,008 de saída
    1º token247 ms
  • Inference.net: Schematron V2 Turboinference-net/schematron-v2-turbojson, declarado128k de contexto
    Ent. / 1M$ 0,033prov. $ 0,03
    Saída / 1M$ 0,165prov. $ 0,15
    Margem+10%$ 0,015 de saída
    1º tokensem medição
  • inclusionAI: Ling 3.0 Flash Fininclusionai/ling-3.0-flash-finferramentas, declaradojson, declarado262k de contexto
    Ent. / 1M$ 0,0462prov. $ 0,042
    Saída / 1M$ 0,1355prov. $ 0,1232
    Margem+10%$ 0,01232 de saída
    1º tokensem medição
  • Google: Gemma 3 4Bgoogle/gemma-3-4b-itvisãojson, declarado131k de contexto
    Ent. / 1M$ 0,055prov. $ 0,05
    Saída / 1M$ 0,11prov. $ 0,1
    Margem+10%$ 0,01 de saída
    1º tokensem medição
  • Cohere: Command R7B (12-2024)cohere/command-r7b-12-2024json, declarado128k de contexto
    Ent. / 1M$ 0,04125prov. $ 0,0375
    Saída / 1M$ 0,165prov. $ 0,15
    Margem+10%$ 0,015 de saída
    1º tokensem medição
  • Inception: Mercury 2.5inception/mercury-2.5ferramentas, declaradojson, declarado260k de contexto
    Ent. / 1M$ 0,044prov. $ 0,04
    Saída / 1M$ 0,165prov. $ 0,15
    Margem+10%$ 0,015 de saída
    1º tokensem medição
  • OpenAI: GPT-5 Nano (batch)openai/gpt-5-nano:batchvisãoferramentas, declaradojson, declarado400k de contexto
    Ent. / 1M$ 0,0275prov. $ 0,025
    Saída / 1M$ 0,22prov. $ 0,2
    Margem+10%$ 0,02 de saída
    1º tokensem medição
  • OpenAI: gpt-oss-120bopenai/gpt-oss-120bferramentas, declaradojson, declarado131k de contexto
    Ent. / 1M$ 0,0407prov. $ 0,037
    Saída / 1M$ 0,187prov. $ 0,17
    Margem+10%$ 0,017 de saída
    1º tokensem medição
  • Google: Gemma 3 12Bgoogle/gemma-3-12b-itvisãoferramentas, declaradojson, declarado131k de contexto
    Ent. / 1M$ 0,055prov. $ 0,05
    Saída / 1M$ 0,165prov. $ 0,15
    Margem+10%$ 0,015 de saída
    1º tokensem medição
  • Mistral: Ministral 3 8B 2512 (batch)mistralai/ministral-8b-2512:batchvisãoferramentas, declaradojson, declarado262k de contexto
    Ent. / 1M$ 0,0825prov. $ 0,075
    Saída / 1M$ 0,0825prov. $ 0,075
    Margem+10%$ 0,0075 de saída
    1º tokensem medição
  • Qwen: Qwen3 30B A3B Instruct 2507qwen/qwen3-30b-a3b-instruct-2507ferramentas, declaradojson, declarado262k de contexto
    Ent. / 1M$ 0,05296prov. $ 0,04815
    Saída / 1M$ 0,2124prov. $ 0,193
    Margem+10%$ 0,0193 de saída
    1º tokensem medição
  • NVIDIA: Nemotron 3.5 Lightningnvidia/nemotron-3.5-lightningferramentas, declaradojson, declarado262k de contexto
    Ent. / 1M$ 0,066prov. $ 0,06
    Saída / 1M$ 0,176prov. $ 0,16
    Margem+10%$ 0,016 de saída
    1º tokensem medição
  • Google: Gemini 2.5 Flash Lite (batch)google/gemini-2.5-flash-lite:batchvisãoferramentas, declaradojson, declarado1M de contexto
    Ent. / 1M$ 0,055prov. $ 0,05
    Saída / 1M$ 0,22prov. $ 0,2
    Margem+10%$ 0,02 de saída
    1º tokensem medição
  • MythoMax 13Bgryphe/mythomax-l2-13bjson, declarado8k de contexto
    Ent. / 1M$ 0,088prov. $ 0,08
    Saída / 1M$ 0,121prov. $ 0,11
    Margem+10%$ 0,011 de saída
    1º tokensem medição
  • Microsoft: Phi 4microsoft/phi-4json, declarado16k de contexto
    Ent. / 1M$ 0,077prov. $ 0,07
    Saída / 1M$ 0,154prov. $ 0,14
    Margem+10%$ 0,014 de saída
    1º tokensem medição
  • NVIDIA: Nemotron 3 Nano 30B A3Bnvidia/nemotron-3-nano-30b-a3bferramentas, declaradojson, declarado262k de contexto
    Ent. / 1M$ 0,055prov. $ 0,05
    Saída / 1M$ 0,22prov. $ 0,2
    Margem+10%$ 0,02 de saída
    1º tokensem medição
  • OpenAI: GPT-4.1 Nano (batch)openai/gpt-4.1-nano:batchvisãoferramentas, declaradojson, declarado1M de contexto
    Ent. / 1M$ 0,055prov. $ 0,05
    Saída / 1M$ 0,22prov. $ 0,2
    Margem+10%$ 0,02 de saída
    1º tokensem medição
  • Upstage: Solar Mini 4upstage/solar-mini4ferramentas, declaradojson, declarado524k de contexto
    Ent. / 1M$ 0,055prov. $ 0,05
    Saída / 1M$ 0,22prov. $ 0,2
    Margem+10%$ 0,02 de saída
    1º tokensem medição
  • Inference.net: Schematron V2 Smallinference-net/schematron-v2-smalljson, declarado128k de contexto
    Ent. / 1M$ 0,055prov. $ 0,05
    Saída / 1M$ 0,253prov. $ 0,23
    Margem+10%$ 0,023 de saída
    1º tokensem medição
  • Z.ai: GLM 5.3 Flash (batch)z-ai/glm-5.3-flash:batchvisãoferramentas, declaradojson, declarado1M de contexto
    Ent. / 1M$ 0,066prov. $ 0,06
    Saída / 1M$ 0,22prov. $ 0,2
    Margem+10%$ 0,02 de saída
    1º tokensem medição
  • Mistral: Ministral 3 3B 2512mistralai/ministral-3b-2512visãoferramentas, declaradojson, declarado131k de contexto
    Ent. / 1M$ 0,11prov. $ 0,1
    Saída / 1M$ 0,11prov. $ 0,1
    Margem+10%$ 0,01 de saída
    1º tokensem medição
  • Reka Edgerekaai/reka-edgevisãoferramentas, declaradojson, declarado16k de contexto
    Ent. / 1M$ 0,11prov. $ 0,1
    Saída / 1M$ 0,11prov. $ 0,1
    Margem+10%$ 0,01 de saída
    1º tokensem medição
  • OpenAI: GPT-6 Luna Pro (batch)openai/gpt-6-luna-pro:batchvisãoferramentas, declaradojson, declarado1,1M de contexto
    Ent. / 1M$ 0,055prov. $ 0,05
    Saída / 1M$ 0,275prov. $ 0,25
    Margem+10%$ 0,025 de saída
    1º tokensem medição
  • OpenAI: GPT-6 Luna (batch)openai/gpt-6-luna:batchvisãoferramentas, declaradojson, declarado1,1M de contexto
    Ent. / 1M$ 0,055prov. $ 0,05
    Saída / 1M$ 0,275prov. $ 0,25
    Margem+10%$ 0,025 de saída
    1º tokensem medição
  • IBM: Granite 4.2 8Bibm-granite/granite-4.2-8bferramentas, declaradojson, declarado131k de contexto
    Ent. / 1M$ 0,066prov. $ 0,06
    Saída / 1M$ 0,275prov. $ 0,25
    Margem+10%$ 0,025 de saída
    1º tokensem medição
  • DeepSeek: DeepSeek Flash Latest~deepseek/deepseek-flash-latestvisãoferramentas, declaradojson, declarado1M de contexto
    Ent. / 1M$ 0,0484prov. $ 0,044
    Saída / 1M$ 0,33prov. $ 0,3
    Margem+10%$ 0,03 de saída
    1º tokensem medição
  • DeepSeek: DeepSeek V4.1 Flashdeepseek/deepseek-v4.1-flashvisãoferramentas, declaradojson, declarado1M de contexto
    Ent. / 1M$ 0,0484prov. $ 0,044
    Saída / 1M$ 0,33prov. $ 0,3
    Margem+10%$ 0,03 de saída
    1º tokensem medição
  • Qwen: Qwen3.5-9Bqwen/qwen3.5-9bvisãoferramentas, declaradojson, declarado262k de contexto
    Ent. / 1M$ 0,11prov. $ 0,1
    Saída / 1M$ 0,165prov. $ 0,15
    Margem+10%$ 0,015 de saída
    1º tokensem medição
  • Qwen: Qwen3.5-Flashqwen/qwen3.5-flash-02-23visãoferramentas, declaradojson, declarado1M de contexto
    Ent. / 1M$ 0,0715prov. $ 0,065
    Saída / 1M$ 0,286prov. $ 0,26
    Margem+10%$ 0,026 de saída
    1º tokensem medição

“prov.” é a tarifa que o provedor publica, lida do catálogo dele. Se uma etiqueta tem marca, uma sonda nesta implantação mediu que funciona; se não tem, é o que o provedor declara. Primeiro token é a mediana medida aqui na última semana, com tráfego real e sondas. Os preços seguem o provedor: quando ele muda uma tarifa, esta lista e a cobrança mudam junto.

Calculadora

Quanto custa uma requisição

Os três mundos mais baratos da lista como ela está filtrada agora. Adicione até quatro de sua escolha com Comparar. Calculado com a mesma função que o gateway usa para cobrar. Você define os tokens; as tarefas são números redondos para começar.

quantas
Custo de mil (1.200 tokens de entrada, 350 de saída) em cada mundo
MundoAntimatterMargem
Mistral: Mistral Nemomistralai/mistral-nemo$ 0,0366$ 0,003330
inclusionAI: Ling 3.0 Flash VLinclusionai/ling-3.0-flash-vl$ 0,0514$ 0,004676
inclusionAI: Ling 3.0 Flashinclusionai/ling-3.0-flash$ 0,0520$ 0,004725

Mil requisições de 1.200 tokens de entrada e 350 de saída. Um token de prompt em cache custa menos onde o provedor publica uma tarifa de cache.

Por necessidade

O mundo mais barato para cada necessidade

Os mundos que leem imagens, suportam um contexto longo, chamam ferramentas ou devolvem JSON, ordenados pelo custo de uma mensagem típica a estes preços.

Piloto automático

Deixe o roteador escolher

Um id de piloto automático escolhe um mundo a cada requisição e é cobrado pelo preço desse mundo nesta lista, com a mesma margem. A resposta nomeia o mundo em x-antimatter-model.

  • antimatter/autoEquilibrado: preço, velocidade medida e qualidade medida, pontuados juntos.
  • antimatter/auto:cheapO menor preço combinado do catálogo.
  • antimatter/auto:fastO menor tempo medido até o primeiro token.
  • antimatter/auto:codeChamadas de ferramenta com funcionamento medido e um contexto dimensionado para código.
  • antimatter/auto:longUma janela de contexto longa, segundo o catálogo.
  • antimatter/auto:visionUm mundo que recebe imagens como entrada.
  • antimatter/auto:toolsUm mundo cujas chamadas de ferramenta foram medidas e funcionam.
  • antimatter/auto:jsonUm mundo cuja saída estruturada foi medida e é válida.
As chaves são grátis. Uma cota gratuita vitalícia de $ 0,25 cobre as primeiras requisições de uma conta que nunca fez depósito.
Só stablecoins, sem cartões: USDG em Robinhood Chain; USDC em Base; USDC ou USDT em Arbitrum One. Envie e depois resgate a transação na ponte; o que chega é o que é creditado.
Agentes usam uma chave criada pela assinatura de uma carteira. O pagamento por requisição com x402 não está ativado aqui. Como
O que a API guarda, por quanto tempo e como apagar: retenção de dados.
Antimatter