Tabela de preços
Cada mundo, com o preço às claras
Cada linha mostra o que o provedor publica e o que o Antimatter cobra, lado a lado. A diferença é a margem, e ela é declarada, não escondida em uma tarifa.
+10%
O preço publicado pelo provedor mais 10%. Essa é a margem inteira, em cada mundo.
Igual para todas as contas. Adicionar crédito não tem taxa: o que você envia é o que é creditado. Não é mais barato que comprar direto e não finge ser: é o preço do provedor mais isto, por uma única chave, um só protocolo e todos os mundos.
- 466
- 459
- 64
- Qwen: Qwen3 32Bqwen/qwen3-32bferramentas, declaradojson, declarado131k de contextoEnt. / 1M$ 0,088prov. $ 0,08Saída / 1M$ 0,308prov. $ 0,28Margem+10%$ 0,028 de saída1º tokensem medição
- ByteDance Seed: Seed 1.6 Flashbytedance-seed/seed-1.6-flashvisãoferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,0825prov. $ 0,075Saída / 1M$ 0,33prov. $ 0,3Margem+10%$ 0,03 de saída1º tokensem medição
- Mistral: Mistral Small 4 (batch)mistralai/mistral-small-2603:batchvisãoferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,0825prov. $ 0,075Saída / 1M$ 0,33prov. $ 0,3Margem+10%$ 0,03 de saída1º tokensem medição
- OpenAI: GPT-4o-mini (batch)openai/gpt-4o-mini:batchvisãoferramentas, declaradojson, declarado128k de contextoEnt. / 1M$ 0,0825prov. $ 0,075Saída / 1M$ 0,33prov. $ 0,3Margem+10%$ 0,03 de saída1º tokensem medição
- OpenAI: gpt-oss-safeguard-20bopenai/gpt-oss-safeguard-20bferramentas, declaradojson, declarado131k de contextoEnt. / 1M$ 0,0825prov. $ 0,075Saída / 1M$ 0,33prov. $ 0,3Margem+10%$ 0,03 de saída1º tokensem medição
- Mistral: Mistral Small 3.2 24Bmistralai/mistral-small-3.2-24b-instructvisãoferramentas, declaradojson, declarado256k de contextoEnt. / 1M$ 0,1031prov. $ 0,09375Saída / 1M$ 0,275prov. $ 0,25Margem+10%$ 0,025 de saída1º tokensem medição
- OpenAI: GPT-5 Nanoopenai/gpt-5-nanovisãoferramentas, declaradojson, declarado400k de contextoEnt. / 1M$ 0,055prov. $ 0,05Saída / 1M$ 0,44prov. $ 0,4Margem+10%$ 0,04 de saída1º tokensem medição
- Z.ai: GLM 4.7 Flashz-ai/glm-4.7-flashferramentas, declaradojson, declarado200k de contextoEnt. / 1M$ 0,06655prov. $ 0,0605Saída / 1M$ 0,44prov. $ 0,4Margem+10%$ 0,04 de saída1º tokensem medição
- Meta: Llama 4 Scoutmeta-llama/llama-4-scoutvisãoferramentas, declaradojson, declarado1,3M de contextoEnt. / 1M$ 0,11prov. $ 0,1Saída / 1M$ 0,33prov. $ 0,3Margem+10%$ 0,03 de saída1º tokensem medição
- Mistral: Ministral 3 8B 2512mistralai/ministral-8b-2512visãoferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,165prov. $ 0,15Saída / 1M$ 0,165prov. $ 0,15Margem+10%$ 0,015 de saída1º tokensem medição
- Mistral: Voxtral Small 24B 2507mistralai/voxtral-small-24b-2507ferramentas, declaradojson, declarado33k de contextoEnt. / 1M$ 0,11prov. $ 0,1Saída / 1M$ 0,33prov. $ 0,3Margem+10%$ 0,03 de saída1º tokensem medição
- Qwen: Qwen3 14Bqwen/qwen3-14bferramentas, declaradojson, declarado131k de contextoEnt. / 1M$ 0,132prov. $ 0,12Saída / 1M$ 0,264prov. $ 0,24Margem+10%$ 0,024 de saída1º tokensem medição
- StepFun: Step 3.5 Flashstepfun/step-3.5-flashferramentas, declarado262k de contextoEnt. / 1M$ 0,11prov. $ 0,1Saída / 1M$ 0,33prov. $ 0,3Margem+10%$ 0,03 de saída1º tokensem medição
- Z.ai: GLM Flash Latest~z-ai/glm-flash-latestvisãoferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,0396prov. $ 0,036Saída / 1M$ 0,55prov. $ 0,5Margem+10%$ 0,05 de saída1º tokensem medição
- Google: Gemma 4 31Bgoogle/gemma-4-31b-itvisãoferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,099prov. $ 0,09Saída / 1M$ 0,374prov. $ 0,34Margem+10%$ 0,034 de saída1º tokensem medição
- Upstage: Solar Pro 4upstage/solar-pro4ferramentas, declaradojson, declarado524k de contextoEnt. / 1M$ 0,099prov. $ 0,09Saída / 1M$ 0,396prov. $ 0,36Margem+10%$ 0,036 de saída1º tokensem medição
- DeepSeek: DeepSeek V4.1 Flash (batch)deepseek/deepseek-v4.1-flash:batchvisãoferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,1232prov. $ 0,112Saída / 1M$ 0,3696prov. $ 0,336Margem+10%$ 0,0336 de saída1º tokensem medição
- Google: Gemma 3 27Bgoogle/gemma-3-27b-itvisãoferramentas, declaradojson, declarado131k de contextoEnt. / 1M$ 0,088prov. $ 0,08Saída / 1M$ 0,495prov. $ 0,45Margem+10%$ 0,045 de saída1º tokensem medição
- NVIDIA: Nemotron 3 Supernvidia/nemotron-3-super-120b-a12bferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,088prov. $ 0,08Saída / 1M$ 0,495prov. $ 0,45Margem+10%$ 0,045 de saída1º tokensem medição
- ByteDance Seed: Seed-2.0-Minibytedance-seed/seed-2.0-minivisãoferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,11prov. $ 0,1Saída / 1M$ 0,44prov. $ 0,4Margem+10%$ 0,04 de saída1º tokensem medição
- Google: Gemini 2.5 Flash Litegoogle/gemini-2.5-flash-litevisãoferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,11prov. $ 0,1Saída / 1M$ 0,44prov. $ 0,4Margem+10%$ 0,04 de saída1º tokensem medição
- OpenAI: GPT-4.1 Nanoopenai/gpt-4.1-nanovisãoferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,11prov. $ 0,1Saída / 1M$ 0,44prov. $ 0,4Margem+10%$ 0,04 de saída1º tokensem medição
- Xiaomi: MiMo-V2.5xiaomi/mimo-v2.5visãoferramentas, declaradojson, declarado1,1M de contextoEnt. / 1M$ 0,154prov. $ 0,14Saída / 1M$ 0,308prov. $ 0,28Margem+10%$ 0,028 de saída1º tokensem medição
- Xiaomi: MiMo-V2.6-Flashxiaomi/mimo-v2.6-flashvisãoferramentas, declaradojson, declarado1,1M de contextoEnt. / 1M$ 0,154prov. $ 0,14Saída / 1M$ 0,308prov. $ 0,28Margem+10%$ 0,028 de saída1º tokensem medição
- PrismML: Ternary Bonsai 2 27Bprism-ml/ternary-bonsai-2-27bvisãoferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,0825prov. $ 0,075Saída / 1M$ 0,55prov. $ 0,5Margem+10%$ 0,05 de saída1º tokensem medição
- Qwen: Qwen3 VL 32B Instructqwen/qwen3-vl-32b-instructvisãoferramentas, declaradojson, declarado131k de contextoEnt. / 1M$ 0,1144prov. $ 0,104Saída / 1M$ 0,4576prov. $ 0,416Margem+10%$ 0,0416 de saída1º tokensem medição
- Mistral: Ministral 3 14B 2512mistralai/ministral-14b-2512visãoferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,22prov. $ 0,2Saída / 1M$ 0,22prov. $ 0,2Margem+10%$ 0,02 de saída1º tokensem medição
- OpenAI: GPT Luna Latest~openai/gpt-luna-latestvisãoferramentas, declaradojson, declarado1,1M de contextoEnt. / 1M$ 0,11prov. $ 0,1Saída / 1M$ 0,55prov. $ 0,5Margem+10%$ 0,05 de saída1º tokensem medição
- OpenAI: GPT-6 Lunaopenai/gpt-6-lunavisãoferramentas, declaradojson, declarado1,1M de contextoEnt. / 1M$ 0,11prov. $ 0,1Saída / 1M$ 0,55prov. $ 0,5Margem+10%$ 0,05 de saída1º tokensem medição
- OpenAI: GPT-6 Luna Proopenai/gpt-6-luna-provisãoferramentas, declaradojson, declarado1,1M de contextoEnt. / 1M$ 0,11prov. $ 0,1Saída / 1M$ 0,55prov. $ 0,5Margem+10%$ 0,05 de saída1º tokensem medição
- Qwen: Qwen3 8Bqwen/qwen3-8bferramentas, declaradojson, declarado131k de contextoEnt. / 1M$ 0,1287prov. $ 0,117Saída / 1M$ 0,5005prov. $ 0,455Margem+10%$ 0,0455 de saída1º tokensem medição
- Qwen: Qwen3 VL 8B Instructqwen/qwen3-vl-8b-instructvisãoferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,1287prov. $ 0,117Saída / 1M$ 0,5005prov. $ 0,455Margem+10%$ 0,0455 de saída1º tokensem medição
- Qwen: Qwen3 235B A22B Instruct 2507qwen/qwen3-235b-a22b-2507ferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,099prov. $ 0,09Saída / 1M$ 0,605prov. $ 0,55Margem+10%$ 0,055 de saída1º tokensem medição
- Qwen: Qwen3 30B A3Bqwen/qwen3-30b-a3bferramentas, declaradojson, declarado131k de contextoEnt. / 1M$ 0,132prov. $ 0,12Saída / 1M$ 0,55prov. $ 0,5Margem+10%$ 0,05 de saída1º tokensem medição
- Mistral: Codestral 2508 (batch)mistralai/codestral-2508:batchferramentas, declaradojson, declarado256k de contextoEnt. / 1M$ 0,165prov. $ 0,15Saída / 1M$ 0,495prov. $ 0,45Margem+10%$ 0,045 de saída1º tokensem medição
- OpenAI: GPT-5.6 Luna Pro (batch)openai/gpt-5.6-luna-pro:batchvisãoferramentas, declaradojson, declarado1,1M de contextoEnt. / 1M$ 0,11prov. $ 0,1Saída / 1M$ 0,66prov. $ 0,6Margem+10%$ 0,06 de saída1º tokensem medição
- OpenAI: GPT-5.6 Luna (batch)openai/gpt-5.6-luna:batchvisãoferramentas, declaradojson, declarado1,1M de contextoEnt. / 1M$ 0,11prov. $ 0,1Saída / 1M$ 0,66prov. $ 0,6Margem+10%$ 0,06 de saída1º tokensem medição
- Qwen: Qwen3.8 Flashqwen/qwen3.8-flashvisãoferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,165prov. $ 0,15Saída / 1M$ 0,517prov. $ 0,47Margem+10%$ 0,047 de saída1º tokensem medição
- Qwen: Qwen3.8 Omni Flashqwen/qwen3.8-omni-flashvisãoferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,165prov. $ 0,15Saída / 1M$ 0,517prov. $ 0,47Margem+10%$ 0,047 de saída1º tokensem medição
- Tencent: Hy3tencent/hy3ferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,1452prov. $ 0,132Saída / 1M$ 0,5808prov. $ 0,528Margem+10%$ 0,0528 de saída1º tokensem medição
“prov.” é a tarifa que o provedor publica, lida do catálogo dele. Se uma etiqueta tem marca, uma sonda nesta implantação mediu que funciona; se não tem, é o que o provedor declara. Primeiro token é a mediana medida aqui na última semana, com tráfego real e sondas. Os preços seguem o provedor: quando ele muda uma tarifa, esta lista e a cobrança mudam junto.
Calculadora
Quanto custa uma requisição
Os três mundos mais baratos da lista como ela está filtrada agora. Adicione até quatro de sua escolha com Comparar. Calculado com a mesma função que o gateway usa para cobrar. Você define os tokens; as tarefas são números redondos para começar.
| Mundo | Antimatter | Provedor | Margem |
|---|---|---|---|
| Mistral: Mistral Nemomistralai/mistral-nemo | $ 0,0366 | $ 0,0333 | $ 0,003330 |
| inclusionAI: Ling 3.0 Flash VLinclusionai/ling-3.0-flash-vl | $ 0,0514 | $ 0,0468 | $ 0,004676 |
| inclusionAI: Ling 3.0 Flashinclusionai/ling-3.0-flash | $ 0,0520 | $ 0,0473 | $ 0,004725 |
Mil requisições de 1.200 tokens de entrada e 350 de saída. Um token de prompt em cache custa menos onde o provedor publica uma tarifa de cache.
Por necessidade
O mundo mais barato para cada necessidade
Os mundos que leem imagens, suportam um contexto longo, chamam ferramentas ou devolvem JSON, ordenados pelo custo de uma mensagem típica a estes preços.
Piloto automático
Deixe o roteador escolher
Um id de piloto automático escolhe um mundo a cada requisição e é cobrado pelo preço desse mundo nesta lista, com a mesma margem. A resposta nomeia o mundo em x-antimatter-model.
antimatter/autoEquilibrado: preço, velocidade medida e qualidade medida, pontuados juntos.antimatter/auto:cheapO menor preço combinado do catálogo.antimatter/auto:fastO menor tempo medido até o primeiro token.antimatter/auto:codeChamadas de ferramenta com funcionamento medido e um contexto dimensionado para código.antimatter/auto:longUma janela de contexto longa, segundo o catálogo.antimatter/auto:visionUm mundo que recebe imagens como entrada.antimatter/auto:toolsUm mundo cujas chamadas de ferramenta foram medidas e funcionam.antimatter/auto:jsonUm mundo cuja saída estruturada foi medida e é válida.