Tabela de preços
Cada mundo, com o preço às claras
Cada linha mostra o que o provedor publica e o que o Antimatter cobra, lado a lado. A diferença é a margem, e ela é declarada, não escondida em uma tarifa.
+10%
O preço publicado pelo provedor mais 10%. Essa é a margem inteira, em cada mundo.
Igual para todas as contas. Adicionar crédito não tem taxa: o que você envia é o que é creditado. Não é mais barato que comprar direto e não finge ser: é o preço do provedor mais isto, por uma única chave, um só protocolo e todos os mundos.
- 466
- 459
- 64
- Meta: Llama Guard 4 12Bmeta-llama/llama-guard-4-12bvisão164k de contextoEnt. / 1M$ 0,198prov. $ 0,18Saída / 1M$ 0,198prov. $ 0,18Margem+10%$ 0,018 de saída1º tokensem medição
- PrismML: Ternary Bonsai 2 27Bprism-ml/ternary-bonsai-2-27bvisãoferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,0825prov. $ 0,075Saída / 1M$ 0,55prov. $ 0,5Margem+10%$ 0,05 de saída1º tokensem medição
- Qwen: Qwen3 VL 32B Instructqwen/qwen3-vl-32b-instructvisãoferramentas, declaradojson, declarado131k de contextoEnt. / 1M$ 0,1144prov. $ 0,104Saída / 1M$ 0,4576prov. $ 0,416Margem+10%$ 0,0416 de saída1º tokensem medição
- Mistral: Ministral 3 14B 2512mistralai/ministral-14b-2512visãoferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,22prov. $ 0,2Saída / 1M$ 0,22prov. $ 0,2Margem+10%$ 0,02 de saída1º tokensem medição
- NVIDIA: Nemotron 3.5 Content Safetynvidia/nemotron-3.5-content-safetyvisão131k de contextoEnt. / 1M$ 0,22prov. $ 0,2Saída / 1M$ 0,22prov. $ 0,2Margem+10%$ 0,02 de saída1º tokensem medição
- OpenAI: GPT Luna Latest~openai/gpt-luna-latestvisãoferramentas, declaradojson, declarado1,1M de contextoEnt. / 1M$ 0,11prov. $ 0,1Saída / 1M$ 0,55prov. $ 0,5Margem+10%$ 0,05 de saída1º tokensem medição
- OpenAI: GPT-6 Lunaopenai/gpt-6-lunavisãoferramentas, declaradojson, declarado1,1M de contextoEnt. / 1M$ 0,11prov. $ 0,1Saída / 1M$ 0,55prov. $ 0,5Margem+10%$ 0,05 de saída1º tokensem medição
- OpenAI: GPT-6 Luna Proopenai/gpt-6-luna-provisãoferramentas, declaradojson, declarado1,1M de contextoEnt. / 1M$ 0,11prov. $ 0,1Saída / 1M$ 0,55prov. $ 0,5Margem+10%$ 0,05 de saída1º tokensem medição
- Qwen: Qwen3 VL 8B Instructqwen/qwen3-vl-8b-instructvisãoferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,1287prov. $ 0,117Saída / 1M$ 0,5005prov. $ 0,455Margem+10%$ 0,0455 de saída1º tokensem medição
- OpenAI: GPT-5.6 Luna Pro (batch)openai/gpt-5.6-luna-pro:batchvisãoferramentas, declaradojson, declarado1,1M de contextoEnt. / 1M$ 0,11prov. $ 0,1Saída / 1M$ 0,66prov. $ 0,6Margem+10%$ 0,06 de saída1º tokensem medição
- OpenAI: GPT-5.6 Luna (batch)openai/gpt-5.6-luna:batchvisãoferramentas, declaradojson, declarado1,1M de contextoEnt. / 1M$ 0,11prov. $ 0,1Saída / 1M$ 0,66prov. $ 0,6Margem+10%$ 0,06 de saída1º tokensem medição
- Qwen: Qwen3.8 Flashqwen/qwen3.8-flashvisãoferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,165prov. $ 0,15Saída / 1M$ 0,517prov. $ 0,47Margem+10%$ 0,047 de saída1º tokensem medição
- Qwen: Qwen3.8 Omni Flashqwen/qwen3.8-omni-flashvisãoferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,165prov. $ 0,15Saída / 1M$ 0,517prov. $ 0,47Margem+10%$ 0,047 de saída1º tokensem medição
- OpenAI: GPT-5.4 Nano (batch)openai/gpt-5.4-nano:batchvisãoferramentas, declaradojson, declarado400k de contextoEnt. / 1M$ 0,11prov. $ 0,1Saída / 1M$ 0,6875prov. $ 0,625Margem+10%$ 0,0625 de saída1º tokensem medição
- Z.ai: GLM 5.3 Flashz-ai/glm-5.3-flashvisãoferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,165prov. $ 0,15Saída / 1M$ 0,55prov. $ 0,5Margem+10%$ 0,05 de saída1º tokensem medição
- Mistral: Mistral Small 4mistralai/mistral-small-2603visãoferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,165prov. $ 0,15Saída / 1M$ 0,66prov. $ 0,6Margem+10%$ 0,06 de saída1º tokensem medição
- OpenAI: GPT-4o-miniopenai/gpt-4o-minivisãoferramentas, declaradojson, declarado128k de contextoEnt. / 1M$ 0,165prov. $ 0,15Saída / 1M$ 0,66prov. $ 0,6Margem+10%$ 0,06 de saída1º tokensem medição
- OpenAI: GPT-4o-mini (2024-07-18)openai/gpt-4o-mini-2024-07-18visãoferramentas, declaradojson, declarado128k de contextoEnt. / 1M$ 0,165prov. $ 0,15Saída / 1M$ 0,66prov. $ 0,6Margem+10%$ 0,06 de saída1º tokensem medição
- Qwen: Qwen3 VL 30B A3B Instructqwen/qwen3-vl-30b-a3b-instructvisãoferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,165prov. $ 0,15Saída / 1M$ 0,66prov. $ 0,6Margem+10%$ 0,06 de saída1º tokensem medição
- Google: Gemini 3.1 Flash Lite (batch)google/gemini-3.1-flash-lite:batchvisãoferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,1375prov. $ 0,125Saída / 1M$ 0,825prov. $ 0,75Margem+10%$ 0,075 de saída1º tokensem medição
- Meta: Llama 4 Maverickmeta-llama/llama-4-maverickvisãoferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,2062prov. $ 0,1875Saída / 1M$ 0,7177prov. $ 0,6525Margem+10%$ 0,06525 de saída1º tokensem medição
- DeepSeek: DeepSeek V4 Flash Vision Expdeepseek/deepseek-v4-flash-vision-expvisãoferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,2372prov. $ 0,2156Saída / 1M$ 0,7115prov. $ 0,6468Margem+10%$ 0,06468 de saída1º tokensem medição
- OpenAI: GPT-5 Mini (batch)openai/gpt-5-mini:batchvisãoferramentas, declaradojson, declarado400k de contextoEnt. / 1M$ 0,1375prov. $ 0,125Saída / 1M$ 1,10prov. $ 1,00Margem+10%$ 0,1 de saída1º tokensem medição
- OpenAI: GPT-4.1 Mini (batch)openai/gpt-4.1-mini:batchvisãoferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,22prov. $ 0,2Saída / 1M$ 0,88prov. $ 0,8Margem+10%$ 0,08 de saída1º tokensem medição
- Qwen: Qwen3.5-35B-A3Bqwen/qwen3.5-35b-a3bvisãoferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,165prov. $ 0,15Saída / 1M$ 1,10prov. $ 1,00Margem+10%$ 0,1 de saída1º tokensem medição
- Qwen: Qwen3.6 35B A3Bqwen/qwen3.6-35b-a3bvisãoferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,165prov. $ 0,15Saída / 1M$ 1,10prov. $ 1,00Margem+10%$ 0,1 de saída1º tokensem medição
- Mistral: Mistral Large 3 2512 (batch)mistralai/mistral-large-2512:batchvisãoferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,275prov. $ 0,25Saída / 1M$ 0,825prov. $ 0,75Margem+10%$ 0,075 de saída1º tokensem medição
- Mistral: Mistral Medium 3.1 (batch)mistralai/mistral-medium-3.1:batchvisãoferramentas, declaradojson, declarado131k de contextoEnt. / 1M$ 0,22prov. $ 0,2Saída / 1M$ 1,10prov. $ 1,00Margem+10%$ 0,1 de saída1º tokensem medição
- Mistral: Mistral Small 3.1 24Bmistralai/mistral-small-3.1-24b-instructvisãoferramentas, declaradojson, declarado128k de contextoEnt. / 1M$ 0,3861prov. $ 0,351Saída / 1M$ 0,6105prov. $ 0,555Margem+10%$ 0,0555 de saída1º tokensem medição
- Qwen: Qwen3.6 Flashqwen/qwen3.6-flashvisãoferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,2062prov. $ 0,1875Saída / 1M$ 1,238prov. $ 1,125Margem+10%$ 0,1125 de saída1º tokensem medição
- Google: Gemini 2.5 Flash (batch)google/gemini-2.5-flash:batchvisãoferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,165prov. $ 0,15Saída / 1M$ 1,375prov. $ 1,25Margem+10%$ 0,125 de saída1º tokensem medição
- Google: Gemini 3.5 Flash Lite (batch)google/gemini-3.5-flash-lite:batchvisãoferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,165prov. $ 0,15Saída / 1M$ 1,375prov. $ 1,25Margem+10%$ 0,125 de saída1º tokensem medição
- MiniMax: MiniMax-01minimax/minimax-01visão1M de contextoEnt. / 1M$ 0,22prov. $ 0,2Saída / 1M$ 1,21prov. $ 1,10Margem+10%$ 0,11 de saída1º tokensem medição
- StepFun: Step 3.7 Flashstepfun/step-3.7-flashvisãoferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,22prov. $ 0,2Saída / 1M$ 1,265prov. $ 1,15Margem+10%$ 0,115 de saída1º tokensem medição
- OpenAI: GPT-5.6 Lunaopenai/gpt-5.6-lunavisãoferramentas, declaradojson, declarado1,1M de contextoEnt. / 1M$ 0,22prov. $ 0,2Saída / 1M$ 1,32prov. $ 1,20Margem+10%$ 0,12 de saída1º tokensem medição
- OpenAI: GPT-5.6 Luna Proopenai/gpt-5.6-luna-provisãoferramentas, declaradojson, declarado1,1M de contextoEnt. / 1M$ 0,22prov. $ 0,2Saída / 1M$ 1,32prov. $ 1,20Margem+10%$ 0,12 de saída1º tokensem medição
- Z.ai: GLM 4.6Vz-ai/glm-4.6vvisãoferramentas, declaradojson, declarado131k de contextoEnt. / 1M$ 0,33prov. $ 0,3Saída / 1M$ 0,99prov. $ 0,9Margem+10%$ 0,09 de saída1º tokensem medição
- OpenAI: GPT-5.4 Nanoopenai/gpt-5.4-nanovisãoferramentas, declaradojson, declarado400k de contextoEnt. / 1M$ 0,22prov. $ 0,2Saída / 1M$ 1,375prov. $ 1,25Margem+10%$ 0,125 de saída1º tokensem medição
- Perceptron: Perceptron Mk1perceptron/perceptron-mk1visãojson, declarado33k de contextoEnt. / 1M$ 0,165prov. $ 0,15Saída / 1M$ 1,65prov. $ 1,50Margem+10%$ 0,15 de saída1º tokensem medição
- Perceptron: Perceptron Mk1.5perceptron/perceptron-mk1.5visãoferramentas, declaradojson, declarado37k de contextoEnt. / 1M$ 0,165prov. $ 0,15Saída / 1M$ 1,65prov. $ 1,50Margem+10%$ 0,15 de saída1º tokensem medição
“prov.” é a tarifa que o provedor publica, lida do catálogo dele. Se uma etiqueta tem marca, uma sonda nesta implantação mediu que funciona; se não tem, é o que o provedor declara. Primeiro token é a mediana medida aqui na última semana, com tráfego real e sondas. Os preços seguem o provedor: quando ele muda uma tarifa, esta lista e a cobrança mudam junto.
Calculadora
Quanto custa uma requisição
Os três mundos mais baratos da lista como ela está filtrada agora. Adicione até quatro de sua escolha com Comparar. Calculado com a mesma função que o gateway usa para cobrar. Você define os tokens; as tarefas são números redondos para começar.
| Mundo | Antimatter | Provedor | Margem |
|---|---|---|---|
| inclusionAI: Ling 3.0 Flash VLinclusionai/ling-3.0-flash-vl | $ 0,0514 | $ 0,0468 | $ 0,004676 |
| Nex AGI: Nex-N2.5-Mininex-agi/nex-n2.5-mini | $ 0,0715 | $ 0,0650 | $ 0,006500 |
| Qwen: Qwen3.7 Flashqwen/qwen3.7-flash | $ 0,0897 | $ 0,0815 | $ 0,008150 |
Mil requisições de 1.200 tokens de entrada e 350 de saída. Um token de prompt em cache custa menos onde o provedor publica uma tarifa de cache.
Por necessidade
O mundo mais barato para cada necessidade
Os mundos que leem imagens, suportam um contexto longo, chamam ferramentas ou devolvem JSON, ordenados pelo custo de uma mensagem típica a estes preços.
Piloto automático
Deixe o roteador escolher
Um id de piloto automático escolhe um mundo a cada requisição e é cobrado pelo preço desse mundo nesta lista, com a mesma margem. A resposta nomeia o mundo em x-antimatter-model.
antimatter/autoEquilibrado: preço, velocidade medida e qualidade medida, pontuados juntos.antimatter/auto:cheapO menor preço combinado do catálogo.antimatter/auto:fastO menor tempo medido até o primeiro token.antimatter/auto:codeChamadas de ferramenta com funcionamento medido e um contexto dimensionado para código.antimatter/auto:longUma janela de contexto longa, segundo o catálogo.antimatter/auto:visionUm mundo que recebe imagens como entrada.antimatter/auto:toolsUm mundo cujas chamadas de ferramenta foram medidas e funcionam.antimatter/auto:jsonUm mundo cuja saída estruturada foi medida e é válida.