Tabela de preços
Cada mundo, com o preço às claras
Cada linha mostra o que o provedor publica e o que o Antimatter cobra, lado a lado. A diferença é a margem, e ela é declarada, não escondida em uma tarifa.
+10%
O preço publicado pelo provedor mais 10%. Essa é a margem inteira, em cada mundo.
Igual para todas as contas. Adicionar crédito não tem taxa: o que você envia é o que é creditado. Não é mais barato que comprar direto e não finge ser: é o preço do provedor mais isto, por uma única chave, um só protocolo e todos os mundos.
- 465
- 458
- 63
- Qwen: Qwen3 VL 8B Instructqwen/qwen3-vl-8b-instructvisãoferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,1287prov. $ 0,117Saída / 1M$ 0,5005prov. $ 0,455Margem+10%$ 0,0455 de saída1º tokensem medição
- Qwen: Qwen3 235B A22B Instruct 2507qwen/qwen3-235b-a22b-2507ferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,099prov. $ 0,09Saída / 1M$ 0,605prov. $ 0,55Margem+10%$ 0,055 de saída1º tokensem medição
- Qwen: Qwen3 30B A3Bqwen/qwen3-30b-a3bferramentas, declaradojson, declarado131k de contextoEnt. / 1M$ 0,132prov. $ 0,12Saída / 1M$ 0,55prov. $ 0,5Margem+10%$ 0,05 de saída1º tokensem medição
- Mistral: Codestral 2508 (batch)mistralai/codestral-2508:batchferramentas, declaradojson, declarado256k de contextoEnt. / 1M$ 0,165prov. $ 0,15Saída / 1M$ 0,495prov. $ 0,45Margem+10%$ 0,045 de saída1º tokensem medição
- OpenAI: GPT-5.6 Luna Pro (batch)openai/gpt-5.6-luna-pro:batchvisãoferramentas, declaradojson, declarado1,1M de contextoEnt. / 1M$ 0,11prov. $ 0,1Saída / 1M$ 0,66prov. $ 0,6Margem+10%$ 0,06 de saída1º tokensem medição
- OpenAI: GPT-5.6 Luna (batch)openai/gpt-5.6-luna:batchvisãoferramentas, declaradojson, declarado1,1M de contextoEnt. / 1M$ 0,11prov. $ 0,1Saída / 1M$ 0,66prov. $ 0,6Margem+10%$ 0,06 de saída1º tokensem medição
- Qwen: Qwen3.8 Flashqwen/qwen3.8-flashvisãoferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,165prov. $ 0,15Saída / 1M$ 0,517prov. $ 0,47Margem+10%$ 0,047 de saída1º tokensem medição
- Qwen: Qwen3.8 Omni Flashqwen/qwen3.8-omni-flashvisãoferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,165prov. $ 0,15Saída / 1M$ 0,517prov. $ 0,47Margem+10%$ 0,047 de saída1º tokensem medição
- Tencent: Hy3tencent/hy3ferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,1452prov. $ 0,132Saída / 1M$ 0,5808prov. $ 0,528Margem+10%$ 0,0528 de saída1º tokensem medição
- OpenAI: GPT-5.4 Nano (batch)openai/gpt-5.4-nano:batchvisãoferramentas, declaradojson, declarado400k de contextoEnt. / 1M$ 0,11prov. $ 0,1Saída / 1M$ 0,6875prov. $ 0,625Margem+10%$ 0,0625 de saída1º tokensem medição
- Z.ai: GLM 5.3 Flashz-ai/glm-5.3-flashvisãoferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,165prov. $ 0,15Saída / 1M$ 0,55prov. $ 0,5Margem+10%$ 0,05 de saída1º tokensem medição
- Tencent: Hunyuan A13B Instructtencent/hunyuan-a13b-instructjson, declarado131k de contextoEnt. / 1M$ 0,154prov. $ 0,14Saída / 1M$ 0,627prov. $ 0,57Margem+10%$ 0,057 de saída1º tokensem medição
- DeepSeek: DeepSeek V4 Pro 0423deepseek/deepseek-v4-proferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,2297prov. $ 0,2088Saída / 1M$ 0,4594prov. $ 0,4176Margem+10%$ 0,04176 de saída1º tokensem medição
- Cohere: Command R (08-2024)cohere/command-r-08-2024ferramentas, declaradojson, declarado128k de contextoEnt. / 1M$ 0,165prov. $ 0,15Saída / 1M$ 0,66prov. $ 0,6Margem+10%$ 0,06 de saída1º tokensem medição
- Mistral: Mistral Small 4mistralai/mistral-small-2603visãoferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,165prov. $ 0,15Saída / 1M$ 0,66prov. $ 0,6Margem+10%$ 0,06 de saída1º tokensem medição
- OpenAI: GPT-4o-miniopenai/gpt-4o-minivisãoferramentas, declaradojson, declarado128k de contextoEnt. / 1M$ 0,165prov. $ 0,15Saída / 1M$ 0,66prov. $ 0,6Margem+10%$ 0,06 de saída1º tokensem medição
- OpenAI: GPT-4o-mini (2024-07-18)openai/gpt-4o-mini-2024-07-18visãoferramentas, declaradojson, declarado128k de contextoEnt. / 1M$ 0,165prov. $ 0,15Saída / 1M$ 0,66prov. $ 0,6Margem+10%$ 0,06 de saída1º tokensem medição
- Qwen: Qwen3 VL 30B A3B Instructqwen/qwen3-vl-30b-a3b-instructvisãoferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,165prov. $ 0,15Saída / 1M$ 0,66prov. $ 0,6Margem+10%$ 0,06 de saída1º tokensem medição
- Upstage: Solar Pro 3upstage/solar-pro-3ferramentas, declaradojson, declarado131k de contextoEnt. / 1M$ 0,165prov. $ 0,15Saída / 1M$ 0,66prov. $ 0,6Margem+10%$ 0,06 de saída1º tokensem medição
- Google: Gemini 3.1 Flash Lite (batch)google/gemini-3.1-flash-lite:batchvisãoferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,1375prov. $ 0,125Saída / 1M$ 0,825prov. $ 0,75Margem+10%$ 0,075 de saída1º tokensem medição
- Meta: Llama 3.3 70B Instructmeta-llama/llama-3.3-70b-instructferramentas, declaradojson, declarado131k de contextoEnt. / 1M$ 0,242prov. $ 0,22Saída / 1M$ 0,55prov. $ 0,5Margem+10%$ 0,05 de saída1º tokensem medição
- Qwen: Qwen3 Coder Nextqwen/qwen3-coder-nextferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,132prov. $ 0,12Saída / 1M$ 0,88prov. $ 0,8Margem+10%$ 0,08 de saída1º tokensem medição
- Mistral: Sabamistralai/mistral-sabaferramentas, declaradojson, declarado33k de contextoEnt. / 1M$ 0,22prov. $ 0,2Saída / 1M$ 0,66prov. $ 0,6Margem+10%$ 0,06 de saída1º tokensem medição
- Meta: Llama 4 Maverickmeta-llama/llama-4-maverickvisãoferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,2062prov. $ 0,1875Saída / 1M$ 0,7177prov. $ 0,6525Margem+10%$ 0,06525 de saída1º tokensem medição
- DeepSeek: DeepSeek V3.2 Expdeepseek/deepseek-v3.2-expferramentas, declaradojson, declarado164k de contextoEnt. / 1M$ 0,297prov. $ 0,27Saída / 1M$ 0,451prov. $ 0,41Margem+10%$ 0,041 de saída1º tokensem medição
- DeepSeek: DeepSeek V3.2deepseek/deepseek-v3.2ferramentas, declaradojson, declarado164k de contextoEnt. / 1M$ 0,308prov. $ 0,28Saída / 1M$ 0,462prov. $ 0,42Margem+10%$ 0,042 de saída1º tokensem medição
- DeepSeek: DeepSeek V4 Flash Vision Expdeepseek/deepseek-v4-flash-vision-expvisãoferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,2372prov. $ 0,2156Saída / 1M$ 0,7115prov. $ 0,6468Margem+10%$ 0,06468 de saída1º tokensem medição
- DeepSeek: DeepSeek V4 Flash Latest~deepseek/deepseek-v4-flash-latestferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,0198prov. $ 0,018Saída / 1M$ 1,408prov. $ 1,28Margem+10%$ 0,128 de saída1º tokensem medição
- DeepSeek: DeepSeek V4 Flash 0731deepseek/deepseek-v4-flash-0731ferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,0198prov. $ 0,018Saída / 1M$ 1,408prov. $ 1,28Margem+10%$ 0,128 de saída1º tokensem medição
- DeepSeek: DeepSeek V4 Flash 0423deepseek/deepseek-v4-flashferramentas, medidojson, medido1M de contextoEnt. / 1M$ 0,033prov. $ 0,03Saída / 1M$ 1,408prov. $ 1,28Margem+10%$ 0,128 de saída1º token1,3 s
- OpenAI: GPT-5 Mini (batch)openai/gpt-5-mini:batchvisãoferramentas, declaradojson, declarado400k de contextoEnt. / 1M$ 0,1375prov. $ 0,125Saída / 1M$ 1,10prov. $ 1,00Margem+10%$ 0,1 de saída1º tokensem medição
- OpenAI: GPT-4.1 Mini (batch)openai/gpt-4.1-mini:batchvisãoferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,22prov. $ 0,2Saída / 1M$ 0,88prov. $ 0,8Margem+10%$ 0,08 de saída1º tokensem medição
- Qwen: Qwen3 Next 80B A3B Instructqwen/qwen3-next-80b-a3b-instructferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,11prov. $ 0,1Saída / 1M$ 1,21prov. $ 1,10Margem+10%$ 0,11 de saída1º tokensem medição
- TheDrummer: Cydonia 24B V4.1thedrummer/cydonia-24b-v4.1json, declarado131k de contextoEnt. / 1M$ 0,33prov. $ 0,3Saída / 1M$ 0,55prov. $ 0,5Margem+10%$ 0,05 de saída1º tokensem medição
- Qwen: Qwen3.5-35B-A3Bqwen/qwen3.5-35b-a3bvisãoferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,165prov. $ 0,15Saída / 1M$ 1,10prov. $ 1,00Margem+10%$ 0,1 de saída1º tokensem medição
- Qwen: Qwen3.6 35B A3Bqwen/qwen3.6-35b-a3bvisãoferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,165prov. $ 0,15Saída / 1M$ 1,10prov. $ 1,00Margem+10%$ 0,1 de saída1º tokensem medição
- MiniMax: MiniMax M2.7minimax/minimax-m2.7ferramentas, declaradojson, declarado205k de contextoEnt. / 1M$ 0,231prov. $ 0,21Saída / 1M$ 0,924prov. $ 0,84Margem+10%$ 0,084 de saída1º tokensem medição
- Qwen2.5 72B Instructqwen/qwen-2.5-72b-instructferramentas, declaradojson, declarado33k de contextoEnt. / 1M$ 0,396prov. $ 0,36Saída / 1M$ 0,44prov. $ 0,4Margem+10%$ 0,04 de saída1º tokensem medição
- Venice: Uncensoredcognitivecomputations/dolphin-mistral-24b-venice-editionjson, declarado128k de contextoEnt. / 1M$ 0,22prov. $ 0,2Saída / 1M$ 0,99prov. $ 0,9Margem+10%$ 0,09 de saída1º tokensem medição
- Inception: Mercury 2inception/mercury-2ferramentas, declaradojson, declarado128k de contextoEnt. / 1M$ 0,275prov. $ 0,25Saída / 1M$ 0,825prov. $ 0,75Margem+10%$ 0,075 de saída1º tokensem medição
“prov.” é a tarifa que o provedor publica, lida do catálogo dele. Se uma etiqueta tem marca, uma sonda nesta implantação mediu que funciona; se não tem, é o que o provedor declara. Primeiro token é a mediana medida aqui na última semana, com tráfego real e sondas. Os preços seguem o provedor: quando ele muda uma tarifa, esta lista e a cobrança mudam junto.
Calculadora
Quanto custa uma requisição
Os três mundos mais baratos da lista como ela está filtrada agora. Adicione até quatro de sua escolha com Comparar. Calculado com a mesma função que o gateway usa para cobrar. Você define os tokens; as tarefas são números redondos para começar.
| Mundo | Antimatter | Provedor | Margem |
|---|---|---|---|
| Mistral: Mistral Nemomistralai/mistral-nemo | $ 0,0366 | $ 0,0333 | $ 0,003330 |
| inclusionAI: Ling 3.0 Flash VLinclusionai/ling-3.0-flash-vl | $ 0,0514 | $ 0,0468 | $ 0,004676 |
| inclusionAI: Ling 3.0 Flashinclusionai/ling-3.0-flash | $ 0,0520 | $ 0,0473 | $ 0,004725 |
Mil requisições de 1.200 tokens de entrada e 350 de saída. Um token de prompt em cache custa menos onde o provedor publica uma tarifa de cache.
Por necessidade
O mundo mais barato para cada necessidade
Os mundos que leem imagens, suportam um contexto longo, chamam ferramentas ou devolvem JSON, ordenados pelo custo de uma mensagem típica a estes preços.
Piloto automático
Deixe o roteador escolher
Um id de piloto automático escolhe um mundo a cada requisição e é cobrado pelo preço desse mundo nesta lista, com a mesma margem. A resposta nomeia o mundo em x-antimatter-model.
antimatter/autoEquilibrado: preço, velocidade medida e qualidade medida, pontuados juntos.antimatter/auto:cheapO menor preço combinado do catálogo.antimatter/auto:fastO menor tempo medido até o primeiro token.antimatter/auto:codeChamadas de ferramenta com funcionamento medido e um contexto dimensionado para código.antimatter/auto:longUma janela de contexto longa, segundo o catálogo.antimatter/auto:visionUm mundo que recebe imagens como entrada.antimatter/auto:toolsUm mundo cujas chamadas de ferramenta foram medidas e funcionam.antimatter/auto:jsonUm mundo cuja saída estruturada foi medida e é válida.