Tabela de preços
Cada mundo, com o preço às claras
Cada linha mostra o que o provedor publica e o que o Antimatter cobra, lado a lado. A diferença é a margem, e ela é declarada, não escondida em uma tarifa.
+10%
O preço publicado pelo provedor mais 10%. Essa é a margem inteira, em cada mundo.
Igual para todas as contas. Adicionar crédito não tem taxa: o que você envia é o que é creditado. Não é mais barato que comprar direto e não finge ser: é o preço do provedor mais isto, por uma única chave, um só protocolo e todos os mundos.
- 466
- 459
- 64
- Mistral: Mistral Nemomistralai/mistral-nemoferramentas, medidojson, medido131k de contextoEnt. / 1M$ 0,0209prov. $ 0,019Saída / 1M$ 0,033prov. $ 0,03Margem+10%$ 0,003 de saída1º token361 ms
- inclusionAI: Ling 3.0 Flash VLinclusionai/ling-3.0-flash-vlvisãoferramentas, medidojson, medido262k de contextoEnt. / 1M$ 0,0231prov. $ 0,021Saída / 1M$ 0,06776prov. $ 0,0616Margem+10%$ 0,00616 de saída1º token726 ms
- inclusionAI: Ling 3.0 Flashinclusionai/ling-3.0-flashferramentas, medidojson, medido262k de contextoEnt. / 1M$ 0,0231prov. $ 0,021Saída / 1M$ 0,0693prov. $ 0,063Margem+10%$ 0,0063 de saída1º token612 ms
- OpenAI: gpt-oss-20bopenai/gpt-oss-20bferramentas, medidojson, medido131k de contextoEnt. / 1M$ 0,0198prov. $ 0,018Saída / 1M$ 0,099prov. $ 0,09Margem+10%$ 0,009 de saída1º token399 ms
- IBM: Granite 4.0 Microibm-granite/granite-4.0-h-microjson, medido131k de contextoEnt. / 1M$ 0,0187prov. $ 0,017Saída / 1M$ 0,1232prov. $ 0,112Margem+10%$ 0,0112 de saída1º token355 ms
- Sao10K: Llama 3 8B Lunarissao10k/l3-lunaris-8bjson, medido8k de contextoEnt. / 1M$ 0,044prov. $ 0,04Saída / 1M$ 0,055prov. $ 0,05Margem+10%$ 0,005 de saída1º token273 ms
- Nex AGI: Nex-N2.5-Mininex-agi/nex-n2.5-minivisãojson, declarado262k de contextoEnt. / 1M$ 0,0275prov. $ 0,025Saída / 1M$ 0,11prov. $ 0,1Margem+10%$ 0,01 de saída1º token2,3 s
- OpenAI: gpt-oss-20b (batch)openai/gpt-oss-20b:batchferramentas, declaradojson, declarado131k de contextoEnt. / 1M$ 0,0264prov. $ 0,024Saída / 1M$ 0,1232prov. $ 0,112Margem+10%$ 0,0112 de saída1º tokensem medição
- Qwen: Qwen3.7 Flashqwen/qwen3.7-flashvisãoferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,033prov. $ 0,03Saída / 1M$ 0,143prov. $ 0,13Margem+10%$ 0,013 de saída1º token590 ms
- OpenAI: gpt-oss-120b (batch)openai/gpt-oss-120b:batchferramentas, declaradojson, declarado131k de contextoEnt. / 1M$ 0,03256prov. $ 0,0296Saída / 1M$ 0,1496prov. $ 0,136Margem+10%$ 0,0136 de saída1º tokensem medição
- Meta: Llama 3.1 8B Instructmeta-llama/llama-3.1-8b-instructferramentas, declaradojson, declarado131k de contextoEnt. / 1M$ 0,055prov. $ 0,05Saída / 1M$ 0,088prov. $ 0,08Margem+10%$ 0,008 de saída1º token415 ms
- Mistral: Mistral Small 3mistralai/mistral-small-24b-instruct-2501json, declarado33k de contextoEnt. / 1M$ 0,055prov. $ 0,05Saída / 1M$ 0,088prov. $ 0,08Margem+10%$ 0,008 de saída1º token247 ms
- Inference.net: Schematron V2 Turboinference-net/schematron-v2-turbojson, declarado128k de contextoEnt. / 1M$ 0,033prov. $ 0,03Saída / 1M$ 0,165prov. $ 0,15Margem+10%$ 0,015 de saída1º tokensem medição
- inclusionAI: Ling 3.0 Flash Fininclusionai/ling-3.0-flash-finferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,0462prov. $ 0,042Saída / 1M$ 0,1355prov. $ 0,1232Margem+10%$ 0,01232 de saída1º tokensem medição
- Google: Gemma 3 4Bgoogle/gemma-3-4b-itvisãojson, declarado131k de contextoEnt. / 1M$ 0,055prov. $ 0,05Saída / 1M$ 0,11prov. $ 0,1Margem+10%$ 0,01 de saída1º tokensem medição
- Cohere: Command R7B (12-2024)cohere/command-r7b-12-2024json, declarado128k de contextoEnt. / 1M$ 0,04125prov. $ 0,0375Saída / 1M$ 0,165prov. $ 0,15Margem+10%$ 0,015 de saída1º tokensem medição
- Inception: Mercury 2.5inception/mercury-2.5ferramentas, declaradojson, declarado260k de contextoEnt. / 1M$ 0,044prov. $ 0,04Saída / 1M$ 0,165prov. $ 0,15Margem+10%$ 0,015 de saída1º tokensem medição
- OpenAI: GPT-5 Nano (batch)openai/gpt-5-nano:batchvisãoferramentas, declaradojson, declarado400k de contextoEnt. / 1M$ 0,0275prov. $ 0,025Saída / 1M$ 0,22prov. $ 0,2Margem+10%$ 0,02 de saída1º tokensem medição
- OpenAI: gpt-oss-120bopenai/gpt-oss-120bferramentas, declaradojson, declarado131k de contextoEnt. / 1M$ 0,0407prov. $ 0,037Saída / 1M$ 0,187prov. $ 0,17Margem+10%$ 0,017 de saída1º tokensem medição
- Google: Gemma 3 12Bgoogle/gemma-3-12b-itvisãoferramentas, declaradojson, declarado131k de contextoEnt. / 1M$ 0,055prov. $ 0,05Saída / 1M$ 0,165prov. $ 0,15Margem+10%$ 0,015 de saída1º tokensem medição
- Mistral: Ministral 3 8B 2512 (batch)mistralai/ministral-8b-2512:batchvisãoferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,0825prov. $ 0,075Saída / 1M$ 0,0825prov. $ 0,075Margem+10%$ 0,0075 de saída1º tokensem medição
- Qwen: Qwen3 30B A3B Instruct 2507qwen/qwen3-30b-a3b-instruct-2507ferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,05296prov. $ 0,04815Saída / 1M$ 0,2124prov. $ 0,193Margem+10%$ 0,0193 de saída1º tokensem medição
- NVIDIA: Nemotron 3.5 Lightningnvidia/nemotron-3.5-lightningferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,066prov. $ 0,06Saída / 1M$ 0,176prov. $ 0,16Margem+10%$ 0,016 de saída1º tokensem medição
- Google: Gemini 2.5 Flash Lite (batch)google/gemini-2.5-flash-lite:batchvisãoferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,055prov. $ 0,05Saída / 1M$ 0,22prov. $ 0,2Margem+10%$ 0,02 de saída1º tokensem medição
- MythoMax 13Bgryphe/mythomax-l2-13bjson, declarado8k de contextoEnt. / 1M$ 0,088prov. $ 0,08Saída / 1M$ 0,121prov. $ 0,11Margem+10%$ 0,011 de saída1º tokensem medição
- Microsoft: Phi 4microsoft/phi-4json, declarado16k de contextoEnt. / 1M$ 0,077prov. $ 0,07Saída / 1M$ 0,154prov. $ 0,14Margem+10%$ 0,014 de saída1º tokensem medição
- NVIDIA: Nemotron 3 Nano 30B A3Bnvidia/nemotron-3-nano-30b-a3bferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,055prov. $ 0,05Saída / 1M$ 0,22prov. $ 0,2Margem+10%$ 0,02 de saída1º tokensem medição
- OpenAI: GPT-4.1 Nano (batch)openai/gpt-4.1-nano:batchvisãoferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,055prov. $ 0,05Saída / 1M$ 0,22prov. $ 0,2Margem+10%$ 0,02 de saída1º tokensem medição
- Upstage: Solar Mini 4upstage/solar-mini4ferramentas, declaradojson, declarado524k de contextoEnt. / 1M$ 0,055prov. $ 0,05Saída / 1M$ 0,22prov. $ 0,2Margem+10%$ 0,02 de saída1º tokensem medição
- Inference.net: Schematron V2 Smallinference-net/schematron-v2-smalljson, declarado128k de contextoEnt. / 1M$ 0,055prov. $ 0,05Saída / 1M$ 0,253prov. $ 0,23Margem+10%$ 0,023 de saída1º tokensem medição
- Z.ai: GLM 5.3 Flash (batch)z-ai/glm-5.3-flash:batchvisãoferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,066prov. $ 0,06Saída / 1M$ 0,22prov. $ 0,2Margem+10%$ 0,02 de saída1º tokensem medição
- Mistral: Ministral 3 3B 2512mistralai/ministral-3b-2512visãoferramentas, declaradojson, declarado131k de contextoEnt. / 1M$ 0,11prov. $ 0,1Saída / 1M$ 0,11prov. $ 0,1Margem+10%$ 0,01 de saída1º tokensem medição
- Reka Edgerekaai/reka-edgevisãoferramentas, declaradojson, declarado16k de contextoEnt. / 1M$ 0,11prov. $ 0,1Saída / 1M$ 0,11prov. $ 0,1Margem+10%$ 0,01 de saída1º tokensem medição
- OpenAI: GPT-6 Luna Pro (batch)openai/gpt-6-luna-pro:batchvisãoferramentas, declaradojson, declarado1,1M de contextoEnt. / 1M$ 0,055prov. $ 0,05Saída / 1M$ 0,275prov. $ 0,25Margem+10%$ 0,025 de saída1º tokensem medição
- OpenAI: GPT-6 Luna (batch)openai/gpt-6-luna:batchvisãoferramentas, declaradojson, declarado1,1M de contextoEnt. / 1M$ 0,055prov. $ 0,05Saída / 1M$ 0,275prov. $ 0,25Margem+10%$ 0,025 de saída1º tokensem medição
- IBM: Granite 4.2 8Bibm-granite/granite-4.2-8bferramentas, declaradojson, declarado131k de contextoEnt. / 1M$ 0,066prov. $ 0,06Saída / 1M$ 0,275prov. $ 0,25Margem+10%$ 0,025 de saída1º tokensem medição
- DeepSeek: DeepSeek Flash Latest~deepseek/deepseek-flash-latestvisãoferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,0484prov. $ 0,044Saída / 1M$ 0,33prov. $ 0,3Margem+10%$ 0,03 de saída1º tokensem medição
- DeepSeek: DeepSeek V4.1 Flashdeepseek/deepseek-v4.1-flashvisãoferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,0484prov. $ 0,044Saída / 1M$ 0,33prov. $ 0,3Margem+10%$ 0,03 de saída1º tokensem medição
- Qwen: Qwen3.5-9Bqwen/qwen3.5-9bvisãoferramentas, declaradojson, declarado262k de contextoEnt. / 1M$ 0,11prov. $ 0,1Saída / 1M$ 0,165prov. $ 0,15Margem+10%$ 0,015 de saída1º tokensem medição
- Qwen: Qwen3.5-Flashqwen/qwen3.5-flash-02-23visãoferramentas, declaradojson, declarado1M de contextoEnt. / 1M$ 0,0715prov. $ 0,065Saída / 1M$ 0,286prov. $ 0,26Margem+10%$ 0,026 de saída1º tokensem medição
“prov.” é a tarifa que o provedor publica, lida do catálogo dele. Se uma etiqueta tem marca, uma sonda nesta implantação mediu que funciona; se não tem, é o que o provedor declara. Primeiro token é a mediana medida aqui na última semana, com tráfego real e sondas. Os preços seguem o provedor: quando ele muda uma tarifa, esta lista e a cobrança mudam junto.
Calculadora
Quanto custa uma requisição
Os três mundos mais baratos da lista como ela está filtrada agora. Adicione até quatro de sua escolha com Comparar. Calculado com a mesma função que o gateway usa para cobrar. Você define os tokens; as tarefas são números redondos para começar.
| Mundo | Antimatter | Provedor | Margem |
|---|---|---|---|
| Mistral: Mistral Nemomistralai/mistral-nemo | $ 0,0366 | $ 0,0333 | $ 0,003330 |
| inclusionAI: Ling 3.0 Flash VLinclusionai/ling-3.0-flash-vl | $ 0,0514 | $ 0,0468 | $ 0,004676 |
| inclusionAI: Ling 3.0 Flashinclusionai/ling-3.0-flash | $ 0,0520 | $ 0,0473 | $ 0,004725 |
Mil requisições de 1.200 tokens de entrada e 350 de saída. Um token de prompt em cache custa menos onde o provedor publica uma tarifa de cache.
Por necessidade
O mundo mais barato para cada necessidade
Os mundos que leem imagens, suportam um contexto longo, chamam ferramentas ou devolvem JSON, ordenados pelo custo de uma mensagem típica a estes preços.
Piloto automático
Deixe o roteador escolher
Um id de piloto automático escolhe um mundo a cada requisição e é cobrado pelo preço desse mundo nesta lista, com a mesma margem. A resposta nomeia o mundo em x-antimatter-model.
antimatter/autoEquilibrado: preço, velocidade medida e qualidade medida, pontuados juntos.antimatter/auto:cheapO menor preço combinado do catálogo.antimatter/auto:fastO menor tempo medido até o primeiro token.antimatter/auto:codeChamadas de ferramenta com funcionamento medido e um contexto dimensionado para código.antimatter/auto:longUma janela de contexto longa, segundo o catálogo.antimatter/auto:visionUm mundo que recebe imagens como entrada.antimatter/auto:toolsUm mundo cujas chamadas de ferramenta foram medidas e funcionam.antimatter/auto:jsonUm mundo cuja saída estruturada foi medida e é válida.