o mapa
Meta

Llama 3.1 8B Instruct

meta-llama/llama-3.1-8b-instruct

menos de 1/100 de centavo por mensagem

Uma mensagem típica: cerca de 500 tokens que você envia e 500 que ele escreve.

$ 0,055 por 1M tokens que você envia$ 0,088 por 1M tokens que ele escrevelê 131K tokens de uma vez

Meta's latest class of model (Llama 3.1) launched with a variety of sizes & flavors. This 8B instruct-tuned version is fast and efficient. It has demonstrated strong performance compared to...

Nas palavras de Meta.

O que ele disser aparece aqui.
415ms
primeira palavra, mediana
5.529ms
primeira palavra, lenta
335,3 tok/s
velocidade
0,0%
erros

De 14 requisições por esta implantação nos últimos 7 dias. Não é um benchmark, só o que esta nave viu.

Sondas de capacidades

sem medição
ferramentas
sem medição
esquema json
sem medição
memória de contexto
sem medição
taxa de recusa

mediana da sonda: primeira palavra 423ms, resposta inteira 436ms, ao longo de 6 horas do dia

Medido de ponta a ponta por este gateway, não lido do que um fabricante afirma. Última leitura em 6 de out. de 2026. A recusa é detectada por padrões com um conjunto fixo de prompts neutros, então tende a contar de menos em vez de acusar demais.

Latência

primeiro token p50 resposta inteira p50 dados insuficientesmáx. 425ms
7 de set. de 2026: nada medido8 de set. de 2026: nada medido9 de set. de 2026: nada medido10 de set. de 2026: nada medido11 de set. de 2026: nada medido12 de set. de 2026: nada medido13 de set. de 2026: nada medido14 de set. de 2026: nada medido15 de set. de 2026: nada medido16 de set. de 2026: nada medido17 de set. de 2026: nada medido18 de set. de 2026: nada medido19 de set. de 2026: nada medido20 de set. de 2026: nada medido21 de set. de 2026: nada medido22 de set. de 2026: nada medido23 de set. de 2026: nada medido24 de set. de 2026: nada medido25 de set. de 2026: nada medido26 de set. de 2026: nada medido27 de set. de 2026: nada medido28 de set. de 2026: nada medido29 de set. de 2026: nada medido30 de set. de 2026: nada medido1 de out. de 2026: nada medido2 de out. de 2026: nada medido3 de out. de 2026: 1 amostra, dados insuficientes (são necessárias 5)4 de out. de 2026: 5 amostras, primeiro token p50 415ms, resposta inteira p50 425ms, 100% com sucesso5 de out. de 2026: 4 amostras, dados insuficientes (são necessárias 5)6 de out. de 2026: 4 amostras, dados insuficientes (são necessárias 5)
7 de set. de 20266 de out. de 2026
Mediana do primeiro token e da resposta inteira por dia UTC, com requisições por este gateway e a sonda programada. 1 de 30 dias tiveram as 5 amostras de que uma mediana precisa aqui; o mais recente, 4 de out. de 2026: primeiro token 415ms, resposta inteira 425ms, 100% com sucesso. Um dia com menos aparece como dados insuficientes, não como um número.
Latência diária, UTC
DiaAmostrasCom sucessoPrimeiro token p50Resposta inteira p50
3 de out. de 20261dados insuficientes
4 de out. de 20265100%415ms425ms
5 de out. de 20264dados insuficientes
6 de out. de 20264dados insuficientes

Histórico de preço e latência em JSON: GET /api/planet/history?id=meta-llama/llama-3.1-8b-instruct.

Um endpoint compatível com OpenAI, o id deste modelo e uma chave am_live_ do painel. Ou teste no chat primeiro, sem chave.

curl https://useantimatter.com/v1/chat/completions \
  -H "Authorization: Bearer $ANTIMATTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model": "meta-llama/llama-3.1-8b-instruct", "messages": [{"role": "user", "content": "Hello"}]}'

Todo o resto está na documentação.

Um selo com o preço ao vivo deste mundo por milhão de tokens, como cobrado aqui, para um README ou um site. Ele leva de volta a esta página.

Preço de Llama 3.1 8B Instruct no Antimatter
<a href="https://useantimatter.com/planet/meta-llama/llama-3.1-8b-instruct"><img src="https://useantimatter.com/api/badge/price?id=meta-llama%2Fllama-3.1-8b-instruct" alt="Llama 3.1 8B Instruct price on Antimatter" height="28"></a>

Os mais próximos em preço e memória, de outros fabricantes.

Volte para a galáxia, ou leve este mundo para uma conversa.

Antimatter