el mapa
Meta

Llama 3.1 8B Instruct

meta-llama/llama-3.1-8b-instruct

menos de 1/100 de centavo por mensaje

Un mensaje típico: unos 500 tokens que envías y 500 que escribe.

0,055 $ por 1M tokens que envías0,088 $ por 1M tokens que escribelee 131K tokens a la vez

Meta's latest class of model (Llama 3.1) launched with a variety of sizes & flavors. This 8B instruct-tuned version is fast and efficient. It has demonstrated strong performance compared to...

En palabras de Meta.

Lo que diga aparecerá aquí.
415ms
primera palabra, mediana
5529ms
primera palabra, lenta
335,3 tok/s
velocidad
0,0 %
errores

De 14 solicitudes a través de este despliegue en los últimos 7 días. No es un benchmark, solo lo que vio esta nave.

Sondas de capacidades

sin medir
herramientas
sin medir
esquema json
sin medir
recuperación de contexto
sin medir
tasa de rechazo

mediana de la sonda: primera palabra 423ms, respuesta completa 436ms, a lo largo de 6 horas del día

Medido de punta a punta a través de este gateway, no leído de lo que afirma un fabricante. Última lectura: 6 oct 2026. El rechazo se detecta por patrones con un conjunto fijo de prompts neutrales, así que se queda corto antes que acusar de más.

Latencia

primer token p50 respuesta completa p50 datos insuficientesmáx. 425ms
7 sept 2026: nada medido8 sept 2026: nada medido9 sept 2026: nada medido10 sept 2026: nada medido11 sept 2026: nada medido12 sept 2026: nada medido13 sept 2026: nada medido14 sept 2026: nada medido15 sept 2026: nada medido16 sept 2026: nada medido17 sept 2026: nada medido18 sept 2026: nada medido19 sept 2026: nada medido20 sept 2026: nada medido21 sept 2026: nada medido22 sept 2026: nada medido23 sept 2026: nada medido24 sept 2026: nada medido25 sept 2026: nada medido26 sept 2026: nada medido27 sept 2026: nada medido28 sept 2026: nada medido29 sept 2026: nada medido30 sept 2026: nada medido1 oct 2026: nada medido2 oct 2026: nada medido3 oct 2026: 1 muestra, datos insuficientes (se necesitan 5)4 oct 2026: 5 muestras, primer token p50 415ms, respuesta completa p50 425ms, 100 % con éxito5 oct 2026: 4 muestras, datos insuficientes (se necesitan 5)6 oct 2026: 4 muestras, datos insuficientes (se necesitan 5)
7 sept 20266 oct 2026
Mediana del primer token y de la respuesta completa por día UTC, con solicitudes a través de este gateway y la sonda programada. 1 de 30 días tuvieron las 5 muestras que una mediana necesita aquí; el más reciente, 4 oct 2026: primer token 415ms, respuesta completa 425ms, 100 % con éxito. Un día con menos se muestra como datos insuficientes, no como un número.
Latencia diaria, UTC
DíaMuestrasCon éxitoPrimer token p50Respuesta completa p50
3 oct 20261datos insuficientes
4 oct 20265100 %415ms425ms
5 oct 20264datos insuficientes
6 oct 20264datos insuficientes

Historial de precio y latencia en JSON: GET /api/planet/history?id=meta-llama/llama-3.1-8b-instruct.

Un endpoint compatible con OpenAI, el id de este modelo y una clave am_live_ del panel. O pruébalo en el chat primero, sin clave.

curl https://useantimatter.com/v1/chat/completions \
  -H "Authorization: Bearer $ANTIMATTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model": "meta-llama/llama-3.1-8b-instruct", "messages": [{"role": "user", "content": "Hello"}]}'

Todo lo demás está en la documentación.

Una insignia con el precio en vivo de este mundo por millón de tokens, tal como se cobra aquí, para un README o un sitio. Enlaza de vuelta a esta página.

Precio de Llama 3.1 8B Instruct en Antimatter
<a href="https://useantimatter.com/planet/meta-llama/llama-3.1-8b-instruct"><img src="https://useantimatter.com/api/badge/price?id=meta-llama%2Fllama-3.1-8b-instruct" alt="Llama 3.1 8B Instruct price on Antimatter" height="28"></a>

Los más cercanos en precio y memoria, de otros fabricantes.

Vuelve a la galaxia, o lleva este mundo a un hilo.

Antimatter