el mapa
inclusionAI

Ling 3.0 Flash

inclusionai/ling-3.0-flash

menos de 1/100 de centavo por mensaje

Un mensaje típico: unos 500 tokens que envías y 500 que escribe.

0,0231 $ por 1M tokens que envías0,0693 $ por 1M tokens que escribelee 262K tokens a la vez

Ling-3.0-flash is a 124B-parameter Mixture-of-Experts (MoE) model, with approximately 5.1B parameters activated per token. The model is designed with token efficiency and production-scale agentic inference as key priorities, enabling developers...

En palabras de inclusionAI.

Lo que diga aparecerá aquí.
612ms
primera palabra, mediana
981ms
primera palabra, lenta
327,9 tok/s
velocidad
0,0 %
errores

De 14 solicitudes a través de este despliegue en los últimos 7 días. No es un benchmark, solo lo que vio esta nave.

Sondas de capacidades

funciona
herramientas
funciona
esquema json
100 %
recuperación de contexto
20 %
tasa de rechazo

mediana de la sonda: primera palabra 612ms, respuesta completa 656ms, a lo largo de 4 horas del día

aguja encontrada a profundidad 10 % sí, 50 % sí, 90 % sí

El comportamiento cambió el 6 oct 2026: structured output went from failing to holding; context recall moved from 0.67 to 1.00. Nadie publica esto; lo notamos porque medimos las mismas cosas de la misma manera cada vez.

Medido de punta a punta a través de este gateway, no leído de lo que afirma un fabricante. Última lectura: 6 oct 2026. El rechazo se detecta por patrones con un conjunto fijo de prompts neutrales, así que se queda corto antes que acusar de más.

Latencia

primer token p50 respuesta completa p50 datos insuficientes
7 sept 2026: nada medido8 sept 2026: nada medido9 sept 2026: nada medido10 sept 2026: nada medido11 sept 2026: nada medido12 sept 2026: nada medido13 sept 2026: nada medido14 sept 2026: nada medido15 sept 2026: nada medido16 sept 2026: nada medido17 sept 2026: nada medido18 sept 2026: nada medido19 sept 2026: nada medido20 sept 2026: nada medido21 sept 2026: nada medido22 sept 2026: nada medido23 sept 2026: nada medido24 sept 2026: nada medido25 sept 2026: nada medido26 sept 2026: nada medido27 sept 2026: nada medido28 sept 2026: nada medido29 sept 2026: nada medido30 sept 2026: nada medido1 oct 2026: nada medido2 oct 2026: nada medido3 oct 2026: 2 muestras, datos insuficientes (se necesitan 5)4 oct 2026: 4 muestras, datos insuficientes (se necesitan 5)5 oct 2026: 4 muestras, datos insuficientes (se necesitan 5)6 oct 2026: 4 muestras, datos insuficientes (se necesitan 5)
7 sept 20266 oct 2026
Mediana del primer token y de la respuesta completa por día UTC, con solicitudes a través de este gateway y la sonda programada. 0 de 30 días tuvieron las 5 muestras que una mediana necesita aquí. Un día con menos se muestra como datos insuficientes, no como un número.
Latencia diaria, UTC
DíaMuestrasCon éxitoPrimer token p50Respuesta completa p50
3 oct 20262datos insuficientes
4 oct 20264datos insuficientes
5 oct 20264datos insuficientes
6 oct 20264datos insuficientes

Historial de precio y latencia en JSON: GET /api/planet/history?id=inclusionai/ling-3.0-flash.

Un endpoint compatible con OpenAI, el id de este modelo y una clave am_live_ del panel. O pruébalo en el chat primero, sin clave.

curl https://useantimatter.com/v1/chat/completions \
  -H "Authorization: Bearer $ANTIMATTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model": "inclusionai/ling-3.0-flash", "messages": [{"role": "user", "content": "Hello"}]}'

Todo lo demás está en la documentación.

Una insignia con el precio en vivo de este mundo por millón de tokens, tal como se cobra aquí, para un README o un sitio. Enlaza de vuelta a esta página.

Precio de Ling 3.0 Flash en Antimatter
<a href="https://useantimatter.com/planet/inclusionai/ling-3.0-flash"><img src="https://useantimatter.com/api/badge/price?id=inclusionai%2Fling-3.0-flash" alt="Ling 3.0 Flash price on Antimatter" height="28"></a>

Los más cercanos en precio y memoria, de otros fabricantes.

Vuelve a la galaxia, o lleva este mundo a un hilo.

Antimatter