el mapa
inclusionAI

Ling 3.0 Flash VL

inclusionai/ling-3.0-flash-vl

menos de 1/100 de centavo por mensaje

Un mensaje típico: unos 500 tokens que envías y 500 que escribe.

0,0231 $ por 1M tokens que envías0,06776 $ por 1M tokens que escribelee 262K tokens a la vezlee imágenes

Ling 3.0 Flash VL builds on Ling 3.0 Flash (124B total / 5.5B active MoE from InclusionAI), further strengthening its language capabilities while adding native visual perception and advanced visual...

En palabras de inclusionAI.

Lo que diga aparecerá aquí.
726ms
primera palabra, mediana
1128ms
primera palabra, lenta
266,0 tok/s
velocidad
0,0 %
errores

De 14 solicitudes a través de este despliegue en los últimos 7 días. No es un benchmark, solo lo que vio esta nave.

Sondas de capacidades

funciona
herramientas
funciona
esquema json
100 %
recuperación de contexto
0 %
tasa de rechazo

mediana de la sonda: primera palabra 742ms, respuesta completa 793ms, a lo largo de 4 horas del día

aguja encontrada a profundidad 10 % sí, 50 % sí, 90 % sí

El comportamiento cambió el 6 oct 2026: structured output went from failing to holding. Nadie publica esto; lo notamos porque medimos las mismas cosas de la misma manera cada vez.

Medido de punta a punta a través de este gateway, no leído de lo que afirma un fabricante. Última lectura: 6 oct 2026. El rechazo se detecta por patrones con un conjunto fijo de prompts neutrales, así que se queda corto antes que acusar de más.

Latencia

primer token p50 respuesta completa p50 datos insuficientes
7 sept 2026: nada medido8 sept 2026: nada medido9 sept 2026: nada medido10 sept 2026: nada medido11 sept 2026: nada medido12 sept 2026: nada medido13 sept 2026: nada medido14 sept 2026: nada medido15 sept 2026: nada medido16 sept 2026: nada medido17 sept 2026: nada medido18 sept 2026: nada medido19 sept 2026: nada medido20 sept 2026: nada medido21 sept 2026: nada medido22 sept 2026: nada medido23 sept 2026: nada medido24 sept 2026: nada medido25 sept 2026: nada medido26 sept 2026: nada medido27 sept 2026: nada medido28 sept 2026: nada medido29 sept 2026: nada medido30 sept 2026: nada medido1 oct 2026: nada medido2 oct 2026: nada medido3 oct 2026: 2 muestras, datos insuficientes (se necesitan 5)4 oct 2026: 4 muestras, datos insuficientes (se necesitan 5)5 oct 2026: 4 muestras, datos insuficientes (se necesitan 5)6 oct 2026: 4 muestras, datos insuficientes (se necesitan 5)
7 sept 20266 oct 2026
Mediana del primer token y de la respuesta completa por día UTC, con solicitudes a través de este gateway y la sonda programada. 0 de 30 días tuvieron las 5 muestras que una mediana necesita aquí. Un día con menos se muestra como datos insuficientes, no como un número.
Latencia diaria, UTC
DíaMuestrasCon éxitoPrimer token p50Respuesta completa p50
3 oct 20262datos insuficientes
4 oct 20264datos insuficientes
5 oct 20264datos insuficientes
6 oct 20264datos insuficientes

Historial de precio y latencia en JSON: GET /api/planet/history?id=inclusionai/ling-3.0-flash-vl.

Un endpoint compatible con OpenAI, el id de este modelo y una clave am_live_ del panel. O pruébalo en el chat primero, sin clave.

curl https://useantimatter.com/v1/chat/completions \
  -H "Authorization: Bearer $ANTIMATTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model": "inclusionai/ling-3.0-flash-vl", "messages": [{"role": "user", "content": "Hello"}]}'

Todo lo demás está en la documentación.

Una insignia con el precio en vivo de este mundo por millón de tokens, tal como se cobra aquí, para un README o un sitio. Enlaza de vuelta a esta página.

Precio de Ling 3.0 Flash VL en Antimatter
<a href="https://useantimatter.com/planet/inclusionai/ling-3.0-flash-vl"><img src="https://useantimatter.com/api/badge/price?id=inclusionai%2Fling-3.0-flash-vl" alt="Ling 3.0 Flash VL price on Antimatter" height="28"></a>

Los más cercanos en precio y memoria, de otros fabricantes.

Vuelve a la galaxia, o lleva este mundo a un hilo.

Antimatter