// opendata

Las cifras reales
de la plataforma.

Datos de uso de la plataforma de inferencia, agregados y anonimizados. Sin prompts, sin contenido; solo contadores a nivel de petición.

Actualización semanal · 20 Sep 2026

1.7T

Tokens procesados

acumulado

108.7M

Peticiones servidas

acumulado

21

Modelos activos

en producción

// modelos

Tokens por modelo.

Tokens acumulados por modelo. Un modelo abierto concentra la mayor parte de la carga, el stack completo está siempre disponible.

01 Qwen 3.6 33.8% 585.9 B · 86.2 M
02 DeepSeek V4-Flash 33.5% 579.1 B · 7.5 M
03 MiMo V2.5 9.8% 169.3 B · 2.6 M
04 glm5.3-flash 8.9% 153.6 B · 1.4 M
05 qwen3.8-flash 3.7% 63.9 B · 1.1 M
06 glm5.2 3.5% 60 B · 729.5 K
07 deepseek-v4-flash-0731 3.4% 59.6 B · 512.6 K
08 Gemma 4 1.5% 26.5 B · 5.4 M
09 glm5.3 1.3% 22.2 B · 271.7 K
10 Qwen3 Embedding 0.6% 10.9 B · 2.4 M
11 Qwen3 Coder <0.1% 142.8 M · 7.1 K
12 claude-opus-5 <0.1% 1.7 M · 533
13 claude-fable-5 <0.1% 2.2 K · 3
14 deepseek <0.1% 103 · 2
15 claude-haiku-4-5 <0.1% 43 · 3
16 Whisper Large v3 <0.1% 24 · 284.6 K
17 gpt-5.6-luna <0.1% 15 · 1
18 claude-sonnet-5 <0.1% 9 · 1
19 gemini-3.5-flash-lite <0.1% 7 · 1

// tokens

Entrada vs. salida.

La inferencia es mayoritariamente de lectura, prompts largos, recuperación y contexto, con una fracción menor de tokens generados.

Entrada · prompt 1.7 T 98.1%
Salida · generado 32.9 B 1.9%

// uso

Tokens por día.

Tokens procesados a diario en los últimos 90 días, con pico en 48.5 B/day.

0 14 B 28 B 42 B 56 B 48.5 B peak
hace 90 díashoy

// más allá del texto

Voz y reranking.

El stack va más allá de los LLM, transcripción, síntesis y reranking funcionan sobre la misma API.

Texto a voz Kokoro 135.8 K peticiones
Reranking Qwen3 Reranker 86.8 K peticiones

// clientes · últimos 7 días

Cómo se conectan los equipos.

Compatibilidad drop-in con OpenAI en producción real, el SDK oficial y OpenCode concentran la gran mayoría del tráfico.

OpenAI SDK (Python) 32.5% 272 devs
curl 22% 184 devs
Node.js 11.7% 98 devs
OpenAI SDK (JS) 7.6% 64 devs
Vercel AI SDK 7.2% 60 devs
Python httpx 6.5% 54 devs
Go HTTP client 5% 42 devs
Python requests 4.1% 34 devs
Otros 3.5% 29 devs

// geografía · últimos 7 días

Origen de las peticiones.

El 75.4% del tráfico se origina en la UE, la audiencia para la que se ha construido esta infraestructura.

España 50.6% 5.6 M
Alemania 11.8% 1.3 M
Finlandia 7.8% 856.3 K
Estados Unidos 7.5% 823.8 K
Francia 4.4% 481 K
México 4.1% 452.5 K
Argentina 4% 446.2 K
Colombia 2.6% 287 K
Canada 1% 109.7 K
AT 0.9% 95.2 K
Ecuador 0.9% 94.8 K
Chile 0.8% 92.5 K
Otros 3.7% 403.7 K

// rendimiento

Latencia y throughput.

Mediana de tiempo hasta el primer token y throughput sostenido por modelo, medido el 20 Sep 2026.

Modelo TTFT p50 Throughput
DeepSeek V4-Flash n/a 5349 rpm
Qwen 3.6 n/a 1722 rpm
MiMo V2.5 n/a 1588 rpm
Gemma 4 n/a 1529 rpm
glm5.3-flash n/a 585 rpm
Qwen3 Embedding n/a 39.4 rpm
glm5.3 n/a 15.8 rpm
qwen3.8-flash n/a 7.3 rpm
Kokoro n/a 4.6 rpm
Whisper Large v3 n/a 3.5 rpm
Qwen3 Reranker n/a 0.7 rpm
glm5.2 n/a 0.6 rpm

TTFT p50 = mediana de tiempo hasta el primer token · Throughput = peticiones sostenidas por minuto.

// para quién

Dos formas de usar este stack.

Estas cifras vienen de cargas de trabajo reales, tanto de comunidad como de despliegues privados.

Builders y comunidad

Modelos frontier, precio justo, sin ceder datos.

Acceso a los últimos modelos abiertos a un coste razonable, sin compartir datos, a través de la comunidad NaN.

nan.builders →
Startups y empresas

Inferencia privada y dedicada con SLAs.

Infraestructura dedicada, soporte y SLAs contractuales, tarifa plana, datos en la UE, compatible con OpenAI.

ver_precios →

Metodología. Las cifras son contadores agregados y anonimizados recogidos a nivel de petición. Helmcode no guarda logs, nunca se almacena contenido de prompts ni respuestas. Las métricas acumuladas cubren toda la vida de la plataforma; las métricas por ventana se indican en cada sección.

// empezar

EMPIEZA A QUEMAR TOKENS

Olvídate de la infra de IA. Despliega hoy el primer endpoint de inferencia privada.

Tarifa plana. Datos en la UE. Compatible con la API de OpenAI.