guía de modelos abiertos · septiembre 2026

El modelo abierto correcto para cada caso de uso.

82 casos de uso empresariales y el modelo open-weight que resuelve cada uno. Sin APIs cerradas: todo lo que hay aquí se puede descargar, auditar y ejecutar bajo tu control.

selector rápido

Dos preguntas, un modelo.

Elige el tipo de tarea y tu restricción principal. La recomendación se actualiza al momento; abajo tienes los 82 casos en detalle.

¿Qué tipo de tarea?

¿Cuál es tu restricción principal?

Qwen3.8-27BAPACHE 2.0

Lo más nuevo de la generación Qwen y el mejor escritor abierto que cabe en una máquina: 52 en el índice de Artificial Analysis, Apache 2.0 y multilingüe nativo con buen español.

Apache 2.0262K→1M ctx27B densoimagen + vídeo pronto en Helmcode self-host o proveedor

ver_los_casos_de_este_modelo →

los 82 casos

Cada caso de uso, su modelo abierto.

Filtra por área o complejidad. Cada ficha da la recomendación principal, la alternativa y por qué. Los distintivos bajo el nombre del modelo dicen dónde puedes ejecutarlo sin alojarlo tú: en Helmcode hoy, en el clúster de NaN.builders o pronto en Helmcode.

11 modelos abiertos cubren los 82 casos. Pulsa uno para ver solo los suyos.

área
complejidad
modelo:
01
Universal Baja

Resumir emails largos

Modelo abierto recomendado

Gemma 4 26B

disponible en Helmcode

Apache 2.0 · 256K ctx · 25,2B/3,8B act · multimodal

Complejidad baja y volumen alto, así que decide la factura: $0.04 por tarea con 3,8B de parámetros activos, y 256K de contexto sostienen un hilo que nadie quiere leerse dos veces.

Alternativa abierta: DeepSeek V4 Flash, para hilos que pidan la ventana de 1M

Caso de uso: Resúmenes →

02
Universal Media

Redactar emails profesionales

Modelo abierto recomendado

Gemma 4 26B

disponible en Helmcode

Apache 2.0 · 256K ctx · 25,2B/3,8B act · multimodal

La empresa entera escribe emails todo el día, y muchas veces no en un solo idioma, así que deciden la cobertura y el coste por mensaje: más de 35 idiomas de fábrica, 140 en el preentrenamiento y $0.04 por tarea con 3,8B de parámetros activos. Multilingüe de diseño, fine-tuneable con la forma de escribir de tu equipo, y en nuestra tarifa plana.

Alternativa abierta: Qwen3.8-27B, 27B densos en una sola máquina

Caso de uso: Generación de contenido →

03
Universal Baja

Resumir documentos muy largos

Modelo abierto recomendado

Qwen3.8-Flash-Next

disponible en NaN.builders pronto en Helmcode

Qwen Community 1.0 · 262K→1M ctx · 125B/6B act · imagen + vídeo

1M de contexto se traga un informe, un expediente o un libro de una pasada, sin chunking, y el 56 en el índice de Artificial Analysis es lo que dice que lo ha entendido. La ventana solo dice qué cabe. Su licencia no es libre, así que revísala.

Alternativa abierta: DeepSeek V4 Flash, la misma ventana al suelo de precio del mercado

Caso de uso: Resúmenes →

04
Universal Media

Transcribir y resumir reuniones

Modelo abierto recomendado

Whisper large-v3-turbo

disponible en Helmcode · Whisper large-v3

MIT · 809M · 99 idiomas · tiempo real

Whisper large-v3-turbo transcribe la grabación entera sin tope de duración, con 809M de parámetros y licencia MIT, y V4 Flash la convierte en acta.

Alternativa abierta: Whisper large-v3 en nuestra tarifa plana, 4,1% de error por palabra frente al 4,6% de turbo

Caso de uso: Voz y transcripción →

05
Universal Baja

RAG sobre documentación interna

Modelo abierto recomendado

DeepSeek V4 Flash 0731

disponible en Helmcode

MIT · 1M ctx · 284B/13B act

El contexto ya viene recuperado: extracción + redacción con citado preciso. Para docs confidenciales, self-host es la única opción válida.

Alternativa abierta: Qwen 3.6 35B

Caso de uso: RAG sobre conocimiento interno →

06
Universal Baja

Priorizar la bandeja de entrada

Modelo abierto recomendado

Gemma 4 26B

disponible en Helmcode

Apache 2.0 · 256K ctx · 25,2B/3,8B act · multimodal

Clasificación con criterios claros en milisegundos, en una GPU, sobre cada email que entra. Solo 3,8B de sus 25,2B parámetros se activan por token, que es lo que mantiene baja la factura por mensaje.

Alternativa abierta: DeepSeek V4 Flash

Caso de uso: Clasificación y triaje →

07
Universal Baja

Crear tareas desde emails y chats

Modelo abierto recomendado

Gemma 4 26B

disponible en Helmcode

Apache 2.0 · 256K ctx · 25,2B/3,8B act · multimodal

Extracción de entidades (qué, quién, cuándo) con JSON fiable, sobre todo lo que escribe el equipo en un día. A ese volumen decide el coste, y 3,8B de parámetros activos son el escalón más barato del tablero.

Alternativa abierta: DeepSeek V4 Flash

Caso de uso: Agentes autónomos →

08
Universal Baja

Seguimientos automáticos de email

Modelo abierto recomendado

Qwen3.8-27B

pronto en Helmcode

Apache 2.0 · 262K→1M ctx · 27B denso · imagen + vídeo

Los seguimientos deben sonar humanos, no automáticos. La misma huella densa de 27B que el Qwen3.6-27B al que sustituye, y catorce puntos más que él en el índice.

Alternativa abierta: Qwen 3.6 35B, el MoE que servimos en tarifa plana

Caso de uso: Agentes autónomos →

09
Universal Media

Corregir y mejorar textos

Modelo abierto recomendado

Qwen3.8-27B

pronto en Helmcode

Apache 2.0 · 262K→1M ctx · 27B denso · imagen + vídeo

Editar es respetar la voz del autor en vez de reescribirla. Multilingüe de diseño, 27B densos que caben en una máquina, y bastante barato para pasarlo por todo lo que escribe el equipo.

Alternativa abierta: GLM-5.3-Flash, o Qwen 3.6 35B en tarifa plana

Caso de uso: Generación de contenido →

10
Universal Baja

Traducción masiva

Modelo abierto recomendado

Gemma 4 26B

disponible en Helmcode

Apache 2.0 · 256K ctx · 25,2B/3,8B act · multimodal

Ningún modelo abierto de esta página cubre más idioma por menos: más de 35 idiomas de fábrica, 140 en el preentrenamiento, Apache 2.0 y 3,8B de parámetros activos por token, que es lo que hace asequible traducir un catálogo entero.

Alternativa abierta: Qwen3.8-27B para adaptación cultural fina, o V4 Flash en los volúmenes más altos

Caso de uso: Traducción →

11
Universal Baja

Búsqueda semántica en la KB

Modelo abierto recomendado

qwen3-embedding + rerank

disponible en Helmcode

Apache 2.0 · embeddings

El 50% olvidado de todo RAG: embeddings + reranking de calidad deciden más que el modelo generador.

Alternativa abierta: DeepSeek V4 Flash (síntesis)

Caso de uso: Búsqueda semántica y recomendación →

12
Universal Baja

Reranking de resultados de búsqueda

Modelo abierto recomendado

qwen3-embedding + rerank

disponible en Helmcode

Apache 2.0 · embeddings

Reordenar los top-k recuperados multiplica la precisión del RAG con un coste marginal mínimo.

Alternativa abierta: Gemma 4 26B como cross-encoder

Caso de uso: Búsqueda semántica y recomendación →

13
Universal Baja

Generar FAQs desde documentación

Modelo abierto recomendado

DeepSeek V4 Flash 0731

disponible en Helmcode

MIT · 1M ctx · 284B/13B act

Comprensión + reformulación en lenguaje de usuario. Ideal para manuales y políticas que no pueden salir a APIs externas.

Alternativa abierta: Qwen3.8-27B

Caso de uso: Generación de contenido →

14
Universal Media

Informes ejecutivos

Modelo abierto recomendado

GLM-5.3-Flash

disponible en NaN.builders pronto en Helmcode

MIT · 1M ctx · 320B/18B act · imagen + vídeo

Síntesis de datos + narrativa: el mejor razonamiento abierto siguiendo plantillas estructuradas complejas y, desde el 26 de agosto, el mejor cuesta la quinta parte.

Alternativa abierta: GLM-5.3, que servimos en tarifa plana

Caso de uso: Generación de contenido →

15
Universal Media

Presentaciones desde datos

Modelo abierto recomendado

GLM-5.3-Flash

disponible en NaN.builders pronto en Helmcode

MIT · 1M ctx · 320B/18B act · imagen + vídeo

Una conclusión por slide, título = mensaje. Integrado con python-pptx o reveal.js: pipeline completo datos → deck.

Alternativa abierta: GLM-5.3 en tarifa plana, o Qwen 3.6 35B en una máquina

Caso de uso: Generación de contenido →

16
Universal Media

Redacción de políticas y procedimientos

Modelo abierto recomendado

Qwen3.8-27B

pronto en Helmcode

Apache 2.0 · 262K→1M ctx · 27B denso · imagen + vídeo

Lenguaje preciso y consistencia terminológica en documentos largos. Contenido interno que no debería salir de casa.

Alternativa abierta: GLM-5.3-Flash, o Qwen 3.6 35B en tarifa plana

Caso de uso: Generación de contenido →

17
Universal Media

Agente de reuniones (agenda + acta)

Modelo abierto recomendado

DeepSeek V4 Flash 0731

disponible en Helmcode

MIT · 1M ctx · 284B/13B act

Una reunión de 1-3h son 50-150K tokens, así que 1M de contexto sostiene una semana entera. Whisper large-v3-turbo transcribe y V4 Flash escribe la agenda y el acta, en self-hosting.

Alternativa abierta: GLM-5.3-Flash para reuniones que acaban en una decisión

Caso de uso: Agentes autónomos →

18
Universal Baja

Resumen de noticias e inteligencia

Modelo abierto recomendado

DeepSeek V4 Flash 0731

disponible en Helmcode

MIT · 1M ctx · 284B/13B act

RSS/scraping → resumen y clasificación en batch → dashboard. Coste por artículo prácticamente cero.

Alternativa abierta: Gemma 4 26B

Caso de uso: Resúmenes →

19
Universal Baja

Detección de urgencia en mensajes

Modelo abierto recomendado

Gemma 4 26B

disponible en Helmcode

Apache 2.0 · 256K ctx · 25,2B/3,8B act · multimodal

Una de las tareas más simples del listado: latencia de milisegundos on-premise, en una GPU, con 3,8B de sus 25,2B parámetros activos por token.

Alternativa abierta: DeepSeek V4 Flash

Caso de uso: Clasificación y triaje →

20
Universal Baja

Gestión de pipeline de proyectos

Modelo abierto recomendado

DeepSeek V4 Flash 0731

disponible en Helmcode

MIT · 1M ctx · 284B/13B act

Estado de tareas, alertas y resúmenes. Los hitos y responsables de proyectos de cliente no salen de la red interna.

Alternativa abierta: Qwen3.8-27B

Caso de uso: Agentes autónomos →

21
Universal Media

Research sobre documentos propios

Modelo abierto recomendado

GLM-5.3-Flash

disponible en NaN.builders pronto en Helmcode

MIT · 1M ctx · 320B/18B act · imagen + vídeo

El mejor razonamiento abierto para sintetizar fuentes ya recopiladas, con 1M de contexto para sostenerlas. Combínalo con scraping propio para la captura.

Alternativa abierta: GLM-5.3, o DeepSeek V4 Pro 0813

Caso de uso: Investigación →

22
Código & IT Alta

Generación de código

Modelo abierto recomendado

GLM-5.3

disponible en Helmcode

Licencia GLM-5.3 (custom) · 1M ctx · 744B · solo texto

Pesos públicos desde el 25 de agosto, y empata con Kimi K3 con la mitad de pesos: 88.2 en Terminal Bench 2.1 frente al 88.3 de K3, y 28.3 en Terminal Bench 3.0 frente a su 17.4, cifras de Z.ai. Lo servimos en tarifa plana, así que las dos cosas que hay que prever solo aplican si lo corres tú: 755 GB, unos dos nodos de 8 GPUs, y una licencia que es MIT más una cláusula dirigida a los proveedores de modelos de 10.000 millones.

Alternativa abierta: Kimi K3, o GLM-5.3-Flash cuando el presupuesto es un nodo

Caso de uso: Copilotos profesionales →

23
Código & IT Alta

Agentes de coding autónomos

Modelo abierto recomendado

GLM-5.3-Flash

disponible en NaN.builders pronto en Helmcode

MIT · 1M ctx · 320B/18B act · imagen + vídeo

El líder abierto en coding agéntico, y el 26 de agosto amplió la ventaja: Z.ai publica 84.3 en Terminal Bench 2.1 y 63.4 en DeepSWE, cifras propias, frente al 81.0 de GLM-5.2.

Alternativa abierta: GLM-5.3, que servimos en tarifa plana

Caso de uso: Agentes autónomos →

24
Código & IT Media

Code review automático

Modelo abierto recomendado

DeepSeek V4 Flash 0731

disponible en Helmcode

MIT · 1M ctx · 284B/13B act

Razona sobre el diff completo para detectar bugs, deuda y fallos de seguridad. Si pasa por aquí cada pull request, decide el precio: $0.11 por tarea frente a los $0.27 de V4 Pro, y no sale de tu infra.

Alternativa abierta: GLM-5.3 en tarifa plana cuando la revisión va de seguridad (84,5 en CyberGym, la mejor cifra abierta), o DeepSeek V4 Pro 0813 para los diffs más difíciles

Caso de uso: Copilotos profesionales →

25
Código & IT Media

Generación de tests

Modelo abierto recomendado

DeepSeek V4 Flash 0731

disponible en Helmcode

MIT · 1M ctx · 284B/13B act

Cobertura de casos límite y mocks coherentes, al menor precio por tarea del campo abierto. DeepSeek publica que Flash 0731 gana al preview de V4 Pro en sus nueve benchmarks de agente.

Alternativa abierta: GLM-5.3-Flash, o DeepSeek V4 Pro 0813

Caso de uso: Copilotos profesionales →

26
Código & IT Alta

Migraciones y refactors largos

Modelo abierto recomendado

GLM-5.3-Flash

disponible en NaN.builders pronto en Helmcode

MIT · 1M ctx · 320B/18B act · imagen + vídeo

Refactors multi-archivo de horas, donde el modelo sostiene el repo y su propio plan a la vez: 1M de contexto, y 328 GB de pesos frente al 1,5 TB que pedía GLM-5.2 para lo mismo.

Alternativa abierta: GLM-5.3, que servimos en tarifa plana

Caso de uso: Migración de código →

27
Código & IT Baja

SQL desde lenguaje natural

Modelo abierto recomendado

Qwen3.8-27B

pronto en Helmcode

Apache 2.0 · 262K→1M ctx · 27B denso · imagen + vídeo

Text-to-SQL sobre tu esquema con few-shot. Esto es código, así que la generación importa: Alibaba publica un 90.3 en LiveCodeBench v6. El esquema es información sensible: mejor en casa.

Alternativa abierta: Qwen 3.6 35B, o V4 Flash

Caso de uso: Copilotos profesionales →

28
Código & IT Media

Documentación técnica automática

Modelo abierto recomendado

GLM-5.3-Flash

disponible en NaN.builders pronto en Helmcode

MIT · 1M ctx · 320B/18B act · imagen + vídeo

Lee el código y escribe la doc, sosteniendo la coherencia entre módulos de un codebase grande. Z.ai publica un 84.3 en Terminal Bench 2.1 para ese trabajo largo, con 1M de contexto.

Alternativa abierta: GLM-5.3 en tarifa plana, o Qwen3.8-27B en una máquina

Caso de uso: Generación de contenido →

29
Código & IT Baja

Agente de soporte L1 / helpdesk IT

Modelo abierto recomendado

DeepSeek V4 Flash 0731

disponible en Helmcode

MIT · 1M ctx · 284B/13B act

Resuelve el 80% de consultas L1 cargando toda la KB en contexto. Datos de empleados y sistemas: dentro de la red.

Alternativa abierta: Gemma 4 26B

Caso de uso: Atención al cliente →

30
Código & IT Alta

Análisis de logs y causa raíz (RCA)

Modelo abierto recomendado

GLM-5.3-Flash

disponible en NaN.builders pronto en Helmcode

MIT · 1M ctx · 320B/18B act · imagen + vídeo

Razonamiento multi-paso conectando eventos no relacionados, con metodología (5 Porqués, Ishikawa). Logs confidenciales: self-host.

Alternativa abierta: GLM-5.3, o DeepSeek V4 Pro 0813

Caso de uso: Agentes autónomos →

31
Código & IT Media

Frontend y UI desde mockups

Modelo abierto recomendado

Qwen3.8-27B

pronto en Helmcode

Apache 2.0 · 262K→1M ctx · 27B denso · imagen + vídeo

Lee el mockup y escribe el componente, con visión nativa y coding de generación actual en los mismos 27B de pesos. Pedía un cluster de 64 GPUs hasta agosto; ahora pide una máquina.

Alternativa abierta: Qwen3.8-Flash-Next si los mockups justifican un cluster

Caso de uso: Copilotos profesionales →

32
Código & IT Baja

Generación de datos sintéticos

Modelo abierto recomendado

DeepSeek V4 Flash 0731

disponible en Helmcode

MIT · 1M ctx · 284B/13B act

Datasets de entrenamiento y prueba a coste marginal cero. La licencia MIT no restringe el uso de las salidas.

Alternativa abierta: Qwen 3.6 35B

Caso de uso: Datos sintéticos →

33
Código & IT Baja

Detección de PII y anonimización

Modelo abierto recomendado

Gemma 4 26B

disponible en Helmcode

Apache 2.0 · 256K ctx · 25,2B/3,8B act · multimodal

Fine-tuneado con tus categorías de datos personales, corre en el borde del pipeline antes de que nada salga.

Alternativa abierta: DeepSeek V4 Flash

Caso de uso: Anonimización →

34
Voz & Multimodal Baja

Transcripción de llamadas (STT)

Modelo abierto recomendado

Whisper large-v3-turbo

disponible en Helmcode · Whisper large-v3

MIT · 809M · 99 idiomas · tiempo real

Transcripción pura a volumen de call center, y gana el modelo que usa todo el mundo: 809M de parámetros, MIT, 99 idiomas y un 4,6% de error por palabra según Artificial Analysis.

Alternativa abierta: Whisper large-v3 cuando decide la precisión, en nuestra tarifa plana

Caso de uso: Voz y transcripción →

35
Voz & Multimodal Baja

Voicebots y síntesis de voz (TTS)

Modelo abierto recomendado

Chatterbox Multilingual

MIT · 500M · 23 idiomas · clonado de voz

23 idiomas, el español entre ellos, clonado de voz con unos segundos de referencia, MIT y 500M de parámetros. Un voicebot abierto completo: Whisper → LLM → Chatterbox. Kokoro solo habla inglés.

Alternativa abierta: Kokoro, solo para inglés y con la huella más pequeña

Caso de uso: Voz y transcripción →

36
Voz & Multimodal Baja

OCR + extracción de escaneados

Modelo abierto recomendado

Qwen3.8-27B

pronto en Helmcode

Apache 2.0 · 262K→1M ctx · 27B denso · imagen + vídeo

Lee la imagen del documento y devuelve los campos como JSON de una pasada, con hasta 16.384 tokens visuales por página para que la letra pequeña siga legible, y por eso aquí la elección es el LLM que ya tienes en marcha. Si el OCR es todo el trabajo, gana un especialista: GLM-OCR son 0,9B con licencia MIT y lidera OmniDocBench v1.5 con 94.62.

Alternativa abierta: GLM-OCR cuando el pipeline es OCR puro, Qwen3.8-Flash-Next para el nivel de máxima precisión

Caso de uso: Extracción de documentos →

37
Voz & Multimodal Media

Análisis de imágenes de producto

Modelo abierto recomendado

Qwen3.8-Flash-Next

disponible en NaN.builders pronto en Helmcode

Qwen Community 1.0 · 262K→1M ctx · 125B/6B act · imagen + vídeo

QA visual, etiquetado de catálogo y verificación de assets. Alibaba publica un 88,5 frente al 85,9 del 27B en percepción del mundo real, que es el eje que decide este caso, y con 6B activos sobre 125B un catálogo entero sale asequible.

Alternativa abierta: Qwen3.8-27B en una máquina, o Gemma 4 26B en tarifa plana

Caso de uso: Inspección visual →

38
Voz & Multimodal Baja

Moderación multimodal

Modelo abierto recomendado

Gemma 4 26B

disponible en Helmcode

Apache 2.0 · 256K ctx · 25,2B/3,8B act · multimodal

Texto e imagen en la misma llamada, fine-tuneable con los criterios de tu plataforma para más consistencia que el zero-shot.

Alternativa abierta: Qwen3.8-27B, Apache 2.0 y fine-tuneable

Caso de uso: Inspección visual →

39
Ventas Alta

Propuestas comerciales desde briefing

Modelo abierto recomendado

Qwen3.8-27B

pronto en Helmcode

Apache 2.0 · 262K→1M ctx · 27B denso · imagen + vídeo

Escritura persuasiva con frameworks (SPIN, Challenger) y narrativa centrada en cliente, y cabeza suficiente para sostener el argumento en una propuesta larga.

Alternativa abierta: GLM-5.3-Flash, o el GLM-5.3 completo en tarifa plana

Caso de uso: Generación de contenido →

40
Ventas Baja

Scoring y priorización de leads

Modelo abierto recomendado

Gemma 4 26B

disponible en Helmcode

Apache 2.0 · 256K ctx · 25,2B/3,8B act · multimodal

Fine-tuneado con tu histórico de conversiones supera con mucho al zero-shot: la ventaja estructural del open source.

Alternativa abierta: DeepSeek V4 Flash

Caso de uso: Clasificación y triaje →

41
Ventas Baja

Seguimiento de oportunidades

Modelo abierto recomendado

DeepSeek V4 Flash 0731

disponible en Helmcode

MIT · 1M ctx · 284B/13B act

Briefings desde la actividad del CRM. Importes y clientes en negociación: inteligencia comercial que no debe salir.

Alternativa abierta: Qwen3.8-27B

Caso de uso: Agentes autónomos →

42
Ventas Media

Scripts de ventas y llamadas

Modelo abierto recomendado

Qwen3.8-27B

pronto en Helmcode

Apache 2.0 · 262K→1M ctx · 27B denso · imagen + vídeo

Manejo de objeciones y personalización por perfil. El argumentario es estrategia confidencial: self-host.

Alternativa abierta: Qwen 3.6 35B en tarifa plana, o GLM-5.3-Flash para las cuentas más difíciles

Caso de uso: Generación de contenido →

43
Ventas Alta

Preparación de negociaciones

Modelo abierto recomendado

GLM-5.3-Flash

disponible en NaN.builders pronto en Helmcode

MIT · 1M ctx · 320B/18B act · imagen + vídeo

El razonamiento estratégico abierto más sólido que cabe en una máquina: 57 en el índice de Artificial Analysis y 328 GB de pesos, frente a los 60 de GLM-5.3 con 755 GB y de Kimi K3 con 1,56 TB.

Alternativa abierta: GLM-5.3, que servimos en tarifa plana

Caso de uso: Investigación →

44
Marketing Media

Contenido de marketing

Modelo abierto recomendado

Qwen3.8-27B

pronto en Helmcode

Apache 2.0 · 262K→1M ctx · 27B denso · imagen + vídeo

Creatividad, copywriting y adaptación al tono de marca. Para alto volumen, el ahorro frente a API cerrada es sustancial.

Alternativa abierta: Qwen 3.6 35B en tarifa plana en los volúmenes más altos

Caso de uso: Generación de contenido →

45
Marketing Baja

Copies y variaciones A/B

Modelo abierto recomendado

Qwen3.8-27B

pronto en Helmcode

Apache 2.0 · 262K→1M ctx · 27B denso · imagen + vídeo

Decenas de variaciones por campaña a coste marginal cero, y lee la pieza igual que el brief: la visión nativa sobre imagen y vídeo viene en los mismos pesos.

Alternativa abierta: Qwen 3.6 35B, o V4 Flash en los volúmenes más altos

Caso de uso: Generación de contenido →

46
Marketing Baja

SEO: briefs y metadescripciones

Modelo abierto recomendado

DeepSeek V4 Flash 0731

disponible en Helmcode

MIT · 1M ctx · 284B/13B act

Generación estructurada en batch sobre todo el catálogo o el blog. Volumen alto, criterios claros: coste manda.

Alternativa abierta: Qwen3.8-27B

Caso de uso: Generación de contenido →

47
Marketing Baja

Análisis de sentimiento de reviews

Modelo abierto recomendado

Gemma 4 26B

disponible en Helmcode

Apache 2.0 · 256K ctx · 25,2B/3,8B act · multimodal

Miles de opiniones en batch con análisis por aspecto, a $0.04 por tarea. Lo que afina el resultado es el fine-tuning con el vocabulario de tu sector, y eso solo se puede con pesos abiertos.

Alternativa abierta: DeepSeek V4 Flash

Caso de uso: Clasificación y triaje →

48
Marketing Baja

Moderación de contenido

Modelo abierto recomendado

Gemma 4 26B

disponible en Helmcode

Apache 2.0 · 256K ctx · 25,2B/3,8B act · multimodal

Criterios propios de la plataforma fine-tuneados, con coste por mensaje prácticamente nulo, y el texto y la imagen pasan por la misma llamada.

Alternativa abierta: Qwen3.8-27B (fine-tune)

Caso de uso: Clasificación y triaje →

49
Atención al cliente Baja

Clasificar y enrutar tickets

Modelo abierto recomendado

Gemma 4 26B

disponible en Helmcode

Apache 2.0 · 256K ctx · 25,2B/3,8B act · multimodal

Multi-label en tiempo real, fine-tuneable con tu histórico de tickets para precisión específica del negocio.

Alternativa abierta: DeepSeek V4 Flash

Caso de uso: Clasificación y triaje →

50
Atención al cliente Baja

Respuesta automática a clientes (FAQ)

Modelo abierto recomendado

DeepSeek V4 Flash 0731

disponible en Helmcode

MIT · 1M ctx · 284B/13B act

Chatbot de atención con datos de cliente bajo RGPD: el self-hosting no es opcional en sectores regulados.

Alternativa abierta: Qwen3.8-27B

Caso de uso: Atención al cliente →

51
Atención al cliente Media

Gestión de reclamaciones

Modelo abierto recomendado

Qwen3.8-27B

pronto en Helmcode

Apache 2.0 · 262K→1M ctx · 27B denso · imagen + vídeo

Empatía + firmeza + solución concreta. Las reclamaciones contienen datos personales: procesamiento en casa.

Alternativa abierta: Qwen 3.6 35B en tarifa plana, o GLM-5.3-Flash

Caso de uso: Atención al cliente →

52
Atención al cliente Baja

Análisis de encuestas y NPS

Modelo abierto recomendado

Gemma 4 26B

disponible en Helmcode

Apache 2.0 · 256K ctx · 25,2B/3,8B act · multimodal

Clasificación temática y sentimiento sobre miles de respuestas abiertas, al menor coste por respuesta del tablero, sin que los datos personales salgan de infraestructura UE.

Alternativa abierta: DeepSeek V4 Flash

Caso de uso: Clasificación y triaje →

53
Atención al cliente Baja

Resúmenes de conversaciones de soporte

Modelo abierto recomendado

Qwen3.8-27B

pronto en Helmcode

Apache 2.0 · 262K→1M ctx · 27B denso · imagen + vídeo

Cierre automático de cada ticket con resumen para el CRM. Alto volumen, redacción correcta, una máquina.

Alternativa abierta: Qwen 3.6 35B, o V4 Flash en los volúmenes más altos

Caso de uso: Resúmenes →

54
RRHH Media

Screening de CVs y candidatos

Modelo abierto recomendado

Qwen3.8-27B

pronto en Helmcode

Apache 2.0 · 262K→1M ctx · 27B denso · imagen + vídeo

Distinguir evidencias de declaraciones genéricas, sin sesgos. Datos de candidatos = RGPD: despliegue local.

Alternativa abierta: GLM-5.3-Flash, o el GLM-5.3 completo en tarifa plana

Caso de uso: Revisión y QA de documentos →

55
RRHH Baja

Onboarding de nuevos empleados

Modelo abierto recomendado

DeepSeek V4 Flash 0731

disponible en Helmcode

MIT · 1M ctx · 284B/13B act

Toda la documentación de onboarding cabe en 1M de contexto, sin RAG y sin que las políticas internas salgan fuera.

Alternativa abierta: Gemma 4 26B

Caso de uso: RAG sobre conocimiento interno →

56
RRHH Alta

Evaluación de rendimiento

Modelo abierto recomendado

Qwen3.8-27B

pronto en Helmcode

Apache 2.0 · 262K→1M ctx · 27B denso · imagen + vídeo

Feedback constructivo con matices. Estos datos pueden acabar en procedimientos laborales: self-host + cifrado.

Alternativa abierta: GLM-5.3-Flash, o el GLM-5.3 completo en tarifa plana

Caso de uso: Generación de contenido →

57
RRHH Baja

Chatbot de RRHH para empleados

Modelo abierto recomendado

DeepSeek V4 Flash 0731

disponible en Helmcode

MIT · 1M ctx · 284B/13B act

Los datos de RRHH son los más sensibles de la empresa: las conversaciones no salen de la infraestructura corporativa.

Alternativa abierta: Qwen3.8-27B

Caso de uso: Copilotos profesionales →

58
RRHH Baja

Ofertas de empleo

Modelo abierto recomendado

Qwen3.8-27B

pronto en Helmcode

Apache 2.0 · 262K→1M ctx · 27B denso · imagen + vídeo

Redacción persuasiva con estructura definida, en español nativo, incluso para perfiles confidenciales.

Alternativa abierta: Qwen 3.6 35B

Caso de uso: Generación de contenido →

59
RRHH Media

Formación y materiales educativos

Modelo abierto recomendado

Qwen3.8-27B

pronto en Helmcode

Apache 2.0 · 262K→1M ctx · 27B denso · imagen + vídeo

Diseño instruccional con adaptación al nivel del alumno. En e-learning de volumen, el coste por módulo tiende a cero.

Alternativa abierta: Qwen 3.6 35B, el MoE que servimos en tarifa plana

Caso de uso: Generación de contenido →

60
RRHH Baja

Comunicación interna y newsletters

Modelo abierto recomendado

Qwen3.8-27B

pronto en Helmcode

Apache 2.0 · 262K→1M ctx · 27B denso · imagen + vídeo

Buen tono y estructura en una sola máquina. Las comunicaciones internas, fuera de APIs de terceros.

Alternativa abierta: Gemma 4 26B, o Qwen 3.6 35B

Caso de uso: Generación de contenido →

61
Finanzas Baja

Facturas y gastos (extracción)

Modelo abierto recomendado

Qwen3.8-27B

pronto en Helmcode

Apache 2.0 · 262K→1M ctx · 27B denso · imagen + vídeo

Procesa la imagen de la factura directamente y devuelve JSON estructurado, con hasta 16.384 tokens visuales por página frente a los 280 del Gemma que servimos. En un A4 escaneado, la letra pequeña es la que decide el importe. Pipeline 100% interno en una sola máquina, y si ese pipeline solo lee documentos, un especialista como GLM-OCR (0,9B, MIT) es todavía más eficiente.

Alternativa abierta: Gemma 4 26B, que servimos en tarifa plana

Caso de uso: Extracción de documentos →

62
Finanzas Alta

Análisis financiero y reporting

Modelo abierto recomendado

DeepSeek V4 Flash 0731

disponible en Helmcode

MIT · 1M ctx · 284B/13B act

Un punto de índice por detrás de V4 Pro a menos de la mitad de coste, y los mismos 1M de contexto para unas cuentas completas. Para cotizadas o M&A, el self-host es casi obligatorio.

Alternativa abierta: DeepSeek V4 Pro 0813, o GLM-5.3-Flash

Caso de uso: Análisis de documentos →

63
Finanzas Alta

Detección de riesgos y fraude

Modelo abierto recomendado

GLM-5.3-Flash

disponible en NaN.builders pronto en Helmcode

MIT · 1M ctx · 320B/18B act · imagen + vídeo

Patrones complejos sobre el historial completo de transacciones, y el 1M de contexto es la cifra publicada del propio modelo. En banca los datos no salen: cuentan los pesos MIT y descargables.

Alternativa abierta: GLM-5.3, o DeepSeek V4 Pro 0813

Caso de uso: Clasificación y triaje →

64
Finanzas Baja

Conciliación bancaria y punteo

Modelo abierto recomendado

DeepSeek V4 Flash 0731

disponible en Helmcode

MIT · 1M ctx · 284B/13B act

Mucho volumen de comparaciones cortas: apuntes del extracto contra los del libro mayor, marcando los casi-cuadres para que los vea una persona. Aquí decide el coste por token.

Alternativa abierta: Gemma 4 26B

Caso de uso: Revisión y QA de documentos →

65
Finanzas Alta

Análisis de riesgo crediticio

Modelo abierto recomendado

DeepSeek V4 Flash 0731

disponible en Helmcode

MIT · 1M ctx · 284B/13B act

Lee las cuentas y redacta el razonamiento detrás de un límite, ratio a ratio, a $0.11 por expediente. Un juicio de solvencia sobre una empresa con nombre se queda en casa, y lo firma una persona.

Alternativa abierta: GLM-5.3-Flash para los expedientes que van a comité

Caso de uso: Análisis de documentos →

66
Finanzas Media

Recobro y avisos de pago

Modelo abierto recomendado

Qwen3.8-27B

pronto en Helmcode

Apache 2.0 · 262K→1M ctx · 27B denso · imagen + vídeo

El mismo mensaje tiene que escalar del recordatorio al requerimiento formal sin perder al cliente, así que pesa más el registro que el razonamiento. 27B densos con Apache 2.0.

Alternativa abierta: Qwen 3.6 35B, el MoE que servimos en tarifa plana

Caso de uso: Generación de contenido →

67
Finanzas Baja

Control de política de gastos

Modelo abierto recomendado

Gemma 4 26B

disponible en Helmcode

Apache 2.0 · 256K ctx · 25,2B/3,8B act · multimodal

Criterio contra reglas claras, que es para lo que sirve esta talla: esta cena pasa del límite, este taxi no lleva asistentes. La política va en el prompt y cambia sin reentrenar nada, a $0.04 por tarea.

Alternativa abierta: DeepSeek V4 Flash

Caso de uso: Revisión y QA de documentos →

68
Legal Alta

Análisis de contratos y cláusulas

Modelo abierto recomendado

GLM-5.3-Flash

disponible en NaN.builders pronto en Helmcode

MIT · 1M ctx · 320B/18B act · imagen + vídeo

El máximo nivel abierto de comprensión de matices que puedes desplegar, con licencia MIT y model card publicados: auditable de punta a punta.

Alternativa abierta: GLM-5.3, o DeepSeek V4 Pro 0813

Caso de uso: Revisión y QA de documentos →

69
Legal Alta

Compliance y normativa

Modelo abierto recomendado

GLM-5.3-Flash

disponible en NaN.builders pronto en Helmcode

MIT · 1M ctx · 320B/18B act · imagen + vídeo

Con el AI Act aplicándose con carácter general desde el 2 de agosto de 2026, un stack abierto y trazable en infraestructura UE aporta la evidencia que necesita tu evaluación.

Alternativa abierta: GLM-5.3, que servimos en tarifa plana

Caso de uso: Revisión y QA de documentos →

70
Legal Baja

Clasificación documental legal

Modelo abierto recomendado

Qwen3.8-27B

pronto en Helmcode

Apache 2.0 · 262K→1M ctx · 27B denso · imagen + vídeo

Etiquetado y triaje de expedientes por materia, jurisdicción y urgencia sin que un solo folio salga del despacho.

Alternativa abierta: Qwen 3.6 35B en tarifa plana, o Gemma 4 26B

Caso de uso: Clasificación y triaje →

71
Legal Alta

Due diligence en data room

Modelo abierto recomendado

Kimi K3

Licencia K3 (custom) · 1M ctx · 2.8T/104B act · multimodal

Miles de documentos que solo significan algo leídos juntos, así que cuenta más razonar entre ellos que el tamaño de la ventana: K3 lidera entre los abiertos en AA-LCR con un 82.7%.

Alternativa abierta: GLM-5.3 en tarifa plana, el mismo índice con la mitad de pesos, o DeepSeek V4 Flash en hardware que ya tienes

Caso de uso: Análisis de documentos →

72
Legal Alta

Búsqueda de jurisprudencia y precedentes

Modelo abierto recomendado

GLM-5.3-Flash

disponible en NaN.builders pronto en Helmcode

MIT · 1M ctx · 320B/18B act · imagen + vídeo

Razonamiento que tiene que sostener una cadena de citas sin inventarse ninguna. Anclado con RAG a tu base de sentencias, nunca a la memoria del modelo.

Alternativa abierta: GLM-5.3, o DeepSeek V4 Pro 0813

Caso de uso: Investigación →

73
Legal Media

Redacción desde biblioteca de cláusulas

Modelo abierto recomendado

Qwen3.8-27B

pronto en Helmcode

Apache 2.0 · 262K→1M ctx · 27B denso · imagen + vídeo

Generar en vez de analizar: montar un primer borrador con cláusulas que legal ya ha aprobado, para que el equipo edite y no parta de cero.

Alternativa abierta: GLM-5.3-Flash, o Qwen 3.6 35B en tarifa plana

Caso de uso: Generación de contenido →

74
Legal Media

Vigilancia de cambios normativos

Modelo abierto recomendado

GLM-5.3-Flash

disponible en NaN.builders pronto en Helmcode

MIT · 1M ctx · 320B/18B act · imagen + vídeo

Vigilar qué ha cambiado en una norma y a qué políticas internas afecta. Es otro trabajo que comprobar el compliance: este corre antes de que nadie incumpla.

Alternativa abierta: DeepSeek V4 Flash

Caso de uso: Agentes autónomos →

75
Operaciones & Estrategia Baja

Gestión de proveedores y compras

Modelo abierto recomendado

DeepSeek V4 Flash 0731

disponible en Helmcode

MIT · 1M ctx · 284B/13B act

Comparativa de condiciones y alertas de vencimiento. Precios pactados = información comercial confidencial.

Alternativa abierta: GLM-5.3-Flash (todos los contratos a la vez, 1M ctx)

Caso de uso: Agentes autónomos →

76
Operaciones & Estrategia Media

Análisis de competencia y mercado

Modelo abierto recomendado

GLM-5.3-Flash

disponible en NaN.builders pronto en Helmcode

MIT · 1M ctx · 320B/18B act · imagen + vídeo

Razonamiento estructurado sobre fuentes ya recopiladas. Para captura web, combina con scraping propio.

Alternativa abierta: DeepSeek V4 Flash

Caso de uso: Investigación →

77
Operaciones & Estrategia Media

Respuestas a RFP y licitaciones

Modelo abierto recomendado

Qwen3.8-27B

pronto en Helmcode

Apache 2.0 · 262K→1M ctx · 27B denso · imagen + vídeo

Cientos de requisitos contestados uno a uno, cada uno trazable a un documento que ya tienes. La oferta es confidencial hasta que se abre el sobre.

Alternativa abierta: GLM-5.3-Flash, o el GLM-5.3 completo en tarifa plana

Caso de uso: Generación de contenido →

78
Operaciones & Estrategia Media

Cuestionarios de seguridad y riesgo de proveedor

Modelo abierto recomendado

GLM-5.3-Flash

disponible en NaN.builders pronto en Helmcode

MIT · 1M ctx · 320B/18B act · imagen + vídeo

Las mismas doscientas preguntas llegan de cada cliente con la redacción cambiada. Se contestan desde tu base de evidencias y una persona firma.

Alternativa abierta: DeepSeek V4 Flash

Caso de uso: Revisión y QA de documentos →

79
Operaciones & Estrategia Baja

Triaje de incidencias logísticas

Modelo abierto recomendado

DeepSeek V4 Flash 0731

disponible en Helmcode

MIT · 1M ctx · 284B/13B act

Miles de eventos cortos al día, cada uno con su destino: retraso, daño, dirección errónea o nada. El volumen elige el modelo.

Alternativa abierta: Gemma 4 26B

Caso de uso: Clasificación y triaje →

80
Operaciones & Estrategia Media

Inspección de calidad desde fotos

Modelo abierto recomendado

Qwen3.8-Flash-Next

disponible en NaN.builders pronto en Helmcode

Qwen Community 1.0 · 262K→1M ctx · 125B/6B act · imagen + vídeo

Lee la foto de la línea, o el vídeo, y redacta el informe de defecto contra tus propios criterios. Alibaba lo sitúa en un 88,5 en percepción del mundo real, su mejor cifra publicada entre todos los modelos con los que se compara, y un defecto que se escapa cuesta más que la inferencia.

Alternativa abierta: Qwen3.8-27B en una máquina, o Gemma 4 26B en tarifa plana

Caso de uso: Inspección visual →

81
Marketing Baja

Imágenes para campañas y redes

Modelo abierto recomendado

FLUX.2 [klein] 9B

disponible en Helmcode disponible en NaN.builders

FLUX Non-Commercial · 9B · ~29 GB VRAM · salida de imagen

Decenas de piezas por semana sin licencia de stock ni ronda de agencia: 9B de parámetros, unos 29 GB de VRAM y una generación en menos de un segundo. En nuestra tarifa plana, y en el clúster de NaN.builders. Su licencia no es libre, así que revísala antes de meterlo en un pipeline comercial.

Alternativa abierta: FLUX.2 [klein] 4B, la vía Apache 2.0 en una GPU de consumo, o Qwen-Image-2512

Caso de uso: Generación de contenido →

82
Marketing Media

Imagen de producto y variantes creativas

Modelo abierto recomendado

FLUX.2 [klein] 9B

disponible en Helmcode disponible en NaN.builders

FLUX Non-Commercial · 9B · ~29 GB VRAM · salida de imagen

Fondos, formatos y versiones de la misma foto: la edición admite varias imágenes de referencia y corre sobre los mismos pesos que generan, así que un catálogo es un modelo y no dos pipelines. En nuestra tarifa plana.

Alternativa abierta: Qwen-Image-2512, Apache 2.0, cuando la pieza se apoya en el texto dentro de la imagen

Caso de uso: Generación de contenido →

disponible en Helmcode (tarifa plana, UE, cero logs) disponible hoy en el clúster de NaN.builders anunciado para Helmcode, todavía no en servicio complejidad = exigencia de la tarea, no del despliegue Kimi K3, GLM-5.3, Qwen3.8-Flash-Next y FLUX.2 [klein] 9B vienen con términos propios y restricciones de uso: revísalos antes de construir

La distancia con los modelos cerrados solo existe en el borde de la frontera. Casi ningún trabajo real vive ahí.

En producción el 99,5% de nuestros tokens pasa por modelos abiertos, y no en las tareas fáciles: clasificar, extraer, resumir, redactar, responder y razonar sobre documentos que nadie más ha leído. Lo que queda es un puñado de problemas de frontera de verdad, y a esos se los enruta al modelo grande en vez de pagar precio de frontera por el otro 99,5%.

empezar

Empieza por un caso, no por una migración.

Coge un caso de la lista, apunta el mismo código a nuestro endpoint y lee las dos salidas una al lado de la otra.

La API que ya llamas. Una tarde. Nada que migrar.

Un proceso con volumen y criterio estable puede convertirse en un modelo pequeño y especializado, con los pesos a tu nombre y corriendo en mucho menos hardware. especialización_de_modelos →