// despliegue

Mismo stack.
El nivel de soberanía que necesites.

Inferencia privada en un cluster compartido de la UE, en hardware Blackwell dedicado o íntegramente dentro de tu datacenter. Misma API, mismo código. Tú eliges hasta dónde llega la soberanía.

// el espectro

Un stack, tres niveles de control.

En función de lo que necesites, puedes decidir si nosotros nos ocupamos de la infraestructura o si todo corre en la tuya.

// modelos de despliegue

Elige dónde corre.

Tres formas de desplegar exactamente el mismo stack de inferencia. El código es idéntico. Lo que cambia es quién posee el hardware y dónde se procesan tus datos.

Shared

Gestionado · cluster compartido UE

Infraestructura compartida en la UE.

La forma más rápida de poner inferencia privada en producción. Un cluster gestionado en la UE, sin logs y nativo en GDPR, sin provisionar una sola GPU.

Mejor para
Equipos pequeños/medianos que van rápido
Dónde corre
Cluster Helmcode UE
Aislamiento
Rate limits por API key
Setup
Inmediato
SLA
99,5% en Growth
Desde
399€ / mes

Dedicated

Hardware exclusivo · Helmcode UE

Hardware Blackwell exclusivo.

Hardware NVIDIA Blackwell reservado en exclusiva dentro de la infraestructura europea de Helmcode, throughput garantizado, aislamiento de red completo y soporte para modelos custom o fine-tuned.

Mejor para
Uso intensivo, compliance estricto
Dónde corre
Helmcode UE · aislado
Aislamiento
Aislamiento de red completo
Setup
Inmediato
SLA
A medida
Desde
Precio a medida

On-premise

Tu datacenter · operado por nosotros

Se ejecuta en tu datacenter.

Desplegamos y operamos todo el stack de inferencia dentro del datacenter, o el de un partner. Los datos no se mueven. Ni un solo token sale de la red.

Mejor para
Banca, defensa, sector público
Dónde corre
Tu datacenter o el nuestro
Aislamiento
Air-gappable
Setup
Semanas · llave en mano
SLA
A medida
Desde
Precio a medida
Listo para banca, salud, defensa y sector público.

// lado a lado

Las diferencias que importan.

Todo es igual salvo soberanía, hardware y SLA. Aquí es donde los tres divergen.

Shared Dedicated On-premise
Dónde se procesa el dato Cluster Helmcode UE Helmcode UE · aislado Tu datacenter · operado por nosotros
Hardware GPUs compartidas B200, exclusiva Hardware propio o nuestro
Aislamiento de red Lógico (por key) Aislamiento de red completo Air-gappable
Modelos custom / fine-tuned No
Tiempo de setup Inmediato Inmediato Semanas · llave en mano
SLA de uptime 99,5% en Growth A medida A medida
Precio de inicio 399€ / mes A medida A medida

// totalmente gestionado

Sea de quien sea el hardware, nosotros llevamos el stack.

El despliegue cambia dónde corre la inferencia, nunca quién la mantiene viva. En los tres modelos, Helmcode provisiona, monitoriza y opera todo el stack para que tu equipo no toque una GPU.

  • Provisioning y monitorización de GPU
  • Instalación y config de vLLM
  • Gestión de versiones de modelo
  • Rate limiting y concurrencia
  • Upgrades de hardware
  • Gestión de SLA

// sectores regulados

Adaptado al cumplimiento de cada sector.

Dónde pueden vivir legalmente tus datos decide cómo despliegas. Un punto de partida para las industrias más reguladas que servimos.

Banca y fintech

Dedicated / On-premise

DORA, GDPR y residencia del dato con aislamiento de red completo.

Salud

Dedicated / On-premise

Los datos de pacientes no salen de un perímetro controlado y auditable.

Legal y legaltech

Shared / Dedicated

Documentos privilegiados procesados solo en la UE, sin logs.

Sector público y defensa

On-premise

Soberano y air-gappable, ningún token sale de tu red.

// migración

Subir de nivel es un cambio de config.

Como los tres hablan la misma API compatible con OpenAI, pasar de shared a dedicated a on-premise no toca tu código de aplicación.

  1. 01

    Empieza en Shared

    Consigue una API key, apunta el SDK a la base URL de Helmcode y despliega el mismo día.

  2. 02

    Escala cuando haga falta

    ¿Compliance más estricto o más carga? Pasas a Dedicated u On-premise y lo provisionamos nosotros.

  3. 03

    Cambia la base URL

    Reapunta la base URL y la key al nuevo despliegue. Mismos modelos, mismo código, cero reescritura.

// faq de despliegue

Despliegue, respondido.

Lo que preguntan los equipos antes de elegir dónde corre la inferencia.

¿Se puede empezar en Shared y pasar a Dedicated u On-premise después?

Sí, ese es el objetivo. Los tres corren el mismo stack tras la misma API compatible con OpenAI. Subir de nivel es cambiar la base URL y la key; tu código de aplicación no cambia.

¿Dónde está exactamente la infraestructura de la UE?

Shared y Dedicated corren en infraestructura de Helmcode dentro de la UE, nunca en hyperscalers estadounidenses sujetos al Cloud Act. La inferencia se procesa en la región y sin logs, conforme a GDPR y AI Act por cómo está construida.

¿Qué hardware usa Dedicated?

NVIDIA B200, 192GB VRAM, 256GB DDR5, reservado en exclusiva. Lo provisionamos, monitorizamos y actualizamos; tú no tocas una GPU.

¿Quién opera un despliegue On-premise?

Nosotros. Helmcode despliega y opera todo el stack de inferencia dentro de tu datacenter o el de un partner, llave en mano. Tú te quedas con el dato y la red; nosotros mantenemos sanas las GPUs, vLLM y los modelos.

¿Se puede air-gappear el On-premise?

Sí. Para los entornos más estrictos, el despliegue puede funcionar totalmente aislado, sin conectividad saliente. Ni un solo token sale de tu red.

¿Se usan datos de cliente para entrenar un modelo?

Nunca, en ningún modelo de despliegue. La ausencia de logs es una propiedad de la arquitectura: prompts y completions no se almacenan, y nada de lo que envías entrena un modelo.

// empezar

EMPIEZA A QUEMAR TOKENS

Olvídate de la infra de IA. Despliega hoy el primer endpoint de inferencia privada.

Tarifa plana. Datos en la UE. Compatible con la API de OpenAI.