// changelog

Cada cambio
publicado.

Registro de lo que sale a producción, modelos, API, rendimiento y plataforma. Sin marketing, solo los diffs.

platform
Nuevo

GLM 5.2, el modelo abierto más potente de la plataforma

El modelo MIT de 744B ya corre en nuestro hardware europeo con zero logs. Es un add-on que añades a cualquier plan enterprise, no algo que el plan cubra: suma tantas API keys con GLM 5.2 como necesites.

  • 150 € al mes por API key
  • 500K de contexto, 100 rpm, 3M tokens por minuto
  • Cupo mensual por tier: 2B, 6,5B y 18B tokens
platform
Nuevo

RAG + Chat

Carga archivos o conecta un repositorio como base de conocimiento y pregúntale directamente desde el Chat. La búsqueda y el modelo corren sobre la misma infraestructura privada.

  • Archivos y repositorios de GitHub
  • Guía en /docs/knowledge-base
api
NuevoAPI

Generación de imágenes con Flux-2-klein

Genera imágenes desde el dashboard de Helmcode o desde la API, con la misma key que ya usas.

platform
Mejorado

2× throughput en Qwen 3.6

Decodificación especulativa activada por defecto en qwen3.6, el doble de tokens por segundo a la misma latencia, sin tocar nada.

api
NuevoAPI

Endpoint de reranking

Endpoint dedicado /v1/rerank para reranking semántico multilingüe, la pieza que faltaba en el pipeline RAG (embedding → rerank → LLM).

  • Con Qwen3-Reranker-8B
  • Más de 100 idiomas
console
Seguridad

Atestación sin logs en la consola

Cada API key muestra una atestación en vivo de que no se almacena contenido de prompts ni respuestas, algo que el equipo de compliance puede capturar directamente.

platform
Nuevo

Planes de GPU dedicada

Hardware exclusivo NVIDIA B200 en infraestructura europea de Helmcode, throughput garantizado, aislamiento de red completo y modelos personalizados.

  • Modelos personalizados y fine-tuning
  • SLA personalizado
platform
Mejorado

Arranques en frío más rápidos, p95 más bajo

Carga de modelos y enrutado del control plane rediseñados. Arranques en frío sensiblemente más rápidos y latencia p95 a la baja en todos los modelos.

api
NuevoAPI

Voz: TTS y STT

Text-to-speech con Kokoro (latencia inferior a un segundo, 67 voces) y speech-to-text con Whisper Large v3 (99+ idiomas), ambos con la misma key.

  • /v1/audio/speech y /v1/audio/transcriptions
api
Corregido

Streaming con tool calls

Resuelto un caso límite donde las respuestas en streaming podían truncarse al intercalar tool calls con contenido. Streaming estable en todos los modelos de chat.

Eso es todo de momento, se actualiza con cada release.