GLM 5.3 ya disponible en Helmcode
GLM 5.3 empata con Kimi K3 en lo más alto de los modelos abiertos y corre en nuestra infraestructura europea con 1M de contexto y los mismos 150 € al mes.
6 entradas
GLM 5.3 empata con Kimi K3 en lo más alto de los modelos abiertos y corre en nuestra infraestructura europea con 1M de contexto y los mismos 150 € al mes.
Cómo diseñar sistemas multi-modelo donde un LLM abierto planifica, otro ejecuta y el contexto que se pasan entre ellos es eficiente.
GLM 5.2, el modelo abierto MIT de 744B, ya corre en la infraestructura europea de Helmcode con zero logs y tarifa plana de 150 euros al mes.
117 billion tokens, 3.68 million requests, 21 countries, and 99.98% uptime. NaN is a community of builders with its own inference infrastructure and a private platform to deploy apps and agents.
In this post we'll learn what parameters and quantization are, so we can figure out how much space AI models take up.
In this post I'll walk you through how the community's inference servers are set up: the hardware we use, the stack we run, and the models we serve.
// cookies
Solo usamos cookies estrictamente necesarias para que el sitio funcione. Nada de analítica ni publicidad, nunca — consulta la Política de cookies.
// preferencias