Docs

Configura tu agente

Casi cualquier herramienta de código con IA se conecta a Helmcode con los mismos dos valores: la base URL y tu API key. Lo que cambia de una a otra es dónde se escriben.

CampoValor
Base URLhttps://api.helmcode.com/v1
API keyla tuya, desde la consola — empieza por sk-

Todas las páginas de esta sección tienen la misma forma: qué necesitas, la configuración exacta con la ruta del fichero, cómo comprobar que funciona y los problemas conocidos.

Elige tu herramienta

¿La tuya no está? Si acepta una base URL de OpenAI y una API key, funciona. Copia los dos valores de la tabla de arriba y pega el id del modelo exactamente como aparece en Modelos.

Lo de «exactamente como aparece» no es una forma de hablar: un id que no servimos vuelve como un 401 diciendo que tu key no tiene acceso a ese modelo, no como un not-found. `glm-5.3` y `glm5.3` se diferencian en una errata y solo uno existe, y el error del otro se lee como un problema de plan.

Al margen de los modelos, Helmcode expone su búsqueda web como herramienta para cualquier agente compatible con MCP — incluido Claude Code, use los modelos que use. Eso es el servidor MCP.

¿Lo que quieres es construir tu propio agente contra la API, en vez de conectar uno? Eso está en Agentes.

Por qué funcionan casi todas

Helmcode expone una API compatible con OpenAI. Las rutas, los campos de la petición y la forma de la respuesta son los que estas herramientas ya esperan, así que para ellas Helmcode es indistinguible de OpenAI salvo por la dirección a la que llaman.

La excepción es Claude Code, que no habla ese formato sino el de Anthropic. No es un problema de credenciales: son dos protocolos distintos. Por eso su página explica los dos caminos que hay.

Qué modelo poner

Casi todas estas herramientas te piden un id de modelo además de la base URL y la key. Para trabajo agéntico, el orden sensato es:

  1. glm5.3-flash — el valor por defecto para sesiones de agente: ventana de 1M, y cuenta contra la cuota mensual que ya incluye cualquier plan.
  2. deepseek-v4-flash — el otro modelo de 1M sobre esa misma cuota — tira de él cuando el razonamiento tiene que aguantar un refactor largo.
  3. qwen3.6 — cuando la tarea está acotada y quieres la respuesta ya — aproximadamente el doble de tokens por segundo, sobre una ventana de 256K.

glm5.3 — el de 744B, no el Flash — es un add-on con su propia bolsa de tokens en vez de ir incluido en el plan, así que no estandarices un equipo sobre él sin comprobar que tu organización lo tiene.

La lista completa, con especificaciones y capacidades, está en Modelos.

Warning: Cuidado con el contexto que declaras. Varias de estas herramientas te dejan escribir a mano la ventana de contexto del modelo. Pon un número mayor que el real y el agente llenará la conversación hasta un punto en el que la API empieza a rechazar peticiones. Ponlo menor y solo compactará antes de lo necesario. En la duda, quédate corto.