Tu payes Claude Code pour rien

avril 2026 · 4 min de lecture

Ce guide t’explique comment configurer Cline et Claw pour utiliser GLM-5 via le endpoint OpenAI-compatible de NVIDIA.

L’objectif est simple :

  • utiliser z-ai/glm5 comme modele par defaut
  • passer par https://integrate.api.nvidia.com/v1
  • ne pas imposer de limite de sortie explicite inutile

Ce guide correspond au setup montre dans la video.

Liens utiles

Prerequis

Avant de commencer, il te faut :

  • une cle API NVIDIA
  • Cline installe si tu veux la version VS Code
  • Claw installe si tu veux la version terminal

Important :

  • ne colle jamais ta vraie cle API dans une video ou un screenshot
  • stocke-la dans un .env, un secret manager, ou dans la config locale de ton outil

1. Endpoint et modele a utiliser

Dans les deux outils, la base est la meme :

Base URL: https://integrate.api.nvidia.com/v1
Model: z-ai/glm5

2. Configurer Cline

Dans Cline, utilise un provider OpenAI compatible.

Renseigne les champs suivants :

Provider: OpenAI
Base URL: https://integrate.api.nvidia.com/v1
Model: z-ai/glm5
API Key: ta_cle_nvidia

Point important sur les tokens

Pour ce setup, ne renseigne pas de limite de sortie manuelle si tu veux eviter d’envoyer un max_tokens explicite.

En pratique :

  • choisis z-ai/glm5
  • ne force pas une valeur de sortie personnalisee

3. Configurer Claw

Variables d’environnement

Tu peux utiliser ces variables :

export NVIDIA_NIM_BASE_URL="https://integrate.api.nvidia.com/v1"
export NVIDIA_NIM_API_KEY="ta_cle_nvidia"

Ou les mettre dans un fichier .env :

NVIDIA_NIM_BASE_URL=https://integrate.api.nvidia.com/v1
NVIDIA_NIM_API_KEY=ta_cle_nvidia

Modele par defaut

Dans la config de Claw, mets :

{
  "model": "z-ai/glm5"
}

Si Claw repart sur Bedrock ou un autre provider

Si tu vois encore un comportement du type :

Bedrock Sonnet
The provided model identifier is invalid

alors ta build ou ta config ne route pas correctement z-ai/glm5.

Dans ce cas, il faut verifier que :

  • le modele par defaut est bien z-ai/glm5
  • le provider utilise bien le endpoint OpenAI-compatible NVIDIA
  • max_tokens n’est pas force localement pour ce modele

4. Retirer les limites de tokens

Sur Cline

Le plus simple est de ne pas definir de limite personnalisee de sortie.

Donc :

  • pas de max_tokens manuel
  • pas de preset local qui bride z-ai/glm5

Sur Claw

Dans le setup montre dans la video, Claw a ete ajuste pour que z-ai/glm5 n’envoie pas de max_tokens explicite.

L’idee est simple :

  • si le modele est z-ai/glm5
  • alors on laisse le provider ne pas envoyer de limite de sortie forcee

5. Verification rapide

Une fois configure, teste avec un prompt simple :

Refactor this function, add tests, and explain the tradeoffs.

Puis avec un prompt plus agentique :

Inspect this repository, identify the main bottleneck, propose a plan, then implement the fix.

Si tout est correct :

  • l’outil utilise z-ai/glm5
  • il tape bien sur https://integrate.api.nvidia.com/v1
  • il ne force pas une limite de sortie locale inutile

6. Probleme courant

Le modele est affiche mais ne marche pas

Si glm-5 ou glm5 est affiche mais que l’appel echoue, utilise directement :

z-ai/glm5

L’outil utilise encore un autre provider

Si ton outil part encore sur Bedrock, Anthropic, ou un autre provider par defaut, il faut corriger la config ou le routage interne.

Tu as une erreur 400

Une erreur 400 Bad Request avec un message sur un identifiant de modele invalide veut generalement dire :

  • mauvais nom de modele
  • mauvais endpoint
  • mauvais provider

7. Configuration minimale a recopier

Cline

Provider: OpenAI
Base URL: https://integrate.api.nvidia.com/v1
Model: z-ai/glm5
API Key: ta_cle_nvidia

Claw

export NVIDIA_NIM_BASE_URL="https://integrate.api.nvidia.com/v1"
export NVIDIA_NIM_API_KEY="ta_cle_nvidia"
{
  "model": "z-ai/glm5"
}

8. Conclusion

Si ton objectif est d’avoir un agent de code proprement configure sur GLM-5, ce setup suffit :

  • Cline pour l’experience editor
  • Claw pour l’experience terminal

Teste-le sur ton propre repo.

Mon guide pour aller plus loin :

Guide Complet : Kimi K2.5 via NVIDIA NIM

Ce guide vient de Build With Nath

La communauté est gratuite. J’y publie ces guides au fil de l’eau et on y répond aux questions.

Autres guides · Guides

Vous dirigez une entreprise et vous voulez savoir lequel de vos process mérite ce genre de traitement ? Le diagnostic vous le dit en trois minutes, ou on en parle trente minutes.