Tu payes Claude Code pour rien
avril 2026 · 4 min de lecture
Ce guide t’explique comment configurer Cline et Claw pour utiliser GLM-5 via le endpoint OpenAI-compatible de NVIDIA.
L’objectif est simple :
- utiliser
z-ai/glm5comme modele par defaut - passer par
https://integrate.api.nvidia.com/v1 - ne pas imposer de limite de sortie explicite inutile
Ce guide correspond au setup montre dans la video.
Liens utiles
- Cline
- Artificial Analysis - Coding Index
- Claw Code
- https://build.nvidia.com/explore/discover?ncid=no-ncid
Prerequis
Avant de commencer, il te faut :
- une cle API NVIDIA
Clineinstalle si tu veux la version VS CodeClawinstalle si tu veux la version terminal
Important :
- ne colle jamais ta vraie cle API dans une video ou un screenshot
- stocke-la dans un
.env, un secret manager, ou dans la config locale de ton outil
1. Endpoint et modele a utiliser
Dans les deux outils, la base est la meme :
Base URL: https://integrate.api.nvidia.com/v1
Model: z-ai/glm5
2. Configurer Cline
Dans Cline, utilise un provider OpenAI compatible.
Renseigne les champs suivants :
Provider: OpenAI
Base URL: https://integrate.api.nvidia.com/v1
Model: z-ai/glm5
API Key: ta_cle_nvidia
Point important sur les tokens
Pour ce setup, ne renseigne pas de limite de sortie manuelle si tu veux eviter d’envoyer un max_tokens explicite.
En pratique :
- choisis
z-ai/glm5 - ne force pas une valeur de sortie personnalisee
3. Configurer Claw
Variables d’environnement
Tu peux utiliser ces variables :
export NVIDIA_NIM_BASE_URL="https://integrate.api.nvidia.com/v1"
export NVIDIA_NIM_API_KEY="ta_cle_nvidia"
Ou les mettre dans un fichier .env :
NVIDIA_NIM_BASE_URL=https://integrate.api.nvidia.com/v1
NVIDIA_NIM_API_KEY=ta_cle_nvidia
Modele par defaut
Dans la config de Claw, mets :
{
"model": "z-ai/glm5"
}
Si Claw repart sur Bedrock ou un autre provider
Si tu vois encore un comportement du type :
Bedrock Sonnet
The provided model identifier is invalid
alors ta build ou ta config ne route pas correctement z-ai/glm5.
Dans ce cas, il faut verifier que :
- le modele par defaut est bien
z-ai/glm5 - le provider utilise bien le endpoint OpenAI-compatible NVIDIA
max_tokensn’est pas force localement pour ce modele
4. Retirer les limites de tokens
Sur Cline
Le plus simple est de ne pas definir de limite personnalisee de sortie.
Donc :
- pas de
max_tokensmanuel - pas de preset local qui bride
z-ai/glm5
Sur Claw
Dans le setup montre dans la video, Claw a ete ajuste pour que z-ai/glm5 n’envoie pas de max_tokens explicite.
L’idee est simple :
- si le modele est
z-ai/glm5 - alors on laisse le provider ne pas envoyer de limite de sortie forcee
5. Verification rapide
Une fois configure, teste avec un prompt simple :
Refactor this function, add tests, and explain the tradeoffs.
Puis avec un prompt plus agentique :
Inspect this repository, identify the main bottleneck, propose a plan, then implement the fix.
Si tout est correct :
- l’outil utilise
z-ai/glm5 - il tape bien sur
https://integrate.api.nvidia.com/v1 - il ne force pas une limite de sortie locale inutile
6. Probleme courant
Le modele est affiche mais ne marche pas
Si glm-5 ou glm5 est affiche mais que l’appel echoue, utilise directement :
z-ai/glm5
L’outil utilise encore un autre provider
Si ton outil part encore sur Bedrock, Anthropic, ou un autre provider par defaut, il faut corriger la config ou le routage interne.
Tu as une erreur 400
Une erreur 400 Bad Request avec un message sur un identifiant de modele invalide veut generalement dire :
- mauvais nom de modele
- mauvais endpoint
- mauvais provider
7. Configuration minimale a recopier
Cline
Provider: OpenAI
Base URL: https://integrate.api.nvidia.com/v1
Model: z-ai/glm5
API Key: ta_cle_nvidia
Claw
export NVIDIA_NIM_BASE_URL="https://integrate.api.nvidia.com/v1"
export NVIDIA_NIM_API_KEY="ta_cle_nvidia"
{
"model": "z-ai/glm5"
}
8. Conclusion
Si ton objectif est d’avoir un agent de code proprement configure sur GLM-5, ce setup suffit :
Clinepour l’experience editorClawpour l’experience terminal
Teste-le sur ton propre repo.
Mon guide pour aller plus loin :