model selection
GLM-5 ou GLM-5V-Turbo : guide de choix de modèle API
2026-08-23
La documentation Zhipu décrit GLM-5 comme modèle d'entrée et sortie texte, avec contexte 200K et support de thinking, streaming, Function Call, sortie structurée et MCP. Les notes de version décrivent GLM-5V-Turbo comme modèle de base Coding multimodal ; choisissez selon la charge, non un classement générique.
Choisissez d'abord la modalité
Pour planification textuelle, Coding, résultats structurés et orchestration d'outils externes, GLM-5 est le modèle texte documenté. Si la compréhension visuelle est réellement nécessaire dans un flux Coding ou GUI, évaluez GLM-5V-Turbo sur sa route multimodale documentée et confirmez entrées et interfaces requises.
Rendez les IDs et contrats explicites
Le guide GLM-5 utilise glm-5 dans ses exemples chat-completions, alors que les exemples actuels GLM-5V-Turbo utilisent glm-5v-turbo. Considérez-les comme identifiants upstream à vérifier et validez autorisation, endpoint, contrôles thinking, streaming, schema et erreurs dans l'environnement choisi.
Prévoyez une ligne de versions mouvante
Les notes Zhipu annoncent aussi des versions plus récentes, dont GLM-5.2. Lorsqu'une sortie affecte votre tâche, revoyez l'aperçu officiel et faites une comparaison contrôlée plutôt que de remplacer silencieusement la configuration de production.
Questions fréquentes
Quel contexte est documenté pour GLM-5 ?
La documentation GLM-5 indique une fenêtre de 200K et une sortie maximale de 128K tokens. Confirmez les limites dans la documentation du fournisseur avant production.
Quand évaluer GLM-5V-Turbo plutôt que GLM-5 ?
Lorsque la compréhension visuelle est nécessaire à un flux Coding ou GUI. Confirmez endpoint multimodal, format d'entrée, outils et disponibilité avant implémentation.
