Guides des modèles

model selection

GLM-5 ou GLM-5V-Turbo : guide de choix de modèle API

La documentation Zhipu décrit GLM-5 comme modèle d'entrée et sortie texte, avec contexte 200K et support de thinking, streaming, Function Call, sortie structurée et MCP. Les notes de version décrivent GLM-5V-Turbo comme modèle de base Coding multimodal ; choisissez selon la charge, non un classement générique.

Choisissez d'abord la modalité

Pour planification textuelle, Coding, résultats structurés et orchestration d'outils externes, GLM-5 est le modèle texte documenté. Si la compréhension visuelle est réellement nécessaire dans un flux Coding ou GUI, évaluez GLM-5V-Turbo sur sa route multimodale documentée et confirmez entrées et interfaces requises.

Rendez les IDs et contrats explicites

Le guide GLM-5 utilise glm-5 dans ses exemples chat-completions, alors que les exemples actuels GLM-5V-Turbo utilisent glm-5v-turbo. Considérez-les comme identifiants upstream à vérifier et validez autorisation, endpoint, contrôles thinking, streaming, schema et erreurs dans l'environnement choisi.

Prévoyez une ligne de versions mouvante

Les notes Zhipu annoncent aussi des versions plus récentes, dont GLM-5.2. Lorsqu'une sortie affecte votre tâche, revoyez l'aperçu officiel et faites une comparaison contrôlée plutôt que de remplacer silencieusement la configuration de production.

Questions fréquentes

Quel contexte est documenté pour GLM-5 ?

La documentation GLM-5 indique une fenêtre de 200K et une sortie maximale de 128K tokens. Confirmez les limites dans la documentation du fournisseur avant production.

Quand évaluer GLM-5V-Turbo plutôt que GLM-5 ?

Lorsque la compréhension visuelle est nécessaire à un flux Coding ou GUI. Confirmez endpoint multimodal, format d'entrée, outils et disponibilité avant implémentation.

Sources officielles

Listez les entrées, sorties, outils et contexte réellement nécessaires, puis faites une petite comparaison vérifiée sur l'API upstream avant de modifier le routage de production.