CogVideoX 5B
Une option solide pour l'auto-hébergement et le contrôle total des données.
Présentation
CogVideoX-5B est un modèle de génération vidéo à poids ouverts publié par Zhipu AI sous licence Apache 2.0 autorisant l'usage commercial. Il produit des clips courts cohérents à partir de descriptions textuelles détaillées, et sa version quantifiée tourne dès 4,4 Go de VRAM, ce qui le rend accessible sur une carte grand public. Limite notable : les prompts doivent être rédigés en anglais et plafonnés à 226 tokens, et la génération reste lente (jusqu'à 90 secondes par clip sur un H100). Étant open source, il peut être déployé entièrement sur site en Europe, sans transfert de données vers un tiers.
Profil de compétences
Non communiqué
Forces
- Open-source et auto-hébergeable
Limites
- Tarification API non publiée
À qui ça s'adresse
- vous voulez maîtriser vos coûts ou auto-héberger
- vous avez des contraintes RGPD
Cas d'usage idéaux
- Prototypage de clips courts
- Génération vidéo en local
- Démos créatives internes
- R&D vidéo générative
- Contenu marketing rapide
Accès & disponibilité
Caractéristiques clés
Confidentialité
Faire tourner en local
| Quantization | Disque | RAM / VRAM | Matériel type |
|---|---|---|---|
| Q4 · recommandé | 2.8 Go | 5 Go | Tout PC/Mac récent |
| Q8 · équilibré | 5.4 Go | 8 Go | PC 16 Go / Mac M1+ / GPU 8 Go |
| FP16 · qualité max | 10 Go | 13 Go | PC 32 Go / Mac 24 Go / RTX 4070 Ti+ |
Estimations pour un contexte modéré. Un long contexte augmente la RAM nécessaire (KV cache).
Déployer
Commandes prêtes à copier, générées depuis la fiche. Ajustez le contexte et le nombre de GPU à votre machine.
Serveur OpenAI-compatible pour la production sur GPU NVIDIA.
pip install vllm
vllm serve THUDM/CogVideoX-5b \
--max-model-len 32768 \
--tensor-parallel-size 1 \
--dtype autoDonnées avancées · pour expertsArchitecture, modalités, coût détaillé, benchmarks complets▾
| Arena Elo | — |
| MMLU | — |
| GPQA | — |
| HumanEval | — |
| SWE-Bench | — |
| MATH | — |