Wan 2.2 5B
Une option solide pour l'auto-hébergement et le contrôle total des données.
Présentation
Wan 2.2 5B est un modèle texte-image-vers-vidéo open source d'Alibaba, capable de générer du 720p à 24 fps grâce à un VAE très compressé. Il vise la vitesse et l'accessibilité plutôt que la puissance brute des modèles MoE 14B de la même famille, avec une esthétique cinématographique soignée. Sa limite : à 5B de paramètres, la cohérence des mouvements complexes reste en retrait par rapport aux versions plus lourdes. Licence Apache 2.0 et poids ouverts : il tourne entièrement en local sur une carte comme la RTX 4090, sans envoyer la moindre donnée hors de l'entreprise.
Profil de compétences
Non communiqué
Forces
- Open-source et auto-hébergeable
Limites
- Tarification API non publiée
À qui ça s'adresse
- vous voulez maîtriser vos coûts ou auto-héberger
- vous avez des contraintes RGPD
Cas d'usage idéaux
- Prototypage vidéo rapide
- Démos internes sans cloud
- Génération image-vers-vidéo
- Tests créatifs sur poste local
Accès & disponibilité
Caractéristiques clés
Confidentialité
Faire tourner en local
| Quantization | Disque | RAM / VRAM | Matériel type |
|---|---|---|---|
| Q4 · recommandé | 2.8 Go | 5 Go | Tout PC/Mac récent |
| Q8 · équilibré | 5.4 Go | 8 Go | PC 16 Go / Mac M1+ / GPU 8 Go |
| FP16 · qualité max | 10 Go | 13 Go | PC 32 Go / Mac 24 Go / RTX 4070 Ti+ |
Estimations pour un contexte modéré. Un long contexte augmente la RAM nécessaire (KV cache).
Déployer
Commandes prêtes à copier, générées depuis la fiche. Ajustez le contexte et le nombre de GPU à votre machine.
Serveur OpenAI-compatible pour la production sur GPU NVIDIA.
pip install vllm
vllm serve Wan-AI/Wan2.2-TI2V-5B \
--max-model-len 32768 \
--tensor-parallel-size 1 \
--dtype autoDonnées avancées · pour expertsArchitecture, modalités, coût détaillé, benchmarks complets▾
| Arena Elo | — |
| MMLU | — |
| GPQA | — |
| HumanEval | — |
| SWE-Bench | — |
| MATH | — |