Mochi 1
Une option solide pour l'auto-hébergement et le contrôle total des données.
Présentation
Mochi 1 est un modèle de génération vidéo à partir de texte développé par Genmo, diffusé en poids ouverts sous licence Apache 2.0. Son architecture AsymmDiT à 10 milliards de paramètres affiche un bon respect des prompts et un rendu photoréaliste convaincant, mais limité à la 480p pour l'instant. Limite assumée : les mouvements extrêmes provoquent parfois des distorsions, et le modèle peine sur les styles animés ou stylisés. Étant open source, il peut tourner entièrement en local sur un GPU dédié sans dépendre d'un cloud, un vrai plus pour la souveraineté des données — à condition de disposer d'assez de VRAM.
Profil de compétences
Non communiqué
Forces
- Open-source et auto-hébergeable
Limites
- Tarification API non publiée
À qui ça s'adresse
- vous voulez maîtriser vos coûts ou auto-héberger
- vous avez des contraintes RGPD
Cas d'usage idéaux
- Prototypage vidéo marketing
- Storyboards générés par IA
- R&D interne génération vidéo
- Démos produit rapides
Accès & disponibilité
Caractéristiques clés
Confidentialité
Faire tourner en local
| Quantization | Disque | RAM / VRAM | Matériel type |
|---|---|---|---|
| Q4 · recommandé | 5.7 Go | 8 Go | PC 16 Go / Mac M1+ / GPU 8 Go |
| Q8 · équilibré | 10.7 Go | 14 Go | PC 32 Go / Mac 24 Go / RTX 4070 Ti+ |
| FP16 · qualité max | 20 Go | 24 Go | Mac 32 Go / RTX 3090-4090 |
Estimations pour un contexte modéré. Un long contexte augmente la RAM nécessaire (KV cache).
Déployer
Commandes prêtes à copier, générées depuis la fiche. Ajustez le contexte et le nombre de GPU à votre machine.
Serveur OpenAI-compatible pour la production sur GPU NVIDIA.
pip install vllm
vllm serve genmo/mochi-1-preview \
--max-model-len 32768 \
--tensor-parallel-size 1 \
--dtype autoDonnées avancées · pour expertsArchitecture, modalités, coût détaillé, benchmarks complets▾
| Arena Elo | — |
| MMLU | — |
| GPQA | — |
| HumanEval | — |
| SWE-Bench | — |
| MATH | — |