HiDream-I1
Une option solide pour l'auto-hébergement et le contrôle total des données.
Présentation
HiDream-I1 est un modèle de génération d'images à 17 milliards de paramètres, diffusé sous licence MIT et conçu pour tourner sur du matériel local. Il devance les meilleurs modèles ouverts (Flux.1-dev, SD3-Medium, CogView4) sur les benchmarks GenEval, DPG et HPSv2.1, en fidélité au prompt comme en qualité perçue. Sa limite : le pipeline s'appuie sur l'encodeur de texte Llama 3.1 8B, soumis à une licence Meta distincte, ce qui complique une conformité open source uniforme. Poids et VAE restent exécutables en local, sans dépendance à une API cloud.
Profil de compétences
Non communiqué
Forces
- Open-source et auto-hébergeable
Limites
- Tarification API non publiée
À qui ça s'adresse
- vous voulez maîtriser vos coûts ou auto-héberger
- vous avez des contraintes RGPD
Cas d'usage idéaux
- Illustrations marketing en interne
- Prototypage visuel produit
- Assets créatifs sans API cloud
- Génération d'images sur mesure
Accès & disponibilité
Caractéristiques clés
Confidentialité
Faire tourner en local
| Quantization | Disque | RAM / VRAM | Matériel type |
|---|---|---|---|
| Q4 · recommandé | 9.7 Go | 13 Go | PC 32 Go / Mac 24 Go / RTX 4070 Ti+ |
| Q8 · équilibré | 18.2 Go | 22 Go | Mac 32 Go / RTX 3090-4090 |
| FP16 · qualité max | 34 Go | 39 Go | Mac 64 Go / bi-GPU 24 Go |
Estimations pour un contexte modéré. Un long contexte augmente la RAM nécessaire (KV cache).
Déployer
Commandes prêtes à copier, générées depuis la fiche. Ajustez le contexte et le nombre de GPU à votre machine.
Serveur OpenAI-compatible pour la production sur GPU NVIDIA.
pip install vllm
vllm serve HiDream-ai/HiDream-I1-Full \
--max-model-len 32768 \
--tensor-parallel-size 1 \
--dtype autoDonnées avancées · pour expertsArchitecture, modalités, coût détaillé, benchmarks complets▾
| Arena Elo | — |
| MMLU | — |
| GPQA | — |
| HumanEval | — |
| SWE-Bench | — |
| MATH | — |