Gemma 3 1B
Une option solide pour l'auto-hébergement et le contrôle total des données.
Présentation
Gemma 3 1B est la plus petite déclinaison de la famille Gemma de Google, avec un milliard de paramètres et une fenêtre de contexte de 32 000 tokens. Son atout tient en un mot : la légèreté. Quantifié, il tourne sur un laptop standard, ce qui en fait un choix pertinent pour des déploiements on-premise où les données ne sortent jamais de l'entreprise, sous licence Gemma autorisant l'usage commercial. Sa limite est structurelle : à cette taille, le raisonnement complexe et la profondeur factuelle restent nettement en retrait des modèles plus lourds.
Profil de compétences
Non communiqué
Forces
- Open-source et auto-hébergeable
Limites
- Tarification API non publiée
À qui ça s'adresse
- vous voulez maîtriser vos coûts ou auto-héberger
- vous avez des contraintes RGPD
Cas d'usage idéaux
- Assistant embarqué sur laptop
- Prototypage local sans cloud
- Automatisation offline légère
- Extraction de texte simple
- Déploiement on-premise sécurisé
Accès & disponibilité
Caractéristiques clés
Confidentialité
Faire tourner en local
| Quantization | Disque | RAM / VRAM | Matériel type |
|---|---|---|---|
| Q4 · recommandé | 0.6 Go | 3 Go | Tout PC/Mac récent |
| Q8 · équilibré | 1.1 Go | 3 Go | Tout PC/Mac récent |
| FP16 · qualité max | 2 Go | 4 Go | Tout PC/Mac récent |
Estimations pour un contexte modéré. Un long contexte augmente la RAM nécessaire (KV cache).
Déployer
Commandes prêtes à copier, générées depuis la fiche. Ajuste le contexte et le nombre de GPU à ta machine.
Le plus simple pour tester sur un poste. Installe Ollama, puis :
ollama run gemma3:1bDonnées avancées · pour expertsArchitecture, modalités, coût détaillé, benchmarks complets▾
| Arena Elo | — |
| MMLU | — |
| GPQA | — |
| HumanEval | — |
| SWE-Bench | — |
| MATH | — |