EN DIRECT
Formalizing Fermat's Last Theorem04/09/26 · Anthropic|Pannes simultanées chez OpenAI et Anthropic sans explication officielle04/09/26|Show HN: Open-Source eInk Bike Computer04/09/26|Les entreprises américaines adoptent de plus en plus l'IA open source04/09/26|Une étude pointe des prix plus élevés dans le mode IA de Google Search04/09/26 · Google|Une étude mesure comment les agents de code choisissent leurs outils tiers03/09/26|GPT-6 Astra d'OpenAI établit un nouveau record sur ARC-AGI-303/09/26 · OpenAI|ESPO : une méthode d'optimisation de prompts plus courte et plus stable que GEPA03/09/26|« Last Translation Benchmark » : un effort collectif pour un référentiel définitif de traduction automatique03/09/26|NVIDIA mise sur l'IA locale à l'IFA 2026 avec les PC RTX Spark et un routeur d'inférence personnel03/09/26 · NVIDIA|Google DeepMind lance WeatherNext 3, son modèle météo IA le plus précis03/09/26 · Google DeepMind|OpenAI lance Daybreak, un programme d'un milliard de dollars pour la cybersécurité des services essentiels03/09/26 · OpenAI|Formalizing Fermat's Last Theorem04/09/26 · Anthropic|Pannes simultanées chez OpenAI et Anthropic sans explication officielle04/09/26|Show HN: Open-Source eInk Bike Computer04/09/26|Les entreprises américaines adoptent de plus en plus l'IA open source04/09/26|Une étude pointe des prix plus élevés dans le mode IA de Google Search04/09/26 · Google|Une étude mesure comment les agents de code choisissent leurs outils tiers03/09/26|GPT-6 Astra d'OpenAI établit un nouveau record sur ARC-AGI-303/09/26 · OpenAI|ESPO : une méthode d'optimisation de prompts plus courte et plus stable que GEPA03/09/26|« Last Translation Benchmark » : un effort collectif pour un référentiel définitif de traduction automatique03/09/26|NVIDIA mise sur l'IA locale à l'IFA 2026 avec les PC RTX Spark et un routeur d'inférence personnel03/09/26 · NVIDIA|Google DeepMind lance WeatherNext 3, son modèle météo IA le plus précis03/09/26 · Google DeepMind|OpenAI lance Daybreak, un programme d'un milliard de dollars pour la cybersécurité des services essentiels03/09/26 · OpenAI|
🇺🇸 États-Unis🎧 Reconnaissance vocaleSortie août 2025

Parakeet TDT 0.6B v3

NVIDIA
Open-sourceSelf-hostRGPD
Verdict

Une option solide pour l'auto-hébergement et le contrôle total des données.

Présentation

Parakeet TDT 0.6B v3 est un modèle ASR de NVIDIA, léger (0,6 milliard de paramètres) et taillé pour tourner sur un simple GPU de laptop. Il détecte et transcrit automatiquement 25 langues européennes, ponctuation et horodatage inclus, ce qui en fait un candidat solide pour des outils de transcription ou de sous-titrage multilingues. La qualité varie selon les langues et NVIDIA note lui-même un écart sur le portugais, entraîné en variante européenne mais souvent évalué contre du portugais brésilien. Poids ouverts sous licence CC-BY-4.0 : déployé en local, l'audio et les transcriptions ne quittent jamais l'infrastructure de l'utilisateur, quelle que soit la nationalité de l'éditeur.

Profil de compétences

Non communiqué

Forces

  • Open-source et auto-hébergeable

Limites

  • Tarification API non publiée

À qui ça s'adresse

Pour vous si…
  • vous voulez maîtriser vos coûts ou auto-héberger
  • vous avez des contraintes RGPD
À éviter si…

    Cas d'usage idéaux

    • Transcription réunion multilingue
    • Sous-titrage vidéo automatique
    • Assistant vocal on-premise
    • Analytique vocale confidentielle

    Accès & disponibilité

    Auto-hébergeable (poids ouverts)

    Caractéristiques clés

    Contexte
    0
    Prix entrée
    Prix sortie
    Vitesse
    Prix non auditéBenchmarks non audités

    Confidentialité

    Conforme RGPDHébergement : self

    Faire tourner en local

    Tourne sur un laptop761k1k
    QuantizationDisqueRAM / VRAMMatériel type
    Q4 · recommandé0.3 Go2 GoTout PC/Mac récent
    Q8 · équilibré0.6 Go3 GoTout PC/Mac récent
    FP16 · qualité max1.2 Go3 GoTout PC/Mac récent

    Estimations pour un contexte modéré. Un long contexte augmente la RAM nécessaire (KV cache).

    Déployer

    Commandes prêtes à copier, générées depuis la fiche. Ajustez le contexte et le nombre de GPU à votre machine.

    Mémoire estimée · FP16 3 Go · Q4 2 Go

    Serveur OpenAI-compatible pour la production sur GPU NVIDIA.

    pip install vllm
    vllm serve nvidia/parakeet-tdt-0.6b-v3 \
      --max-model-len 32768 \
      --tensor-parallel-size 1 \
      --dtype auto
    nvidia/parakeet-tdt-0.6b-v3
    Données avancées · pour experts
    Architecture, modalités, coût détaillé, benchmarks complets
    Architecture
    Taille
    600M
    Date de coupe
    Entrées
    text
    Sorties
    text
    Licence
    cc-by-4.0
    Hébergement
    self
    Score d'hallucination
    Coût estimé (API)
    Échange type (~3k entrée / 1k sortie)
    Non communiqué
    1M entrée + 1M sortie
    Non communiqué
    Tous les benchmarks
    Arena Elo
    MMLU
    GPQA
    HumanEval
    SWE-Bench
    MATH

    Modèles similaires