EN DIRECT
CliffCompaction : une méthode de compression de contexte pour réduire le coût des agents de codage22/09/26|FleXray : un modèle généraliste pour segmenter les radiographies du corps entier22/09/26|Anthropic dévoile Claude Opus 5.522/09/26 · Anthropic|Des documents judiciaires révèlent des propos internes accablants sur le scraping de contenu par l'IA19/09/26|L'armée américaine évite de justesse un incident après un rapport de renseignement halluciné par une IA18/09/26|Une étude révèle que les biais de genre des GPT ne disparaissent pas, ils se transforment17/09/26 · OpenAI|Google DeepMind ajoute une mémoire côté serveur sécurisée à Private AI Compute23/09/26 · Google DeepMind|Google DeepMind ajoute la synthèse vocale à Gemini 3.823/09/26 · Google DeepMind|NVIDIA lance Nemotron 3 Diarization pour identifier les locuteurs en temps réel23/09/26 · NVIDIA|OpenAI élargit l'accès de son programme Daybreak à l'Ukraine pour la cyberdéfense civile23/09/26 · OpenAI|OpenAI mise sur des influenceurs pour redorer son image publique23/09/26 · OpenAI|Claude Code ne lirait le fichier AGENTS.md que si la télémétrie est activée23/09/26 · Anthropic|CliffCompaction : une méthode de compression de contexte pour réduire le coût des agents de codage22/09/26|FleXray : un modèle généraliste pour segmenter les radiographies du corps entier22/09/26|Anthropic dévoile Claude Opus 5.522/09/26 · Anthropic|Des documents judiciaires révèlent des propos internes accablants sur le scraping de contenu par l'IA19/09/26|L'armée américaine évite de justesse un incident après un rapport de renseignement halluciné par une IA18/09/26|Une étude révèle que les biais de genre des GPT ne disparaissent pas, ils se transforment17/09/26 · OpenAI|Google DeepMind ajoute une mémoire côté serveur sécurisée à Private AI Compute23/09/26 · Google DeepMind|Google DeepMind ajoute la synthèse vocale à Gemini 3.823/09/26 · Google DeepMind|NVIDIA lance Nemotron 3 Diarization pour identifier les locuteurs en temps réel23/09/26 · NVIDIA|OpenAI élargit l'accès de son programme Daybreak à l'Ukraine pour la cyberdéfense civile23/09/26 · OpenAI|OpenAI mise sur des influenceurs pour redorer son image publique23/09/26 · OpenAI|Claude Code ne lirait le fichier AGENTS.md que si la télémétrie est activée23/09/26 · Anthropic|
SkillNouveauéditeur officiel

video-use (Browser Use)

Skill : Une méthode réutilisable : instructions, procédures, parfois scripts ou modèles · nécessite claude-code

Montage vidéo par agent : déposez vos rushes dans un dossier, décrivez le résultat, l'agent coupe les blancs, étalonne, sous-titre et rend final.mp4.

Bluffant pour les vidéos face caméra et tutos sans ouvrir un logiciel de montage ; demande ffmpeg et une clé ElevenLabs pour la transcription.

Score global
7.5 /10
Sécu : une réserve, lire la fiche
Utilité
7.0
Fiabilité
10.0
Sécurité
Une réserve
Facilité
5 min · À l’aise

La sécurité reflète la destination des données, les permissions demandées et les incidents recensés à la date de vérification. Ce n’est pas une garantie d’absence de risque : vérifiez le mode de déploiement et les connexions que vous activez.

Ce que ça fait, concrètement

Monter une vidéo demande habituellement d'ouvrir un logiciel dédié, d'apprendre ses raccourcis et de passer de longues minutes à couper les silences, corriger les couleurs et ajouter des sous-titres. video-use supprime ces étapes en confiant le travail à un agent qui lit vos rushes et produit un fichier final.mp4 sans que vous touchiez à une timeline.

Concrètement, vous déposez vos fichiers bruts dans un dossier, vous décrivez le résultat souhaité en langage naturel, et l'agent prend la main. Il transcrit l'audio via ElevenLabs Scribe pour obtenir les horodatages mot à mot, repère les silences et les mots de remplissage, propose une stratégie de montage, attend votre validation, puis exécute les coupes, l'étalonnage, les fondus audio et la génération des sous-titres via ffmpeg. Un cycle d'auto-évaluation vérifie chaque point de coupe avant de vous remettre le fichier.

L'outil convient aux créateurs de contenu qui tournent des vidéos face caméra, des tutoriels ou des interviews et qui veulent un rendu propre sans maîtriser un logiciel de montage. Il s'adresse aussi aux développeurs à l'aise avec le terminal qui souhaitent automatiser leur post-production.

En revanche, il ne convient pas à ceux qui recherchent une interface graphique, qui travaillent sur des projets nécessitant un contrôle fin image par image, ou qui ne souhaitent pas envoyer l'audio de leurs rushes à un service tiers pour la transcription.

Ce que ça propose

  • ·Suppression automatique des mots de remplissage (« euh », faux départs) et des silences entre les prises.
  • ·Étalonnage colorimétrique automatique de chaque segment via des chaînes ffmpeg personnalisables (cinématique chaud, neutre punchy, ou sur mesure).
  • ·Fondus audio de 30 ms à chaque coupe pour éviter tout claquement sonore.
  • ·Génération et incrustation de sous-titres stylisés, configurables en blocs de 2 mots en majuscules par défaut.
  • ·Génération d'animations en parallèle via HyperFrames, Remotion, Manim ou PIL, chacune traitée par un sous-agent dédié.
  • ·Auto-évaluation du rendu à chaque point de coupe avant présentation du résultat, avec jusqu'à 3 tentatives de correction automatique.
  • ·Mémoire de session persistante dans un fichier project.md pour reprendre le travail d'une session à l'autre.
  • ·Téléchargement de sources en ligne via yt-dlp (optionnel).

En pratique

Prix
GratuitGratuit et open source ; transcription facturée par ElevenLabs à l'usage, plus les tokens de l'agent.
Usage commercial
Usage commercial : oui
Disponible sur
GitHub
Hôte
claude-code
Autres hôtes
claude-code, codex, any-agent
Interface FR
Non

Sécurité et données

Pastille
Sécu : une réserve, lire la fiche
Vos données
Local ou cloud selon usage
Permissions
Exécute ffmpeg et des scripts Python sur vos fichiers ; l'audio des rushes est envoyé à ElevenLabs pour la transcription.
Maintenance
Active

Liens et dépôt vérifiés le 23 septembre 2026 · ajoutée le 23 septembre 2026

Comment installer video-use (Browser Use)

1. Clonez le dépôt et créez un lien symbolique vers le dossier skills de votre agent : git clone https://github.com/browser-use/video-use ~/Developer/video-use && ln -sfn ~/Developer/video-use ~/.claude/skills/video-use 2. Installez les dépendances Python : cd ~/Developer/video-use && uv sync (ou pip install -e .) 3. Installez ffmpeg (obligatoire) : brew install ffmpeg 4. Installez yt-dlp si vous souhaitez télécharger des sources en ligne : brew install yt-dlp 5. Copiez le fichier d'environnement et ajoutez votre clé ElevenLabs : cp .env.example .env puis ouvrez .env et renseignez ELEVENLABS_API_KEY (ne partagez pas ce fichier, il contient votre clé API) 6. Placez-vous dans votre dossier de rushes et lancez l'agent : cd /chemin/vers/vos/vidéos && claude
git clone https://github.com/browser-use/video-use ~/Developer/video-use && ln -sfn ~/Developer/video-use ~/.claude/skills/video-use && cd ~/Developer/video-use && uv sync && brew install ffmpeg && cp .env.example .env

Documentation officielle

Dans la même catégorie

Toute la catégorie Vidéo