Un skill Claude Code qui monte tes vidéos 9:16 sur la trend « YOU CAN ASK THE FLOWERS (HORROR MIX) » — cuts calés à la frame sur les drops réels du fichier, voix mixée sous la musique, captions snappées sur le beat. Tu donnes ton rush, il sort le MP4.
34,45s, 1080×1920, sortie telle quelle du pipeline. Monte le son : tout l'intérêt est dans le placement, et le placement s'entend.
Ce morceau n'a pas de beat percussif net. Les analyseurs automatiques (librosa & co) renvoient un BPM que rien ne départage entre 104 et 124, et un placement de drop faux de plus d'une demi-seconde. Résultat : tu cales ta révélation sur 3s alors que le vrai drop est à 2,34s — 0,65s de retard, largement au-dessus du seuil perceptible.
volume=0.9 au lieu de 0.09 : +7 dB au-dessus de la voix, inaudibleCe n'est pas un prompt ni un template. C'est la procédure complète — mesures, commandes FFmpeg, garde-fous et pièges déjà payés — que Claude exécute à ta place.
Drop principal à 2.34s, mini-drops tous les 8.02s,
beat à 0.50125s (~119,7 BPM). Mesuré sur l'enveloppe d'énergie du vrai
MP3, pas estimé — et la méthode de mesure est fournie pour la refaire sur n'importe
quel autre son.
La commande prête à l'emploi : scale/crop 1080×1920, pulse de zoom calé sur le beat
avec son décalage de phase, sidechaincompress pour le ducking, coupe sur
un mini-drop. Plus la variante multi-plans avec le piège du -c copy qui
coupe au keyframe et désaligne tout.
Un MP3 continu ne respecte jamais la grille. Le skill génère un clip TTS par phrase,
trime le silence de padding, mesure chaque clip contre son slot de 8,02s et les pose
sur les mini-drops avec adelay. Avec normalize=0 sur
l'amix, sans quoi la voix disparaît.
Chaque groupe de mots occupe un nombre entier de beats, minimum un. C'est ce qui évite
le bug le plus coûteux du format : deux groupes qui atterrissent sur le même beat et
s'écrasent — la caption sort avec data-s == data-e et devient invisible.
Assert automatique avant injection.
L'anneau jaune de l'avatar flashe toutes les 2.673s — le tiers de phrase,
donc un pulse sur trois retombe pile sur un mini-drop. Pas de zoom plein écran, et pas
3,000s pile (ça dérive de 2s en fin de vidéo). Avec
immediateRender: false, sans quoi aucun pulse ne sort du rendu.
Le skill extrait les stems et mesure le mean_volume des deux pistes au
lieu de juger à l'oreille. La musique doit finir 10 à 16 dB sous la voix — un signe
+ dans la mesure et le mix est déclaré cassé avant publication.
Chaque changement de plan tombe sur un mini-drop, et la vidéo se termine sur un mini-drop — 34,42s, pas 35s.
data-start / data-duration déjà calculés.Ce skill n'a pas été écrit d'un trait : c'est le résidu de plusieurs vidéos ratées, d'un rendu de 11 minutes jeté à la poubelle et d'une grille de drops entièrement remesurée parce que l'analyse automatique se trompait. Voilà ce que ça représente.
Claude Code, ffmpeg/ffprobe et node. C'est tout
pour la version « rush talking-head », qui est le cas d'usage principal. HyperFrames et
un TTS ne servent que si tu veux une compo animée ou une voix générée plutôt que ta
propre voix.
La grille livrée est mesurée sur ce morceau précis — la recopier sur un autre son donnerait un montage faux. En revanche la §2 du skill documente la méthode de mesure complète (enveloppe RMS par trames de 20 ms, détection du front de montée le plus raide) et le one-liner Node qui recalcule la période de pulse et le décalage de phase pour ton fps. Tu peux donc l'appliquer à la trend suivante.
Non. Tu poses le dossier dans .claude/skills/ et tu demandes à Claude de
monter ta vidéo. Le skill est écrit pour être exécuté par l'agent, pas lu ligne par
ligne. Les commandes sont là si tu veux comprendre ou reprendre la main.
Du mécanisme de distribution des trends : une vidéo qui utilise le son officiel est référencée sur la page de ce son et touche son audience en plus de la tienne. C'est l'ordre de grandeur observé sur les contenus AutomationBoost montés sur le son de la trend — pas une garantie contractuelle, et ça ne remplace pas un bon hook. Le skill garantit la partie technique : que ton montage colle vraiment au son.
Après l'upload, tu ajoutes le son officiel dans l'app à 1-5 % de volume par-dessus ta vidéo. C'est ce qui te fait exister dans la trend, et ça se fait forcément à la main dans l'application. Ta bande-son mixée reste celle qu'on entend. Le skill te le rappelle à la fin de chaque montage.
Après le paiement Stripe, tu reçois par email un lien d'accès personnel vers ta page de
téléchargement. Le pack est un .zip de 12 Ko — trois fichiers Markdown à
poser dans .claude/skills/.
La différence entre une vidéo qui « colle » à la trend et une qui sonne à côté tient dans 0,65 seconde. Ce skill l'a déjà mesurée pour toi.
⚡ Obtenir le skill — 19,90 €