De zéro à une chaîne YouTube IA en quatorze étapes (HyperFrames + Shortflow)
Le walkthrough complet, depuis le moment où vous n'avez ni script, ni voix, ni B-roll, ni canal jusqu'au premier épisode publié sur six plateformes. Quatorze étapes, environ deux jours de travail effectif. Ce que je dois faire moi-même quand je lance une nouvelle chaîne.
J'ai lancé, en moyenne, une nouvelle chaîne IA tous les deux mois depuis dix-huit mois. Huit chaînes actives à ce jour, chacune sortie de la même séquence de démarrage, légèrement rodée à chaque tour. Ce qui suit est ce parcours dans son état actuel, condensé en quatorze étapes ordonnées.
L'objectif n'est pas de vous donner une recette générique. L'objectif est de vous épargner les erreurs de séquencement que j'ai faites en lançant Cocorico Histoire en novembre 2025, et que j'ai depuis évitées sur les sept chaînes suivantes. La courbe d'apprentissage entre une chaîne et la suivante est en grande partie une question de savoir dans quel ordre faire les choses.
Comptez environ deux jours pleins de travail effectif entre la décision de lancer et le premier épisode publié. Pas une heure, pas une semaine — deux jours, à condition d'avoir tous les prérequis techniques (Claude Code, Python, FFmpeg, HyperFrames, comptes de plateformes existants).
Phase 1 — Définition (quatre étapes, environ quatre heures)
Étape 1 — Choisir un concept de chaîne en une phrase
Une chaîne IA tient si son concept tient en une phrase de moins de quinze mots. « Pourquoi cet objet du quotidien existe-t-il » pour WhyFactory. « Une histoire de France par épisode, en soixante secondes » pour Cocorico. « Les posts r/nosleep narrés à voix lente » pour Reddit Horror. Si vous ne pouvez pas l'écrire en une phrase, ce n'est pas un concept, c'est encore une idée.
Le test simple : faites lire votre phrase à trois proches. Si les trois la reformulent à peu près de la même manière, le concept est tenable. Si chacun la comprend différemment, vous avez un travail de précision à finir.
Étape 2 — Écrire le document éditorial
Mille à mille cinq cents mots qui décrivent : la posture du narrateur, les cinq mécanismes de voix (synchronie de découverte, opinions assumées, faits-en-plot-twists, anticipation viewer, CTA tissé), des exemples positifs et négatifs, et les red flags. C'est l'étape que tout le monde veut sauter ; c'est aussi celle dont l'absence détermine si la chaîne tient ou pas. J'en ai parlé en détail dans le post sur la voix éditoriale.
Compter deux heures pour rédiger un doc utilisable. C'est moins un texte qu'un outil de validation : à chaque écriture future, vous reviendrez le consulter pour trancher.
Étape 3 — Constituer le backlog priorisé
Vingt sujets minimum, ordonnés par banger-factor — votre intuition de celui qui marchera le mieux en premier. Pour WhyFactory, mon backlog initial contenait « pourquoi le clavier est en AZERTY », « pourquoi le bouton snooze fait neuf minutes », « pourquoi les Pringles ont leur tube », etc. Vingt entrées garantissent que vous ne tombez pas en panne sèche au quatrième épisode.
Format minimum par entrée : titre, hook proposé, source factuelle vérifiée (Wikipedia anglais souvent meilleur que la version FR), badge de banger-factor de une à trois étoiles. Notion ou un fichier Markdown versionné dans le repo de la chaîne — peu importe.
Étape 4 — Verrouiller l'identité visuelle
Une couleur de signature, une typographie, un wordmark, une grille de captions, et idéalement un mark simple (un signe graphique qui se reconnaît miniature). Pas besoin de designer professionnel — un dimanche après-midi sur Figma suffit pour une chaîne expérimentale. Le but n'est pas la perfection esthétique ; c'est la cohérence sur la durée. WhyFactory : background #0A0A0F, signature cyan #00E5FF, captions jaune #FFD60A, wordmark WHY cyan + FACTORY cream en font weight 900.
Phase 2 — Infrastructure (cinq étapes, environ trois heures)
Étape 5 — Scaffolder le projet HyperFrames
Une commande :
npx hyperframes init <slug-de-la-chaine>
L'assistant interactif vous pose deux questions : taille (1080×1920 pour Shorts), durée par défaut (60 s). Le scaffold produit une structure complète : index.html, dossier scripts/, dossier episodes/, dossier renders/. Vingt minutes pour parcourir le squelette et comprendre où vit chaque chose.
Étape 6 — Forker un générateur de scripts
Si vous démarrez de zéro, copiez le générateur Python d'une chaîne existante (mes huit chaînes partagent ~90% du même code) et adaptez-le. Si vous démarrez vraiment de zéro, commencez par implémenter : (a) la lecture du JSON de config, (b) l'appel TTS avec cache par hash, (c) la transcription Whisper + forced-align, (d) la sélection B-roll Pexels, (e) le mix FFmpeg, (f) l'appel npx hyperframes render. Une journée complète pour un développeur, deux à trois pour un créateur sans bagage technique.
Étape 7 — Configurer les voix TTS
Pour la chaîne, choisissez une voix par tier : Kokoro pour itération, F5 local pour validation, ElevenLabs pour prod. Sur ElevenLabs, faites un blind A/B sur trois voix candidates avant de verrouiller la prod. Voix retenue chez moi pour le FR : Liam (fr-quiz-host). Cette décision est presque irréversible — changer de voix après dix épisodes oblige à recréer l'attente sonore que les viewers réguliers ont déjà installée. Choisissez avec attention.
Étape 8 — Connecter les six plateformes sociales
Créez le compte de la chaîne sur chacune si ce n'est pas déjà fait (YouTube, TikTok, Instagram Business/Creator, Facebook Page, Threads, LinkedIn). Profil cohérent : même avatar, même nom, même bio courte. Puis dans le dashboard Shortflow, OAuth chaque plateforme. Compter cinq à dix minutes par plateforme, soit une heure pour les six.
Étape 9 — Brancher le serveur MCP Shortflow sur Claude Code
Une commande dans le terminal du repo de la chaîne :
claude mcp add shortflow https://api.shortflow.leandre.io/mcp \
--transport http \
--scope local \
--header "Authorization: Bearer sk_live_votre_clé"
Cinq minutes en cumulé, y compris la création de la clé API dans le dashboard. À la fin, Claude Code peut piloter la publication. Cette étape est suffisamment courte pour ne pas justifier de la faire plus tard — autant l'avoir d'emblée pour que tout l'épisode 01 puisse passer par la séquence MCP.
Phase 3 — Premier épisode (cinq étapes, environ six heures)
Étape 10 — Écrire le script de l'épisode 01
L'épisode pilote. Choisissez le sujet le plus haut sur le backlog en banger-factor. Écrivez le script à la main, segment par segment, en relisant à voix haute après chaque ré-écriture. Quatre cents à cinq cents mots parlés sur soixante secondes. Deux twists en cascade dans les huit premières secondes. Référez-vous obligatoirement au document éditorial à chaque doute.
Compter deux heures pour produire un script verrouillé acceptable. Je l'ai souvent fait en une heure dans l'urgence ; le résultat se voit toujours.
Étape 11 — Générer la voix sur les trois tiers
Lancez la pipeline complète : Kokoro pour vérifier que le rythme tient, F5 local pour la prosodie, ElevenLabs pour la prod. À cette étape, vous découvrirez probablement deux ou trois choses à ajuster dans le script — un mot qui se prononce mal, une virgule qui crée une césure trop longue, un nom propre que la voix coupe en deux. Corrigez, relancez le segment fautif uniquement (le cache par hash garde le reste intact).
Compter une heure de cycle complet sur un script de soixante secondes.
Étape 12 — Valider le montage et rendre le MP4
Lancez npx hyperframes preview pour ouvrir le studio dans le navigateur. Vérifiez que les sous-titres sont synchronisés, que le B-roll s'enchaîne sans saut visuel, que la vignette est lisible. Une ou deux corrections mineures sont normales sur un premier épisode — un B-roll qui ne convient pas, un effet de transition mal calibré.
Une fois validé, npx hyperframes render. Trois à cinq minutes de calcul. Le MP4 final atterrit dans renders/.
Étape 13 — Publier via Claude Code et MCP
Ouvrez Claude Code dans le terminal du projet et lancez la séquence MCP en cinq prompts décrits dans le tuto Shortflow + Claude. Les six plateformes reçoivent la publication, programmées avec un décalage horaire stratégique pour éviter la cannibalisation.
À ce stade, votre premier épisode est en stock sur six plateformes, prêt à se déclencher aux horaires que vous avez choisis. Vingt minutes au total, dont la majeure partie est la rédaction des captions adaptées par plateforme (cf. le manuel cross-publication).
Étape 14 — Verrouiller le calendrier de publication des prochains épisodes
Avant la publication effective de l'épisode 01, fixez la cadence pour les six suivants. Si votre rythme cible est trois épisodes par semaine, programmez les épisodes 02 à 07 dans le backlog, avec leurs sujets et leurs dates de publication. Cette discipline préventive évite le piège classique : publier l'épisode 01, attendre la réaction, et perdre deux semaines à hésiter sur la suite.
Mon protocole personnel : la cadence est verrouillée avant la publication de l'épisode 01. Les chiffres de l'épisode 01 modulent éventuellement la cadence de l'épisode 08 ou 09, jamais celle des sept premiers. Cette discipline élimine la procrastination la plus coûteuse — celle qui consiste à attendre les retours avant de continuer à produire.
Le tableau récap
| # | Étape | Phase | Durée | |---|---|---|---| | 1 | Concept en une phrase | Définition | 30 min | | 2 | Document éditorial | Définition | 2 h | | 3 | Backlog priorisé | Définition | 1 h | | 4 | Identité visuelle | Définition | 30 min | | 5 | Scaffolding HyperFrames | Infrastructure | 30 min | | 6 | Générateur Python | Infrastructure | 1-2 h | | 7 | Configuration TTS | Infrastructure | 30 min | | 8 | Comptes sociaux + OAuth | Infrastructure | 1 h | | 9 | MCP Shortflow sur Claude Code | Infrastructure | 5 min | | 10 | Script épisode 01 | Premier épisode | 2 h | | 11 | Voix trois tiers | Premier épisode | 1 h | | 12 | Montage et rendu | Premier épisode | 1 h | | 13 | Publication MCP | Premier épisode | 20 min | | 14 | Calendrier des prochains | Premier épisode | 30 min | | Total | | | ~13 h |
Treize heures effectives, à étaler sur deux jours pour préserver la qualité de chaque décision. Faire la même séquence en une journée est possible mais déconseillé — la fatigue de la deuxième moitié contamine la qualité de l'épisode pilote, et celui-là porte une responsabilité disproportionnée dans la trajectoire future de la chaîne.
L'erreur de séquencement que je vois le plus
Les créateurs qui ratent le lancement font presque toujours la même erreur : ils commencent par l'étape 5 (scaffolding HyperFrames ou équivalent technique), parce que c'est confortable et tangible. Ils renvoient à plus tard les étapes 1 à 4 (définition), parce qu'elles sont inconfortables et abstraites.
Le résultat est prévisible. À l'étape 10, ils découvrent qu'ils n'ont pas calibré la voix éditoriale, qu'ils n'ont pas verrouillé l'identité visuelle, et que leur backlog tient en trois lignes. Ils produisent un épisode 01 acceptable techniquement, médiocre éditorialement. Et la chaîne meurt entre l'épisode 04 et l'épisode 08, parce que la phase de définition n'a jamais été faite et que le doute s'installe.
L'ordre des étapes n'est pas négociable. La définition d'abord, l'infrastructure ensuite, le premier épisode en dernier. Inverser cette séquence, c'est construire une maison en commençant par les rideaux.
Si vous lancez votre première chaîne
Une dernière observation, qui résume tout le reste. Le coût d'opportunité d'une chaîne qui meurt avant l'épisode 10 est très élevé — vous y avez investi treize heures, vous avez configuré six comptes sociaux que vous abandonnerez, vous avez construit un pipeline technique qui ne tournera plus. Le coût d'opportunité d'une chaîne qui tient mais qui démarre lentement est très bas — vous avez les outils en place, le backlog est priorisé, l'inertie de production fait son travail.
Cette asymétrie devrait gouverner toutes vos décisions de séquencement. Ne précipitez pas la définition. Ne sautez pas l'étape éditoriale. Ne commencez pas le code avant d'avoir le doc. Treize heures bien dépensées sur le bon ordre valent infiniment plus que vingt heures dépensées dans le mauvais.
C'est, je pense, la seule chose qui distingue une chaîne IA qui tient deux ans d'une chaîne qui meurt à l'épisode 7.
Pour la couche d'infrastructure publication — celle qui rend les six plateformes adressables depuis un appel MCP unique — c'est exactement ce que fait Shortflow. Créer un compte ouvre un essai gratuit de sept jours avec MCP activé par défaut. Branchez-le avant l'étape 14 ; vous gagnerez une heure sur le chemin.