Dossier
SMF·HEADLINER
Reçu le
31.07.2026
Instruit le
28.09.2026
Pièces annexées
3
Questions
4

SMF·HEADLINER

Un prompt peut-il remplacer Headliner ?

Montage audio et vidéo — podcast recording, cleanup and publishing

Presque Verdict enregistré le 28.09.2026 · Vérifié le 31.07.2026
Prix
19,99 $US/moisSource: headliner.app · Vérifié le 31 juillet 2026
Par an
239,88 $US
Temps de fabrication
Une semaine
Votes
0 vote
OuiPresque (coché)Pas encore

Bordereau de suivi des pièces

Pièce A Le prompt
Pièce B Ce que tu perds
Pièce C Pourquoi certains continuent de payer : audio infrastructure, distribution, and production polish
Pièce Q Questions

Verdict

Un audiogramme, c’est une image fixe, une forme d’onde animée, et des sous-titres incrustés, rendus en vidéo. Chaque partie de ça, c’est ffmpeg et une transcription, et une version fonctionnelle, c’est un week-end. Là où ça s’étire, c’est la finition : un timing de sous-titres qui casse aux limites de phrase plutôt qu’en plein milieu d’un mot, une forme d’onde qui se lit bien à 400 pixels de large, et une file de rendu qui ne bloque pas ta machine pendant dix minutes par clip.

Pièce B — Ce que tu perds

Pièce A — Le prompt

Reçu le31.07.2026
Construis un générateur d’audiogramme local : de l’audio en entrée, une vidéo sociale sous-titrée en sortie.

Entrée : un fichier audio ou vidéo. Montre une forme d’onde de tout le fichier et laisse l’utilisateur sélectionner un segment en glissant, avec un ajustement fin au clavier et un aperçu de juste ce segment. Sélectionner le clip, c’est la majorité du travail en pratique, donc rends ça rapide.

Transcription : lance whisper.cpp en local sur le segment sélectionné pour obtenir des horodatages au mot près. Au mot près, pas au segment près — le timing des sous-titres en dépend.

Sous-titres, là où la qualité se joue vraiment. Groupe les mots en lignes de sous-titre en utilisant ces règles, toutes configurables :

- Un maximum de N caractères par ligne et M lignes à l’écran à la fois.
- Casser à la ponctuation d’abord, puis à une conjonction ou préposition, et seulement ensuite à la limite de caractères. Ne jamais casser en plein milieu d’un mot.
- Une durée minimum à l’écran par sous-titre, en étendant les courts en empruntant à l’espace qui suit.
- Surlignage optionnel au mot près, où le mot actuellement prononcé est mis en emphase dans la ligne visible.

Rends chaque sous-titre depuis la transcription corrigée, et rends la transcription modifiable avant le rendu — le modèle se trompera sur les noms et le jargon et les corriger après coup veut dire re-rendre.

Visuels : une image de fond ou une couleur unie, un titre, et une forme d’onde animée pilotée par l’amplitude audio réelle, dans l’un de trois styles (barres, ligne, cercle). Position et taille sont choisies parmi un petit ensemble de mises en page, pas par placement libre.

Formats : rends le même clip en carré (1:1), vertical (9:16) et paysage (16:9) en une passe, avec la mise en page qui s’adapte par format et un guide de zone de sécurité montré dans l’aperçu pour que les sous-titres ne se retrouvent pas sous l’interface propre d’une plateforme.

Rendu : compose les images et assemble avec ffmpeg. Montre une vraie barre de progression avec un temps estimé, lance le rendu dans un processus en arrière-plan pour que l’interface reste utilisable, et permets l’annulation sans laisser un fichier à moitié écrit.

Fichiers de projet : stocke la sélection de clip, la transcription corrigée, la mise en page et le style en JSON pour qu’un clip puisse être re-rendu après une correction de sous-titre sans refaire le travail.

Hors périmètre : le nettoyage ou mastering audio, une bibliothèque de médias stock, la sélection automatique de clip, la publication directe vers n’importe quelle plateforme, et tout rendu hébergé.

L’ouverture pré-remplit le prompt — il ne reste qu’à appuyer sur entrée.

Pièce B — Ce que tu perds

  • B.1 le rendu cloud — les longs clips occupent ta propre machine
  • B.2 la bibliothèque de templates et de médias stock
  • B.3 des suggestions automatiques de quels segments valent la peine d’être extraits
  • B.4 les préréglages de plateforme tenus à jour à mesure que les specs sociales changent

Alternatives existantes

Pièce C — Pourquoi certains continuent de payer : audio infrastructure, distribution, and production polish

Parce que le rendu est lent et que les préréglages se périment. Un outil qui connaît déjà le ratio d’aspect de ce mois-ci et les règles de zone de sécurité pour quatre plateformes vaut plus que le code de rendu en dessous.

Questions

Puis-je importer mes projets Headliner ?

Non. Les projets Headliner vivent dans son propre éditeur sans export au-delà des fichiers vidéo finis, qui restent utilisables. Les sélections de clip et les corrections de sous-titres se reconstruisent ici, ce qui pour un catalogue existant ne vaut pas la peine — commence avec de nouveaux épisodes.

Combien de temps prend un rendu ?

Environ le temps réel à quelques fois le temps réel sur un ordinateur portable moderne, selon la résolution et le style de forme d’onde, donc un clip de 60 secondes en trois formats prend quelques minutes. C’est la différence fondamentale avec un moteur de rendu cloud, et c’est pourquoi le prompt insiste pour que le rendu tourne en arrière-plan.

Combien ça coûte à faire tourner ?

Rien après le téléchargement du modèle Whisper. La transcription et le rendu sont tous deux locaux, donc un nombre illimité de clips ne coûte que le temps de ta machine — ce qui est l’argument le plus fort pour construire celui-ci soi-même.

Quelle est la seule chose qui ne survit pas à la reconstruction ?

Savoir quoi extraire. Headliner suggère des segments qui valent la peine d’être sortis, et choisir les bonnes 45 secondes d’une heure, c’est la partie qui détermine vraiment si le clip performe. Un sélecteur manuel te laisse ça entièrement.

Récépissé

Tu l’as déjà reconstruit toi-même ?