En haut : les 2 POC « hyper pro ». En bas : le format actuel (diaporama + carrousel).
Tes retours appliqués : les VOIX SONT CELLES DU V7 que tu as validées — extraites du V7 au mot près (Whisper), puis nettoyées : silence total entre les mots et entre les répliques, « bruits de proute » (friture glottale d'Aubergio après « Hmm », « Tamise », « dit ») supprimés par remontée anti-fry, fond sonore retiré. Mesure : 23 pauses sur 23 à 0,00 s de bruit. Production : 2 min 17 s (rendu parallèle + réutilisation des voix validées). QA usine : tout vert ✅.
Ton retour appliqué : les bruits ENTRE les répliques (souffles/clics résiduels de la voix IA, mesurés à −35/−42 dB dans chaque pause du V8) sont éliminés — chaque prise est rognée sur la vraie parole, notée sur sa propreté (une prise bruitée est refaite), et le fond sonore a été entièrement retiré. Mesure objective : 17 pauses sur 18 en silence numérique pur. Rendu vidéo accéléré (3 navigateurs en parallèle). QA usine : tout vert ✅.
Tes retours appliqués : les sons « Mmh/Haha » hors bulles sont SUPPRIMÉS (c'étaient eux qui parasitaient), et chaque réplique est désormais transcrite par Whisper et comparée au texte — une prise où la voix déforme un mot est rejetée et refaite automatiquement. Décor : poufs bibliothèque (validé). QA usine : tout vert ✅.
Tes retours appliqués : MUSIQUE SUPPRIMÉE (plus de bruit de fond), voix d'Aubergio changée (référence Rémy, plus chaude), multi-takes (2-3 prises par réplique, la plus naturelle est gardée), yeux redessinés (pupilles centrées, regard vivant), logo en zone sûre Instagram. QA automatique : tout vert ✅. C'est CE standard que l'usine reproduira chaque jour.
Room tone continu (plus de silence numérique = liaisons naturelles), réactions « Mmh / Haha » du perso qui écoute pendant les pauses, mastering podcast pro (-16 LUFS, compression, coupe-bas), nappe musicale chaude qui s'efface sous la voix (ducking), tours de parole variables. + fixes : ponctuation française dans les bulles, bouches agrandies, yeux adoucis, regard caméra sur le hook et le CTA, micro-dérive caméra permanente.
Banque VALIDÉE par Antoine (thème cocooning chaleureux) : salon canapé ⭐ + poufs bibliothèque ⭐, et 2 nouveaux salons cocooning en génération (poufs+plaids+bougies, coin lecture+guirlandes).




Regards croisés (chacun regarde l'autre), lip-sync 3 formes de bouche, gestes variés (coucou/pointer/haussement d'épaules), mugs cœur assortis + casque + néon « ♥ Boutique du Plaisir » sur la table, boucle parfaite (la fin revient sur la scène), bulles affichées le temps d'être LUES, et voix Chatterbox CORRIGÉES (les pauses naturelles sont préservées — le bug qui pressait/robotisait la voix est réparé).
Nouveau : corps humains (robe, chemise-cravate, bras, jambes) avec tête de pêche / d'aubergine — plus humains, lecture immédiate. Voix Chatterbox (open-source, les plus naturelles), prénoms dans le dialogue, hook en bandeau (la scène reste visible), carte de fin signée.

Bulles redessinées (étiquette 🍑/🍆, couleurs par locuteur, texte aéré), pitch-shift artificiel supprimé (la ponctuation fait l'intonation). Persos pleine couleur, studio néon.
Écoute les 3 et dis-moi lequel sonne le plus naturel / le moins IA. C'est lui qu'on gardera partout.
D — Chatterbox (open-source, le + naturel) ⭐ nouveau
A — Vivienne + Rémy (multilingues)
B — Denise + Henri
C — Éloïse + Henri
Studio IA chaleureux (brique+néon), micros aux bouches, hochements de tête, voix avec prosodie (débit/hauteur par émotion, pauses irrégulières), vrai dialogue avec rire et teasing, persos jamais délavés.
Deux fruits mascottes assis à une table de podcast avec micros, caméra calme (plan à deux + zooms lents, sans coupures brutales), dialogue naturel. Format qui cartonne.
Pêche & aubergine mascottes (gants, chaussures, bras qui fait coucou sur les gestes), décor IA détaillé, angles multiples, fluide + synchro + voix naturelle. La version la plus aboutie.
Fond généré par l'IA (détaillé/réaliste) + pêche/aubergine + caméra qui coupe entre plan large, plan à deux et gros plans sur le locuteur. Fluide, synchro, voix naturelle.
Décor en 3 plans qui glissent à des vitesses différentes (parallaxe), arrière-plan flou / fruits nets (profondeur de champ), caméra en légère perspective. 4 lieux dispo (salon/chambre/terrasse/bar).
Cast fruits (on comprend direct 😏), moteur déterministe (0 saccade, 0 désynchro), voix multilingues, salon animé + bulles + hook + carte de fin.
Gestes (main), hook percutant (90%…), rythme serré, carte de fin CTA, décor enrichi (table, plantes), bulles bien placées, expressions accentuées, respiration, caméra. La version complète.
Caméra qui pousse vers le locuteur, expressions (surprise/curiosité/sourire), respiration, bulles manga + sous-titres mot-à-mot + hook animé. Toutes tes demandes.
Persos animés (bouche, yeux, mise en avant du locuteur) dans le salon + bulles de dialogue au-dessus de la tête + hook + voix off. La base qu'on améliore.
Personnages anime générés en local (gratuit), montés en Reel : hook, plans Elle/Lui, voix off, sous-titres. La direction premium.
Les 2 persos générés :

Persos assis dans un vrai salon (déco, canapé, lumière), accroche des 2 premières secondes, yeux anime, dialogue H/F. La direction premium.
Personnages illustrés qui se parlent, voix H/F, bouche + yeux animés, sous-titres synchronisés, fond studio premium. Le format cible.

↑ la variété : 4 palettes × décors × formats × looks
2 personnages dessin qui se parlent, voix H/F, bouche animée, sous-titres « Elle/Lui » synchronisés. 100% maison, sans GPU ni licence.
Voix off française + sous-titres mot-à-mot synchronisés sur fond brandé animé. Sans personnages.












