Dans cette réponse
Comment les références et les paramètres de sortie affectent-ils la génération ?
Références et paramètres de sortie
Comprenez comment le média source, le rapport hauteur/largeur, la résolution, la durée et les choix vocaux contrôlent la génération.
Les paramètres de génération sont des contraintes créatives et non des préférences décoratives. Définissez-les en fonction de l’utilisation finale du bien.
Médias sources et références
Vous pouvez ajouter des médias compatibles à partir de votre appareil ou sélectionner des médias de marque existants lorsque le modèle accepte ce type d'entrée. Une référence peut établir l’identité du sujet, l’apparence du produit, la composition, le style, le mouvement ou le dialogue, mais on ne peut pas s’attendre à ce qu’une seule référence contrôle tous ces éléments de la même manière.
Utilisez le moins de références qui communiquent clairement l’exigence. Des références contradictoires peuvent rendre ambiguë la priorité souhaitée. La capacité du modèle détermine les types de supports acceptés et les limites de référence.
Rapport hauteur/largeur
Choisissez le rapport à partir de la destination : vertical pour les histoires et de nombreux emplacements courts, carré pour les présentations de flux équilibrées et horizontal pour les surfaces paysagères. Recomposer plutôt que de compter sur une culture destructrice lorsque la destination change.
Résolution
La résolution affecte les dimensions de sortie, le traitement et parfois l'estimation. Sélectionnez-le uniquement une fois que le format et le concept sont stables. Un fichier de plus haute résolution ne répare pas une composition faible ou un sujet inexact.
Durée
Pour la vidéo et l’audio, la durée change ce qui peut arriver et combien la diffusion peut coûter. Rédigez un brief qui correspond au moment choisi. Un court clip doit généralement exprimer un mouvement ou un moment plutôt qu’une histoire complète multi-scènes.
Mode voix et audio
La sélection vocale apparaît uniquement pour les itinéraires vocaux compatibles. Prévisualisez une voix lorsque cela est possible, puis testez-la avec un langage de marque représentatif. Le mode audio modifie le type d'instruction attendu par le système : un script vocal est différent d'un résumé musical ou d'une description de scène sonore.
Préserver la provenance
Gardez l'actif source et le résultat généré distincts. La synchronisation labiale crée une nouvelle vidéo plutôt que de remplacer l'originale. Les modèles de workflow conservent également les entrées sources réutilisables séparément des exemples générés.
Cette réponse vous a-t-elle été utile ?