Sujet et action
Qui ou quoi est à l'écran, et la seule chose qu'il fait. Une action claire par génération — une main qui soulève une tasse, une voiture qui démarre — se lit bien mieux qu'une chaîne d'événements compressée en quelques secondes.
Texte en vidéo
Texte en vidéo
Décrivez le sujet, l’action et le mouvement de caméra : Seedance 2.0 génère la scène jusqu’en 4K avec un son assorti. Aucune timeline, aucun plugin ni ferme de rendu.
Décrivez la scène, l’action des personnages et le mouvement de la caméra. par exemple « lentement avec un dolly sur une silhouette solitaire traversant une rue éclairée au néon sous la pluie ».
Modèle
0/2000
Sorties
Audio
Avec audio
Son, voix et musique synchronisés
Votre vidéo générée apparaîtra ici. Décrivez un plan, puis cliquez sur Générer.
Texte à vidéo est la forme la plus pure de l'outil : pas de téléversement, pas de matériel source, rien qu'une description. Seedance 2.0 lit votre phrase et produit un clip de 4 à 15 secondes jusqu'à 4K, avec éclairage, mouvement de caméra et mouvement physiquement plausible déduits des mots — plus un audio généré en synchronisation avec ce qu'il a décidé de vous montrer.
Décrivez le sujet, l’action, la caméra, la lumière et l’ambiance pour guider un nouveau plan généré. Une demande telle qu’un suivi à l’épaule derrière un cycliste à l’heure dorée donne au fournisseur des indications visuelles et de mouvement concrètes, mais la trajectoire exacte de la caméra et l’éclairage peuvent varier. L’usage commercial avec un accès payant reste soumis aux Conditions d’utilisation.
Quatre leviers, tous accessibles en langage naturel. Apprendre à les actionner délibérément, c'est toute la compétence.
Qui ou quoi est à l'écran, et la seule chose qu'il fait. Une action claire par génération — une main qui soulève une tasse, une voiture qui démarre — se lit bien mieux qu'une chaîne d'événements compressée en quelques secondes.
Travelling, panoramique, orbite, grue, plan fixe ; grand-angle, 35 mm, macro ; caméra à l’épaule ou sur pied. Ces termes guident la caméra, mais la trajectoire et le rythme générés peuvent toujours varier.
Heure dorée, ciel couvert, lumière clé dure, débordement de néon, à la bougie. La lumière fait plus pour le ressenti d'un clip que n'importe quel adjectif sur la beauté, et c'est le levier que la plupart des gens oublient de toucher.
L'échec le plus courant est d'écrire une histoire au lieu d'un plan. Un modèle avec un plafond de quinze secondes ne peut pas livrer « une femme se réveille, prépare un café, va au travail et retrouve son amie » — il tentera les quatre et n'en réussira aucun. Choisissez le seul instant qui porte l'idée et décrivez-le comme le ferait une liste de plans : sujet, action, caméra, lumière, ambiance. Si la séquence a vraiment besoin de plusieurs rebondissements, générez-les comme des prises séparées et joignez-les avec Transition vidéo.
La deuxième leçon est que la précision vaut mieux que l’enthousiasme. « Cinématographique, superbe, 8K, chef-d’œuvre » ne donne aucune instruction exploitable ; « contre-plongée 35 mm, asphalte mouillé réfléchissant le néon, lent travelling avant, pluie légère » en donne cinq. Modifiez ensuite une seule variable à la fois et comparez. Utilisez Seedance 2.0 Mini en 480p avec un coût indiqué plus faible, puis réutilisez la consigne et les références retenues dans une nouvelle génération sur le modèle phare. Chaque exécution est indépendante, le résultat peut donc varier.
« Lente approche sur un chef dressant des noix de Saint-Jacques, lumière clé au tungstène venant de la gauche, faible profondeur de champ, vapeur qui s'élève » — sujet, action, caméra, lumière, objectif, détail. Six décisions, une phrase.
Comme l'audio est généré avec l'image, nommer ce que vous voulez entendre — « grésillement, brouhaha lointain de cuisine, pas de musique » — façonne le mixage autant que l'image.
Spécifications du modèle
Des limites publiées, pas un arrondi marketing. Chaque chiffre ci-dessous est appliqué par le générateur avant que vos crédits ne soient réservés, si bien qu'une tâche qui dépasserait une limite est rejetée plutôt que d'échouer à mi-parcours.
Le modèle appartient à ByteDance. Ce que FrameAI ajoute, c'est ce qui décide s'il est réellement utilisable au travail : des limites honnêtes, une facturation honnête, et un résultat que vous avez le droit de publier.
Le texte, jusqu'à neuf images de référence et jusqu'à trois clips vidéo de référence sont fusionnés en une seule génération, pas assemblés après coup. Il n'y a pas de mode texte-à-vidéo séparé à activer — vous ajoutez le matériel dont vous disposez et le modèle le concilie.
Lorsque l’audio est activé, Seedance 2.0 génère avec la vidéo des bruits de pas, une ambiance, des impacts, des dialogues et une bande-son. Vérifiez leur contenu et leur synchronisation avant publication, ou désactivez l’audio si le clip exige un design sonore séparé.
Une seule consigne couvre un plan vertical 9:16 pour Reels, un master 16:9 pour YouTube et un cadre anamorphique 21:9 pour un générique. La résolution va de 480p au 4K, si bien que la même prise survit à un écran de cinéma comme à un téléphone.
La réservation maximale est calculée selon le modèle, la durée, la résolution, le format et l’ajout éventuel d’une vidéo de référence, puis affichée avant la validation. Après une vidéo réussie, le montant final est établi d’après la consommation transmise par le fournisseur et les crédits non utilisés sont restitués ; les échecs confirmés rendent la réservation.
Utilisez Mini pour explorer des consignes à moindre coût, Fast lorsque vous souhaitez équilibrer vitesse de génération et coût, et Seedance 2.0 pour la meilleure qualité avec une sortie jusqu’en 4K. Changer de modèle lance une nouvelle génération : les résultats peuvent varier.
Les contenus générés avec un abonnement payant ou un pack de crédits acheté peuvent être utilisés à des fins commerciales conformément aux Conditions d’utilisation. Les contenus créés uniquement avec des crédits d’inscription gratuits ou promotionnels sont réservés à l’évaluation et à un usage personnel.
Modifiez une seule variable à la fois pour garder chaque itération ciblée. Le temps de génération varie selon le modèle, les réglages, les références et la charge du fournisseur.
Nommez le sujet, l'action unique, le mouvement de caméra et la lumière. Évitez les adjectifs qui veulent dire « bien » — ils ne portent aucune information exploitable par le modèle.
Vertical pour le fil, 16:9 pour le web, 21:9 pour quelque chose de cinématographique. Commencez court et en basse résolution tant que vous testez encore ; le compteur de crédits vous indique ce que chaque choix coûte.
Examinez le résultat et modifiez une seule variable — l'objectif, la lumière, le verbe. Deux ou trois passes suffisent généralement, et vous apprenez quel mot faisait le travail.
C'est le plus fort précisément là où il n'y a rien à filmer et pas de temps pour construire.
Une consigne écrite permet d’explorer des panoramas urbains, des ambiances météo, des intérieurs et des textures abstraites. Chaque résultat est une nouvelle interprétation : vérifiez le plan par rapport au montage avant de l’utiliser.
Avant que quoi que ce soit ne soit conçu ou tourné, générez cinq interprétations d'un brief et présentez-les. Débattre d'images en mouvement est bien plus productif que débattre d'adjectifs.
Publier chaque jour est difficile avec un calendrier de tournage, mais plus réaliste avec une consigne. Le format vertical et le son synchronisé facultatif peuvent réduire la préparation en postproduction, mais vérifiez l’image, le son et le contenu avant publication. L’usage commercial exige que le contenu ait été généré avec un abonnement payant ou un pack de crédits acheté et reste soumis aux Conditions d’utilisation.
Cela génère un clip vidéo à partir d'une description écrite seule, sans séquence ni image téléversée. Sur FrameAI, Seedance 2.0 produit des clips de 4 à 15 secondes jusqu'à 4K, avec le mouvement de caméra, l'éclairage et l'audio synchronisé déduits de votre consigne.
Une ou deux phrases précises valent mieux qu'un paragraphe. Couvrez le sujet, l'action, la caméra et la lumière ; laissez tomber des mots comme « cinématographique » et « chef-d'œuvre », qui n'ajoutent aucune information. Le champ accepte jusqu'à 2000 caractères, mais vous en aurez rarement besoin d'une fraction.
FrameAI accepte les consignes rédigées en anglais ou en chinois. Employez des termes concrets pour le sujet, l’action et la caméra, puis vérifiez le résultat généré, car l’interprétation peut varier dans les deux langues.
Généralement, la consigne demandait trop à la fois. Réduisez-la à une seule action avec un seul comportement de caméra, puis rajoutez du détail un élément à la fois. Les qualificatifs vagues nuisent aussi — remplacez-les par des noms concrets, des choix d'objectif et des termes d'éclairage.
Oui. Une consigne peut demander un travelling, un panoramique, une orbite, une grue, une caméra à l'épaule ou un plan fixe. Le modèle interprète ces termes comme des indications, et le résultat peut varier. Le contrôle du mouvement précise la direction de caméra sans garantir une trajectoire image par image.
Autant que vos crédits le permettent : aucun plafond quotidien. Un brouillon Seedance 2.0 Mini en 480p a une réservation maximale inférieure à une génération 4K sur le modèle phare. La réservation s’affiche avant validation. Après une vidéo réussie, le montant final est établi d’après la consommation transmise par le fournisseur et les crédits non utilisés sont restitués. Chaque tentative est une nouvelle génération.
Chaque outil est le même modèle Seedance 2.0 appliqué à une tâche différente. Passez librement de l'un à l'autre — vos crédits, votre historique et vos exports sont partagés.
Écrivez une ligne, choisissez un format, cliquez sur générer. Pas de suite de montage, pas de ferme de rendu, pas de post-production — un clip fini avec du son, prêt à télécharger.