NouveauSeedance 2.5vient d’arriver. 30 secondes complètes, avec le son, en une seule prise.30 secondes, avec le son, une prise.Essayer tout de suiteEssayer

Pruna AI · Clips · standard

P-Video Avatar

Une photo et une piste audio deviennent un clip parlant. Le prompt est facultatif.

Ce qu’il coûte

5s · 720p10,5 crédits
5s · 1080p19 crédits

Ce qu’il accepte

Formats16:9 4:3 1:1 3:4 9:16 21:9
Résolutions720p 1080p
Durée1–15 secondes
Images de référence1
Audio de référence1
AudioToujours généré
Entrées requisesimage, audio

Quand y aller

Un modèle d’interprétation plutôt qu’un générateur : il exige une image et une piste audio, et il anime la personne de l’image pour qu’elle prononce l’audio. Le prompt est facultatif, car les deux entrées obligatoires spécifient déjà presque tout : qui parle et ce qu’il dit.

C’est de loin la voie la moins chère vers un clip de personne qui parle dans le catalogue. Dix crédits et demi pour une prise de cinq secondes en 720p, dix-neuf en 1080p. Associez-le à l’un des modèles de voix et à un seul portrait, et une prise de parole scénarisée coûte très peu par réplique.

La durée est fixée par l’audio et non choisie : elle court aussi longtemps que la piste, jusqu’à quinze secondes. C’est le bon comportement pour la synchronisation labiale, et cela veut dire que le réglage de longueur du composeur ne vous appartient pas. Pour une meilleure fidélité sur le même travail, OmniHuman 1.5 le fait en 1080p avec de meilleurs mouvements et coûte plusieurs fois plus ; pour se caler sur des *images filmées* plutôt que sur une photo, c’est Kling Lip Sync.

Fait avec lui

Comparé à

Les guides qui en parlent

P-Video Avatar est à un clic dans le composeur.

Tous les modèles de ce catalogue partent de la même barre de prompt, payés dans les mêmes crédits. Les nouveaux comptes démarrent avec de quoi dépenser.

Créez maintenant