7ART

Modèles d'IA sur 7ART

75 Des moteurs dédiés à la vidéo, à l’image, à la musique, à la voix, aux avatars et à la 3D — le tout dans un seul flux de travail, avec un seul solde de crédits. Nous ajoutons de nouveaux modèles de haut niveau dès que nous obtenons l’accès à l’API.

Chaque durée, niveau de qualité et prix indiqués ci-dessous correspondent à ce que 7ART propose et facture pour ce modèle — ces informations sont tirées des tableaux du studio lui-même, et non d’une fiche technique du fournisseur.

Dans le catalogue d'aujourd'hui

22 vidéo · 25 image · 6 musique · 11 voix et audio · 5 avatar et synchronisation labiale · 6 3d

01 / Vidéo

Modèles vidéo

Elles divergent sur presque tout — durée du clip, résolution maximale, utilisation ou non d’une vidéo de référence — ; ce qui distingue donc chaque carte, c’est la différence qu’elle apporte, et non l’argument de vente.

Ouvrez le studio vidéo
7Video sur 7ARTVidéo7ART préréglage
7ART

7Video

7ART

Durée
5 à 15 s
Qualité
768p / 2K
Données d'entrée
Image de départ et image finale, ou références d’images, de vidéos ou de fichiers audio

Crédits

10 % au-dessus du tarif de base du moteur

Afficher le modèle
Gemini Omni Flash sur 7ARTVidéo
Google

Gemini Omni Flash

Modèle d’Google e multimodal fonctionnant entièrement à partir de son propre panel de référence : images, extrait vidéo, personnages et voix enregistrés, sans cartes d’images.

Durée
4, 6, 8 ou 10 s
Niveaux de qualité des résultats
720p / 1080p / 4K
Aspect
16:9 ou 9:16

Crédits

90 / 120 / 150 / 180 pour 4 / 6 / 8 / 10 s en 720p ou 1080p · 210 / 240 / 270 / 300 en 4K · forfait de 240 (720p/1080p) ou 360 (4K) avec une référence vidéo

Afficher le modèle
VEO sur 7ARTVidéo
Google3 modèles

VEO

3.1 Quality: Google

Durée
4, 6 ou 8 s
Qualité
Aperçu / 1080p / 4K
Données d'entrée
Image de départ + image finale
  • 3.1 Quality
  • 3.1 Fast
  • 3.1 Lite

Crédits · 3.1 Quality

Forfait par génération : 250 aperçus · 255 en 1080p · 370 en 4K

Afficher le modèle
Seedance sur 7ARTVidéo
4 modèles

Seedance

2.5: Les clips les plus longs du studio, un audio généré avec la vidéo et de loin le plus large ensemble de références — jusqu’en 1080p (pas de niveau 4K).

Durée
4 à 30 s
Qualité
480p / 720p / 1080p
Références
30 images · 10 vidéos · 10 fichiers audio
  • 2.5
  • 2.0
  • 2.0 Fast
  • 2.0 Mini

Crédits · 2.5

37/s en 480p · 79/s en 720p · 208/s en 1080p

Afficher le modèle
Kling sur 7ARTVidéo
Kling AI5 modèles

Kling

3.0: L’Kling la plus performante — personnages, son synchronisé, prises de vue multiples et qualité 4K.

Durée
3 à 15 s
Qualité
720p / 1080p / 4K
Données d'entrée
Image de départ ; image de fin hors mode multi-prises
  • 3.0
  • 3.0 Turbo
  • 2.6
  • 2.5 Turbo
  • + 1, etc.

Crédits · 3.0

14 par seconde en 720p · 18 par seconde en 1080p · 20 / 27 par seconde avec audio · 67 par seconde en 4K

Afficher le modèle
Grok Imagine (video) sur 7ARTVidéo
xAI

Grok Imagine (video)

Animations dynamiques, conversion de texte et d’images en vidéo, et le tarif à la seconde le plus bas du studio.

Durée
6 à 30 s
Qualité
480p / 720p
Données d'entrée
Image de départ

Crédits

1,6 image/seconde en 480p · 3 images/seconde en 720p

Afficher le modèle
MiniMax H3 sur 7ARTVidéo
MiniMax

MiniMax H3

Quatre niveaux de qualité — de 480P à 4K — première à dernière image, et références image, vidéo et audio.

Durée
5 à 15 s
Qualité
480P / 768P / 2K / 4K
Données d'entrée
Image de départ et image finale, ou 9 images / 3 vidéos / 3 fichiers audio

Crédits

10/s en 480P · 22,5/s en 768P · 36,5/s en 2K · 32/s en 4K, plus les secondes de toute vidéo de référence et 11 crédits par image de référence au-delà des 5 premières

Afficher le modèle
HappyHorse 1.1 sur 7ARTVidéo
Alibaba

HappyHorse 1.1

Texte, image ou référence multiple à une vidéo — images uniquement, aucune référence vidéo ou audio.

Durée
3 à 15 s
Qualité
720p / 1080p
Données d'entrée
Image de départ ou images de référence

Crédits

33 images par seconde en 720p · 44 images par seconde en 1080p

Afficher le modèle
Wan sur 7ARTVidéo
3 modèles

Wan

2.7: Quatre modes en un — texte vers vidéo, image vers vidéo, montage vidéo et référence vers vidéo — avec audio d’accompagnement, expansion de la consigne et consignes négatives.

Durée
5, 10 ou 15 s
Qualité
720p / 1080p
Données d'entrée
Image de départ, image finale, vidéo de référence, piste audio de pilotage
  • 2.7
  • 2.6
  • 2.5

Crédits · 2.7

16 images par seconde en 720p · 24 images par seconde en 1080p

Afficher le modèle
MMAudio v2 sur 7ARTVidéo

MMAudio v2

Génère une piste de bruitages pour un clip qui n'en comporte pas.

Résultat
Son multiplexé sur le clip source

Crédits

Tarif forfaitaire de 5 par exécution

Afficher le modèle
Luma Ray-2 Modify sur 7ARTVidéo
Luma

Luma Ray-2 Modify

Permet de remodeler un clip existant de bout en bout.

Résultat
L'intégralité du clip source, remaniée

Crédits

600 Flat par exécution

Afficher le modèle
Tous les moteurs d'22s vidéo, avec l'ensemble des caractéristiques techniques et des tarifs
ModèleÀ quoi cela sert-il ?Caractéristiques techniquesCrédits
7Video7ART7ART
  • Durée: 5 à 15 s
  • Qualité: 768p / 2K
  • Données d'entrée: Image de départ et image finale, ou références d’images, de vidéos ou de fichiers audio
10 % au-dessus du tarif de base du moteur
Gemini Omni FlashGoogleModèle d’Google e multimodal fonctionnant entièrement à partir de son propre panel de référence : images, extrait vidéo, personnages et voix enregistrés, sans cartes d’images.Répertorié dans le sélecteur 7ART sous le nom «Gemini Omni Video» — ce nom provient du point de terminaison de notre fournisseur, et non de Google.
  • Durée: 4, 6, 8 ou 10 s
  • Niveaux de qualité des résultats: 720p / 1080p / 4K
  • Aspect: 16:9 ou 9:16
  • Références: 7 images · 1 clip vidéo · 3 personnages · 3 voix
90 / 120 / 150 / 180 pour 4 / 6 / 8 / 10 s en 720p ou 1080p · 210 / 240 / 270 / 300 en 4K · forfait de 240 (720p/1080p) ou 360 (4K) avec une référence vidéo
VEO 3.1 QualityGoogleGoogle
  • Durée: 4, 6 ou 8 s
  • Qualité: Aperçu / 1080p / 4K
  • Données d'entrée: Image de départ + image finale
Forfait par génération : 250 aperçus · 255 en 1080p · 370 en 4K
VEO 3.1 FastGoogleVEO plus rapide, et le seul forfait acceptant des photos de référence.
  • Durée: 4, 6 ou 8 s
  • Qualité: Aperçu / 1080p / 4K
  • Données d'entrée: Images de début et de fin, ou jusqu’à 3 photos de référence
Forfait par génération : 60 aperçus · 65 en 1080p · 180 en 4K
VEO 3.1 LiteGoogleL’VEO, à un prix abordable — idéale pour faire des essais.
  • Durée: 4, 6 ou 8 s
  • Qualité: Aperçu / 1080p / 4K
  • Données d'entrée: Image de départ + image finale
Forfait par génération : 30 aperçus · 35 en 1080p · 150 en 4K
Seedance 2.5ByteDanceLes clips les plus longs du studio, un audio généré avec la vidéo et de loin le plus large ensemble de références — jusqu’en 1080p (pas de niveau 4K).
  • Durée: 4 à 30 s
  • Qualité: 480p / 720p / 1080p
  • Références: 30 images · 10 vidéos · 10 fichiers audio
  • Aspect: 21:9, 16:9, 4:3, 1:1, 3:4, 9:16 ou auto
37/s en 480p · 79/s en 720p · 208/s en 1080p
Seedance 2.0ByteDanceDes personnes réalistes avec une forte cohérence d’identité et des séquences multi-plans cinématographiques ; le seul niveau Seedance qui produit de la 4K.
  • Durée: 4 à 15 s
  • Qualité: 480p / 720p / 1080p / 4K
  • Références: 9 images · 3 vidéos · 3 fichiers audio
19 / 41 / 102 / 311 par seconde en 480p / 720p / 1080p / 4K · avec une vidéo de référence : 11,5 / 25 / 62 par seconde sur la durée d’entrée + de sortie (pas de tarif avec vidéo en 4K)
Seedance 2.0 FastByteDanceSeedance 2.0 s allégées pour les brouillons et les aperçus.
  • Durée: 4 à 15 s
  • Qualité: 480p / 720p
  • Références: 9 images · 3 vidéos · 3 fichiers audio
15,5/sec à 480p · 33/sec à 720p · avec une référence vidéo : 9/20 par seconde sur les secondes d’entrée et de sortie
Seedance 2.0 MiniByteDanceLe niveau d’Seedance s le plus économique.
  • Durée: 4 à 15 s
  • Qualité: 480p / 720p
  • Références: 9 images · 3 vidéos · 3 fichiers audio
9,5/seconde en 480p · 20,5/seconde en 720p · avec une référence vidéo : 6 / 12,5 par seconde sur les secondes d’entrée et de sortie
Kling 3.0Kling AIL’Kling la plus performante — personnages, son synchronisé, prises de vue multiples et qualité 4K.
  • Durée: 3 à 15 s
  • Qualité: 720p / 1080p / 4K
  • Données d'entrée: Image de départ ; image de fin hors mode multi-prises
  • Audio: Facultatif — augmente le tarif par seconde
14 par seconde en 720p · 18 par seconde en 1080p · 20 / 27 par seconde avec audio · 67 par seconde en 4K
Kling 3.0 TurboKling AIKling 3.0 plus rapide, du texte et de l'image vers la vidéo.
  • Durée: 3 à 15 s
  • Qualité: 720p / 1080p
  • Données d'entrée: Image de départ
18 images/seconde en 720p · 22,5 images/seconde en 1080p
Kling 2.6Kling AIFiable et performant en matière d’animation, avec du son.
  • Durée: 5 ou 10 s
  • Qualité: 720p / 1080p
  • Données d'entrée: Image de départ
11/sec · 22/sec avec audio
Kling 2.5 TurboKling AILe moteur de création de brouillons le plus rapide et le moins cher.
  • Durée: 5 ou 10 s
  • Qualité: 720p
  • Données d'entrée: Image de départ
9/sec
Kling 3.0 Motion ControlKling AITransfert de mouvement : il s'agit de récupérer le mouvement d'un clip et de l'appliquer à un nouveau sujet.Fonctionne dans le studio Motion, et non dans le sélecteur de modèles vidéo.
  • Qualité: 720p / 1080p
  • Données d'entrée: Image de départ
20 images par seconde en 720p · 27 images par seconde en 1080p
Grok Imagine (video)xAIAnimations dynamiques, conversion de texte et d’images en vidéo, et le tarif à la seconde le plus bas du studio.
  • Durée: 6 à 30 s
  • Qualité: 480p / 720p
  • Données d'entrée: Image de départ
1,6 image/seconde en 480p · 3 images/seconde en 720p
MiniMax H3MiniMaxQuatre niveaux de qualité — de 480P à 4K — première à dernière image, et références image, vidéo et audio.Les références ne sont envoyées que lorsqu’il n’y a pas d’image de départ — le panneau en masque une pendant que l’autre est utilisée.
  • Durée: 5 à 15 s
  • Qualité: 480P / 768P / 2K / 4K
  • Données d'entrée: Image de départ et image finale, ou 9 images / 3 vidéos / 3 fichiers audio
  • Aspect: 21:9, 16:9, 4:3, 1:1, 3:4, 9:16
10/s en 480P · 22,5/s en 768P · 36,5/s en 2K · 32/s en 4K, plus les secondes de toute vidéo de référence et 11 crédits par image de référence au-delà des 5 premières
HappyHorse 1.1AlibabaTexte, image ou référence multiple à une vidéo — images uniquement, aucune référence vidéo ou audio.
  • Durée: 3 à 15 s
  • Qualité: 720p / 1080p
  • Données d'entrée: Image de départ ou images de référence
33 images par seconde en 720p · 44 images par seconde en 1080p
Wan 2.7Quatre modes en un — texte vers vidéo, image vers vidéo, montage vidéo et référence vers vidéo — avec audio d’accompagnement, expansion de la consigne et consignes négatives.
  • Durée: 5, 10 ou 15 s
  • Qualité: 720p / 1080p
  • Données d'entrée: Image de départ, image finale, vidéo de référence, piste audio de pilotage
16 images par seconde en 720p · 24 images par seconde en 1080p
Wan 2.6Transformez une vidéo existante ; plusieurs scènes.
  • Durée: 5, 10 ou 15 s
  • Qualité: 720p / 1080p
  • Données d'entrée: Image de départ, vidéo de référence
14 images/seconde en 720p · 21 images/seconde en 1080p
Wan 2.5Cette fonctionnalité développe pour vous les prompts courts en descriptions plus détaillées.
  • Durée: 5 ou 10 s
  • Qualité: 720p / 1080p
  • Données d'entrée: Image de départ
12 images/seconde en 720p · 20 images/seconde en 1080p
MMAudio v2Génère une piste de bruitages pour un clip qui n'en comporte pas.Le processus s'exécute à partir des actions d'édition d'un clip, et non à partir du sélecteur de modèles.
  • Résultat: Son multiplexé sur le clip source
Tarif forfaitaire de 5 par exécution
Luma Ray-2 ModifyLumaPermet de remodeler un clip existant de bout en bout.Le processus s’exécute à partir des actions d’édition d’un clip, et non à partir du sélecteur de modèles.
  • Résultat: L'intégralité du clip source, remaniée
600 Flat par exécution

02 / Image

Modèles d'images

Le nombre d’images de référence indiqué ici correspond au nombre que le fournisseur principal reçoit effectivement ; ce n’est pas toujours le nombre que la zone de téléchargement vous permet de déposer. FLUX génère environ 1 MP à chaque niveau, quelle que soit la résolution indiquée.

Ouvrez l'atelier d'images
7Image sur 7ARTImage7ART préréglage
7ART

7Image

7ART

Résolutions
1K / 2K / 4K
Références
Jusqu’à 16

Crédits

10 % au-dessus du tarif de base du moteur

Afficher le modèle
Nano Banana sur 7ARTImage
Google2 modèles

Nano Banana

2: Jusqu’à 14 images de référence : le choix le plus sûr pour garantir la cohérence d’un visage.

Résolutions
1K / 2K / 4K
Références
Jusqu’à 14
  • 2
  • Pro

Crédits · 2

16 / 24 / 32 par image en 1K / 2K / 4K

Afficher le modèle
Seedream sur 7ARTImage
ByteDance3 modèles

Seedream

5 Lite: Économique et rapide.

Résolutions
2K / 3K
Références
Jusqu’à 10
  • 5 Lite
  • 4.5
  • 4.0

Crédits · 5 Lite

6 en 2K · 8 en 3K

Afficher le modèle
GPT Image 2.5 sur 7ARTImage
OpenAI2 modèles

GPT Image 2.5

Flare: L’GPT Image 2.5 par défaut. Les modifications ne concernent que ce que vous avez demandé et laissent inchangés le sujet, la composition et l’arrière-plan.

Résolutions
1K / 2K / 4K
Références
Jusqu’à 16
  • Flare
  • Sunburst

Crédits · Flare

À partir de 7 crédits par image. Une image au format grand écran 16:9 coûte 9 crédits en 1K, 12 en 2K et 21 en 4K ; une image carrée coûte plus cher, jusqu'à 36 crédits.

Afficher le modèle
GPT Image 2 sur 7ARTImage
OpenAI

GPT Image 2

Jusqu’à 16 références ; l’IA est particulièrement performante pour suivre les instructions et intégrer du texte dans l’image.

Résolutions
1K / 2K / 4K
Références
Jusqu’à 16

Crédits

8 / 11 / 20 par image en 1K / 2K / 4K

Afficher le modèle
Z-Image sur 7ARTImage
Alibaba

Z-Image

Des modèles de conversion texte-image à petit prix — aucune image de référence n’est nécessaire.

Résultat
2K, qualité unique et fixe
Références
Aucun — conversion texte-image uniquement

Crédits

2 par image

Afficher le modèle
Grok Imagine (image) sur 7ARTImage
xAI

Grok Imagine (image)

Texte et image-vers-image : un forfait unique vous permet d'obtenir un lot complet.

Résultat
2K, qualité unique et fixe
Références
1
Traitement par lots
6 images en mode « vitesse » · 4 en mode « qualité »

Crédits

4 par génération en mode « vitesse » · 5 en mode « qualité »

Afficher le modèle
FLUX sur 7ARTImage
Black Forest Labs12 modèles

FLUX

FLUX.2 Pro: Réalisme et typographie de haut niveau.

Résultat
~1 MP
  • FLUX.2 Pro
  • FLUX.2
  • FLUX.2 Turbo
  • FLUX.2 Flash
  • + 8, etc.

Crédits · FLUX.2 Pro

6 par image

Afficher le modèle
Clarity Upscaler sur 7ARTImage

Clarity Upscaler

Permet d’agrandir une image unique, par défaut au double de sa taille d’origine.

Entrée
Exactement 1 image

Crédits

24 par session

Afficher le modèle
IC-Light v2 sur 7ARTImage

IC-Light v2

Permet de rééclairer une seule image.

Entrée
Exactement 1 image

Crédits

20 par exécution

Afficher le modèle
Tous les moteurs d'25s image, avec l'ensemble des caractéristiques techniques et des tarifs
ModèleÀ quoi cela sert-il ?Caractéristiques techniquesCrédits
7Image7ART7ART
  • Résolutions: 1K / 2K / 4K
  • Références: Jusqu’à 16
10 % au-dessus du tarif de base du moteur
Nano Banana 2GoogleJusqu’à 14 images de référence : le choix le plus sûr pour garantir la cohérence d’un visage.
  • Résolutions: 1K / 2K / 4K
  • Références: Jusqu’à 14
16 / 24 / 32 par image en 1K / 2K / 4K
Nano Banana ProGoogleComposition multi-images.
  • Résolutions: 1K / 2K / 4K
  • Références: Jusqu’à 8
30 / 30 / 60 par image en 1K / 2K / 4K
Seedream 5 LiteByteDanceÉconomique et rapide.
  • Résolutions: 2K / 3K
  • Références: Jusqu’à 10
6 en 2K · 8 en 3K
Seedream 4.5ByteDanceLe niveau « mid-Seedream ».
  • Résolutions: 2K / 4K
  • Références: Jusqu’à 10
7 en 2K · 9 en 4K
Seedream 4.0ByteDanceLa gamme de résolutions la plus étendue de Seedream s.
  • Résolutions: 1K / 2K / 4K
  • Références: Jusqu’à 10
5 / 6 / 8 par image en 1K / 2K / 4K
GPT Image 2.5 FlareOpenAIL’GPT Image 2.5 par défaut. Les modifications ne concernent que ce que vous avez demandé et laissent inchangés le sujet, la composition et l’arrière-plan.Dix formats d'image disponibles à chaque niveau. Les arrière-plans transparents sont pris en charge. Les formes plus larges coûtent moins de crédits que les formes carrées.
  • Résolutions: 1K / 2K / 4K
  • Références: Jusqu’à 16
À partir de 7 crédits par image. Une image au format grand écran 16:9 coûte 9 crédits en 1K, 12 en 2K et 21 en 4K ; une image carrée coûte plus cher, jusqu'à 36 crédits.
GPT Image 2.5 SunburstOpenAIGPT Image 2.5 Conçue pour privilégier la précision plutôt que la rapidité — pour les campagnes et les projets de produits où chaque modification doit être parfaitement exacte.Plus lent que Flare. Dix formats d'image par niveau, prise en charge des arrière-plans transparents.
  • Résolutions: 1K / 2K / 4K
  • Références: Jusqu’à 16
Identique à Flare : à partir de 7 crédits par image, 9 en 1K, 12 en 2K et 21 en 4K pour un format grand écran 16:9.
GPT Image 2OpenAIJusqu’à 16 références ; l’IA est particulièrement performante pour suivre les instructions et intégrer du texte dans l’image.Un rendu à l'échelle 1:1 ne peut pas être en 4K, et une taille non spécifiée est plafonnée à 1K.
  • Résolutions: 1K / 2K / 4K
  • Références: Jusqu’à 16
8 / 11 / 20 par image en 1K / 2K / 4K
Z-ImageAlibabaDes modèles de conversion texte-image à petit prix — aucune image de référence n’est nécessaire.
  • Résultat: 2K, qualité unique et fixe
  • Références: Aucun — conversion texte-image uniquement
2 par image
Grok Imagine (image)xAITexte et image-vers-image : un forfait unique vous permet d'obtenir un lot complet.
  • Résultat: 2K, qualité unique et fixe
  • Références: 1
  • Traitement par lots: 6 images en mode « vitesse » · 4 en mode « qualité »
4 par génération en mode « vitesse » · 5 en mode « qualité »
FLUX.2 ProBlack Forest LabsRéalisme et typographie de haut niveau.
  • Résultat: ~1 MP
6 par image
FLUX.2Black Forest LabsRéalisme ; prend en charge les prompts au format JSON et les codes de couleur hexadécimaux.
  • Résultat: ~1 MP
3 par image
FLUX.2 TurboBlack Forest LabsRapide et économique.
  • Résultat: ~1 MP
2 par image
FLUX.2 FlashBlack Forest LabsL'FLUX.2 la plus rapide.
  • Résultat: ~1 MP
1 par image
FLUX.2 KleinBlack Forest LabsModèle 9B en quelques étapes.
  • Résultat: ~1 MP
2 par image
FLUX.1 DevBlack Forest LabsLa qualité classique d’FLUX.
  • Résultat: ~1 MP
5 par image
FLUX.1 SchnellBlack Forest LabsDes ébauches en moins d'une seconde.
  • Résultat: ~1 MP
1 par image
FLUX.2 EditBlack Forest LabsInstruct-edit — modifiez ou composez jusqu’à 4 images.N'apparaît dans le sélecteur qu'une fois qu'une image de référence a été jointe.
  • Résultat: ~1 MP
  • Références: Jusqu’à 4
5 par image
FLUX.2 Pro EditBlack Forest LabsFonctionnalité Premium « instruct-edit ».N'apparaît dans le sélecteur qu'une fois qu'une image de référence a été jointe.
  • Résultat: ~1 MP
  • Références: Jusqu’à 9
9 par image
FLUX.2 Klein EditBlack Forest LabsModifications rapides et légères.N'apparaît dans le sélecteur qu'une fois qu'une image de référence a été jointe.
  • Résultat: ~1 MP
  • Références: Jusqu’à 4
5 par image
Trained ElementBlack Forest LabsFLUX.1 Dev À cela s'ajoute un modèle LoRA entraîné sur votre propre « Element » — qui reproduit exactement cette identité.N'apparaît dans la liste de sélection que lorsqu'un élément entraîné est @mentionné dans la consigne.
  • Résultat: ~1 MP
  • Références: 1
  • Formation: 400 crédits, une fois par élément
10 par image, après un paiement unique de 400 pour l'entraînement
Clarity UpscalerPermet d’agrandir une image unique, par défaut au double de sa taille d’origine.Accessible uniquement via le Super Agent — il n’y a pas de bouton dédié dans Image Studio.
  • Entrée: Exactement 1 image
24 par session
IC-Light v2Permet de rééclairer une seule image.Accessible uniquement via le Super Agent — il n’y a pas de bouton dédié dans Image Studio.
  • Entrée: Exactement 1 image
20 par exécution
FLUX.1 KontextBlack Forest LabsModification des instructions à partir d’une seule image source.Accessible uniquement via le Super Agent — il n’y a pas de bouton dédié dans Image Studio.
  • Entrée: Exactement 1 image
8 par session

03 / Musique

Modèles musicaux

Un seul fournisseur, six versions, un prix forfaitaire — car ce qui est intéressant sur Suno et 7ART, c’est tout ce qui se passe une fois que le contenu est créé.

Ouvrez le studio de musique
Tous les moteurs d'6s musique, avec l'ensemble des caractéristiques techniques et des tarifs
ModèleÀ quoi cela sert-il ?Caractéristiques techniquesCrédits
Suno V5.5SunoLa dernière version d’Suno, dans le studio de musique 7ART.
  • Statut: Dernières actualités
12 par génération
Suno V5SunoLa version générée par le parcours musical lorsqu’aucune option n’est sélectionnée.
  • Statut: Par défaut
12 par génération
Suno V4.5 AllSunoVersion antérieure d’Suno, qui reste sélectionnable.12 par génération
Suno V4.5+SunoVersion antérieure d’Suno, qui reste sélectionnable.12 par génération
Suno V4.5SunoVersion antérieure d’Suno, toujours disponible à la sélection.12 par génération
Suno V4SunoLa version la plus ancienne d’Suno, toujours sélectionnable dans le studio.12 par génération

04 / Voix et audio

Modèles vocaux et audio

Voix, dialogues, effets et musique. Les moteurs d’ElevenLabs s fonctionnent via fal avec un système de repli kie ; Sonilo dispose d’un seul fournisseur et ne propose pas de solution de secours.

Ouvrez le studio vocal
Tous les moteurs d'11s voix et audio, avec l'ensemble des caractéristiques techniques et des tarifs
ModèleÀ quoi cela sert-il ?Caractéristiques techniquesCrédits
ElevenLabs Turbo 2.5ElevenLabsLe niveau de synthèse vocale rapide.
  • Vitesse: 0.7×–1.2×
10 pour 1 000 caractères
ElevenLabs Multilingual v2ElevenLabsLe niveau de synthèse vocale multilingue.
  • Vitesse: 0.7×–1.2×
20 pour 1 000 caractères
ElevenLabs Eleven v3ElevenLabsLe niveau de synthèse vocale expressive.
  • Vitesse: 0.7×–1.2×
20 pour 1 000 caractères
ElevenLabs v3 DialogueElevenLabsDialogue à plusieurs intervenants à partir d’un script.20 pour 1 000 caractères
ElevenLabs Sound Effects v2ElevenLabsUn effet sonore issu d’une description textuelle.0,4 par seconde
ElevenLabs Audio IsolationElevenLabsÉlimine le bruit de fond d’un enregistrement.0,34 par seconde
ElevenLabs Speech-to-TextElevenLabsTranscrit la parole à partir d'un fichier audio.6 par minute
ElevenLabs DubbingElevenLabsPermet de doubler une vidéo dans une autre langue.180 par minute, arrondi à l'unité supérieure
HeyGen Video Translate — PrecisionHeyGenPermet de traduire une vidéo avec une voix clonée et une synchronisation labiale réajustée.20 par seconde de production
HeyGen Video Translate — SpeedHeyGenLe mode de traduction vidéo rapide.10 par seconde de production
Sonilo v1.1SoniloConception sonore adaptée à l’action : bruitages ou bande-son synchronisés avec une vidéo, ou l’un ou l’autre à partir d’une description textuelle.
  • Modes: Vidéo → effets sonores · Vidéo → musique · Texte → son · Texte → musique
  • Rubriques: ≥ 5 s chacun, consécutifs, ≤ 200 caractères
  • Seuil de facturation: 15 secondes minimum
1,8 par seconde pour les deux modes vidéo · 0,36 par seconde pour la conversion texte-son · 0,5 par seconde pour la conversion texte-musique, pour une durée minimale de 15 secondes

05 / Avatar et synchronisation labiale

Modèles d'avatar et de synchronisation labiale

Quatre moteurs proposés par quatre fournisseurs permettent de faire parler un visage, à partir d’un simple portrait ou d’une séquence vidéo dont vous disposez déjà.

Ouvrez le studio de synchronisation labiale
Tous les moteurs d'5s avatar et synchronisation labiale, avec l'ensemble des caractéristiques techniques et des tarifs
ModèleÀ quoi cela sert-il ?Caractéristiques techniquesCrédits
Kling Avatar — StandardKling AITransforme un portrait en avatar parlant.
  • Qualité: 720p
  • Longueur maximale: 60 s
8 par seconde
Kling Avatar — ProKling AILe niveau « avatar parlant » en 1080p, et le clip le plus long du studio.
  • Qualité: 1080p
  • Longueur maximale: 5 minutes
16 par seconde
HeyGen Avatar IVHeyGenTransformation d’une photo en avatar parlant.
  • Qualité: 720p / 1080p
  • Longueur maximale: 60 s
20 par seconde
Omnihuman 1.5ByteDanceD'un portrait à une vidéo parlante.
  • Qualité: 720p / 1080p, au même tarif
  • Longueur maximale: 60 s
27 par seconde
Volcengine Lip SyncVolcenginePermet de resynchroniser les lèvres d'une vidéo existante avec un nouvel enregistrement audio.
  • Entrée: Une vidéo source
  • Longueur maximale: 60 s
8 par seconde

06 / 3D

Modèles 3D

Quatre générateurs et deux outils de maillage, tous accessibles via fal. Les valeurs de Polycount correspondent à la plage du curseur du studio, qui est délibérément plus étroite que ce que les extrémités acceptent.

Ouvrez le studio 3D
Tous les moteurs d'6s 3d, avec l'ensemble des caractéristiques techniques et des tarifs
ModèleÀ quoi cela sert-il ?Caractéristiques techniquesCrédits
Meshy 6MeshyLe meilleur maillage polyvalent : topologie quadrangulaire, matériaux PBR et poses.
  • Modes: Image · Vues multiples · Texte
  • Polycount: 10,000–300,000
  • Suppléments: PBR · topologie en quadrilatères · pose A / pose T
  • Images: Jusqu’à 4
240 par génération
Hunyuan 3.1 ProLe maillage le plus détaillé, avec une entrée multi-vues.
  • Modes: Image · Vues multiples · Texte
  • Polycount: 40,000–1,500,000
  • Suppléments: PBR
  • Images: Jusqu’à 4
80 par génération
Trellis 2Rapide et abordable, à partir d’une seule image.
  • Modes: Image uniquement
  • Polycount: 10,000–300,000
  • Images: 1
60 par génération
Tripo 2.5Tripo3DLe maillage le plus rapide du studio 3D.
  • Modes: Image · Vues multiples · Texte
  • Polycount: 10,000–300,000
  • Suppléments: PBR
  • Images: Jusqu’à 4
60 par génération
Retexture EngineMeshyPermet de modifier la texture d’un maillage dont vous disposez déjà, à partir d’une consigne ou d’une image de référence.
  • Entrée: Un maillage existant + une image de style
  • Suppléments: PBR
60 par exécution
RemeshMeshyRemesh : redimensionnez et réexportez un modèle en vue de son impression ou d’une autre étape du processus.
  • Entrée: Un maillage existant
  • Polycount: 10,000–300,000
  • Formats: GLB · FBX · OBJ · STL · USDZ
40 par exécution

Comment un modèle apparaît sur cette page

Un modèle apparaît ici dès que nous sommes en mesure de l’exécuter : accès à l’API accordé, adaptateur développé, prix fixé. C’est au fournisseur qu’il revient d’accorder l’accès, et non à nous de le promettre ; vous ne trouverez donc pas sur cette page de date de lancement pour tout ce que nous ne sommes pas en mesure de générer à l’heure actuelle.

Ce que vous obtenez, c’est un espace unique pour tout gérer. La même barre de saisie de consigne, les mêmes fichiers de référence à télécharger, la même bibliothèque et un solde de crédits commun à tous les modèles — ainsi, passer d’une image à une vidéo puis à une partition ne vous coûte qu’un simple choix dans le menu déroulant, et non un nouvel abonnement.

Lorsque deux fournisseurs proposent le même modèle, nous en utilisons un comme principal et l’autre comme solution de secours ; le prix affiché reste le même dans les deux cas.

Tous les modèles ci-dessus, avec un seul solde

Pas d’abonnements par fournisseur, pas de comptes distincts, pas besoin de réapprendre à utiliser l’interface utilisateur à chaque fois qu’un nouveau modèle est disponible.