7ART

Modelos de IA en 7ART

75 Motores para vídeo, imagen, música, voz, avatares y 3D: todo en un único flujo de trabajo y con un único saldo de créditos. Incorporamos nuevos modelos de primer nivel tan pronto como conseguimos acceso a la API.

Todas las duraciones, niveles de calidad y precios que se indican a continuación corresponden a lo que ofrece y cobra 7ART por ese modelo; los datos proceden de las propias tablas del estudio, no de la ficha técnica de un proveedor.

En el catálogo de hoy

22 vídeo · 25 imagen · 6 música · 11 voz y audio · 5 avatar y sincronización labial · 6 3d

01 / Vídeo

Modelos de vídeo

Discrepan en casi todo —la duración del clip, el límite máximo de resolución, si se utilizará o no un vídeo de referencia—, por lo que lo que distingue a cada tarjeta es la diferencia, no la propuesta.

Abrir el estudio de vídeo
7Video en 7ARTVídeo7ART preajuste
7ART

7Video

7ART

Duración
5–15 s
Calidad
768P / 2K
Datos de entrada
Fotograma inicial y final, o referencias de imagen, vídeo o audio

Créditos

Un 10 % por encima de la tarifa base del motor

Ver modelo
Gemini Omni Flash en 7ARTVídeo
Google

Gemini Omni Flash

Modelo Google multimodal que se basa íntegramente en su propio panel de referencia: imágenes, un videoclip, personajes y voces guardados, sin tarjetas de fotogramas.

Duración
4, 6, 8 o 10 s
Niveles de salida
720p / 1080p / 4K
Aspecto
16:9 o 9:16

Créditos

90 / 120 / 150 / 180 para 4 / 6 / 8 / 10 s a 720p o 1080p · 210 / 240 / 270 / 300 a 4K · 240 fijos (720p/1080p) o 360 (4K) con un vídeo de referencia

Ver modelo
VEO en 7ARTVídeo
Google3 modelos

VEO

3.1 Quality: Google

Duración
4, 6 u 8 s
Calidad
Vista previa / 1080p / 4K
Datos de entrada
Fotograma inicial + fotograma final
  • 3.1 Quality
  • 3.1 Fast
  • 3.1 Lite

Créditos · 3.1 Quality

Tarifa plana por generación: 250 vistas previas · 255 a 1080p · 370 a 4K

Ver modelo
Seedance en 7ARTVídeo
4 modelos

Seedance

2.5: Los clips más largos del estudio, audio generado junto con el vídeo y, con diferencia, el conjunto de referencias más amplio: hasta 1080p (sin nivel 4K).

Duración
4–30 s
Calidad
480p / 720p / 1080p
Referencias
30 imágenes · 10 vídeos · 10 archivos de audio
  • 2.5
  • 2.0
  • 2.0 Fast
  • 2.0 Mini

Créditos · 2.5

37/seg. a 480p · 79/seg. a 720p · 208/seg. a 1080p

Ver modelo
Kling en 7ARTVídeo
Kling AI5 modelos

Kling

3.0: El plan Kling, el más completo: personajes, sonido sincronizado, múltiples tomas y una resolución de 4K.

Duración
3–15 s
Calidad
720p / 1080p / 4K
Datos de entrada
Fotograma inicial; fotograma final fuera de la secuencia de múltiples tomas
  • 3.0
  • 3.0 Turbo
  • 2.6
  • 2.5 Turbo
  • +1 más

Créditos · 3.0

14 por segundo a 720p · 18 por segundo a 1080p · 20/27 por segundo con audio · 67 por segundo a 4K

Ver modelo
Grok Imagine (video) en 7ARTVídeo
xAI

Grok Imagine (video)

Movimiento intenso, conversión de texto e imagen a vídeo, y el precio por segundo más económico del estudio.

Duración
6–30 s
Calidad
480p / 720p
Datos de entrada
Fotograma inicial

Créditos

1,6/seg. a 480p · 3/seg. a 720p

Ver modelo
MiniMax H3 en 7ARTVídeo
MiniMax

MiniMax H3

Cuatro niveles de calidad —de 480p a 4K—, desde el primer hasta el último fotograma, y referencias de imagen, vídeo y audio.

Duración
5–15 s
Calidad
480P / 768P / 2K / 4K
Datos de entrada
Fotograma inicial y final, o 9 imágenes / 3 vídeos / 3 archivos de audio

Créditos

10/seg. a 480p · 22,5/seg. a 768p · 36,5/seg. a 2K · 32/seg. a 4K, más los segundos del propio vídeo de referencia y 11 créditos por cada imagen de referencia a partir de las primeras 5.

Ver modelo
HappyHorse 1.1 en 7ARTVídeo
Alibaba

HappyHorse 1.1

Texto, imagen o referencias múltiples a vídeo —solo imágenes, sin referencias de vídeo ni audio—.

Duración
3–15 s
Calidad
720p / 1080p
Datos de entrada
Fotograma inicial o imágenes de referencia

Créditos

33/seg. a 720p · 44/seg. a 1080p

Ver modelo
Wan en 7ARTVídeo
3 modelos

Wan

2.7: Cuatro modos en uno —texto a vídeo, imagen a vídeo, edición de vídeo y referencia a vídeo— con audio de guía, expansión de indicaciones y indicaciones negativas.

Duración
5, 10 o 15 s
Calidad
720p / 1080p
Datos de entrada
Fotograma inicial, fotograma final, vídeo de referencia, audio de referencia
  • 2.7
  • 2.6
  • 2.5

Créditos · 2.7

16 fotogramas por segundo a 720p · 24 fotogramas por segundo a 1080p

Ver modelo
MMAudio v2 en 7ARTVídeo

MMAudio v2

Genera una pista de efectos de sonido para un clip que carece de ella.

Resultado
Audio multiplexado en el clip de origen

Créditos

5 por ejecución

Ver modelo
Luma Ray-2 Modify en 7ARTVídeo
Luma

Luma Ray-2 Modify

Renueva el estilo de un clip existente de principio a fin.

Resultado
El clip original completo, rediseñado

Créditos

600 por ejecución

Ver modelo
Todos los motores de 22 vídeo, con todas las especificaciones y precios
ModeloPara qué sirveEspecificacionesCréditos
7Video7ART7ART
  • Duración: 5–15 s
  • Calidad: 768P / 2K
  • Datos de entrada: Fotograma inicial y final, o referencias de imagen, vídeo o audio
Un 10 % por encima de la tarifa base del motor
Gemini Omni FlashGoogleModelo Google multimodal que se basa íntegramente en su propio panel de referencia: imágenes, un videoclip, personajes y voces guardados, sin tarjetas de fotogramas.Aparece en el selector de 7ART como «Gemini Omni Video»; ese nombre procede del punto final de nuestro proveedor, no de Google.
  • Duración: 4, 6, 8 o 10 s
  • Niveles de salida: 720p / 1080p / 4K
  • Aspecto: 16:9 o 9:16
  • Referencias: 7 imágenes · 1 clip de vídeo · 3 personajes · 3 voces
90 / 120 / 150 / 180 para 4 / 6 / 8 / 10 s a 720p o 1080p · 210 / 240 / 270 / 300 a 4K · 240 fijos (720p/1080p) o 360 (4K) con un vídeo de referencia
VEO 3.1 QualityGoogleGoogle
  • Duración: 4, 6 u 8 s
  • Calidad: Vista previa / 1080p / 4K
  • Datos de entrada: Fotograma inicial + fotograma final
Tarifa plana por generación: 250 vistas previas · 255 a 1080p · 370 a 4K
VEO 3.1 FastGoogleVEO más rápido, y el único nivel que admite fotos de referencia.
  • Duración: 4, 6 u 8 s
  • Calidad: Vista previa / 1080p / 4K
  • Datos de entrada: Fotogramas inicial y final, o hasta tres fotografías de referencia
Tarifa plana por generación: 60 vistas previas · 65 a 1080p · 180 a 4K
VEO 3.1 LiteGoogleVEO, una opción asequible, ideal para experimentar.
  • Duración: 4, 6 u 8 s
  • Calidad: Vista previa / 1080p / 4K
  • Datos de entrada: Fotograma inicial + fotograma final
Tarifa plana por generación: 30 vistas previas · 35 a 1080p · 150 a 4K
Seedance 2.5ByteDanceLos clips más largos del estudio, audio generado junto con el vídeo y, con diferencia, el conjunto de referencias más amplio: hasta 1080p (sin nivel 4K).
  • Duración: 4–30 s
  • Calidad: 480p / 720p / 1080p
  • Referencias: 30 imágenes · 10 vídeos · 10 archivos de audio
  • Aspecto: 21:9, 16:9, 4:3, 1:1, 3:4, 9:16 o automático
37/seg. a 480p · 79/seg. a 720p · 208/seg. a 1080p
Seedance 2.0ByteDancePersonas reales con una gran coherencia en su identidad y secuencias cinematográficas de varias tomas; el único nivel de Seedance que ofrece renderización en 4K.
  • Duración: 4–15 s
  • Calidad: 480p / 720p / 1080p / 4K
  • Referencias: 9 imágenes · 3 vídeos · 3 archivos de audio
19 / 41 / 102 / 311 por segundo a 480p / 720p / 1080p / 4K · con una referencia de vídeo: 11,5 / 25 / 62 por segundo a lo largo de los segundos de entrada y salida (el 4K no tiene tasa con vídeo)
Seedance 2.0 FastByteDanceSeedance 2.0, una versión más ligera para borradores y vistas previas.
  • Duración: 4–15 s
  • Calidad: 480p / 720p
  • Referencias: 9 imágenes · 3 vídeos · 3 archivos de audio
15,5/seg. a 480p · 33/seg. a 720p · con una referencia de vídeo de 9/20 por segundo sobre los segundos de entrada + salida
Seedance 2.0 MiniByteDanceEl nivel más económico de Seedance.
  • Duración: 4–15 s
  • Calidad: 480p / 720p
  • Referencias: 9 imágenes · 3 vídeos · 3 archivos de audio
9,5/seg. a 480p · 20,5/seg. a 720p · con una referencia de vídeo: 6 / 12,5 por segundo sobre los segundos de entrada + salida
Kling 3.0Kling AIEl plan Kling, el más completo: personajes, sonido sincronizado, múltiples tomas y una resolución de 4K.
  • Duración: 3–15 s
  • Calidad: 720p / 1080p / 4K
  • Datos de entrada: Fotograma inicial; fotograma final fuera de la secuencia de múltiples tomas
  • Audio: Opcional: aumenta la velocidad por segundo
14 por segundo a 720p · 18 por segundo a 1080p · 20/27 por segundo con audio · 67 por segundo a 4K
Kling 3.0 TurboKling AIKling 3.0 más rápido, así como conversión de texto e imagen a vídeo.
  • Duración: 3–15 s
  • Calidad: 720p / 1080p
  • Datos de entrada: Fotograma inicial
18/seg. a 720p · 22,5/seg. a 1080p
Kling 2.6Kling AIFiable y con gran capacidad para la animación, con sonido.
  • Duración: 5 o 10 s
  • Calidad: 720p / 1080p
  • Datos de entrada: Fotograma inicial
11/seg · 22/seg con audio
Kling 2.5 TurboKling AIEl motor de bocetos más rápido y económico.
  • Duración: 5 o 10 s
  • Calidad: 720p
  • Datos de entrada: Fotograma inicial
9/seg.
Kling 3.0 Motion ControlKling AITransferencia de movimiento: se toma el movimiento de un clip y se aplica a un nuevo sujeto.Se ejecuta en el estudio de Motion, no en el selector de modelos de vídeo.
  • Calidad: 720p / 1080p
  • Datos de entrada: Fotograma inicial
20/seg. a 720p · 27/seg. a 1080p
Grok Imagine (video)xAIMovimiento intenso, conversión de texto e imagen a vídeo, y el precio por segundo más económico del estudio.
  • Duración: 6–30 s
  • Calidad: 480p / 720p
  • Datos de entrada: Fotograma inicial
1,6/seg. a 480p · 3/seg. a 720p
MiniMax H3MiniMaxCuatro niveles de calidad —de 480p a 4K—, desde el primer hasta el último fotograma, y referencias de imagen, vídeo y audio.Las referencias solo se envían cuando no hay fotograma inicial; el panel oculta uno mientras se utiliza el otro.
  • Duración: 5–15 s
  • Calidad: 480P / 768P / 2K / 4K
  • Datos de entrada: Fotograma inicial y final, o 9 imágenes / 3 vídeos / 3 archivos de audio
  • Aspecto: 21:9, 16:9, 4:3, 1:1, 3:4, 9:16
10/seg. a 480p · 22,5/seg. a 768p · 36,5/seg. a 2K · 32/seg. a 4K, más los segundos del propio vídeo de referencia y 11 créditos por cada imagen de referencia a partir de las primeras 5.
HappyHorse 1.1AlibabaTexto, imagen o referencias múltiples a vídeo —solo imágenes, sin referencias de vídeo ni audio—.
  • Duración: 3–15 s
  • Calidad: 720p / 1080p
  • Datos de entrada: Fotograma inicial o imágenes de referencia
33/seg. a 720p · 44/seg. a 1080p
Wan 2.7Cuatro modos en uno —texto a vídeo, imagen a vídeo, edición de vídeo y referencia a vídeo— con audio de guía, expansión de indicaciones y indicaciones negativas.
  • Duración: 5, 10 o 15 s
  • Calidad: 720p / 1080p
  • Datos de entrada: Fotograma inicial, fotograma final, vídeo de referencia, audio de referencia
16 fotogramas por segundo a 720p · 24 fotogramas por segundo a 1080p
Wan 2.6Transformar un vídeo existente; con varias escenas.
  • Duración: 5, 10 o 15 s
  • Calidad: 720p / 1080p
  • Datos de entrada: Fotograma inicial, vídeo de referencia
14/seg. a 720p · 21/seg. a 1080p
Wan 2.5Amplía las instrucciones breves para ofrecerle descripciones más detalladas.
  • Duración: 5 o 10 s
  • Calidad: 720p / 1080p
  • Datos de entrada: Fotograma inicial
12/seg. a 720p · 20/seg. a 1080p
MMAudio v2Genera una pista de efectos de sonido para un clip que carece de ella.Se ejecuta a partir de las acciones de edición de un clip, no desde el selector de modelos.
  • Resultado: Audio multiplexado en el clip de origen
5 por ejecución
Luma Ray-2 ModifyLumaRenueva el estilo de un clip existente de principio a fin.Se ejecuta a partir de las acciones de edición de un clip, no desde el selector de modelos.
  • Resultado: El clip original completo, rediseñado
600 por ejecución

02 / Imagen

Modelos de imagen

El número de capturas de pantalla de imágenes de referencia que se muestran aquí corresponde al número que recibe realmente el proveedor principal, que no siempre coincide con el número que permite cargar el cuadro de subida de archivos. FLUX genera imágenes de aproximadamente 1 MP en todos los niveles, independientemente de lo que indique la etiqueta de resolución.

Abra el estudio de imágenes
7Image en 7ARTImagen7ART preajuste
7ART

7Image

7ART

Resoluciones
1K / 2K / 4K
Referencias
Hasta 16

Créditos

Un 10 % por encima de la tarifa base del motor

Ver modelo
Nano Banana en 7ARTImagen
Google2 modelos

Nano Banana

2: Hasta 14 imágenes de referencia: la opción más segura para mantener la coherencia en los rasgos faciales.

Resoluciones
1K / 2K / 4K
Referencias
Hasta 14
  • 2
  • Pro

Créditos · 2

16 / 24 / 32 por imagen a 1K / 2K / 4K

Ver modelo
Seedream en 7ARTImagen
ByteDance3 modelos

Seedream

5 Lite: Económico y rápido.

Resoluciones
2K / 3K
Referencias
Hasta 10
  • 5 Lite
  • 4.5
  • 4.0

Créditos · 5 Lite

6 a 2K · 8 a 3K

Ver modelo
GPT Image 2.5 en 7ARTImagen
OpenAI2 modelos

GPT Image 2.5

Flare: El GPT Image 2.5 predeterminado. Las ediciones solo modifican lo que usted ha solicitado y no alteran el sujeto, la composición ni el fondo.

Resoluciones
1K / 2K / 4K
Referencias
Hasta 16
  • Flare
  • Sunburst

Créditos · Flare

A partir de 7 créditos por imagen. Una imagen panorámica de 16:9 cuesta 9 créditos en 1K, 12 en 2K y 21 en 4K; una imagen cuadrada cuesta más, hasta 36 créditos.

Ver modelo
GPT Image 2 en 7ARTImagen
OpenAI

GPT Image 2

Admite hasta 16 referencias; destaca por su capacidad para seguir instrucciones y por la presencia de texto dentro de la imagen.

Resoluciones
1K / 2K / 4K
Referencias
Hasta 16

Créditos

8 / 11 / 20 por imagen a 1K / 2K / 4K

Ver modelo
Z-Image en 7ARTImagen
Alibaba

Z-Image

Plantillas económicas de texto a imagen: no se necesitan imágenes de referencia en absoluto.

Resultado
2K, calidad única fija
Referencias
Ninguno — solo conversión de texto a imagen

Créditos

2 por imagen

Ver modelo
Grok Imagine (image) en 7ARTImagen
xAI

Grok Imagine (image)

Texto e imagen a imagen; una tarifa plana permite obtener un lote completo.

Resultado
2K, calidad única fija
Referencias
1
Por lotes
6 imágenes en modo rápido · 4 en modo de calidad

Créditos

4 por generación en modo rápido · 5 en modo de calidad

Ver modelo
FLUX en 7ARTImagen
Black Forest Labs12 modelos

FLUX

FLUX.2 Pro: Máximo realismo y tipografía.

Resultado
~1 MP
  • FLUX.2 Pro
  • FLUX.2
  • FLUX.2 Turbo
  • FLUX.2 Flash
  • +8 más

Créditos · FLUX.2 Pro

6 por imagen

Ver modelo
Clarity Upscaler en 7ARTImagen

Clarity Upscaler

Aumenta la resolución de una sola imagen, por defecto al doble.

Entrada
Exactamente 1 imagen

Créditos

24 por ejecución

Ver modelo
IC-Light v2 en 7ARTImagen

IC-Light v2

Reejecuta una sola imagen.

Entrada
Exactamente 1 imagen

Créditos

20 por ejecución

Ver modelo
Todos los motores de 25 imagen, con todas las especificaciones y precios
ModeloPara qué sirveEspecificacionesCréditos
7Image7ART7ART
  • Resoluciones: 1K / 2K / 4K
  • Referencias: Hasta 16
Un 10 % por encima de la tarifa base del motor
Nano Banana 2GoogleHasta 14 imágenes de referencia: la opción más segura para mantener la coherencia en los rasgos faciales.
  • Resoluciones: 1K / 2K / 4K
  • Referencias: Hasta 14
16 / 24 / 32 por imagen a 1K / 2K / 4K
Nano Banana ProGoogleComposición de varias imágenes.
  • Resoluciones: 1K / 2K / 4K
  • Referencias: Hasta 8
30 / 30 / 60 por imagen a 1K / 2K / 4K
Seedream 5 LiteByteDanceEconómico y rápido.
  • Resoluciones: 2K / 3K
  • Referencias: Hasta 10
6 a 2K · 8 a 3K
Seedream 4.5ByteDanceEl nivel Seedream de gama media.
  • Resoluciones: 2K / 4K
  • Referencias: Hasta 10
7 a 2K · 9 a 4K
Seedream 4.0ByteDanceEl rango de resolución más amplio de Seedream s.
  • Resoluciones: 1K / 2K / 4K
  • Referencias: Hasta 10
5 / 6 / 8 por imagen a 1K / 2K / 4K
GPT Image 2.5 FlareOpenAIEl GPT Image 2.5 predeterminado. Las ediciones solo modifican lo que usted ha solicitado y no alteran el sujeto, la composición ni el fondo.Diez relaciones de aspecto en cada nivel. Se admiten fondos transparentes. Las formas más anchas cuestan menos créditos que las cuadradas.
  • Resoluciones: 1K / 2K / 4K
  • Referencias: Hasta 16
A partir de 7 créditos por imagen. Una imagen panorámica de 16:9 cuesta 9 créditos en 1K, 12 en 2K y 21 en 4K; una imagen cuadrada cuesta más, hasta 36 créditos.
GPT Image 2.5 SunburstOpenAIGPT Image 2.5 Optimizada para priorizar la precisión frente a la velocidad, ideal para trabajos de campañas y productos en los que es imprescindible que una edición sea exacta.Más lenta que Flare. Diez relaciones de aspecto en cada nivel; admite fondos transparentes.
  • Resoluciones: 1K / 2K / 4K
  • Referencias: Hasta 16
Idéntico a Flare: desde 7 créditos por imagen, 9 a 1K, 12 a 2K y 21 a 4K para una pantalla panorámica 16:9.
GPT Image 2OpenAIAdmite hasta 16 referencias; destaca por su capacidad para seguir instrucciones y por la presencia de texto dentro de la imagen.Un renderizado 1:1 no puede ser de 4K, y un tamaño no especificado tiene un límite máximo de 1K.
  • Resoluciones: 1K / 2K / 4K
  • Referencias: Hasta 16
8 / 11 / 20 por imagen a 1K / 2K / 4K
Z-ImageAlibabaPlantillas económicas de texto a imagen: no se necesitan imágenes de referencia en absoluto.
  • Resultado: 2K, calidad única fija
  • Referencias: Ninguno — solo conversión de texto a imagen
2 por imagen
Grok Imagine (image)xAITexto e imagen a imagen; una tarifa plana permite obtener un lote completo.
  • Resultado: 2K, calidad única fija
  • Referencias: 1
  • Por lotes: 6 imágenes en modo rápido · 4 en modo de calidad
4 por generación en modo rápido · 5 en modo de calidad
FLUX.2 ProBlack Forest LabsMáximo realismo y tipografía.
  • Resultado: ~1 MP
6 por imagen
FLUX.2Black Forest LabsRealismo; admite indicaciones en formato JSON y códigos de color hexadecimales.
  • Resultado: ~1 MP
3 por imagen
FLUX.2 TurboBlack Forest LabsRápido y económico.
  • Resultado: ~1 MP
2 por imagen
FLUX.2 FlashBlack Forest LabsEl FLUX.2 más rápido.
  • Resultado: ~1 MP
1 por imagen
FLUX.2 KleinBlack Forest LabsModelo 9B de pocos pasos.
  • Resultado: ~1 MP
2 por imagen
FLUX.1 DevBlack Forest LabsLa clásica calidad de FLUX.
  • Resultado: ~1 MP
5 por imagen
FLUX.1 SchnellBlack Forest LabsBorradores en menos de un segundo.
  • Resultado: ~1 MP
1 por imagen
FLUX.2 EditBlack Forest LabsInstruct-edit: edite o cree hasta 4 imágenes.Aparece en el selector únicamente una vez que se ha adjuntado una imagen de referencia.
  • Resultado: ~1 MP
  • Referencias: Hasta 4
5 por imagen
FLUX.2 Pro EditBlack Forest LabsFunción premium de edición de instrucciones.Aparece en el selector únicamente una vez que se ha adjuntado una imagen de referencia.
  • Resultado: ~1 MP
  • Referencias: Hasta 9
9 por imagen
FLUX.2 Klein EditBlack Forest LabsEdiciones rápidas y sencillas.Aparece en el selector únicamente una vez que se ha adjuntado una imagen de referencia.
  • Resultado: ~1 MP
  • Referencias: Hasta 4
5 por imagen
Trained ElementBlack Forest LabsFLUX.1 Dev Además, un modelo LoRA entrenado a partir de su propio «Element» reproduce esa identidad con total exactitud.Aparece en el selector únicamente cuando se menciona (@) un elemento entrenado en el prompt.
  • Resultado: ~1 MP
  • Referencias: 1
  • Entrenamiento: 400 créditos, una vez por elemento
10 por imagen, tras un pago único de 400 para el entrenamiento.
Clarity UpscalerAumenta la resolución de una sola imagen, por defecto al doble.Solo se puede acceder a ella a través del Super Agent; no hay ningún botón para ello en el Image Studio.
  • Entrada: Exactamente 1 imagen
24 por ejecución
IC-Light v2Reejecuta una sola imagen.Solo se puede acceder a través del Super Agent; no hay ningún botón para ello en el Image Studio.
  • Entrada: Exactamente 1 imagen
20 por ejecución
FLUX.1 KontextBlack Forest LabsEdición de instrucciones sobre una única imagen de origen.Solo se puede acceder a ella a través del Super Agent; no hay ningún botón para ello en el Image Studio.
  • Entrada: Exactamente 1 imagen
8 por ejecución

03 / Música

Modelos musicales

Un proveedor, seis versiones, un precio único: porque lo interesante de Suno en 7ART es todo lo que ocurre una vez que la pista ya existe.

Abra el estudio de música
Todos los motores de 6 música, con todas las especificaciones y precios
ModeloPara qué sirveEspecificacionesCréditos
Suno V5.5SunoLa última versión de Suno en el estudio de música 7ART.
  • Estado: Últimas novedades
12 por generación
Suno V5SunoLa versión que genera la ruta musical cuando no se selecciona ninguna.
  • Estado: Predeterminado
12 por generación
Suno V4.5 AllSunoVersión anterior de Suno, que se mantiene como opción seleccionable.12 por generación
Suno V4.5+SunoVersión anterior de Suno, que se mantiene como opción seleccionable.12 por generación
Suno V4.5SunoVersión anterior de Suno, que se mantiene como opción seleccionable.12 por generación
Suno V4SunoLa versión más antigua de Suno que aún se puede seleccionar en el estudio.12 por generación

04 / Voz y audio

Modelos de voz y audio

Voz, diálogo, efectos y banda sonora. Los motores de ElevenLabs se ejecutan a través de «fal» con un plan de contingencia de «kie»; Sonilo cuenta con un único proveedor y carece de una segunda opción.

Abrir el estudio de voz
Todos los motores de 11 voz y audio, con todas las especificaciones y precios
ModeloPara qué sirveEspecificacionesCréditos
ElevenLabs Turbo 2.5ElevenLabsEl nivel de conversión rápida de texto a voz.
  • Velocidad: 0.7×–1.2×
10 por cada 1.000 caracteres
ElevenLabs Multilingual v2ElevenLabsEl nivel de conversión de texto a voz multilingüe.
  • Velocidad: 0.7×–1.2×
20 por cada 1.000 caracteres
ElevenLabs Eleven v3ElevenLabsEl nivel de conversión de texto a voz con capacidad expresiva.
  • Velocidad: 0.7×–1.2×
20 por cada 1.000 caracteres
ElevenLabs v3 DialogueElevenLabsDiálogo entre varios interlocutores a partir de un guion.20 por cada 1.000 caracteres
ElevenLabs Sound Effects v2ElevenLabsUn efecto de sonido a partir de una descripción textual.0,4 por segundo
ElevenLabs Audio IsolationElevenLabsElimina el ruido de fondo de una grabación.0,34 por segundo
ElevenLabs Speech-to-TextElevenLabsTranscribe el discurso a partir de un archivo de audio.6 por minuto
ElevenLabs DubbingElevenLabsDobla un vídeo a otro idioma.180 por minuto, redondeado al alza
HeyGen Video Translate — PrecisionHeyGenTraduce un vídeo con una voz clonada y una sincronización labial reajustada.20 por segundo de salida
HeyGen Video Translate — SpeedHeyGenEl modo de traducción rápida de vídeos.10 por segundo de salida
Sonilo v1.1SoniloDiseño de sonido que acompaña a la acción: efectos de sonido o una banda sonora sincronizada con un vídeo, o cualquiera de ambos a partir de una descripción textual.
  • Modos: Vídeo → efectos de sonido · Vídeo → música · Texto → sonido · Texto → música
  • Secciones: ≥5 s cada uno, contiguos, ≤200 caracteres
  • Importe mínimo de facturación: Mínimo de 15 segundos
1,8 por segundo para cualquiera de los modos de vídeo · 0,36 por segundo de texto a sonido · 0,5 por segundo de texto a música, con un mínimo de 15 segundos

05 / Avatar y sincronización labial

Modelos de avatar y de sincronización labial

Cuatro motores de cuatro proveedores para hacer que un rostro hable, a partir de un único retrato o de material de vídeo que ya tenga.

Abrir el estudio de sincronización labial
Todos los motores de 5 avatar y sincronización labial, con todas las especificaciones y precios
ModeloPara qué sirveEspecificacionesCréditos
Kling Avatar — StandardKling AIConvierte un retrato en un avatar que habla.
  • Calidad: 720p
  • Longitud máxima: 60 s
8 por segundo
Kling Avatar — ProKling AIEl nivel de avatares parlantes en 1080p y el clip más largo del estudio.
  • Calidad: 1080p
  • Longitud máxima: 5 minutos
16 por segundo
HeyGen Avatar IVHeyGenDe una foto a un avatar que habla.
  • Calidad: 720p / 1080p
  • Longitud máxima: 60 s
20 por segundo
Omnihuman 1.5ByteDanceDe un retrato a un vídeo en el que el personaje habla.
  • Calidad: 720p / 1080p, con el mismo coste
  • Longitud máxima: 60 s
27 por segundo
Volcengine Lip SyncVolcengineVuelve a sincronizar los labios de un vídeo existente con un nuevo audio.
  • Entrada: Un vídeo de origen
  • Longitud máxima: 60 s
8 por segundo

06 / 3D

Modelos 3D

Cuatro generadores y dos herramientas de malla, todo ello a través de fal. Las cifras de Polycount corresponden al rango del control deslizante del estudio, que es deliberadamente más estrecho que lo que admiten los extremos.

Abra el estudio 3D
Todos los motores de 6 3d, con todas las especificaciones y precios
ModeloPara qué sirveEspecificacionesCréditos
Meshy 6MeshyLa mejor malla en todos los aspectos: topología cuadrangular, materiales PBR y poses.
  • Modos: Imagen · Vistas múltiples · Texto
  • Polycount: 10,000–300,000
  • Extras: PBR · topología de cuadriláteros · postura A / postura T
  • Imágenes: Hasta 4
240 por generación
Hunyuan 3.1 ProLa malla con mayor nivel de detalle, con entrada de múltiples vistas.
  • Modos: Imagen · Vistas múltiples · Texto
  • Polycount: 40,000–1,500,000
  • Extras: PBR
  • Imágenes: Hasta 4
80 por generación
Trellis 2Rápido y asequible, a partir de una sola imagen.
  • Modos: Solo imagen
  • Polycount: 10,000–300,000
  • Imágenes: 1
60 por generación
Tripo 2.5Tripo3DLa malla más rápida del estudio 3D.
  • Modos: Imagen · Vistas múltiples · Texto
  • Polycount: 10,000–300,000
  • Extras: PBR
  • Imágenes: Hasta 4
60 por generación
Retexture EngineMeshyRetexturiza una malla que ya tenga, a partir de una indicación o de una imagen de estilo.
  • Entrada: Una malla existente + una imagen de un estilo
  • Extras: PBR
60 por ejecución
RemeshMeshyRemesh a, reajusta la escala y vuelve a exportar un modelo para su impresión o para otro proceso.
  • Entrada: Una malla existente
  • Polycount: 10,000–300,000
  • Formatos: GLB · FBX · OBJ · STL · USDZ
40 por ejecución

Cómo llega un modelo a esta página

Un modelo aparece aquí una vez que podemos ejecutarlo realmente: se ha concedido el acceso a la API, se ha escrito el adaptador y se ha fijado el precio. El acceso lo concede el proveedor, no lo prometemos nosotros, por lo que no encontrará en esta página una fecha de lanzamiento para nada que no podamos generar en la actualidad.

Lo que sí obtiene es un único lugar desde el que gestionarlo todo. La misma barra de indicaciones, las mismas subidas de referencias, la misma biblioteca y un único saldo de créditos del que se nutren todos los modelos; de este modo, pasar de una imagen a un vídeo o a una partitura solo le supondrá seleccionar una opción del menú desplegable, no una nueva suscripción.

Cuando dos proveedores ofrecen el mismo modelo, utilizamos uno como principal y el otro como alternativa, y el precio que se muestra es el mismo en ambos casos.

Todos los modelos anteriores, con un único saldo

Sin suscripciones por proveedor, sin cuentas separadas y sin tener que volver a familiarizarse con la interfaz de usuario cada vez que se lanza un nuevo modelo.