7ART

KI-Modelle auf 7ART

75 Engines für Video, Bild, Musik, Sprache, Avatare und 3D – in einem Arbeitsablauf, mit einem einzigen Credit-Guthaben. Wir fügen neue Modelle der Spitzenklasse hinzu, sobald wir API-Zugriff erhalten.

Alle unten aufgeführten Zeitangaben, Ausgabestufen und Preise entsprechen den Angeboten und Gebühren, die 7ART für das jeweilige Modell berechnet – diese Angaben stammen aus den Tabellen des Studios selbst und nicht aus einem Datenblatt des Anbieters.

Im heutigen Katalog

22 video · 25 bild · 6 musik · 11 sprache & audio · 5 avatar & lippensynchronisation · 6 3d

01 / Video

Videomodelle

Sie unterscheiden sich in fast allen Punkten – Clip-Länge, maximale Auflösung, ob überhaupt ein Referenzvideo verwendet wird –; daher steht auf jeder Karte der Unterschied, nicht der Vorschlag.

Öffnen Sie das Videostudio
7Video auf 7ARTVideo7ART Voreinstellung
7ART

7Video

7ART

Dauer
5–15 Sekunden
Qualität
768P / 2K
Eingaben
Start- und Endbild oder Bild-/Video-/Audio-Referenzen

Credits

10 % über dem Basistarif der Engine

Modell anzeigen
Gemini Omni Flash auf 7ARTVideo
Google

Gemini Omni Flash

Ein multimodales Google-Modell, das vollständig auf der Grundlage seines eigenen Referenzpanels gesteuert wird – Bilder, ein Videoclip, gespeicherte Charaktere und Stimmen, keine Frame-Karten.

Dauer
4, 6, 8 oder 10 Sekunden
Ausgabestufen
720p / 1080p / 4K
Aspekt
16:9 oder 9:16

Credits

90 / 120 / 150 / 180 für 4 / 6 / 8 / 10 Sekunden bei 720p oder 1080p · 210 / 240 / 270 / 300 bei 4K · pauschal 240 (720p/1080p) oder 360 (4K) mit einer Videovorlage

Modell anzeigen
VEO auf 7ARTVideo
Google3 Modelle

VEO

3.1 Quality: Google

Dauer
4, 6 oder 8 Sekunden
Qualität
Vorschau / 1080p / 4K
Eingaben
Start- und Endbild
  • 3.1 Quality
  • 3.1 Fast
  • 3.1 Lite

Credits · 3.1 Quality

Pauschalpreis pro Generierung: 250 Vorschau · 255 bei 1080p · 370 bei 4K

Modell anzeigen
Seedance auf 7ARTVideo
4 Modelle

Seedance

2.5: Die längsten Clips im Studio, Audio zusammen mit dem Video generiert und das mit Abstand größte Referenz-Set — bis 1080p (keine 4K-Stufe).

Dauer
4–30 s
Qualität
480p / 720p / 1080p
Quellenangaben
30 Bilder · 10 Videos · 10 Audiodateien
  • 2.5
  • 2.0
  • 2.0 Fast
  • 2.0 Mini

Credits · 2.5

37/Sek. bei 480p · 79/Sek. bei 720p · 208/Sek. bei 1080p

Modell anzeigen
Kling auf 7ARTVideo
Kling AI5 Modelle

Kling

3.0: Das leistungsstärkste Kling – Charaktere, synchronisierter Ton, Multi-Shot und eine 4K-Stufe.

Dauer
3–15 Sekunden
Qualität
720p / 1080p / 4K
Eingaben
Startbild; Endbild außerhalb einer Multi-Shot-Sequenz
  • 3.0
  • 3.0 Turbo
  • 2.6
  • 2.5 Turbo
  • +1 mehr

Credits · 3.0

14 pro Sekunde bei 720p · 18 pro Sekunde bei 1080p · 20 bzw. 27 pro Sekunde mit Ton · 67 pro Sekunde bei 4K

Modell anzeigen
Grok Imagine (video) auf 7ARTVideo
xAI

Grok Imagine (video)

Starke Animationen, Text- und Bild-zu-Video-Konvertierung sowie die günstigsten Preise pro Sekunde im Studio.

Dauer
6–30 s
Qualität
480p / 720p
Eingaben
Startbild

Credits

1,6/Sek. bei 480p · 3/Sek. bei 720p

Modell anzeigen
MiniMax H3 auf 7ARTVideo
MiniMax

MiniMax H3

Vier Qualitätsstufen — 480P bis 4K — First-to-Last-Frame sowie Bild-, Video- und Audio-Referenzen.

Dauer
5–15 Sekunden
Qualität
480P / 768P / 2K / 4K
Eingaben
Start- und Endbild oder 9 Bilder / 3 Videos / 3 Audiodateien

Credits

10/Sek. bei 480P · 22,5/Sek. bei 768P · 36,5/Sek. bei 2K · 32/Sek. bei 4K, plus die Sekunden jeder Referenz-Video-Datei und 11 Credits pro Referenzbild ab dem sechsten

Modell anzeigen
HappyHorse 1.1 auf 7ARTVideo
Alibaba

HappyHorse 1.1

Text, Bild oder Mehrfachverweise auf Videos – ausschließlich Bilder, keine Video- oder Audioverweise.

Dauer
3–15 Sekunden
Qualität
720p / 1080p
Eingaben
Startbild oder Referenzbilder

Credits

33 Bilder pro Sekunde bei 720p · 44 Bilder pro Sekunde bei 1080p

Modell anzeigen
Wan auf 7ARTVideo
3 Modelle

Wan

2.7: Vier Modi in einem – Text-zu-Video, Bild-zu-Video, Videobearbeitung und Referenz-zu-Video – mit begleitendem Audio, Prompt-Erweiterung und negativen Prompts.

Dauer
5, 10 oder 15 Sekunden
Qualität
720p / 1080p
Eingaben
Startbild, Endbild, Referenzvideo, Steuerungsaudio
  • 2.7
  • 2.6
  • 2.5

Credits · 2.7

16 Bilder pro Sekunde bei 720p · 24 Bilder pro Sekunde bei 1080p

Modell anzeigen
MMAudio v2 auf 7ARTVideo

MMAudio v2

Erzeugt eine Geräuschspur für einen Clip, der noch keine enthält.

Ergebnis
Auf den Quellclip gemultiplexte Audiodaten

Credits

Pauschal 5 pro Durchlauf

Modell anzeigen
Luma Ray-2 Modify auf 7ARTVideo
Luma

Luma Ray-2 Modify

Gestaltet einen bestehenden Clip von Anfang bis Ende neu.

Ergebnis
Der gesamte Quellclip, neu gestaltet

Credits

Pauschal 600 pro Durchlauf

Modell anzeigen
Alle 22 video Engines mit allen technischen Daten und Preisen
ModellWozu dient die Anwendung?Technische DatenCredits
7Video7ART7ART
  • Dauer: 5–15 Sekunden
  • Qualität: 768P / 2K
  • Eingaben: Start- und Endbild oder Bild-/Video-/Audio-Referenzen
10 % über dem Basistarif der Engine
Gemini Omni FlashGoogleEin multimodales Google-Modell, das vollständig auf der Grundlage seines eigenen Referenzpanels gesteuert wird – Bilder, ein Videoclip, gespeicherte Charaktere und Stimmen, keine Frame-Karten.Im Auswahlmenü 7ART wird die Option als „Gemini Omni-Video“ aufgeführt – dieser Name stammt vom Endpunkt unseres Anbieters und nicht von Google.
  • Dauer: 4, 6, 8 oder 10 Sekunden
  • Ausgabestufen: 720p / 1080p / 4K
  • Aspekt: 16:9 oder 9:16
  • Quellenangaben: 7 Bilder · 1 Videoclip · 3 Charaktere · 3 Stimmen
90 / 120 / 150 / 180 für 4 / 6 / 8 / 10 Sekunden bei 720p oder 1080p · 210 / 240 / 270 / 300 bei 4K · pauschal 240 (720p/1080p) oder 360 (4K) mit einer Videovorlage
VEO 3.1 QualityGoogleGoogle
  • Dauer: 4, 6 oder 8 Sekunden
  • Qualität: Vorschau / 1080p / 4K
  • Eingaben: Start- und Endbild
Pauschalpreis pro Generierung: 250 Vorschau · 255 bei 1080p · 370 bei 4K
VEO 3.1 FastGoogleSchnelleres VEO und die einzige Stufe, die Referenzfotos akzeptiert.
  • Dauer: 4, 6 oder 8 Sekunden
  • Qualität: Vorschau / 1080p / 4K
  • Eingaben: Start- und Endbilder oder bis zu 3 Referenzfotos
Pauschalpreis pro Generierung: 60 Vorschauen · 65 bei 1080p · 180 bei 4K
VEO 3.1 LiteGoogleDie kostengünstige Version VEO – ideal zum Experimentieren.
  • Dauer: 4, 6 oder 8 Sekunden
  • Qualität: Vorschau / 1080p / 4K
  • Eingaben: Start- und Endbild
Pauschalpreis pro Generierung: 30 Vorschauen · 35 bei 1080p · 150 bei 4K
Seedance 2.5ByteDanceDie längsten Clips im Studio, Audio zusammen mit dem Video generiert und das mit Abstand größte Referenz-Set — bis 1080p (keine 4K-Stufe).
  • Dauer: 4–30 s
  • Qualität: 480p / 720p / 1080p
  • Quellenangaben: 30 Bilder · 10 Videos · 10 Audiodateien
  • Aspekt: 21:9, 16:9, 4:3, 1:1, 3:4, 9:16 oder „auto“
37/Sek. bei 480p · 79/Sek. bei 720p · 208/Sek. bei 1080p
Seedance 2.0ByteDanceRealistische Personen mit starker Identitätskonsistenz und filmischen Multi-Shot-Sequenzen; die einzige Seedance-Stufe, die 4K rendert.
  • Dauer: 4–15 Sekunden
  • Qualität: 480p / 720p / 1080p / 4K
  • Quellenangaben: 9 Bilder · 3 Videos · 3 Audiodateien
19 / 41 / 102 / 311 pro Sekunde bei 480p / 720p / 1080p / 4K · mit Video-Referenz 11,5 / 25 / 62 pro Sekunde über Eingabe- + Ausgabesekunden (kein Mit-Video-Tarif bei 4K)
Seedance 2.0 FastByteDanceEine vereinfachte Version von Seedance 2.0 für Entwürfe und Vorschauen.
  • Dauer: 4–15 Sekunden
  • Qualität: 480p / 720p
  • Quellenangaben: 9 Bilder · 3 Videos · 3 Audiodateien
15,5/Sek. bei 480p · 33/Sek. bei 720p · bei Verwendung einer Videovorlage 9/20 pro Sek. über die Eingabe- und Ausgabedauer
Seedance 2.0 MiniByteDanceDie günstigste Seedance-Stufe.
  • Dauer: 4–15 Sekunden
  • Qualität: 480p / 720p
  • Quellenangaben: 9 Bilder · 3 Videos · 3 Audiodateien
9,5/Sek. bei 480p · 20,5/Sek. bei 720p · bei Verwendung einer Videovorlage 6 / 12,5 pro Sekunde über die Eingabe- und Ausgabedauer
Kling 3.0Kling AIDas leistungsstärkste Kling – Charaktere, synchronisierter Ton, Multi-Shot und eine 4K-Stufe.
  • Dauer: 3–15 Sekunden
  • Qualität: 720p / 1080p / 4K
  • Eingaben: Startbild; Endbild außerhalb einer Multi-Shot-Sequenz
  • Audio: Optional – erhöht die Rate pro Sekunde
14 pro Sekunde bei 720p · 18 pro Sekunde bei 1080p · 20 bzw. 27 pro Sekunde mit Ton · 67 pro Sekunde bei 4K
Kling 3.0 TurboKling AISchnellere Kling 3.0, Text- und Bild-zu-Video-Erstellung.
  • Dauer: 3–15 Sekunden
  • Qualität: 720p / 1080p
  • Eingaben: Startbild
18/Sek. bei 720p · 22,5/Sek. bei 1080p
Kling 2.6Kling AIZuverlässig und besonders stark bei Animationen, inklusive Ton.
  • Dauer: 5 oder 10 Sekunden
  • Qualität: 720p / 1080p
  • Eingaben: Startbild
11/Sek. · 22/Sek. mit Audio
Kling 2.5 TurboKling AIDie schnellste und kostengünstigste Engine zur Erstellung von Entwürfen.
  • Dauer: 5 oder 10 Sekunden
  • Qualität: 720p
  • Eingaben: Startbild
9/Sek.
Kling 3.0 Motion ControlKling AIBewegungsübertragung – die Bewegung aus einem Clip wird übernommen und auf ein neues Motiv angewendet.Die Anwendung läuft im Motion Studio, nicht im Video-Modell-Auswahlfenster.
  • Qualität: 720p / 1080p
  • Eingaben: Startbild
20 Bilder pro Sekunde bei 720p · 27 Bilder pro Sekunde bei 1080p
Grok Imagine (video)xAIStarke Animationen, Text- und Bild-zu-Video-Konvertierung sowie die günstigsten Preise pro Sekunde im Studio.
  • Dauer: 6–30 s
  • Qualität: 480p / 720p
  • Eingaben: Startbild
1,6/Sek. bei 480p · 3/Sek. bei 720p
MiniMax H3MiniMaxVier Qualitätsstufen — 480P bis 4K — First-to-Last-Frame sowie Bild-, Video- und Audio-Referenzen.Referenzen werden nur gesendet, wenn kein Startframe vorhanden ist – das Feld blendet eines aus, während das andere verwendet wird.
  • Dauer: 5–15 Sekunden
  • Qualität: 480P / 768P / 2K / 4K
  • Eingaben: Start- und Endbild oder 9 Bilder / 3 Videos / 3 Audiodateien
  • Aspekt: 21:9, 16:9, 4:3, 1:1, 3:4, 9:16
10/Sek. bei 480P · 22,5/Sek. bei 768P · 36,5/Sek. bei 2K · 32/Sek. bei 4K, plus die Sekunden jeder Referenz-Video-Datei und 11 Credits pro Referenzbild ab dem sechsten
HappyHorse 1.1AlibabaText, Bild oder Mehrfachverweise auf Videos – ausschließlich Bilder, keine Video- oder Audioverweise.
  • Dauer: 3–15 Sekunden
  • Qualität: 720p / 1080p
  • Eingaben: Startbild oder Referenzbilder
33 Bilder pro Sekunde bei 720p · 44 Bilder pro Sekunde bei 1080p
Wan 2.7Vier Modi in einem – Text-zu-Video, Bild-zu-Video, Videobearbeitung und Referenz-zu-Video – mit begleitendem Audio, Prompt-Erweiterung und negativen Prompts.
  • Dauer: 5, 10 oder 15 Sekunden
  • Qualität: 720p / 1080p
  • Eingaben: Startbild, Endbild, Referenzvideo, Steuerungsaudio
16 Bilder pro Sekunde bei 720p · 24 Bilder pro Sekunde bei 1080p
Wan 2.6Ein bestehendes Video umwandeln; mehrere Szenen.
  • Dauer: 5, 10 oder 15 Sekunden
  • Qualität: 720p / 1080p
  • Eingaben: Startbild, Referenzvideo
14/Sek. bei 720p · 21/Sek. bei 1080p
Wan 2.5Erweitert kurze Prompts für Sie zu ausführlicheren Beschreibungen.
  • Dauer: 5 oder 10 Sekunden
  • Qualität: 720p / 1080p
  • Eingaben: Startbild
12 Bilder pro Sekunde bei 720p · 20 Bilder pro Sekunde bei 1080p
MMAudio v2Erzeugt eine Geräuschspur für einen Clip, der noch keine enthält.Die Ausführung erfolgt über die Bearbeitungsfunktionen eines Clips, nicht über die Modellauswahl.
  • Ergebnis: Auf den Quellclip gemultiplexte Audiodaten
Pauschal 5 pro Durchlauf
Luma Ray-2 ModifyLumaGestaltet einen bestehenden Clip von Anfang bis Ende neu.Die Ausführung erfolgt über die Bearbeitungsfunktionen eines Clips, nicht über die Modellauswahl.
  • Ergebnis: Der gesamte Quellclip, neu gestaltet
Pauschal 600 pro Durchlauf

02 / Bild

Bildmodelle

Die hier angegebenen Obergrenzen für Referenzbilder entsprechen der Anzahl, die der Hauptanbieter tatsächlich erhält; dies ist nicht immer die Anzahl, die Sie über das Upload-Feld hochladen können. FLUX rendert in jeder Stufe etwa 1 MP, unabhängig davon, was auf dem Auflösungsfeld angegeben ist.

Öffnen Sie das Bildstudio
7Image auf 7ARTBild7ART Voreinstellung
7ART

7Image

7ART

Auflösungen
1K / 2K / 4K
Quellenangaben
Bis zu 16

Credits

10 % über dem Basistarif der Engine

Modell anzeigen
Nano Banana auf 7ARTBild
Google2 Modelle

Nano Banana

2: Bis zu 14 Referenzbilder – die sicherste Wahl, um die Konsistenz eines Gesichts zu gewährleisten.

Auflösungen
1K / 2K / 4K
Quellenangaben
Bis zu 14
  • 2
  • Pro

Credits · 2

16 / 24 / 32 pro Bild bei 1K / 2K / 4K

Modell anzeigen
Seedream auf 7ARTBild
ByteDance3 Modelle

Seedream

5 Lite: Kostengünstig und schnell.

Auflösungen
2K / 3K
Quellenangaben
Bis zu 10
  • 5 Lite
  • 4.5
  • 4.0

Credits · 5 Lite

6 bei 2K · 8 bei 3K

Modell anzeigen
GPT Image 2.5 auf 7ARTBild
OpenAI2 Modelle

GPT Image 2.5

Flare: Die Standard-GPT Image 2.5 (Standard-Einstellung). Bei Bearbeitungen werden nur die von Ihnen gewünschten Änderungen vorgenommen, während Motiv, Bildaufbau und Hintergrund unverändert bleiben.

Auflösungen
1K / 2K / 4K
Quellenangaben
Bis zu 16
  • Flare
  • Sunburst

Credits · Flare

Ab 7 Credits pro Bild. Ein Breitbild im Format 16:9 kostet 9 Credits bei 1K, 12 bei 2K und 21 bei 4K; ein quadratisches Bild kostet mehr, bis zu 36 Credits.

Modell anzeigen
GPT Image 2 auf 7ARTBild
OpenAI

GPT Image 2

Bis zu 16 Referenzbilder; die KI ist besonders gut darin, Anweisungen zu befolgen und Text in das Bild zu integrieren.

Auflösungen
1K / 2K / 4K
Quellenangaben
Bis zu 16

Credits

8 / 11 / 20 pro Bild bei 1K / 2K / 4K

Modell anzeigen
Z-Image auf 7ARTBild
Alibaba

Z-Image

Kostengünstige Text-zu-Bild-Vorlagen – es sind keinerlei Referenzbilder erforderlich.

Ergebnis
2K, einheitliche feste Qualität
Quellenangaben
Keine – ausschließlich Text-zu-Bild

Credits

2 pro Bild

Modell anzeigen
Grok Imagine (image) auf 7ARTBild
xAI

Grok Imagine (image)

Text und Bild-zu-Bild; gegen eine Pauschalgebühr erhalten Sie einen ganzen Stapel.

Ergebnis
2K, einheitliche feste Qualität
Quellenangaben
1
Stapelverarbeitung
6 Bilder im Schnellmodus · 4 im Qualitätsmodus

Credits

4 pro Generierung im Geschwindigkeitsmodus · 5 im Qualitätsmodus

Modell anzeigen
FLUX auf 7ARTBild
Black Forest Labs12 Modelle

FLUX

FLUX.2 Pro: Höchster Realismus und Typografie.

Ergebnis
~1 MP
  • FLUX.2 Pro
  • FLUX.2
  • FLUX.2 Turbo
  • FLUX.2 Flash
  • +8 mehr

Credits · FLUX.2 Pro

6 pro Bild

Modell anzeigen
Clarity Upscaler auf 7ARTBild

Clarity Upscaler

Skaliert ein einzelnes Bild hoch, standardmäßig um das Zweifache.

Eingabe
Genau 1 Bild

Credits

24 pro Durchlauf

Modell anzeigen
IC-Light v2 auf 7ARTBild

IC-Light v2

Erzeugt eine neue Beleuchtung für ein einzelnes Bild.

Eingabe
Genau 1 Bild

Credits

20 pro Durchlauf

Modell anzeigen
Alle 25 bild Engines mit allen technischen Daten und Preisen
ModellWozu dient die Anwendung?Technische DatenCredits
7Image7ART7ART
  • Auflösungen: 1K / 2K / 4K
  • Quellenangaben: Bis zu 16
10 % über dem Basistarif der Engine
Nano Banana 2GoogleBis zu 14 Referenzbilder – die sicherste Wahl, um die Konsistenz eines Gesichts zu gewährleisten.
  • Auflösungen: 1K / 2K / 4K
  • Quellenangaben: Bis zu 14
16 / 24 / 32 pro Bild bei 1K / 2K / 4K
Nano Banana ProGoogleZusammensetzung aus mehreren Bildern.
  • Auflösungen: 1K / 2K / 4K
  • Quellenangaben: Bis zu 8
30 / 30 / 60 pro Bild bei 1K / 2K / 4K
Seedream 5 LiteByteDanceKostengünstig und schnell.
  • Auflösungen: 2K / 3K
  • Quellenangaben: Bis zu 10
6 bei 2K · 8 bei 3K
Seedream 4.5ByteDanceDie „Mid-Seedream“-Stufe.
  • Auflösungen: 2K / 4K
  • Quellenangaben: Bis zu 10
7 bei 2K · 9 bei 4K
Seedream 4.0ByteDanceDer größte Auflösungsbereich der Seedream s.
  • Auflösungen: 1K / 2K / 4K
  • Quellenangaben: Bis zu 10
5 / 6 / 8 pro Bild in den Auflösungen 1K / 2K / 4K
GPT Image 2.5 FlareOpenAIDie Standard-GPT Image 2.5 (Standard-Einstellung). Bei Bearbeitungen werden nur die von Ihnen gewünschten Änderungen vorgenommen, während Motiv, Bildaufbau und Hintergrund unverändert bleiben.Zehn Seitenverhältnisse pro Stufe. Transparente Hintergründe werden unterstützt. Breitere Formen kosten weniger Credits als quadratische.
  • Auflösungen: 1K / 2K / 4K
  • Quellenangaben: Bis zu 16
Ab 7 Credits pro Bild. Ein Breitbild im Format 16:9 kostet 9 Credits bei 1K, 12 bei 2K und 21 bei 4K; ein quadratisches Bild kostet mehr, bis zu 36 Credits.
GPT Image 2.5 SunburstOpenAIGPT Image 2.5 Ausgerichtet auf Präzision statt Geschwindigkeit – für Kampagnen- und Produktarbeiten, bei denen eine Bearbeitung exakt stimmen muss.Langsamer als Flare. Zehn Seitenverhältnisse in jeder Stufe, transparente Hintergründe werden unterstützt.
  • Auflösungen: 1K / 2K / 4K
  • Quellenangaben: Bis zu 16
Identisch mit Flare: ab 7 Credits pro Bild, 9 bei 1K, 12 bei 2K und 21 bei 4K für ein Breitbildformat im Verhältnis 16:9.
GPT Image 2OpenAIBis zu 16 Referenzbilder; die KI ist besonders gut darin, Anweisungen zu befolgen und Text in das Bild zu integrieren.Ein 1:1-Render kann nicht in 4K erfolgen, und bei einer nicht näher spezifizierten Größe liegt die Obergrenze bei 1K.
  • Auflösungen: 1K / 2K / 4K
  • Quellenangaben: Bis zu 16
8 / 11 / 20 pro Bild bei 1K / 2K / 4K
Z-ImageAlibabaKostengünstige Text-zu-Bild-Vorlagen – es sind keinerlei Referenzbilder erforderlich.
  • Ergebnis: 2K, einheitliche feste Qualität
  • Quellenangaben: Keine – ausschließlich Text-zu-Bild
2 pro Bild
Grok Imagine (image)xAIText und Bild-zu-Bild; gegen eine Pauschalgebühr erhalten Sie einen ganzen Stapel.
  • Ergebnis: 2K, einheitliche feste Qualität
  • Quellenangaben: 1
  • Stapelverarbeitung: 6 Bilder im Schnellmodus · 4 im Qualitätsmodus
4 pro Generierung im Geschwindigkeitsmodus · 5 im Qualitätsmodus
FLUX.2 ProBlack Forest LabsHöchster Realismus und Typografie.
  • Ergebnis: ~1 MP
6 pro Bild
FLUX.2Black Forest LabsRealismus; versteht JSON- und Hex-Farb-Prompts.
  • Ergebnis: ~1 MP
3 pro Bild
FLUX.2 TurboBlack Forest LabsSchnell und kostengünstig.
  • Ergebnis: ~1 MP
2 pro Bild
FLUX.2 FlashBlack Forest LabsDie schnellste FLUX.2.
  • Ergebnis: ~1 MP
1 pro Bild
FLUX.2 KleinBlack Forest Labs9B-Modell mit wenigen Schritten.
  • Ergebnis: ~1 MP
2 pro Bild
FLUX.1 DevBlack Forest LabsDie klassische FLUX-Qualität.
  • Ergebnis: ~1 MP
5 pro Bild
FLUX.1 SchnellBlack Forest LabsEntwürfe in weniger als einer Sekunde.
  • Ergebnis: ~1 MP
1 pro Bild
FLUX.2 EditBlack Forest LabsInstruct-edit – Bearbeiten oder Erstellen von bis zu 4 Bildern.Wird erst dann in der Auswahl angezeigt, wenn ein Referenzbild hinzugefügt wurde.
  • Ergebnis: ~1 MP
  • Quellenangaben: Bis zu 4
5 pro Bild
FLUX.2 Pro EditBlack Forest LabsPremium-Funktion „Instruct-Edit“.Wird erst dann in der Auswahl angezeigt, wenn ein Referenzbild hinzugefügt wurde.
  • Ergebnis: ~1 MP
  • Quellenangaben: Bis zu 9
9 pro Bild
FLUX.2 Klein EditBlack Forest LabsSchnelle, unkomplizierte Bearbeitungen.Wird erst dann in der Auswahl angezeigt, wenn ein Referenzbild hinzugefügt wurde.
  • Ergebnis: ~1 MP
  • Quellenangaben: Bis zu 4
5 pro Bild
Trained ElementBlack Forest LabsFLUX.1 Dev Hinzu kommt ein LoRA-Modell, das auf Ihrem eigenen Element trainiert wurde – es gibt diese Identität exakt wieder.Wird im Auswahlfeld nur angezeigt, wenn ein trainiertes Element im Prompt @erwähnt wird.
  • Ergebnis: ~1 MP
  • Quellenangaben: 1
  • Training: 400 Credits, einmal pro Element
10 pro Bild, nach einer einmaligen Gebühr von 400 für das Training
Clarity UpscalerSkaliert ein einzelnes Bild hoch, standardmäßig um das Zweifache.Zugänglich ausschließlich über den Super Agent – im Image Studio gibt es hierfür keine Schaltfläche.
  • Eingabe: Genau 1 Bild
24 pro Durchlauf
IC-Light v2Erzeugt eine neue Beleuchtung für ein einzelnes Bild.Zugänglich ausschließlich über den Super Agent – im Image Studio gibt es hierfür keine Schaltfläche.
  • Eingabe: Genau 1 Bild
20 pro Durchlauf
FLUX.1 KontextBlack Forest LabsAnweisungen bearbeiten anhand eines einzelnen Quellbildes.Zugänglich ausschließlich über den Super Agent – im Image Studio gibt es hierfür keine Schaltfläche.
  • Eingabe: Genau 1 Bild
8 pro Durchlauf

03 / Musik

Musikmodelle

Ein Anbieter, sechs Versionen, ein Pauschalpreis – denn das Interessante an Suno auf 7ART ist alles, was geschieht, nachdem der Track erstellt wurde.

Öffnen Sie das Musikstudio
Alle 6 musik Engines mit allen technischen Daten und Preisen
ModellWozu dient die Anwendung?Technische DatenCredits
Suno V5.5SunoDie neueste Version von Suno im Musikstudio 7ART.
  • Status: Aktuell
12 pro Generierung
Suno V5SunoDie Version, die der Musikpfad generiert, wenn keine Auswahl getroffen wurde.
  • Status: Standard
12 pro Generierung
Suno V4.5 AllSunoFrühere Version Suno, die weiterhin auswählbar ist.12 pro Generierung
Suno V4.5+SunoFrühere Version Suno, die weiterhin auswählbar ist.12 pro Generierung
Suno V4.5SunoFrühere Version Suno, die weiterhin auswählbar ist.12 pro Generierung
Suno V4SunoDie älteste Version von Suno, die im Studio noch auswählbar ist.12 pro Generierung

04 / Sprache & Audio

Sprach- und Audiomodelle

Sprache, Dialoge, Effekte und Musik. Die ElevenLabs-Engines laufen über „fal“ mit einem „kie“-Fallback; Sonilo verfügt über einen einzigen Anbieter und keine zweite Instanz.

Öffnen Sie das Sprachstudio
Alle 11 sprache & audio Engines mit allen technischen Daten und Preisen
ModellWozu dient die Anwendung?Technische DatenCredits
ElevenLabs Turbo 2.5ElevenLabsDie Stufe für schnelle Text-zu-Sprache-Wiedergabe.
  • Geschwindigkeit: 0.7×–1.2×
10 pro 1.000 Zeichen
ElevenLabs Multilingual v2ElevenLabsDie mehrsprachige Text-to-Speech-Stufe.
  • Geschwindigkeit: 0.7×–1.2×
20 pro 1.000 Zeichen
ElevenLabs Eleven v3ElevenLabsDie Stufe für ausdrucksstarke Text-zu-Sprache-Wiedergabe.
  • Geschwindigkeit: 0.7×–1.2×
20 pro 1.000 Zeichen
ElevenLabs v3 DialogueElevenLabsDialog zwischen mehreren Sprechern nach einem Skript.20 pro 1.000 Zeichen
ElevenLabs Sound Effects v2ElevenLabsEin Soundeffekt, der aus einer Textbeschreibung generiert wurde.0,4 pro Sekunde
ElevenLabs Audio IsolationElevenLabsEntfernt Hintergrundgeräusche aus einer Aufnahme.0,34 pro Sekunde
ElevenLabs Speech-to-TextElevenLabsTranskribiert Sprache aus einer Audiodatei.6 pro Minute
ElevenLabs DubbingElevenLabsSynchronisiert ein Video in eine andere Sprache.180 pro Minute, aufgerundet
HeyGen Video Translate — PrecisionHeyGenÜbersetzt ein Video mit einer geklonteten Stimme und einer neu synchronisierten Mundbewegung.20 pro Sekunde Ausgabe
HeyGen Video Translate — SpeedHeyGenDer Modus für schnelle Videoübersetzungen.10 pro Sekunde Ausgabe
Sonilo v1.1SoniloSounddesign, das genau auf die Handlung abgestimmt ist – Geräuscheffekte oder eine mit dem Video synchronisierte Musikuntermalung, oder beides, basierend auf einer Textbeschreibung.
  • Modi: Video → Soundeffekte · Video → Musik · Text → Sound · Text → Musik
  • Abschnitte: Jeweils ≥5 Sekunden, zusammenhängend, ≤200 Zeichen
  • Abrechnungsuntergrenze: Mindestens 15 Sekunden
1,8/Sek. für jeden Videomodus · 0,36/Sek. Text-zu-Ton · 0,5/Sek. Text-zu-Musik, bei einer Mindestdauer von 15 Sekunden

05 / Avatar & Lippensynchronisation

Avatar- und Lippensynchronisationsmodelle

Vier Engines von vier Anbietern, mit denen Sie ein Gesicht zum Sprechen bringen können – entweder anhand eines einzelnen Porträts oder anhand von bereits vorhandenem Filmmaterial.

Öffnen Sie das Lipsync-Studio
Alle 5 avatar & lippensynchronisation Engines mit allen technischen Daten und Preisen
ModellWozu dient die Anwendung?Technische DatenCredits
Kling Avatar — StandardKling AIVerwandelt ein Porträt in einen sprechenden Avatar.
  • Qualität: 720p
  • Maximale Länge: 60s
8 pro Sekunde
Kling Avatar — ProKling AIDie 1080p-Stufe mit sprechendem Avatar und der längste Clip im Studio.
  • Qualität: 1080p
  • Maximale Länge: 5 Minuten
16 pro Sekunde
HeyGen Avatar IVHeyGenAus einem Foto entsteht ein sprechender Avatar.
  • Qualität: 720p / 1080p
  • Maximale Länge: 60s
20 pro Sekunde
Omnihuman 1.5ByteDanceVom Porträt zum sprechenden Video.
  • Qualität: 720p / 1080p, zum gleichen Preis
  • Maximale Länge: 60s
27 pro Sekunde
Volcengine Lip SyncVolcengineEin bestehendes Video wird mit einer neuen Tonspur neu synchronisiert.
  • Eingabe: Ein Quellvideo
  • Maximale Länge: 60s
8 pro Sekunde

06 / 3D

3D-Modelle

Vier Generatoren und zwei Mesh-Werkzeuge, alle über fal. Die Polycount-Werte entsprechen dem Bereich des Studio-Schiebereglers, der bewusst enger gewählt ist als die von den Endpunkten akzeptierten Werte.

Öffnen Sie das 3D-Studio
Alle 6 3d Engines mit allen technischen Daten und Preisen
ModellWozu dient die Anwendung?Technische DatenCredits
Meshy 6MeshyDas beste Allround-Netz – Quad-Topologie, PBR-Materialien und Posing.
  • Modi: Bild · Mehrfachansicht · Text
  • Polycount: 10,000–300,000
  • Extras: PBR · Quad-Topologie · A-Pose / T-Pose
  • Bilder: Bis zu 4
240 pro Generierung
Hunyuan 3.1 ProDas Mesh mit der höchsten Detailgenauigkeit, mit Multi-View-Eingabe.
  • Modi: Bild · Mehrfachansicht · Text
  • Polycount: 40,000–1,500,000
  • Extras: PBR
  • Bilder: Bis zu 4
80 pro Generierung
Trellis 2Schnell und kostengünstig – bereits ab einem einzigen Bild.
  • Modi: Nur Bild
  • Polycount: 10,000–300,000
  • Bilder: 1
60 pro Generierung
Tripo 2.5Tripo3DDas schnellste Mesh im 3D-Studio.
  • Modi: Bild · Mehrfachansicht · Text
  • Polycount: 10,000–300,000
  • Extras: PBR
  • Bilder: Bis zu 4
60 pro Generierung
Retexture EngineMeshyErzeugt neue Texturen für ein bereits vorhandenes Mesh anhand einer Eingabe oder eines Stilbildes.
  • Eingabe: Ein vorhandenes Mesh + ein Bild in einem bestimmten Stil
  • Extras: PBR
60 pro Durchlauf
RemeshMeshyRemesh en, skalieren Sie ein Modell neu und exportieren Sie es erneut für den Druck oder eine andere Verarbeitungskette.
  • Eingabe: Ein vorhandenes Netzmodell
  • Polycount: 10,000–300,000
  • Formate: GLB · FBX · OBJ · STL · USDZ
40 pro Durchlauf

Wie ein Modell auf diese Seite gelangt

Ein Modell erscheint hier, sobald wir es tatsächlich ausführen können – d. h., sobald der API-Zugriff gewährt, der Adapter geschrieben und der Preis festgelegt ist. Die Gewährung des Zugriffs liegt im Ermessen des Anbieters und kann von uns nicht zugesichert werden; daher finden Sie auf dieser Seite kein Veröffentlichungsdatum für Inhalte, die wir zum jetzigen Zeitpunkt noch nicht generieren können.

Was Sie erhalten, ist eine zentrale Plattform, auf der Sie all dies ausführen können. Dieselbe Eingabezeile, dieselben hochgeladenen Referenzdateien, dieselbe Bibliothek und ein einziges Credit-Guthaben, auf das jedes Modell zurückgreift – der Wechsel von einem Bild zu einem Video oder einer Partitur kostet Sie also lediglich eine Auswahl aus dem Dropdown-Menü, kein neues Abonnement.

Wenn zwei Anbieter dasselbe Modell bereitstellen, nutzen wir einen als primären Anbieter und den anderen als Ausweichlösung; der angezeigte Preis ist in beiden Fällen identisch.

Alle oben gezeigten Modelle mit einem einzigen Guthaben

Keine anbieterbezogenen Abonnements, keine separaten Konten, kein erneutes Einarbeiten in die Benutzeroberfläche bei jeder Einführung eines neuen Modells.