7ART

7ART의 AI 모델

75 동영상, 이미지, 음악, 음성, 아바타 및 3D를 위한 엔진이 하나의 워크플로우와 하나의 크레딧 잔액으로 통합되어 있습니다. API 접근 권한을 확보하는 대로 새로운 최상위 모델을 추가하고 있습니다.

아래에 명시된 모든 소요 시간, 출력 등급 및 가격은 7ART에서 해당 모델에 대해 제공하고 청구하는 내용입니다. 이는 공급업체의 사양서가 아닌 스튜디오 자체 표에서 발췌한 정보입니다.

오늘의 카탈로그

22 동영상 · 25 이미지 · 6 음악 · 11 음성 및 오디오 · 5 아바타 및 립싱크 · 6 3d

01 / 동영상

동영상 모델

이 카드들은 클립 길이, 해상도 상한선, 참조 동영상을 사용할지 여부 등 거의 모든 사항에 대해 의견이 다르므로, 각 카드가 담고 있는 내용은 제안 내용이 아니라 차이점입니다.

비디오 스튜디오 열기
7Video 7ART동영상7ART 프리셋
7ART

7Video

7ART

소요 시간
5–15초
품질
768P / 2K
입력 사항
시작 및 종료 프레임, 또는 이미지/동영상/오디오 참조 자료

크레딧

기본 엔진 요율보다 10% 높은 요금

모델 보기
Gemini Omni Flash 7ART동영상
Google

Gemini Omni Flash

이미지, 동영상 클립, 저장된 캐릭터 및 음성 등 자체 참조 패널만을 기반으로 작동하는 멀티모달 Google 모델로, 프레임 카드는 사용하지 않습니다.

소요 시간
4, 6, 8 또는 10초
출력 등급
720p / 1080p / 4K
아스펙트
16:9 또는 9:16

크레딧

720p 또는 1080p 해상도에서 4 / 6 / 8 / 10초 분량에 대한 90 / 120 / 150 / 180 · 4K 해상도에서 210 / 240 / 270 / 300 · 동영상 참조 자료가 있는 경우 240(720p/1080p) 또는 360(4K) 고정

모델 보기
VEO 7ART동영상
Google3 모델

VEO

3.1 Quality: Google

소요 시간
4, 6 또는 8초
품질
미리보기 / 1080p / 4K
입력 사항
시작 프레임 + 종료 프레임
  • 3.1 Quality
  • 3.1 Fast
  • 3.1 Lite

크레딧 · 3.1 Quality

생성당 정액 요금: 미리보기 250회 · 1080p 255회 · 4K 370회

모델 보기
Seedance 7ART동영상
4 모델

Seedance

2.5: 스튜디오에서 가장 긴 클립, 영상과 함께 생성되는 오디오, 압도적으로 넓은 참조 자료 세트 — 최대 1080p (4K 등급 없음).

소요 시간
4–30초
품질
480p / 720p / 1080p
참고 문헌
이미지 30장 · 동영상 10개 · 오디오 10개
  • 2.5
  • 2.0
  • 2.0 Fast
  • 2.0 Mini

크레딧 · 2.5

480p 초당 37 · 720p 초당 79 · 1080p 초당 208 크레딧

모델 보기
Kling 7ART동영상
Kling AI5 모델

Kling

3.0: 가장 성능이 뛰어난 Kling — 캐릭터, 동기화된 사운드, 멀티 샷, 4K 화질 옵션이 제공됩니다.

소요 시간
3–15초
품질
720p / 1080p / 4K
입력 사항
시작 프레임; 멀티샷 외부의 종료 프레임
  • 3.0
  • 3.0 Turbo
  • 2.6
  • 2.5 Turbo
  • +1 더 보기

크레딧 · 3.0

720p 기준 초당 14개 · 1080p 기준 초당 18개 · 오디오 포함 시 초당 20~27개 · 4K 기준 초당 67개

모델 보기
Grok Imagine (video) 7ART동영상
xAI

Grok Imagine (video)

강력한 모션, 텍스트 및 이미지-비디오 변환 기능을 제공하며, 스튜디오 내에서 초당 비용이 가장 저렴합니다.

소요 시간
6–30초
품질
480p / 720p
입력 사항
시작 프레임

크레딧

480p 기준 초당 1.6개 · 720p 기준 초당 3개

모델 보기
MiniMax H3 7ART동영상
MiniMax

MiniMax H3

네 가지 품질 등급 — 480P부터 4K까지 — 첫 프레임-마지막 프레임 제어, 이미지/영상/오디오 참조 지원.

소요 시간
5–15초
품질
480P / 768P / 2K / 4K
입력 사항
시작 및 종료 프레임, 또는 이미지 9장 / 동영상 3개 / 오디오 3개

크레딧

480P 초당 10 · 768P 초당 22.5 · 2K 초당 36.5 · 4K 초당 32 크레딧, 참조 영상 자체의 재생 시간과 6번째부터의 참조 이미지당 11 크레딧이 추가됩니다

모델 보기
HappyHorse 1.1 7ART동영상
Alibaba

HappyHorse 1.1

텍스트, 이미지 또는 동영상에 대한 다중 참조 — 이미지만 가능하며, 동영상이나 오디오 참조는 허용되지 않습니다.

소요 시간
3–15초
품질
720p / 1080p
입력 사항
시작 프레임 또는 참조 이미지

크레딧

720p 기준 초당 33프레임 · 1080p 기준 초당 44프레임

모델 보기
Wan 7ART동영상
3 모델

Wan

2.7: 텍스트-투-비디오, 이미지-투-비디오, 비디오 편집, 레퍼런스-투-비디오 등 4가지 모드를 하나로 통합했으며, 오디오 생성, 프롬프트 확장 및 부정 프롬프트 기능을 제공합니다.

소요 시간
5, 10 또는 15초
품질
720p / 1080p
입력 사항
시작 프레임, 종료 프레임, 참조 동영상, 구동 오디오
  • 2.7
  • 2.6
  • 2.5

크레딧 · 2.7

720p에서 초당 16프레임 · 1080p에서 초당 24프레임

모델 보기
MMAudio v2 7ART동영상

MMAudio v2

사운드 효과가 없는 클립에 대한 폴리 트랙을 생성합니다.

출력 결과
소스 클립에 오디오가 멀티플렉싱되었습니다.

크레딧

실행당 5 플랫

모델 보기
Luma Ray-2 Modify 7ART동영상
Luma

Luma Ray-2 Modify

기존 클립을 처음부터 끝까지 재구성합니다.

출력 결과
전체 원본 클립을 재편집한 것

크레딧

실행당 600 플랫

모델 보기
모든 22 동영상 엔진 및 각 사양과 가격 정보
모델용도사양크레딧
7Video7ART7ART
  • 소요 시간: 5–15초
  • 품질: 768P / 2K
  • 입력 사항: 시작 및 종료 프레임, 또는 이미지/동영상/오디오 참조 자료
기본 엔진 요율보다 10% 높은 요금
Gemini Omni FlashGoogle이미지, 동영상 클립, 저장된 캐릭터 및 음성 등 자체 참조 패널만을 기반으로 작동하는 멀티모달 Google 모델로, 프레임 카드는 사용하지 않습니다.7ART 선택기에서 “Gemini Omni Video”로 표시되는데, 이 이름은 Google에서 유래한 것이 아니라 당사의 제공업체 엔드포인트에서 비롯된 것입니다.
  • 소요 시간: 4, 6, 8 또는 10초
  • 출력 등급: 720p / 1080p / 4K
  • 아스펙트: 16:9 또는 9:16
  • 참고 문헌: 이미지 7장 · 동영상 클립 1개 · 캐릭터 3개 · 음성 3개
720p 또는 1080p 해상도에서 4 / 6 / 8 / 10초 분량에 대한 90 / 120 / 150 / 180 · 4K 해상도에서 210 / 240 / 270 / 300 · 동영상 참조 자료가 있는 경우 240(720p/1080p) 또는 360(4K) 고정
VEO 3.1 QualityGoogleGoogle
  • 소요 시간: 4, 6 또는 8초
  • 품질: 미리보기 / 1080p / 4K
  • 입력 사항: 시작 프레임 + 종료 프레임
생성당 정액 요금: 미리보기 250회 · 1080p 255회 · 4K 370회
VEO 3.1 FastGoogleVEO보다 속도가 빠르며, 참조 사진을 허용하는 유일한 요금제입니다.
  • 소요 시간: 4, 6 또는 8s
  • 품질: 미리보기 / 1080p / 4K
  • 입력 사항: 시작 및 종료 프레임, 또는 최대 3장의 참조 사진
생성당 정액: 미리보기 60회 · 1080p 65회 · 4K 180회
VEO 3.1 LiteGoogle가격이 저렴한 VEO — 실험용으로 적합합니다.
  • 소요 시간: 4, 6 또는 8초
  • 품질: 미리보기 / 1080p / 4K
  • 입력 사항: 시작 프레임 + 종료 프레임
생성당 정액: 미리보기 30회 · 1080p 35회 · 4K 150회
Seedance 2.5ByteDance스튜디오에서 가장 긴 클립, 영상과 함께 생성되는 오디오, 압도적으로 넓은 참조 자료 세트 — 최대 1080p (4K 등급 없음).
  • 소요 시간: 4–30초
  • 품질: 480p / 720p / 1080p
  • 참고 문헌: 이미지 30장 · 동영상 10개 · 오디오 10개
  • 아스펙트: 21:9, 16:9, 4:3, 1:1, 3:4, 9:16 또는 자동
480p 초당 37 · 720p 초당 79 · 1080p 초당 208 크레딧
Seedance 2.0ByteDance강한 정체성 일관성을 갖춘 사실적인 인물과 영화 같은 멀티샷 시퀀스 · 4K를 렌더링하는 유일한 Seedance 등급입니다.
  • 소요 시간: 4–15초
  • 품질: 480p / 720p / 1080p / 4K
  • 참고 문헌: 이미지 9장 · 동영상 3개 · 오디오 3개
480p / 720p / 1080p / 4K 기준 초당 19 / 41 / 102 / 311 크레딧 · 참조 영상 사용 시 입력+출력 시간 기준 초당 11.5 / 25 / 62 크레딧 (4K는 참조 영상 요금 없음)
Seedance 2.0 FastByteDance초안 및 미리보기를 위한 경량 버전 Seedance 2.0.
  • 소요 시간: 4–15초
  • 품질: 480p / 720p
  • 참고 문헌: 이미지 9장 · 동영상 3개 · 오디오 3개
480p 기준 초당 15.5개 · 720p 기준 초당 33개 · 동영상 참조 자료 사용 시 입력 및 출력 시간을 합산한 초당 9/20개
Seedance 2.0 MiniByteDanceSeedance의 가장 저렴한 요금제입니다.
  • 소요 시간: 4–15초
  • 품질: 480p / 720p
  • 참고 문헌: 이미지 9장 · 동영상 3개 · 오디오 3개
480p 기준 초당 9.5개 · 720p 기준 초당 20.5개 · 참조 동영상이 있는 경우 입력 및 출력 시간당 초당 6개 / 12.5개
Kling 3.0Kling AI가장 성능이 뛰어난 Kling — 캐릭터, 동기화된 사운드, 멀티 샷, 4K 화질 옵션이 제공됩니다.
  • 소요 시간: 3–15초
  • 품질: 720p / 1080p / 4K
  • 입력 사항: 시작 프레임; 멀티샷 외부의 종료 프레임
  • 오디오: 선택 사항 — 초당 생성 속도를 높입니다.
720p 기준 초당 14개 · 1080p 기준 초당 18개 · 오디오 포함 시 초당 20~27개 · 4K 기준 초당 67개
Kling 3.0 TurboKling AIKling 3.0, 텍스트 및 이미지-to-video 기능을 더 빠르게 이용할 수 있습니다.
  • 소요 시간: 3–15초
  • 품질: 720p / 1080p
  • 입력 사항: 시작 프레임
720p 기준 초당 18프레임 · 1080p 기준 초당 22.5프레임
Kling 2.6Kling AI신뢰할 수 있으며, 사운드가 포함된 애니메이션 제작에 강점을 보입니다.
  • 소요 시간: 5 또는 10초
  • 품질: 720p / 1080p
  • 입력 사항: 시작 프레임
초당 11개 · 오디오 포함 시 초당 22개
Kling 2.5 TurboKling AI가장 빠르고 저렴한 초안 생성 엔진입니다.
  • 소요 시간: 5 또는 10초
  • 품질: 720p
  • 입력 사항: 시작 프레임
초당 9개
Kling 3.0 Motion ControlKling AI모션 전송 — 한 클립의 움직임을 가져와 새로운 피사체에 적용하는 기술입니다.비디오 모델 선택기가 아닌 Motion 스튜디오에서 실행됩니다.
  • 품질: 720p / 1080p
  • 입력 사항: 시작 프레임
720p에서 초당 20프레임 · 1080p에서 초당 27프레임
Grok Imagine (video)xAI강력한 모션, 텍스트 및 이미지-비디오 변환 기능을 제공하며, 스튜디오 내에서 초당 비용이 가장 저렴합니다.
  • 소요 시간: 6–30초
  • 품질: 480p / 720p
  • 입력 사항: 시작 프레임
480p 기준 초당 1.6개 · 720p 기준 초당 3개
MiniMax H3MiniMax네 가지 품질 등급 — 480P부터 4K까지 — 첫 프레임-마지막 프레임 제어, 이미지/영상/오디오 참조 지원.참조 정보는 시작 프레임이 없을 때만 전송되며, 한 프레임이 사용 중일 때는 다른 프레임이 패널에 숨겨집니다.
  • 소요 시간: 5–15초
  • 품질: 480P / 768P / 2K / 4K
  • 입력 사항: 시작 및 종료 프레임, 또는 이미지 9장 / 동영상 3개 / 오디오 3개
  • 아스펙트: 21:9, 16:9, 4:3, 1:1, 3:4, 9:16
480P 초당 10 · 768P 초당 22.5 · 2K 초당 36.5 · 4K 초당 32 크레딧, 참조 영상 자체의 재생 시간과 6번째부터의 참조 이미지당 11 크레딧이 추가됩니다
HappyHorse 1.1Alibaba텍스트, 이미지 또는 동영상에 대한 다중 참조 — 이미지만 가능하며, 동영상이나 오디오 참조는 허용되지 않습니다.
  • 소요 시간: 3–15초
  • 품질: 720p / 1080p
  • 입력 사항: 시작 프레임 또는 참조 이미지
720p 기준 초당 33프레임 · 1080p 기준 초당 44프레임
Wan 2.7텍스트-투-비디오, 이미지-투-비디오, 비디오 편집, 레퍼런스-투-비디오 등 4가지 모드를 하나로 통합했으며, 오디오 생성, 프롬프트 확장 및 부정 프롬프트 기능을 제공합니다.
  • 소요 시간: 5, 10 또는 15초
  • 품질: 720p / 1080p
  • 입력 사항: 시작 프레임, 종료 프레임, 참조 동영상, 구동 오디오
720p에서 초당 16프레임 · 1080p에서 초당 24프레임
Wan 2.6기존 동영상을 변환; 다중 장면.
  • 소요 시간: 5, 10 또는 15초
  • 품질: 720p / 1080p
  • 입력 사항: 시작 프레임, 참조 동영상
720p 기준 초당 14프레임 · 1080p 기준 초당 21프레임
Wan 2.5짧은 프롬프트를 더 풍부한 설명으로 확장해 드립니다.
  • 소요 시간: 5 또는 10초
  • 품질: 720p / 1080p
  • 입력 사항: 시작 프레임
720p 기준 초당 12프레임 · 1080p 기준 초당 20프레임
MMAudio v2사운드 효과가 없는 클립에 대한 폴리 트랙을 생성합니다.모델 선택기가 아닌 클립의 편집 동작을 통해 실행됩니다.
  • 출력 결과: 소스 클립에 오디오가 멀티플렉싱되었습니다.
실행당 5 플랫
Luma Ray-2 ModifyLuma기존 클립을 처음부터 끝까지 재구성합니다.모델 선택기가 아닌 클립의 편집 동작을 통해 실행됩니다.
  • 출력 결과: 전체 원본 클립을 재편집한 것
실행당 600 플랫

02 / 이미지

이미지 모델

여기에 표시된 참조 이미지 캡은 주요 제공자가 실제로 수신하는 수치를 나타내며, 이는 업로드 상자에 드롭할 수 있는 수량과 항상 일치하지는 않습니다. FLUX은 해상도 표기 사항과 관계없이 모든 티어에서 약 1MP 크기로 렌더링합니다.

이미지 스튜디오 열기
7Image 7ART이미지7ART 프리셋
7ART

7Image

7ART

해상도
1K / 2K / 4K
참고 문헌
최대 16

크레딧

기본 엔진 요율보다 10% 높은 요금

모델 보기
Nano Banana 7ART이미지
Google2 모델

Nano Banana

2: 최대 14장의 참조 이미지 — 얼굴의 일관성을 유지하기 위한 가장 안전한 선택입니다.

해상도
1K / 2K / 4K
참고 문헌
최대 14
  • 2
  • Pro

크레딧 · 2

이미지당 16 / 24 / 32개, 해상도 1K / 2K / 4K

모델 보기
Seedream 7ART이미지
ByteDance3 모델

Seedream

5 Lite: 저렴하고 빠릅니다.

해상도
2K / 3K
참고 문헌
최대 10
  • 5 Lite
  • 4.5
  • 4.0

크레딧 · 5 Lite

2K 해상도 6장 · 3K 해상도 8장

모델 보기
GPT Image 2.5 7ART이미지
OpenAI2 모델

GPT Image 2.5

Flare: 기본 설정인 ‘GPT Image 2.5’입니다. 편집 시 요청한 내용만 변경되며, 주제, 구도 및 배경은 그대로 유지됩니다.

해상도
1K / 2K / 4K
참고 문헌
최대 16
  • Flare
  • Sunburst

크레딧 · Flare

이미지 1장당 7크레딧부터 시작합니다. 16:9 와이드스크린의 경우 1K 해상도는 9크레딧, 2K는 12크레딧, 4K는 21크레딧이 소요되며, 정사각형 이미지는 더 비싸서 최대 36크레딧까지 듭니다.

모델 보기
GPT Image 2 7ART이미지
OpenAI

GPT Image 2

최대 16개의 참조 이미지를 지원하며, 지시 사항 이행과 이미지 내 텍스트 표현에 강점을 보입니다.

해상도
1K / 2K / 4K
참고 문헌
최대 16

크레딧

이미지당 1K / 2K / 4K 해상도에 따라 8 / 11 / 20 크레딧이 소요됩니다.

모델 보기
Z-Image 7ART이미지
Alibaba

Z-Image

저렴한 텍스트-이미지 변환 서비스 — 참조 이미지가 전혀 필요하지 않습니다.

출력 결과
2K, 단일 고정 화질
참고 문헌
없음 — 텍스트-이미지 변환 기능만 제공

크레딧

이미지당 2개

모델 보기
Grok Imagine (image) 7ART이미지
xAI

Grok Imagine (image)

텍스트 및 이미지-투-이미지(image-to-image) 기능; 일정한 요금을 지불하면 전체 배치 결과를 한 번에 받을 수 있습니다.

출력 결과
2K, 단일 고정 화질
참고 문헌
1
일괄 처리
스피드 모드에서 6장 · 품질 모드에서 4장

크레딧

속도 모드에서는 생성당 4개 · 품질 모드에서는 5개

모델 보기
FLUX 7ART이미지
Black Forest Labs12 모델

FLUX

FLUX.2 Pro: 최고 수준의 사실감과 타이포그래피.

출력 결과
~1 MP
  • FLUX.2 Pro
  • FLUX.2
  • FLUX.2 Turbo
  • FLUX.2 Flash
  • +8 더 보기

크레딧 · FLUX.2 Pro

이미지당 6개

모델 보기
Clarity Upscaler 7ART이미지

Clarity Upscaler

단일 이미지를 업스케일하며, 기본값은 2배입니다.

입력
정확히 1장의 이미지

크레딧

실행당 24개

모델 보기
IC-Light v2 7ART이미지

IC-Light v2

단일 이미지를 다시 렌더링합니다.

입력
정확히 1장의 이미지

크레딧

실행당 20

모델 보기
모든 25 이미지 엔진 및 각 사양과 가격 정보
모델용도사양크레딧
7Image7ART7ART
  • 해상도: 1K / 2K / 4K
  • 참고 문헌: 최대 16
기본 엔진 요율보다 10% 높은 요금
Nano Banana 2Google최대 14장의 참조 이미지 — 얼굴의 일관성을 유지하기 위한 가장 안전한 선택입니다.
  • 해상도: 1K / 2K / 4K
  • 참고 문헌: 최대 14
이미지당 16 / 24 / 32개, 해상도 1K / 2K / 4K
Nano Banana ProGoogle여러 이미지를 조합한 합성 이미지.
  • 해상도: 1K / 2K / 4K
  • 참고 문헌: 최대 8
이미지당 30 / 30 / 60, 해상도 1K / 2K / 4K
Seedream 5 LiteByteDance저렴하고 빠릅니다.
  • 해상도: 2K / 3K
  • 참고 문헌: 최대 10
2K 해상도 6장 · 3K 해상도 8장
Seedream 4.5ByteDanceSeedream의 중간 등급입니다.
  • 해상도: 2K / 4K
  • 참고 문헌: 최대 10
7개 2K · 9개 4K
Seedream 4.0ByteDanceSeedream s에서 지원하는 가장 넓은 해상도 범위입니다.
  • 해상도: 1K / 2K / 4K
  • 참고 문헌: 최대 10
이미지당 5 / 6 / 8개, 해상도 1K / 2K / 4K
GPT Image 2.5 FlareOpenAI기본 설정인 ‘GPT Image 2.5’입니다. 편집 시 요청한 내용만 변경되며, 주제, 구도 및 배경은 그대로 유지됩니다.각 티어마다 10가지 화면 비율이 제공됩니다. 투명한 배경을 지원합니다. 정사각형보다 가로가 긴 형태의 경우 크레딧 소모량이 더 적습니다.
  • 해상도: 1K / 2K / 4K
  • 참고 문헌: 최대 16
이미지 1장당 7크레딧부터 시작합니다. 16:9 와이드스크린의 경우 1K 해상도는 9크레딧, 2K는 12크레딧, 4K는 21크레딧이 소요되며, 정사각형 이미지는 더 비싸서 최대 36크레딧까지 듭니다.
GPT Image 2.5 SunburstOpenAIGPT Image 2.5 속도보다는 정확성에 중점을 두도록 조정되어 있어, 편집 내용이 정확히 일치해야 하는 캠페인 및 제품 작업에 적합합니다.Flare보다 속도가 느립니다. 각 티어별로 10가지 화면 비율을 제공하며, 투명한 배경을 지원합니다.
  • 해상도: 1K / 2K / 4K
  • 참고 문헌: 최대 16
Flare와 동일하게, 16:9 와이드스크린 기준 이미지당 7크레딧, 1K 해상도는 9크레딧, 2K는 12크레딧, 4K는 21크레딧이 소요됩니다.
GPT Image 2OpenAI최대 16개의 참조 이미지를 지원하며, 지시 사항 이행과 이미지 내 텍스트 표현에 강점을 보입니다.1:1 렌더링은 4K 해상도로 생성될 수 없으며, 크기가 명시되지 않은 경우 최대 1K까지 지원됩니다.
  • 해상도: 1K / 2K / 4K
  • 참고 문헌: 최대 16
이미지당 1K / 2K / 4K 해상도에 따라 8 / 11 / 20 크레딧이 소요됩니다.
Z-ImageAlibaba저렴한 텍스트-이미지 변환 서비스 — 참조 이미지가 전혀 필요하지 않습니다.
  • 출력 결과: 2K, 단일 고정 화질
  • 참고 문헌: 없음 — 텍스트-이미지 변환 기능만 제공
이미지당 2개
Grok Imagine (image)xAI텍스트 및 이미지-투-이미지(image-to-image) 기능; 일정한 요금을 지불하면 전체 배치 결과를 한 번에 받을 수 있습니다.
  • 출력 결과: 2K, 단일 고정 화질
  • 참고 문헌: 1
  • 일괄 처리: 스피드 모드에서 6장 · 품질 모드에서 4장
속도 모드에서는 생성당 4개 · 품질 모드에서는 5개
FLUX.2 ProBlack Forest Labs최고 수준의 사실감과 타이포그래피.
  • 출력 결과: ~1 MP
이미지당 6개
FLUX.2Black Forest Labs사실감; JSON 및 16진수 색상 프롬프트를 이해합니다.
  • 출력 결과: ~1 MP
이미지당 3개
FLUX.2 TurboBlack Forest Labs빠르고 저렴합니다.
  • 출력 결과: ~1 MP
이미지당 2개
FLUX.2 FlashBlack Forest Labs가장 빠른 FLUX.2.
  • 출력 결과: ~1 MP
이미지당 1개
FLUX.2 KleinBlack Forest Labs소수 단계 9B 모델.
  • 출력 결과: ~1 MP
이미지당 2개
FLUX.1 DevBlack Forest LabsFLUX 특유의 고품질입니다.
  • 출력 결과: ~1 MP
이미지당 5개
FLUX.1 SchnellBlack Forest Labs1초도 채 걸리지 않는 초안 생성.
  • 출력 결과: ~1 MP
이미지당 1개
FLUX.2 EditBlack Forest LabsInstruct-edit — 최대 4장의 이미지를 편집하거나 조합할 수 있습니다.참조 이미지가 첨부된 경우에만 선택기에 표시됩니다.
  • 출력 결과: ~1 MP
  • 참고 문헌: 최대 4
이미지당 5개
FLUX.2 Pro EditBlack Forest Labs프리미엄 인스트럭트-에디트.참조 이미지가 첨부된 경우에만 선택기에 표시됩니다.
  • 출력 결과: ~1 MP
  • 참고 문헌: 최대 9
이미지당 9개
FLUX.2 Klein EditBlack Forest Labs빠르고 간편한 편집 기능.참조 이미지가 첨부된 경우에만 선택기에 표시됩니다.
  • 출력 결과: ~1 MP
  • 참고 문헌: 최대 4
이미지당 5개
Trained ElementBlack Forest LabsFLUX.1 Dev 또한 사용자 고유의 ‘Element’로 훈련된 LoRA를 통해 해당 정체성을 정확히 재현합니다.프롬프트에서 훈련된 엘리먼트가 @멘션된 경우에만 피커에 표시됩니다.
  • 출력 결과: ~1 MP
  • 참고 문헌: 1
  • 훈련: 400 크레딧, 요소당 1회
이미지당 10 크레딧이 소요되며, 초기 훈련 비용으로 400 크레딧이 일회성으로 청구됩니다.
Clarity Upscaler단일 이미지를 업스케일하며, 기본값은 2배입니다.슈퍼 에이전트를 통해서만 접근할 수 있으며, 이미지 스튜디오에는 이에 대한 버튼이 없습니다.
  • 입력: 정확히 1장의 이미지
실행당 24개
IC-Light v2단일 이미지를 다시 렌더링합니다.슈퍼 에이전트를 통해서만 접근할 수 있으며, 이미지 스튜디오에는 이에 대한 버튼이 없습니다.
  • 입력: 정확히 1장의 이미지
실행당 20
FLUX.1 KontextBlack Forest Labs단일 원본 이미지를 대상으로 지시-편집 기능을 사용할 수 있습니다.슈퍼 에이전트를 통해서만 접근할 수 있으며, 이미지 스튜디오에는 이에 대한 버튼이 없습니다.
  • 입력: 정확히 1장의 이미지
실행당 8개

03 / 음악

음악 모델

단일 공급업체, 6가지 버전, 단일 정액 요금 — 7ART의 ‘Suno’에서 흥미로운 점은 트랙이 생성된 후 일어나는 모든 과정이기 때문입니다.

음악 스튜디오 열기
모든 6 음악 엔진 및 각 사양과 가격 정보
모델용도사양크레딧
Suno V5.5Suno7ART 음악 스튜디오의 최신 Suno 버전입니다.
  • 상태: 최신
생성당 12개
Suno V5Suno음악 생성 경로에서 아무것도 선택하지 않았을 때 사용되는 버전입니다.
  • 상태: 기본값
생성당 12개
Suno V4.5 AllSuno이전 버전의 Suno도 계속 선택할 수 있도록 유지되었습니다.생성당 12개
Suno V4.5+Suno이전 버전의 Suno도 계속 선택 가능하도록 유지되었습니다.생성당 12개
Suno V4.5Suno이전 버전의 Suno도 계속 선택할 수 있도록 유지되었습니다.생성당 12개
Suno V4Suno스튜디오에서 여전히 선택할 수 있는 가장 오래된 Suno 버전입니다.생성당 12개

04 / 음성 및 오디오

음성 및 오디오 모델

음성, 대화, 효과음 및 배경 음악. ElevenLabs 엔진은 fal을 통해 실행되며 kie를 대체 옵션으로 사용합니다. Sonilo은 단일 제공업체만 있으며 두 번째 경로는 없습니다.

보이스 스튜디오 열기
모든 11 음성 및 오디오 엔진 및 각 사양과 가격 정보
모델용도사양크레딧
ElevenLabs Turbo 2.5ElevenLabs고속 텍스트 음성 변환(TTS) 요금제입니다.
  • 속도: 0.7×–1.2×
1,000자당 10
ElevenLabs Multilingual v2ElevenLabs다국어 텍스트 음성 변환(TTS) 서비스 등급입니다.
  • 속도: 0.7×–1.2×
1,000자당 20
ElevenLabs Eleven v3ElevenLabs표현력이 풍부한 텍스트 음성 변환(TTS) 등급입니다.
  • 속도: 0.7×–1.2×
1,000자당 20
ElevenLabs v3 DialogueElevenLabs대본에 기반한 다중 화자 대화.1,000자당 20
ElevenLabs Sound Effects v2ElevenLabs텍스트 설명을 바탕으로 생성된 음향 효과.초당 0.4
ElevenLabs Audio IsolationElevenLabs녹음된 파일에서 배경 잡음을 제거합니다.초당 0.34
ElevenLabs Speech-to-TextElevenLabs오디오 파일의 음성을 텍스트로 변환합니다.분당 6개
ElevenLabs DubbingElevenLabs동영상을 다른 언어로 더빙합니다.분당 180개, 올림 처리
HeyGen Video Translate — PrecisionHeyGen복제된 목소리와 재동기화된 입모양을 적용하여 동영상을 변환합니다.출력량: 초당 20개
HeyGen Video Translate — SpeedHeyGen빠른 동영상 번역 모드.출력 속도: 초당 10개
Sonilo v1.1Sonilo동작에 맞춰 적용되는 사운드 디자인 — 폴리(foley)나 영상과 동기화된 배경 음악, 또는 텍스트 설명에 기반한 폴리나 배경 음악 중 하나.
  • 모드: 동영상 → 음향 효과 · 동영상 → 음악 · 텍스트 → 소리 · 텍스트 → 음악
  • 섹션: 각 항목당 5초 이상, 연속적으로 배치, 200자 이하
  • 최소 청구 금액: 최소 15초
동영상 모드당 1.8/초 · 텍스트-사운드 변환 0.36/초 · 텍스트-음악 변환 0.5/초 (최소 15초 기준)

05 / 아바타 및 립싱크

아바타 및 립싱크 모델

단일 초상화나 이미 보유한 영상 자료를 바탕으로 얼굴이 말을 하게 만드는, 4개 업체의 4가지 엔진입니다.

립싱크 스튜디오 열기
모든 5 아바타 및 립싱크 엔진 및 각 사양과 가격 정보
모델용도사양크레딧
Kling Avatar — StandardKling AI초상화를 말하는 아바타로 변환합니다.
  • 품질: 720p
  • 최대 길이: 60초
초당 8개
Kling Avatar — ProKling AI1080p 화질의 말하는 아바타 등급과 스튜디오에서 제작된 가장 긴 영상 클립입니다.
  • 품질: 1080p
  • 최대 길이: 5분
초당 16개
HeyGen Avatar IVHeyGen사진을 말하는 아바타로 변환.
  • 품질: 720p / 1080p
  • 최대 길이: 60초
초당 20개
Omnihuman 1.5ByteDance초상화에서 대화형 동영상으로.
  • 품질: 720p / 1080p, 요금은 동일하게 청구됩니다.
  • 최대 길이: 60초
초당 27개
Volcengine Lip SyncVolcengine기존 동영상의 입모양을 새로운 오디오에 맞춰 재동기화합니다.
  • 입력: 원본 동영상
  • 최대 길이: 60초
초당 8개

06 / 3D

3D 모델

4개의 생성기와 2개의 메쉬 도구가 모두 fal을 통해 제공됩니다. 폴리카운트 수치는 스튜디오 슬라이더의 범위를 나타내며, 이는 양 끝점이 허용하는 범위보다 의도적으로 좁게 설정되어 있습니다.

3D 스튜디오 열기
모든 6 3d 엔진 및 각 사양과 가격 정보
모델용도사양크레딧
Meshy 6Meshy최고의 종합적인 메쉬 — 쿼드 토폴로지, PBR 머티리얼 및 포징.
  • 모드: 이미지 · 다중 뷰 · 텍스트
  • 폴리카운트: 10,000–300,000
  • 추가 정보: PBR · 쿼드 토폴로지 · A-포즈 / T-포즈
  • 이미지: 최대 4
생성당 240
Hunyuan 3.1 Pro다중 뷰 입력을 지원하는 최고 수준의 디테일을 가진 메쉬입니다.
  • 모드: 이미지 · 다중 뷰 · 텍스트
  • 폴리카운트: 40,000–1,500,000
  • 추가 정보: PBR
  • 이미지: 최대 4
생성당 80
Trellis 2단일 이미지 하나만으로도 빠르고 경제적으로 생성할 수 있습니다.
  • 모드: 이미지만
  • 폴리카운트: 10,000–300,000
  • 이미지: 1
생성당 60
Tripo 2.5Tripo3D3D 스튜디오에서 가장 빠르게 생성되는 메쉬입니다.
  • 모드: 이미지 · 다중 뷰 · 텍스트
  • 폴리카운트: 10,000–300,000
  • 추가 정보: PBR
  • 이미지: 최대 4
생성당 60
Retexture EngineMeshy이미 가지고 있는 메시를 프롬프트나 스타일 이미지를 바탕으로 재텍스처링합니다.
  • 입력: 기존 메쉬 + 1가지 스타일의 이미지
  • 추가 정보: PBR
실행당 60
RemeshMeshyRemesh는 인쇄나 다른 파이프라인을 위해 모델의 크기를 조정하고 다시 내보내는 기능을 의미합니다.
  • 입력: 기존 메쉬
  • 폴리카운트: 10,000–300,000
  • 지원 형식: GLB · FBX · OBJ · STL · USDZ
실행당 40

모델이 이 페이지에 등록되는 방식

모델은 실제로 실행할 수 있게 되면(API 접근 권한 부여, 어댑터 작성, 가격 설정 완료) 이곳에 표시됩니다. 접근 권한은 공급업체가 부여하는 것이지 당사가 약속할 수 있는 사항이 아니므로, 현재 생성할 수 없는 항목에 대해서는 이 페이지에서 출시일을 확인할 수 없습니다.

이 앱을 통해 사용자는 모든 작업을 한 곳에서 수행할 수 있습니다. 동일한 프롬프트 입력창, 동일한 참조 자료 업로드 기능, 동일한 라이브러리를 사용하며, 모든 모델이 동일한 크레딧 잔액을 공유하므로, 이미지에서 동영상으로, 다시 악보로 전환할 때 새로운 구독을 신청할 필요 없이 드롭다운 메뉴를 선택하기만 하면 됩니다.

동일한 모델을 제공하는 두 공급자가 있는 경우, 한 곳을 주 공급자로, 다른 한 곳을 대체 공급자로 운영하며, 표시되는 가격은 두 경우 모두 동일합니다.

위의 모든 모델은 하나의 잔액으로 생성됩니다.

공급업체별 구독이 필요 없고, 별도의 계정도 필요 없으며, 새로운 모델이 출시될 때마다 UI를 다시 익힐 필요도 없습니다.