예. APIXO는 이 경로를 Kling 3.0 Standard로 표기하고 가격을 책정합니다. 이는 Kling 3.0 Turbo 및 Video 3.0 Omni와는 별개이므로, 해당 버전들의 속도, 레퍼런스 기능, 편집 제어, 가격 정책이 여기에 적용되지 않습니다.
Kuaishou의 Kling Video 3.0 Standard는 APIXO에서 텍스트 투 비디오, 이미지 애니메이션, 캐릭터 모션 전송 기능을 결합합니다. 생성된 클립을 15초로 확장하고, 선택적인 네이티브 오디오를 지원하며, 더 강력한 내러티브 제어를 위해 샷 레벨 프롬프팅을 추가했습니다. 모션 컨트롤은 하나의 캐릭터 이미지와 하나의 참조 연기 비디오를 페어링합니다.
APIXO 모드
생성 / 애니메이션 / 변환
무음 가격
$0.084/초오디오가 생성되지 않는 텍스트 및 이미지 모드
사운드 생성 가격
$0.13/초오디오가 생성되는 텍스트 및 이미지 모드
생성 길이
3–15초
출시일
2026년 2월 5일
Kling 3.0 Std(으)로 만들기
작업 공간 로딩 중...
내러티브와 연속성에 대한 더 높은 제어력
확장된 장면 길이
Kling Video 3.0은 기본 생성 길이를 15초로 확장하여, Kling Video 2.6의 최대 10초보다 액션, 대화, 카메라 전환 및 장면 전개를 위한 더 많은 여유를 제공합니다.
다중 샷 스토리텔링
Kuaishou는 카메라 앵글 변경, 샷-리버스-샷 대화, 교차 편집, 보이스오버를 포함한 멀티씬 및 멀티샷 지시를 해석하도록 Video 3.0을 설계했습니다. APIXO는 텍스트 및 이미지 기반 생성을 위해 선택적인 시간 지정 프롬프트 세그먼트를 제공합니다.
향상된 요소 일관성
개선된 일관성은 캐릭터, 사물, 환경 및 브랜드 요소가 프레임 전반에 걸쳐 더 일관성 있게 유지되도록 돕습니다. 복잡한 움직임이나 긴 시퀀스에서는 여전히 시각적 오류가 발생할 수 있어 검토가 필요합니다.
다국어 네이티브 오디오
Upstream Video 3.0은 영어, 중국어, 일본어, 한국어, 스페인어로 음성 생성을 지원하며, 영어 억양과 중국어 방언도 지원합니다. APIXO는 텍스트 및 이미지 기반 모드에서 사운드 제어 기능을 통해 생성된 오디오를 제공합니다.
향상된 텍스트 보존
Kuaishou는 간판, 캡션, 로고, 브랜드 의류와 같은 가시적인 텍스트의 유지 및 생성 능력이 향상되었다고 보고했습니다. 상업적 사용 전에는 정확한 철자와 배치를 확인해야 합니다.
사실적인 연기
Video 3.0은 표현력이 풍부한 캐릭터와 역동적인 연기를 위한 사실적인 결과물을 개선합니다. 상세한 프롬프트를 통해 하나의 생성된 시퀀스 내에서 피사체의 행동, 카메라 방향, 장면 진행, 사운드를 조율할 수 있습니다.
새로운 장면 생성 또는 기존 모션 변환
텍스트 및 이미지 생성
프롬프트로 생성하거나 1~2개의 이미지를 애니메이션하여 3~15초 분량의 영상을 만듭니다. 사운드 생성 또는 무음 출력을 선택하고, 선택적으로 클립을 시간별 프롬프트 세그먼트로 나누어 샷 단위로 디렉팅할 수 있습니다.
캐릭터 모션 제어
캐릭터 이미지 1개와 레퍼런스 모션 비디오 1개를 결합하세요. 방향이 이미지를 따를지 비디오를 따를지 선택하고, 길이는 레퍼런스 클립에서 가져오며, 사운드 설정에 따라 원본 오디오 보존 여부가 결정됩니다.
APIXO의 Kling 3.0 Standard
생성 및 모션 전송을 위한 워크플로우별 제어 기능
1:1 / 9:16 / 16:9
텍스트 투 비디오 화면 비율
이미지 1–2개
이미지 투 비디오
이미지 1개 + 비디오 1개
모션 제어
최대 30초
모션 참조
JPG / JPEG / PNG
이미지 형식
MP4 URL 1개
APIXO 결과물
스토리, 퍼포먼스, 브랜드 모션 개발
멀티샷 장면 프로토타입
타임라인 기반 프롬프트 세그먼트를 사용하여 설정 샷, 클로즈업, 리액션, 장면 전환 등으로 더 긴 클립을 구성하세요. 생성된 결과물로 제작 전 내러티브 리듬, 카메라 전환, 대화 흐름, 장면의 논리성을 테스트할 수 있습니다.
참조 연기 전송
짧은 레퍼런스 비디오의 움직임을 캐릭터 이미지에 적용하여 퍼포먼스 연구, 안무 테스트 또는 스타일화된 애니메이션을 제작할 수 있습니다. 신체 방향이 소스 이미지를 따라야 할지, 모션 영상을 따라야 할지에 따라 방향을 선택하세요.
브랜드 오디오-비주얼 캠페인
제품 쇼케이스, 내레이션 광고, 짧은 소셜 캠페인을 기본 음성, 음악, 배경음, 효과와 함께 제작하세요. 게시하기 전에 제품의 형태, 보이는 텍스트, 로고, 음성 내용 및 동기화를 검토하세요.
다국어 대화 콘셉트
Kling Video 3.0의 네이티브 음성 기능을 사용하여 대화, 인터뷰, 여러 언어가 사용되는 장면의 프로토타입을 만들어보세요. 각 화자, 언어, 순서, 톤, 액션을 명확히 지정한 후, 화자 지정, 발음, 입 모양, 연속성을 확인하세요.
올바른 사운드 및 길이 규칙 적용
APIXO 제약 사항
텍스트 투 비디오 및 이미지 투 비디오는 3~15초 길이를 지원하며, 모션 컨트롤은 해당 필드를 무시합니다.
이미지 투 비디오는 시작 이미지 1개와 선택적으로 마지막 프레임을 가이드할 두 번째 이미지를 허용합니다.
모션 컨트롤에는 정확히 하나의 캐릭터 이미지와 30초 이하의 공개 참조 비디오가 필요합니다.
화면 비율 선택은 APIXO를 통한 텍스트 투 비디오에만 적용됩니다.
APIXO는 별도의 업로드된 오디오, 비디오 확장, 비디오 편집 또는 임의의 다중 레퍼런스 모드를 제공하지 않습니다.
프로덕션 통합은 폴링 또는 공개 HTTPS 콜백을 통해 비동기 결과를 검색할 수 있습니다.
Kling 3.0 Standard 관련 질문
텍스트 투 비디오 및 이미지 투 비디오는 사운드 비활성화 시 생성된 동영상 1초당 $0.084, 사운드 활성화 시 1초당 $0.13의 비용이 발생합니다. 청구 가능 시간은 3초에서 15초 사이에서 선택한 값입니다.
APIXO는 모션 컨트롤에 대해 감지된 참조 동영상 1초당 $0.13을(를) 청구하며, 최소 3초부터 요금이 부과됩니다. 제출된 시간 필드는 무시되며, 30초를 초과하는 참조 동영상은 거부됩니다.
텍스트 투 비디오 및 이미지 투 비디오의 경우, sound: true는 모델이 생성한 오디오를 요청하고 false는 사운드 없는 결과물을 생성합니다. 모션 제어에서는 동일한 필드가 새로 생성된 오디오를 요청하는 대신 레퍼런스 비디오의 원본 오디오 보존 여부를 결정합니다.
정체성, 해부학적 구조, 손, 객체 접촉, 삽입된 텍스트, 전환 논리, 빠른 움직임, 화자 인식, 대화 정확성, 발음 및 립싱크를 확인하세요. 장면이 길어지거나 샷이 많아질수록 시간적 흐름과 캐릭터의 일관성이 어긋날 가능성이 커집니다.
다른 모델 살펴보기
다음 크리에이티브 워크플로우에 필요한 더 많은 AI 모델을 만나보세요