YouArt

AI 말하는 사진

AI 말하는 사진: 사진을 오디오에 맞춰 립싱크

사진과 말하게 할 오디오를 올리세요. 얼굴이 살아 움직이며 오디오 길이만큼 내 말을 전합니다. 기본 모델은 사람, 반려동물, 만화 캐릭터를 모두 지원합니다.

사진

JPEG, PNG 또는 WebP. 선명한 얼굴이 하나 있어야 합니다

오디오

MP3, WAV 또는 M4A, 1~60초, 최대 30 MB

사진을 오디오에 맞춰 말하는 동영상으로 바꿉니다. 사람, 동물, 만화, 스타일화된 캐릭터를 지원하며 클립 길이는 오디오 트랙과 같습니다.

완성된 동영상 길이에 따라 초 단위로 요금이 책정되며, 1초 미만은 올림하여 계산합니다. 동영상은 오디오와 같은 길이로 만들어지므로 오디오를 첨부하면 아래에 정확한 총액이 표시됩니다.

12 크레딧/초

말하는 동영상은 나중에 다시 열 수 있는 세션에서 표시됩니다. 바로 다운로드하거나 다른 도구에서 사용할 수 있습니다.

사용 방법

세 단계로 말하는 사진 만들기

  1. 1단계

    사진 업로드

    선명한 얼굴이 하나 있는 사진을 추가하세요. 인물 사진, 반려동물, 일러스트 캐릭터 모두 가능합니다. 얼굴이 밝게 나오고 가려지지 않아야 합니다.

  2. 2단계

    오디오 추가

    사진이 말할 오디오를 1~60초 길이로 추가하세요. 내 목소리, 녹음한 메시지, AI로 생성한 음성 모두 가능합니다. 그런 다음 모델을 선택하세요.

  3. 3단계

    생성 및 다운로드

    말하는 동영상은 오디오와 같은 길이로 만들어지며 내 세션에서 열립니다. 바로 다운로드하거나 다른 편집 작업으로 이어갈 수 있습니다.

활용 방법

AI 말하는 사진으로 만들 수 있는 영상

사진 한 장으로 만드는 진행자

내 얼굴이 나온 프로필 사진 한 장으로 카메라를 설치하지 않고도 짧은 설명 영상, 공지, 환영 메시지를 만드세요.

일러스트 캐릭터와 AI 캐릭터

마스코트, 일러스트 캐릭터, AI로 생성한 인물 이미지에 목소리를 입혀 이야기, 강의, 소셜 미디어 게시물에 활용하세요.

반려동물과 동물

강아지나 고양이 사진이 메시지를 전하게 해 보세요. 동물 사진은 기본 모델을 포함한 두 Kling 모델에서 사용할 수 있습니다.

사진 한 장, 여러 버전

같은 메시지를 여러 언어로 또는 여러 대상에 맞게 녹음하고, 모든 버전에 사진 한 장을 다시 사용하세요.

시작하기 전에

말하는 사진을 자연스럽게 만드는 요령

오디오 길이만큼

사진에는 자체 길이가 없으므로 동영상은 오디오 길이를 따릅니다. 1초부터 60초까지 초 단위로 정확히 맞춰집니다. 요금도 이 길이를 기준으로 부과되므로 먼저 오디오 앞뒤의 무음 구간을 잘라내세요.

알맞은 사진 고르기

카메라를 향하고 조명이 밝으며 손, 머리카락, 선글라스에 가려지지 않은 얼굴 하나가 가장 좋습니다. 한 사진에 얼굴이 여러 개 있으면 결과를 예측하기 어려우므로 말하게 할 인물이나 캐릭터만 남도록 잘라내세요.

세 가지 모델 중 선택

Kling Avatar v2 Standard가 기본 모델로, 사람, 반려동물, 만화, 개성 있는 화풍의 캐릭터를 가장 낮은 가격에 처리합니다. Kling Avatar v2 Pro는 초당 가격이 더 높은 대신 디테일이 더 선명하고 입 모양이 더 또렷합니다. Sync 3 Talking Photo는 선명한 정면 얼굴이 하나 있는 사진이나 일러스트에서 작동합니다.

월 단위가 아닌 초 단위로 결제

말하는 사진은 완성된 동영상 길이에 따라 초 단위로 요금이 책정되므로 짧은 메시지는 그만큼 비용도 적게 듭니다. 모든 요금제에 크레딧이 포함되며 YouArt의 다른 모든 도구에서도 사용할 수 있습니다.

Basic

취미로 창작하거나 다양하게 시도하는 분께

$9.99/월
요금제 선택
  • 1000 크레딧
  • 월 최대 약 200장의 이미지
  • 월 최대 약 332초 분량의 동영상
  • 지능형 크리에이티브 에이전트
  • 동영상 편집기
  • GPT Image 2.5, GPT Image 2, Nano Banana Pro 등 최신 이미지 모델
  • Seedance 2 등 최신 동영상 모델
  • 실사 얼굴 이미지 업로드
  • ElevenLabs로 음성 생성
  • 워터마크 없음
  • 템플릿 무제한 이용

Pro

인기

크리에이터와 전문가에게

$29.99/월
요금제 선택
  • 3300 크레딧
  • 월 최대 약 1000장의 이미지
  • 월 최대 약 1100초 분량의 동영상
  • 지능형 크리에이티브 에이전트
  • 동영상 편집기
  • GPT Image 2.5, GPT Image 2, Nano Banana Pro 등 최신 이미지 모델
  • Seedance 2 등 최신 동영상 모델
  • 실사 얼굴 이미지 업로드
  • ElevenLabs로 음성 생성
  • 워터마크 없음
  • 템플릿 무제한 이용

Max

최고의 가성비

사용량이 많은 사용자와 팀에게

$149.99/월
요금제 선택
  • 18000 크레딧
  • 월 최대 약 6000장의 이미지
  • 월 최대 약 6000초 분량의 동영상
  • 지능형 크리에이티브 에이전트
  • 동영상 편집기
  • GPT Image 2.5, GPT Image 2, Nano Banana Pro 등 최신 이미지 모델
  • Seedance 2 등 최신 동영상 모델
  • 실사 얼굴 이미지 업로드
  • ElevenLabs로 음성 생성
  • 워터마크 없음
  • 템플릿 무제한 이용

Team

팀과 스튜디오에

$329.99/월
요금제 선택
  • 36300 크레딧
  • 월 최대 약 12000장의 이미지
  • 월 최대 약 12100초 분량의 동영상
  • 실사 얼굴 이미지 업로드
  • 팀과 캔버스, 워크플로, 에셋 공유
  • 팀당 최대 10명
  • 최대 5개 팀
  • 역할별 관리
  • 팀 크레딧 관리 및 사용 한도 설정
  • 팀원별 사용량 확인

궁금한 점

AI 말하는 사진 자주 묻는 질문

정지 사진 한 장으로 만드는 동영상입니다. 사진과 오디오 트랙을 넣으면 AI가 얼굴에 움직임을 더해 오디오 속 말을 하게 하며, 입의 움직임이 소리를 따라갑니다. 결과물은 오디오와 같은 길이의 짧은 말하는 동영상입니다.

사진 한 장을 넘어

말하는 사진을 여러 개 만들어야 하나요?

이 페이지는 한 번에 한 단계씩 실행합니다. 워크플로 편집기를 열면 대본 작성부터 음성 생성까지 같은 워크플로에서 진행하거나, 직접 생성한 인물 이미지로 시작하거나, 여러 장의 사진을 한꺼번에 말하는 동영상으로 바꿀 수 있습니다.