AI Engineering Tools

AI 미디어

AI 더빙·번역·립싱크 용어

AI 더빙과 현지화에 사용하는 트랜스크립트, 화자 분리, 타임코드, 번역 각색, 발음 용어집, 음성 매칭, 음소, 비짐, 립싱크, 배경음 보존, 자막과 캡션을 설명합니다.

12 개 용어

원본 분석

트랜스크립트

Transcript

원본 오디오나 영상의 발화 내용을 시간 흐름과 함께 기록한 텍스트입니다.

언제 쓰나

번역, 화자 배정, 자막 생성, 품질 검수의 기준 원문으로 사용합니다.

프롬프트 조각

모든 발화된 줄을 구두점과 함께 기록하고 원래 타임코드를 유지합니다.

원본 분석

화자 분리

Speaker diarization

서로 다른 사람이 말하는 구간을 구분하고 각 발화를 화자에게 배정합니다.

언제 쓰나

여러 화자가 대화하는 콘텐츠를 번역하거나 더빙하기 전에 사용합니다.

프롬프트 조각

대화를 화자 A와 화자 B로 분리하고, 중단과 겹침은 유지합니다.

원본 분석

타임코드

Timecode

대사나 사건의 시작과 종료 위치를 나타내는 시간 정보입니다.

언제 쓰나

번역 대사, 자막, 편집, 검수 의견의 위치를 맞출 때 사용합니다.

프롬프트 조각

각 번역된 줄을 원래의 시작 및 종료 타임코드 내에 유지합니다.

번역과 현지화

번역 각색

Translation adaptation

직역의 의미를 유지하면서 대상 문화, 말투, 발화 시간에 맞게 자연스럽게 다듬습니다.

언제 쓰나

직역이 부자연스럽거나 장면의 발화 시간보다 길 때 사용합니다.

프롬프트 조각

자연스러운 한국어 대화로 변환하고, 농담과 의도를 보존하며, 원래 줄의 지속 시간을 맞춥니다.

번역과 현지화

발음 용어집

Pronunciation glossary

이름, 브랜드, 장소, 전문 용어의 승인된 번역과 발음을 정리한 목록입니다.

언제 쓰나

여러 화자, 에피소드, 언어에서 용어와 발음을 일관되게 유지할 때 사용합니다.

프롬프트 조각

승인된 용어집을 적용합니다. Acme은 번역하지 않고 'ACK-mee'로 발음합니다.

음성

음성 매칭

Voice match

원본 화자와 어울리는 특성을 가진 대상 음성을 선택하거나 설계합니다.

언제 쓰나

불필요한 신원 복제 없이 캐릭터의 연령, 에너지, 음성 무게감, 역할을 유지할 때 사용합니다.

프롬프트 조각

원본 화자의 차분한 에너지와 음색을 따르고, 승인된 대상 목소리를 사용합니다.

음성

음성 연속성

Voice continuity

더빙 화자의 정체성, 연기 강도, 억양, 녹음 특성을 장면 전체에서 안정적으로 유지합니다.

언제 쓰나

시리즈, 추가 녹음, 분할 작업, 재생성된 대사에서 일관성을 유지할 때 사용합니다.

프롬프트 조각

스피커 A의 모든 줄에 대해 동일한 승인된 음성 프로필과 방 음향을 사용합니다.

발화와 립싱크

음소

Phoneme

발음과 타이밍을 분석할 때 사용하는 구별 가능한 최소 말소리 단위입니다.

언제 쓰나

발음 오류를 확인하고 생성 음성을 더 정밀하게 맞출 때 사용합니다.

프롬프트 조각

최종 자음 음소를 원본 단어의 끝과 일치시키고, 자연스러운 연음법을 유지합니다.

발화와 립싱크

비짐

Viseme

하나 이상의 말소리와 연결되는 눈에 보이는 입 모양입니다.

언제 쓰나

얼굴 애니메이션을 조정하거나 입 모양이 더빙 음성과 맞는지 확인할 때 사용합니다.

프롬프트 조각

더빙된 구절에 맞춰 입술 모양을 조정하고, 자연스러운 턱과 입술 움직임을 보존합니다.

발화와 립싱크

립싱크

Lip sync

화면의 입 움직임을 교체된 음성의 타이밍과 소리 패턴에 맞춥니다.

언제 쓰나

번역과 음성 생성 후, 특히 얼굴이 크게 보이는 대화 장면에 사용합니다.

주의

과도하게 보정하면 치아, 입술, 얼굴 정체성이 왜곡될 수 있으므로 근접 프레임을 검수하세요.

프롬프트 조각

한국 더빙에 맞춰 입 모양을 맞추고, 얼굴 특징과 자연스러운 표정을 유지합니다.

오디오 믹스

배경음 보존

Background preservation

대사를 교체하거나 번역하면서 음악, 환경음, 효과음을 유지합니다.

언제 쓰나

대사가 분리된 제작용 스템으로 제공되지 않을 때 사용합니다.

프롬프트 조각

대화만 교체하고, 원래 음악, 배경 소리, 그리고 음향 효과는 유지합니다.

텍스트 출력

자막과 캡션

Subtitle and caption

번역된 대사를 표시하거나 대사와 중요한 비언어 소리를 함께 전달하는 시간 기반 텍스트입니다.

언제 쓰나

언어 번역에는 자막을, 효과음과 화자 정보까지 필요할 때는 캡션을 사용합니다.

프롬프트 조각

화자 라벨, 음향 효과, 읽기 쉬운 줄 바꿈, 그리고 보존된 타임코드를 포함하는 한국어 자막을 생성합니다.