CapCut·Vrew 영상 자막 자동 생성 방법과 프로그램 선택 기준
화면 연출과 영상 편집이 중심이면 CapCut, 문서 편집 방식의 대본 수정과 SRT 내보내기가 목표면 Vrew가 맞습니다. 자동 캡션 메뉴를 실행하면 몇 분 안에 자막이 생성됩니다.
- 분야
- 만들기
- 공식 자료
- 3개
- 읽는 시간
- 5분
- 최종 확인
- 2026.09.24
프로그램 선택 요약과 준비 조건
자동 자막 기능을 실행하려면 음성이 선명하게 녹음된 MP4·MOV 영상 파일 또는 MP3·WAV 오디오 파일이 필요합니다. 배경음악이나 잡음이 크게 섞인 음성은 인식 정확도가 떨어지므로, 배경음 제거 기능을 먼저 적용하거나 잡음이 적은 원본을 준비해야 합니다.
CapCut과 Vrew는 모두 AI 음성 인식을 서버 통신으로 처리합니다. 따라서 오프라인 상태에서는 자막 자동 생성 메뉴를 사용할 수 없으며, 작업 전에 컴퓨터와 모바일 장치의 인터넷 연결을 확인해야 합니다.
CapCut과 Vrew의 편집 방식과 주요 기능을 비교한 표입니다.
| 비교 항목 | CapCut (캡컷) | Vrew (브루) |
|---|---|---|
| 주요 편집 방식 | 타임라인 기반 영상 편집 | 워드 프로세서 스타일 대본 편집 |
| 자막 파일 내보내기 (SRT) | 공식 페이지에 내보내기 형식 미표기(실제 화면에서 확인) | 공식 페이지에 내보내기 형식 미표기(실제 화면에서 확인) |
| AI 음성 합성 (TTS) | 원클릭 적용, 여러 캐릭터 음성 제공 | 여러 성우 음성과 대본 연동 |
| 추천 작업 유형 | 숏폼(Reels/TikTok)과 비주얼 효과 | 튜토리얼, 강의, 자막 중심 긴 영상 |
음성 파일이 지나치게 길거나 용량이 과도하게 크면 업로드 타임아웃 오류가 발생할 수 있습니다. 단일 파일 기준 1시간을 초과하는 영상은 구간을 나누어 작업해야 합니다.
기업 내부 기밀이나 미공개 제품 정보가 포함된 영상은 처리 전에 각 서비스의 데이터 수집 정책을 검토해야 합니다. 클라우드 처리 과정에서 보안 문제가 생길 수 있으므로, 사내 보안 정책에 부합하는지 사전에 검증합니다.
내보내기 전 자막 검수 항목

자동 생성된 자막은 발음이나 전문 용어에 따라 오탈자가 생길 수 있습니다. 최종 내보내기 전에 다음 항목을 대조해 오류를 교정합니다.
- 고유명사와 전문 용어의 오인식 교정 여부
- 문장 단위 띄어쓰기와 맞춤법
- 화면 하단 타임라인과 음성 싱크 일치 여부
- 자막 폰트 크기와 화면 가장자리 가림 여부
위 항목을 순서대로 대조하면 영상의 가독성이 높아집니다. 검수 과정에서 발견한 오탈자를 일괄 수정하면 작업 시간을 줄일 수 있습니다.
자막 줄바꿈은 1줄당 15자 내외로 유지하는 것이 시청자의 눈 피로를 줄이는 데 적합합니다. 2줄을 초과하는 자막은 화면에서 읽기 어려우므로 분할 편집합니다.
텍스트 스타일은 배경 색상과 대비되는 폰트 색상으로 설정합니다. 검은색 테두리나 그림자 효과를 추가하면 배경 영상이 밝아져도 자막이 선명하게 보입니다.
새 프로젝트부터 자막 영상 내보내기까지의 절차
영상 파일 준비부터 자막 영상 내보내기까지의 절차는 다음과 같습니다.
- 사용할 프로그램(CapCut 또는 Vrew)을 실행하고 메인 화면에서 '새 프로젝트' 버튼을 클릭합니다.
- 편집할 MP4 영상 파일을 작업 영역 타임라인 또는 미디어 창으로 드래그해 업로드합니다.
- 상단 툴바 메뉴에서 자막 관련 탭을 선택합니다. CapCut은 '텍스트(Text)' 메뉴에서 '자동 캡션(Auto Captions)'을 클릭하고, Vrew는 'AI 자막 생성' 또는 '음성 분석'을 선택합니다.
- 원본 영상의 언어를 '한국어'로 지정한 뒤 '생성(Create)' 버튼을 눌러 음성 인식을 시작합니다.
- 생성된 자막 텍스트를 타임라인에서 클릭해 오탈자를 수정하고, 우측 속성 창에서 폰트 스타일, 크기, 테두리 효과를 일괄 적용합니다.
- 자막과 음성 구간의 시작·끝 지점을 타임라인 바로 조절해 정밀하게 맞춥니다.
- 검수가 끝나면 오른쪽 상단의 '내보내기(Export)' 메뉴에서 해상도(1080p 이상)와 프레임 레이트를 설정한 뒤 최종 MP4 파일로 저장합니다.
위 절차는 추가 장비 없이 진행할 수 있습니다. 다만 실행 도중 인터넷 연결이 끊기면 자막 생성이 중단되므로 연결 상태를 유지해야 합니다.
CapCut에서 자막 스타일을 바꿀 때는 '모든 캡션에 적용' 옵션을 체크해야 전체 자막의 서식이 통일됩니다. Vrew는 전체 선택 기능으로 서식을 한꺼번에 변경합니다.
내보낸 파일의 결과 검증
내보낸 파일은 전용 미디어 플레이어로 처음부터 끝까지 재생해 최종 상태를 판정합니다. 음성과 자막 텍스트가 0.5초 이상 어긋나지 않으면 정상으로 판단합니다.
모바일 화면과 PC 모니터처럼 서로 다른 디스플레이에서 재생해 자막이 비디오 프레임 밖으로 벗어나지 않는지 확인합니다. 자막이 잘리면 폰트 크기를 줄이거나 줄바꿈을 다시 설정해야 합니다.
자막에 사용한 폰트의 상업적 이용 권리도 확인해야 합니다. 프로그램이 제공하는 기본 폰트라도 플랫폼과 이용 목적에 따라 허용 범위가 다를 수 있으므로, 공식 라이선스 약관을 검토합니다.
인식 오류 원인과 조치
인식 실패나 텍스트 누락의 가장 큰 원인은 원본 오디오의 음량이 너무 작거나 잡음 비율이 높은 것입니다. 음성이 포화되거나 뭉개진 경우에는 프로그램의 오디오 편집 메뉴에서 '노이즈 감소' 기능을 적용한 뒤 자막 생성을 재시도합니다.
자막 생성 버튼이 활성화되지 않으면 프로그램을 최신 버전으로 업데이트하고 클라우드 서버 점검 여부를 확인해야 합니다. 사내망처럼 네트워크 제약이 있는 환경이라면 방화벽 정책이 서버 통신을 차단하는지도 확인합니다.
자동 생성으로 해결되지 않는 복잡한 음성이나 다국어 번역 자막이 필요한 경우에는 자막 파일(SRT)을 수동으로 작성해 '자막 불러오기' 메뉴로 가져오는 것이 대안입니다.
기술 오류가 계속되어 고객지원이 필요하다면 사용 중인 OS 버전, 오류 문구 캡처, 대상 영상 파일의 포맷 정보를 준비해 각 서비스의 공식 지원 센터나 문의 메일로 전달합니다.
녹음 환경별 준비물
음성 인식 자막의 정확도는 녹음 단계의 오디오 품질에 크게 좌우됩니다. USB 콘덴서 마이크를 사용하면 수음 범위와 노이즈 억제 능력이 향상되어 AI의 자막 인식 오류를 줄일 수 있습니다.
조용한 실내에서 혼자 진행하는 튜토리얼이나 강의 녹음에는 단일지향성 USB 콘덴서 마이크가 적합합니다. 외부 소음이 계속되는 환경이라면 핀 마이크나 지향성 샷건 마이크로 목소리를 집중적으로 수음해야 합니다.
스마트폰이나 노트북의 내장 마이크만 사용할 수 있는 경우에는 장비를 새로 구입하지 않고 소음이 차단된 공간에서 녹음하거나, 녹음 후 편집 프로그램의 노이즈 억제 필터를 적용하는 방식으로 대체합니다.
이 글의 수정 내역 · 2026-09-24
2026-09-24 정정: 근거 없는 SRT 내보내기 비교('CapCut 제한적·플러그인', 'Vrew 기본 지원')를 '공식 페이지 미표기'로 바꾸고 오타 정정, 앱스토어 출처를 제거하고 Vrew 공식 페이지를 출처에 추가. 메뉴명은 실측 전까지 확인 필요.
참고한 출처
capcut.com — CapCut 온라인 동영상 편집기 (2026-09-24)
capcut.com — CapCut Terms of Service (2026-09-24)
vrew.ai — Vrew (2026-09-24)
공식 문서 확인