1차 추출
음성 구간을 분석해 초벌 자막과 기본 타임스탬프를 생성합니다.
Trans-ACT의 중심은 플레이어·변환·스트리밍입니다. AI는 그 위에 자막 추출, 번역, TTS·Voice Cloning 같은 반복 작업을 자동화하는 확장 기능으로 배치합니다.
영상·음성을 분석해 타임스탬프 자막을 생성하고 품질 필터를 거친 뒤 번역·TTS·음성 복제로 확장합니다.
기존 동영상 콘텐츠 또는 음성 파일 입력
화자 음성을 텍스트와 타임스탬프로 추출
품질 필터와 후처리로 자막 정확도 보강
언어별 자막 생성과 자막 규격 변환
필요 시 새 언어 음성 콘텐츠로 확장
소개자료의 3단계 자막 프로세스를 바탕으로 1차 추출, 품질 필터, 정합성 필터를 거쳐 실제 서비스에 사용할 수 있는 자막을 생성합니다.
음성 구간을 분석해 초벌 자막과 기본 타임스탬프를 생성합니다.
낮은 신뢰 구간, 무음·노이즈 구간과 문장 단위를 보정해 읽기 좋은 형태로 정리합니다.
중복 문장 제거, 타임 구간 보정, A/V 싱크를 보강해 최종 자막을 생성합니다.
VTT, SRT 등 다양한 자막 규격을 대상으로 다국어 번역과 편집 기능을 제공합니다. 소개자료에서는 약 100개국 언어 지원을 확장 목표로 제시하고 있습니다.
번역된 텍스트를 TTS 음성으로 생성하거나, 프로젝트 요구에 따라 원 화자의 특성을 활용한 Voice Cloning 기능을 옵션으로 적용합니다.
모든 영상을 AI로 다시 설계할 필요가 없습니다. 현재 CMS·LMS와 미디어 서버 구조를 유지하면서 필요한 기능만 API 또는 모듈로 연결합니다.
플레이어 교체부터 변환·스트리밍 통합, AI 기능 추가까지 단계적으로 적용할 수 있습니다.