무료, 가입 불필요, 워터마크 없음. 1시간 분량의 오디오는 약 2분 만에 변환됩니다.
지금 바로 사용할 파일이 없으신가요? 아래에 YouTube 링크를 붙여넣으세요 자막을 16개 언어로 번역할 수 있습니다 또는 링크를 붙여넣으세요.
다음을 붙여넣으세요 YouTube 링크 그러면 몇 초 안에 결과가 나옵니다. 또한 해당 비디오에 자막이 없더라도 저희는 자막을 생성합니다. 대부분의 도구는 여기서 포기하지만, 저희는 인터뷰, 강의, 팟캐스트, 음성 메모 등 최대 90분 길이의 파일을 처리하며, 계정 생성이나 워터마크 삽입 없이 사용할 수 있습니다.
일반적인 오디오 또는 비디오 형식을 지원합니다. 즉시 텍스트 변환이 시작됩니다. 계정 생성, 이메일 주소 입력, 일일 사용량 제한 없이 사용할 수 있습니다.
음성 인식 모델(Whisper)을 사용하여 GPU에서 텍스트를 변환하고, 언어를 자동으로 감지하며, 여러 목소리가 있는 경우 누가 말하는지 표시합니다. 일반적으로 실시간보다 훨씬 빠르게 처리됩니다.
일반 텍스트 형식(TXT)과 시간 코드가 포함된 자막 파일(SRT 및 VTT)을 얻으세요. 업로드한 파일은 자동으로 삭제됩니다.
이 페이지에서 보시는 것은 전체 버전의 도구이며, 체험판이 아닙니다. 이용권은 녹취 자체를 변경하거나 녹취록을 개선하지 않습니다. 대신 녹취록으로 무엇을 할 수 있는지에 대한 기능을 추가합니다 그 후.
이 도구는 체험판이 아닌 정식 버전입니다. 유료 구독과 동일한 모델 및 스크립트를 제공하며, 기능 제한은 없습니다.
결제는 저희 파트너사인 Polar에서 처리합니다. 결제 및 부가가치세 관리를 담당하며, 별도의 계정 생성 없이 현재 브라우저에 이용 정보가 저장됩니다.
YouTube, Reels, TikTok용 SRT/VTT 자막: 분당 요금 지불 없이 접근성을 높이고 더 많은 사람에게 다가가세요.
녹음된 인터뷰, 회의, 강의를 검색 가능한 텍스트로 변환하여 인용하고 빠르게 내용을 파악할 수 있으며, 화자별로 분리되어 누가 무슨 말을 했는지 확인할 수 있습니다.
각 에피소드에 대한 전체 스크립트를 제공하여 프로그램 정보 및 SEO(검색 엔진 최적화)에 활용할 수 있습니다. 에피소드의 모든 내용을 색인으로 만들어 검색 가능하게 합니다.
네, 그렇습니다. 계정 생성이나 워터마크 삽입이 필요 없고, 분당 요금이나 일일 사용량 제한도 없습니다. 또한 이 무료 도구는 평가판이 아니므로 유효 기간이 끝나지 않으며 다른 기능과 동일한 방식으로 작동합니다. 광고 수익으로 GPU를 계속 운영할 수 있습니다. 선택적으로 추가할 수 있는 기능은 다음과 같습니다 월 5유로 요금제 회의록, 실제 화자 이름, Word 파일 내보내기 및 더 높은 사용량 제한을 제공합니다. 이를 통해 스크립트 작업 시 더욱 편리하게 사용할 수 있습니다 스크립트를 활용하여 더 많은 작업을 수행할 수 있지만, 스크립트 품질이 향상되는 것은 아닙니다.
자체 서버에서 처리되며 완료되면 즉시 삭제됩니다. 결과는 45분 이내에 모두 지워집니다. 어떤 데이터도 저장하거나 공유하거나 학습 자료로 사용하지 않습니다. 자세한 내용은 다음을 참조하세요 개인 정보 보호 정책.
저희는 최고의 오픈 소스 음성 인식 모델 중 하나인 our speech model를 사용합니다. 명확한 발음으로 말하면 매우 정확하게 받아쓰기가 가능하지만, 강한 억양, 여러 사람의 목소리가 섞여 들리는 경우, 배경 소음 또는 품질이 낮은 녹음은 어떤 도구라도 처리하기 어렵습니다. 항상 최종 결과물을 빠르게 검토해 주세요.
네, 그렇습니다. 두 명 이상의 화자가 있는 경우 자동으로 스크립트를 분리하여 최대 8명의 화자에 대한 내용을 구분합니다. 별도의 설정을 할 필요가 없습니다. 이 기능 덕분에 인터뷰나 회의 녹음 파일을 읽기 쉬운 형태로 만들 수 있습니다. AI가 화자를 추정하므로, 여러 목소리가 섞여 들리거나 매우 유사한 목소리의 경우 빠르게 확인해 주세요.
네, 파일을 업로드하기 전에 "편집된 버전 또는 자막이 있는 버전도 함께 만들기"를 선택하면 모든 욕설이 삭제되거나 음소거되거나 잘린 두 번째 파일이 생성됩니다 또한 원하시면 "음", 그리고 긴 침묵 구간도 제거할 수 있습니다. 먼저 전체 목록과 시간 코드를 확인하고 원하는 단어는 남겨둘 수 있습니다. 자세한 내용은 다음을 참조하세요 욕설 삭제 기능 및 불필요한 단어 제거 기능.
약 100개 언어를 자동으로 감지하거나 직접 선택할 수 있습니다. 오디오 및 비디오: MP3, WAV, M4A, FLAC, OGG, MP4, MOV, MKV, WEBM 등, 최대 1.5GB, 90분까지 지원합니다.
네, 동영상을 직접 업로드하고 SRT 또는 VTT 파일을 다운로드하세요. SRT 파일을 동영상 옆에 두거나 YouTube에 자막으로 업로드할 수 있습니다.
네, Instagram, TikTok, WhatsApp 및 대부분의 TV는 별도의 자막 파일을 지원하지 않으므로, 파일을 업로드하기 전에 "편집된 버전 또는 자막이 있는 버전도 함께 만들기"를 선택하고 세 가지 스타일(일반, 박스형, 크게) 중 하나를 선택한 다음 텍스트가 동영상에 포함된 MP4 파일을 다운로드하세요별도의 편집 프로그램 설치 없이 워터마크 없이 원본 파일은 그대로 유지됩니다. 전체 사용 방법: 모든 동영상에 자막을 추가하는 방법.
이것은 저희의 다른 도구입니다: StemGrab 보컬, 드럼, 베이스 및 악기 음원을 분리해 주며, 역시 무료입니다.
한 사람이 영어로 말하는 깨끗한 녹음에서는 모델이 대략 100단어 중 98단어를 정확하게 인식합니다. 깨끗한 음성에서 1.94%의 단어 오류를 측정했습니다. 가장 큰 영향을 미치는 세 가지 요소가 있습니다. 첫째, 두 사람이 동시에 말하는 교차 대화는 모델이 하나를 선택해야 하므로 문제가 됩니다. 둘째, 마이크와의 거리입니다. 회의 테이블 반대편에 있는 휴대폰은 음성보다 주변 소리를 더 많이 녹음합니다. 셋째, 특이한 어휘입니다. 이름, 브랜드, 전문 용어 및 약어는 문맥을 통해 추측되므로 이전에 본 적 없는 성은 그럴듯하게 들리는 단어로 출력됩니다. 강한 억양은 대부분의 사람들이 예상하는 것보다 더 잘 처리되고, 배경 음악은 더 나쁘게 처리됩니다.
음성 인식에는 GPU 시간이 필요하며, 대부분의 무료 음성 인식 서비스는 클라우드 서비스를 통해 1분당 오디오를 기준으로 시간을 임대합니다. 이는 하루에 세 개의 파일과 20분의 사용 시간 제한을 두는 이유입니다. 저희는 하드웨어를 직접 소유하고 있습니다. 동일한 그래픽 카드가 네덜란드에서 다른 도구를 실행하는 데 사용되므로 추가 녹음에는 요금이 부과되는 대신 전기 요금만 발생하며, 페이지에 게재된 광고로 이를 충당합니다. 따라서 파일 크기는 최대 90분, 용량은 최대 2기가바이트까지 가능하며, 계정이나 이메일 주소 없이 원하는 만큼 사용할 수 있습니다.