VoxScriber
100% 무료 · 회원가입 불필요 · 99개 언어

브라우저에서 한국어 음성 무료 변환

VoxScriber Nano는 한국어(한국어)를 이해하며 기기에서 로컬로 처리됩니다. 무료 모드에서는 10분 제한이 있습니다.

브라우저에서 VoxScriber Nano(오픈소스)를 실행 — 로컬 AI, 파일당 최대 10분, 기본 정확도(~85%). 전문적인 사용에는 Premium을 이용하세요.

🔒 로컬 AI💰 100% 무료📝 파일당 10분

변환이 브라우저에서 로컬로 실행됩니다. 서비스 개선을 위해 결과를 선택적으로 공유할 수 있습니다(동의 필요). 제한: 파일당 10분, 정확도 ~85%.

Premium 보기 →

무료 vs Premium — 차이점 확인

무료(브라우저) Premium(클라우드)
파일 제한 10 min 10 horas
정확도 ~85% >95%
화자 분리
단어별 타임스탬프
비디오 지원(MP4/MOV)
내보내기 형식 TXT, SRT, VTT DOCX, PDF, JSON…
속도(1시간 오디오) ~2 min / 1h ~2 min / 1h
개인정보 보호 100% local ☁️ + 🔒
🔒

로컬 AI

변환이 브라우저에서 실행됩니다. 서버 공유는 선택 사항입니다(동의 필요).

빠르고 로컬 처리

브라우저에서 직접 AI 처리 — 대기 시간 없음.

🌍

99개 언어

음성 언어를 자동으로 감지합니다.

💻

회원가입 불필요

계정 생성 없이 즉시 시작하세요.

How it works

1

음성 업로드 또는 녹음

MP3, WAV, M4A, OGG 파일을 드래그하거나 마이크를 직접 사용하세요.

2

AI가 기기에서 실행

Whisper AI가 한 번 다운로드되어 캐시에 저장됩니다. 다음 방문 시 대기 없음.

3

텍스트 복사 또는 다운로드

몇 초 안에 결과가 표시됩니다. .txt로 다운로드하거나 한 번의 클릭으로 복사하세요.

Whisper가 한국어를 얼마나 잘 처리하나요?

Whisper는 한국어의 교착어 구조를 처리하고 올바른 한글과 적절한 띄어쓰기를 출력합니다 — 이는 한국어 음성 인식의 어려운 부분입니다. 경어 수준은 충실하게 받아써지며, 영어 차용어는 일반적으로 발음대로 한글로 표기됩니다.

한국어 오디오는 일반적으로 어디서 오나요?

KakaoTalk 음성 메시지, 강의 녹음, 교회 설교, 비즈니스 회의 및 인터뷰 오디오.

무료로 전사할 수 있는 관련 언어: 日本語 · 中国語 · 베트남어 · 20개 무료 전사 언어 모두 보기

브라우저 전사의 정확도는 얼마나 되나요?

브라우저 전사는 WebAssembly를 사용하여 OpenAI의 Whisper 모델을 기기에서 직접 실행합니다. 세 가지 모델 크기를 제공하며, 정확도는 선택한 모델에 따라 다릅니다:

  • 나노 (~40MB) — 기본값. 명확한 음성에서 약 85% 정확도. 빠른 메모, 음성 메시지 및 초안에 적합합니다. iOS에서 실행되는 유일한 모델입니다.
  • 미니 (~150MB) — 대략 90% 정확도. 기기에 4GB 이상의 RAM이 있고 더 깨끗한 출력이 필요한 경우 좋은 중간 지점입니다.
  • 플러스 (~500MB) — 가장 정확한 로컬 옵션으로, 선명한 오디오에서 93%에 근접합니다. 다운로드 및 실행 속도가 느리며, 8GB 이상의 RAM을 갖춘 데스크톱 컴퓨터에 가장 적합합니다.

로컬 모델의 정확도를 낮추는 요인: 배경 소음, 여러 사람이 동시에 말하는 경우, 심한 억양, 압축된 음성 메모와 같은 낮은 비트레이트 녹음. 95% 이상의 전문적인 정확도, 단어 수준 타임스탬프 또는 화자 라벨이 필요한 경우 클라우드 모델이 필요합니다. 위의 비교를 참조하세요.

브라우저 대 클라우드 전사: 어떤 것이 필요하신가요?

브라우저 전사는 개인정보 보호가 가장 중요하거나 오디오가 짧을 때 적합합니다. 아무것도 업로드되지 않고, 이후에 삭제할 필요가 없으며, 비용이 들지 않습니다. 트레이드오프는 속도와 정밀도입니다. CPU가 약 20분 동안 1시간 분량의 오디오를 처리하며, 로컬 모델은 화자 라벨과 단어 수준 타이밍을 건너뜁니다.

클라우드 전사는 회의, 인터뷰, 강의, 법적 녹음 등 작업할 때 적합합니다. 전용 GPU는 약 2분 만에 1시간 분량의 오디오를 95% 이상의 정확도로 텍스트로 변환하고, 최대 30명의 화자를 라벨링하며, 최대 10시간 길이의 파일을 허용하고, 자막 형식 외에도 DOCX, PDF 및 JSON으로 내보낼 수 있습니다.

실용적인 경험 법칙: 카페에서 녹음을 큰 소리로 읽어도 괜찮을 정도라면 클라우드의 속도와 정확도가 우세합니다. 오디오가 민감한 경우(의료 상담, 기밀 회의, 개인 음성 메모) 브라우저 도구는 모든 것을 기기에 보관하고 몇 분 내에 사용 가능한 트랜스크립트를 제공합니다. 많은 사용자가 브라우저에서 빠른 개인 메모를, 클라우드에서 전문 작업을 결합합니다.

프리미엄 요금제 보기 →

지원되는 오디오 형식

MP3, WAV, M4A, OGG, OPUS, FLAC 또는 WEBM을 업로드하세요. 브라우저가 디코딩할 수 있는 모든 형식입니다. 일반적인 소스는 바로 작동합니다: WhatsApp 음성 메모(OPUS), iPhone 음성 메모(M4A), Android 녹음기 파일, Zoom 녹음(M4A/MP4), Telegram 음성 메시지(OGG), 팟캐스트 파일(MP3). MP4, MOV와 같은 비디오 컨테이너는 브라우저가 코덱을 지원하는 경우 오디오 트랙을 위해 디코딩됩니다. 파일 로드에 실패하면 일반적인 컨테이너에 비정상적인 코덱이 포함된 경우가 대부분이며, 먼저 MP3로 변환하면 거의 모든 경우에 해결됩니다.

다른 형식이 필요하신가요? 무료 변환기를 사용하세요: 무료 MP3 / WAV / OGG / AAC 오디오 변환기

🚀 Premium

더 필요하신가요? Premium을 사용해 보세요

전문적인 사용 — 화자 분리, 긴 파일, AI 분석 및 모든 내보내기 형식.

🎭

화자 분리(다이어리제이션)

각 구간에서 누가 말하는지 자동으로 식별합니다. 회의, 인터뷰, 팟캐스트에 최적.

⏱️

최대 10시간 파일 지원

로컬 모델은 최대 10분을 지원합니다. Premium은 최대 10시간 파일을 처리합니다.

🧠

요약, 감성 분석 & 주제

AI가 내용을 분석하여 요약, 감성 분석, 주제 추출을 생성합니다.

📄

전체 내보내기 옵션

SRT, VTT, DOCX, JSON, PDF로 내보내기 — 자막, 문서, 자동화에 이상적.

Premium 요금제 보기 →

FAQ

음성이 서버에 업로드되나요?

변환이 브라우저에서 100% 로컬로 실행됩니다. 완료 후 서비스 개선을 위해 음성과 텍스트를 선택적으로 공유할 수 있습니다(동의 체크박스) — 완전히 선택 사항입니다.

어떤 오디오 형식이 지원되나요?

MP3, WAV, M4A, OGG, FLAC, WEBM, MP4, MOV 및 브라우저가 디코딩할 수 있는 모든 형식.

오디오 파일은 얼마나 길어도 되나요?

무료 모드에서는 파일당 최대 10분입니다. 더 긴 오디오를 위해 Premium 요금제는 최대 10시간을 지원합니다.

어떤 언어가 지원되나요?

Whisper 모델은 한국어, 영어, 포르투갈어, 스페인어, 프랑스어, 독일어, 일본어, 아랍어 등 99개 언어를 지원합니다. 감지는 자동입니다.

무언가를 설치해야 하나요?

아니요. 브라우저에서 직접 작동합니다. AI 모델(~40MB)이 한 번 다운로드되어 캐시에 저장됩니다.

변환된 텍스트가 어딘가에 저장되나요?

기본적으로 아닙니다 — 결과는 브라우저에만 남습니다. 동의 체크박스를 선택하면 음성과 텍스트가 서버로 전송되고 7일 후 삭제됩니다. 언제든지 동의를 철회할 수 있습니다.

Premium과의 차이점은 무엇인가요?

무료 모드는 VoxScriber Nano(4비트 양자화, q4)를 로컬로 사용합니다: 파일당 10분 제한, 정확도 ~85%, 화자 분리 없음, 타임스탬프는 세그먼트 단위(~30초)만 가능. Premium은 클라우드 모델(AssemblyAI + Whisper Large float32)을 사용합니다: 정확도 >95%, 최대 30명 화자 분리, 단어별 타임스탬프, 최대 10시간 파일, MP4/MOV/MKV 비디오 지원, DOCX/PDF/JSON 내보내기. 속도: 1시간 오디오가 로컬 CPU에서 ~20분 vs Premium GPU에서 ~2분.

모바일에서도 작동하나요?

예, 하지만 성능은 기기에 따라 다릅니다. RAM이 적은 스마트폰에서는 변환이 느릴 수 있습니다.

정말 무료인가요?

네. 브라우저 전사기는 평가판 기간, 워터마크, 가입 없이 진정으로 무료입니다. 프리미엄 클라우드 요금제로 수익을 창출하며, 무료 도구로는 수익을 내지 않습니다.

내 오디오가 기기를 떠나나요?

아니요. 전사는 WebAssembly를 통해 로컬에서 실행됩니다. 유일한 예외는 녹음을 당사와 공유하기 위해 선택적 동의 확인란을 명시적으로 선택한 경우입니다.

파일 크기 제한이 있나요?

실질적인 제한은 기간(파일당 10분)과 기기의 메모리이며, 메가바이트가 아닙니다. 10분짜리 MP3는 일반적으로 10-20MB이며 대부분의 기기에서 잘 작동합니다.

전사에 얼마나 걸리나요?

나노 모델의 경우 최신 노트북에서 오디오 길이의 약 1-2배가 소요됩니다. 5분짜리 파일은 약 5-10분이 걸립니다. 첫 실행 시 약 40MB의 일회성 모델 다운로드가 추가됩니다.

자막(SRT)을 내보낼 수 있나요?

네. 무료 내보내기에는 .txt, .srt, .vtt(세그먼트 타임스탬프 포함)가 포함됩니다. 단어 수준 타임스탬프 정밀도와 DOCX/PDF/JSON 내보내기는 프리미엄을 참조하세요.

여러 파일을 한 번에 전사할 수 있나요?

네. 최대 5개의 파일을 대기열에 추가할 수 있으며 브라우저에서 하나씩 처리됩니다. 프리미엄은 대기열 제한을 제거하고 클라우드에서 파일을 병렬로 처리합니다.

첫 번째 전사가 더 오래 걸리는 이유는 무엇인가요?

처음 방문 시 AI 모델이 다운로드되어 브라우저에서 컴파일됩니다. 그런 다음 캐시되므로 이후의 모든 전사가 즉시 시작됩니다.

오프라인에서 작동하나요?

부분적으로 가능합니다. 모델이 캐시되면 전사 자체는 연결이 필요하지 않습니다. 페이지를 로드하려면 여전히 온라인 상태여야 합니다.

한국어 띄어쓰기를 올바르게 처리하나요?

네 — 최신 Whisper는 이전 도구의 일반적인 실패 지점인 띄어쓰기를 잘 처리합니다.

경어를 올바르게 받아쓰나요?

네 — 격식체와 비격식체 모두 말한 대로 받아써집니다.

한국어에 혼합된 영어 단어는 어떻게 처리되나요?

일반적으로 발음대로 한글로 표기되며, 명확한 영어 구문은 라틴 문자로 유지될 수 있습니다.