무료 도구 · 회원가입 없음

무료 텍스트 음성 변환: 자연스러운 AI 음성, MP3 다운로드

최종 업데이트 작성: Avalon

텍스트를 자연스러운 음성으로 변환해 MP3 또는 WAV로 다운로드합니다.

    텍스트는 기기 밖으로 나가지 않습니다. 음성은 브라우저에서 실행되는 AI 모델이 만들기 때문에 서버에 업로드되지 않습니다. 이 오디오는 AI로 생성된 것이므로 게시할 때 그 사실을 밝혀 주세요.

    이 도구의 기능

    텍스트를 무료로 음성으로 바꾸려면 위에 텍스트를 붙여넣고 음성을 선택한 후 음성 만들기를 누르세요. 결과를 바로 재생하고 MP3로 다운로드할 수 있으며 회원가입은 필요 없습니다. 음성은 오픈 AI 음성 모델인 Kokoro에서 제공되며 브라우저에서 실행되므로 텍스트가 기기에 그대로 남아 있습니다. 짧은 동영상의 내레이션, 슬라이드 설명, 귀로 하는 교정, 내가 쓴 글 듣기에 알맞습니다.

    사용 방법

    1. 입력란에 텍스트를 입력하거나 붙여넣거나, .txt 파일을 여세요.
    2. 음성과 속도를 선택하세요.
    3. 어디서나 재생되는 작은 파일은 MP3, 동영상 편집용은 WAV를 선택하세요.
    4. 음성 만들기를 누르세요. 처음에는 음성 모델이 한 번 다운로드됩니다.
    5. 재생을 눌러 들어 본 다음 다운로드를 누르세요.

    자연스러운 음성을 위한 팁

    • 숫자, 날짜, 가격은 평소처럼 쓰세요. "$19.99", "October 4", "9:30"은 전부 풀어서 읽어 줍니다.
    • 문장 부호가 리듬을 만듭니다. 쉼표에서는 짧게 쉬고, 새 문단에서는 더 길게 쉽니다.
    • 동영상 내레이션에는 문장을 짧게 쓰고, 장면이 바뀌는 곳에 빈 줄을 넣으세요.
    • 이름이 잘못 읽히면 소리 나는 대로 적어 보세요.
    • 완성된 동영상에 자막이 필요하신가요? 무료 자막 생성기를 사용해 보세요.

    크레딧

    음성은 hexgrad의 Kokoro-82M(Apache 2.0)을 사용합니다. 발음은 misaki(Apache 2.0)의 사전을 사용합니다. 모델은 ONNX Runtime Web(MIT)으로 실행되며, MP3 파일은 lamejs(LGPL)로 만듭니다. 전체 고지: 서드파티 라이선스.

    무료, Pro, Pro+

    무료ProPro+
    오디오 파일당 텍스트 길이1,000자20,000자브라우저에서 20,000자, 빠른 서버 음성으로 40,000자
    문단별 오디오 파일 1개씩, ZIP으로—예예
    저장된 프리셋—예예
    결과 품질모든 요금제에서 브라우저 처리 방식이 동일합니다브라우저 처리는 동일하며, 서버에서는 더 높은 정확도로 처리합니다
    크레딧으로 이용하는 서버 도구크레딧 팩 이용 시크레딧 팩 이용 시매달 300 크레딧

    Pro+ 크레딧은 서버 도구 사용에 쓰입니다. 고정밀 음성 텍스트 변환, 고정밀 자동 자막, 빠른 서버 음성, AI PDF 요약·답변·번역이 해당됩니다. 크레딧 팩(150 크레딧, 12개월간 유효)은 모든 플랜에서 사용할 수 있습니다. 플랜 비교.

    자주 묻는 질문

    이 오디오를 YouTube 동영상이나 상업적 용도로 사용할 수 있나요?

    네. 음성 모델인 Kokoro-82M은 상업적 이용을 허용하는 Apache 2.0 라이선스로 공개되어 있으며, 만드신 오디오에 Avalon이 별도의 조건을 붙이지 않습니다. 음성은 AI로 생성된 것입니다. 플랫폼에서 AI 콘텐츠 표시를 요구하는 곳에는 그 사실을 밝혀 주세요.

    내 텍스트가 어딘가에 업로드되나요?

    아니요. 음성 모델은 브라우저 안에서 내 기기에서 실행됩니다. 텍스트는 저희 서버나 다른 곳으로 전송되지 않습니다. 단, 직접 켜서 사용하는 선택 기능인 Pro+ 빠른 서버 음성은 예외입니다.

    첫 실행은 왜 더 오래 걸리나요?

    처음에는 브라우저가 음성 모델과 발음 사전을 다운로드하며, 크기는 약 97 MB입니다. 이 파일은 브라우저에 저장되므로 다음부터는 바로 시작됩니다.

    얼마나 걸리나요?

    기기에 따라 다릅니다. 최신 노트북에서는 보통 재생 시간보다 빠르게 오디오가 만들어지며, 휴대폰이나 오래된 컴퓨터는 더 느립니다. 진행 표시줄에서 진행 상황을 확인할 수 있고 언제든지 중지할 수 있습니다.

    어떤 언어를 지원하나요?

    미국 영어 음성으로 영어를 지원합니다. 다른 언어는 아직 지원하지 않습니다.

    단어가 잘못 읽히는 이유는 무엇인가요?

    발음은 약 180,000개의 영어 단어가 담긴 사전을 기준으로 합니다. 사전에 없는 이름이나 새로운 단어는 철자 규칙으로 읽기 때문에 틀릴 수 있습니다. 예를 들어 Siobhan은 Shiv-awn처럼 소리 나는 대로 적으면 대개 해결됩니다.

    한도는 어떻게 되나요?

    무료 버전은 일일 한도 없이 한 번에 최대 1,000자까지 음성으로 만들 수 있습니다. Avalon Pro는 한 번에 최대 20,000자까지 만들 수 있고, 문단별로 오디오 파일을 하나씩 ZIP으로 저장할 수 있으며, 음성과 속도를 저장된 프리셋으로 사용할 수 있습니다. Avalon Pro+는 최대 40,000자 텍스트를 위한 빠른 서버 음성을 추가로 제공하며, 크레딧으로 결제합니다.

    새 실험을 이메일로 받아보세요

    매월 말에 짧은 이메일 한 통을 보내 드립니다. 진행한 실험, 결과 수치, 따라 해 볼 수 있는 단계를 담았습니다. 언제든 구독을 취소할 수 있습니다.