無料テキスト読み上げ: 自然なAI音声、MP3ダウンロード
テキストを自然な音声に変換し、MP3またはWAVでダウンロードできます。
音声を作成するため、テキストは当社サーバーと音声合成プロバイダーに送信されます。音声は常にMP3で保存されます。テキストは保存しません。音声はAIで生成されたものです。詳しくはプライバシーポリシーをご覧ください。
現在ご利用中の機能は、これからも無料です。
テキストが端末の外に出ることはありません。音声はブラウザー上で動作するAIモデルで作成されるため、サーバーにアップロードされることはありません。音声はAIで生成されたものです。公開する際はその旨を明記してください。
このデバイスの最近の結果
このブラウザー内にのみ保存され、アップロードされることはありません。7日間、最大500 MBまで保持され、古いものから削除されます。
まだ保存されたものはありません。各ツールで作成した結果がここに表示されます。
Avalon Proなら、最近の結果をこのデバイスに7日間保存するので、どのツールからでも再ダウンロードでき、複数のファイルをまとめて次のツールに引き継げます。Avalon Proを見る
このツールでできること
テキストを無料で音声に変換するには、上にテキストを貼り付け、音声を選んで音声を作成を押してください。結果はすぐに再生でき、登録なしでMP3としてダウンロードできます。音声はオープンなAI音声モデルのKokoroによるもので、ブラウザー上で動作するため、テキストは端末内にとどまります。短い動画のナレーション、スライドの解説、耳で聞く校正、自分の文章の聞き返しに便利です。
使い方
- ボックスにテキストを入力または貼り付けるか、.txtファイルを開きます。
- 音声と速度を選びます。
- どこでも再生できる小さなファイルならMP3、動画編集にはWAVを選びます。
- 音声を作成を押します。初回のみ、音声モデルが1回ダウンロードされます。
- 再生を押して聞き、ダウンロードを押します。
自然に聞こえるコツ
- 数字、日付、価格は普通に書いてください。「$19.99」「October 4」「9:30」はそのまま全文で読み上げられます。
- 句読点でリズムが決まります。カンマで短い間、新しい段落で長めの間が入ります。
- 動画のナレーションには、文を短くし、場面が変わる箇所に空行を入れましょう。
- 名前の読み方がおかしいときは、発音どおりのつづりで書いてください。
- 完成した動画に字幕が必要ですか? 無料の字幕作成ツールをご利用ください。
クレジット
音声はhexgradのKokoro-82M(Apache 2.0)です。発音にはmisaki(Apache 2.0)の辞書を使用しています。モデルはONNX Runtime Web(MIT)で動作し、MP3ファイルはlamejs(LGPL)で書き出されます。詳細はサードパーティライセンスをご覧ください。
Free、Pro、Pro+
| Free | Pro | Pro+ | |
|---|---|---|---|
| 1つの音声ファイルあたりのテキスト量 | 1,000文字 | 20,000文字 | ブラウザーで20,000文字、高速サーバー音声で40,000文字 |
| 段落ごとに1つの音声ファイル(ZIP) | — | あり | あり |
| 保存済みプリセット | — | あり | あり |
| 結果の品質 | どのプランでもブラウザでの処理は同じです | ブラウザでの処理は同じで、サーバーではより高精度です | |
| クレジットで使うサーバーツール | クレジットパックで利用可能 | クレジットパックで利用可能 | 毎月300クレジット |
Pro+のクレジットは、サーバーツールの利用に使えます。高精度の音声文字起こし、高精度の自動字幕生成、高速なサーバー音声、AI PDFの要約・回答・翻訳が対象です。クレジットパック(150クレジット、有効期間12か月)は、どのプランでも使えます。プランを比較。
よくある質問
音声をYouTube動画や商用利用に使えますか?
はい。音声モデルのKokoro-82MはApache 2.0ライセンスで公開されており、商用利用が可能です。作成した音声に当社独自の条件を加えることもありません。音声はAIで生成されたものです。プラットフォームでAIコンテンツの表示が求められる場合は、その旨を明記してください。
テキストはどこかにアップロードされますか?
いいえ。音声モデルはお使いのブラウザー内、つまりご自身の端末上で動作します。テキストが当社のサーバーやほかの第三者に送信されることはありません。唯一の例外は、ご自身でオンにするオプションのPro+高速サーバー音声です。
初回の実行に時間がかかるのはなぜですか?
初回のみ、ブラウザーが音声モデルと発音辞書(約97 MB)をダウンロードします。これらはブラウザーに保存されるため、次回以降はすぐに始められます。
どれくらい時間がかかりますか?
端末によって異なります。最近のノートPCなら、通常は再生時間より短い時間で音声が作成されます。スマートフォンや古いパソコンでは時間がかかります。進行状況バーで進み具合を確認でき、いつでも停止できます。
対応している言語は何ですか?
英語(アメリカ英語の音声)です。ほかの言語にはまだ対応していません。
単語の発音がおかしいのはなぜですか?
発音は約180,000語の英単語辞書に基づいています。辞書にない名前や新しい単語はつづりのルールで読み上げるため、間違うことがあります。たとえばSiobhanならShiv-awnのように、聞こえるとおりに書くと、たいてい直ります。
制限はありますか?
無料版では一度に最大1,000文字まで読み上げでき、1日の上限はありません。Avalon Proでは一度に最大20,000文字まで読み上げでき、段落ごとに音声ファイルをZIPで保存できます。また、音声と速度をプリセットとして保存できます。Avalon Pro+では、最大40,000文字のテキストに対応する高速サーバー音声が加わり、クレジットでお支払いいただけます。