参考にしたい声の短い録音と、読ませたい文章を渡すと、その声で読み上げてくれるお試しページです。F5-TTS という仕組みを使っており、数秒のサンプルでもかなり似た声になります。使われているモデルは商用利用も認められています。
#音声合成#声の複製
これは何?ブラウザで使えるサービス
できること
数秒の録音からの声の再現/その声での読み上げ/複数言語での生成/登録なしでブラウザから利用
誰に効く?
自分の声でナレーションを量産したい人。声の再現を試したい人
用意するもの
ブラウザで開いて、参考にする音声(数秒)と読ませたい文章を入れるだけです。インストールも登録も要りません。
時間のめやす
3分
使えるようになるまでの手順をひらく
- 下の「GitHubで見る」ボタンで公式ページを開く
- ページ内の公式サイトリンク(Website / Cloud など)へ進む
- アカウント登録(メールアドレスなど)をする
- そのままブラウザ上で使えます
迷ったらこれ:いつも使っているAIチャット(ChatGPT・Claude・Geminiなど)にこのツールのGitHubリンクを貼って 「これを使いたい。私のPCでの始め方を一歩ずつ教えて」と頼むのが一番の近道です。
他人の顔や声を扱う前に
本人の許可なく顔や声を使い、その人が言っていない・していないことをしているように 見せる映像や音声を作って公開すると、名誉毀損や肖像権・パブリシティ権の侵害として 損害賠償や刑事責任を問われることがあります。性的な内容にした場合や、 実在の人物になりすまして金銭をだまし取る目的で使った場合は、さらに重い責任を問われます。 使ってよいのは、自分自身の素材か、内容と公開範囲まで説明したうえで許可を得た相手の素材だけだと 考えてください。手元のパソコンだけで処理できることと、作ったものを公開してよいことは別の問題です。
注意点
他人の声を本人の許可なく再現して使うと、なりすましや権利侵害になります。家族や知人の声を装った詐欺の手口も実在するため、自分の声か、明確に許可を得た声だけに使ってください。公開する時は合成音声だと分かるようにしてください。参考にする音声は雑音のない静かな録音のほうがうまくいきます。アップロードした音声は公開元のサーバーに送られます。 ここに書いたは、このお試しページ自体のものです。作ったものを仕事に使えるかどうかは、中で使われているAIモデルの条件で決まります。使われているモデルは商用利用も認められています(mit / mit / mit)。ただし著作権表示など条件が付く場合があるので、配布物に含めるなら本文を確認してください。
ひとことメモ
公開元のサーバー上で動くお試しページです。アップロードした画像や文章はその環境に送られるので、社外に出せないものは入れないでください。混み合っていると順番待ちになることがあります。
E2-F5-TTSについてよくある質問
- E2-F5-TTSを使うのに、インストールや専門知識は必要ですか?
- ブラウザで開くだけで使えます。インストールは不要です。
- E2-F5-TTSはスマホでも使えますか?
- スマホには対応していません。パソコンが必要です。
- E2-F5-TTSは仕事(商用)で使えますか?
- 公開元がライセンスをはっきり書いていないため、商用で使ってよいかは判断できません。仕事で使う場合は、公式ページで確認するか、作者に問い合わせてください。
音声生成のほかのツール
E2-F5-TTSが合わなかったときの、同じ用途の候補です。
MegaTTS3-Voice-Cloning
声を複製して読み上げる音声AIデモ
上級者向け・黒い画面いらない
TTS-Arena-V2
読み上げAIを聞き比べて、どれが自然か投票できるページ
準備がいる・黒い画面いらない
Zonos
Zonos音声生成モデルのデモ
準備がいる・黒い画面いらない
Chatterbox-Multilingual-TTS
23言語対応のChatterbox音声合成
準備がいる・黒い画面いらない
llasa-3b-tts
声をまねた読み上げ作成
上級者向け・黒い画面いらない
VibeVoice-Realtime-0.5B
リアルタイム音声生成
準備がいる・黒い画面いらない