NVIDIAの音声認識モデルを、ブラウザの中だけで動かすリアルタイム文字起こしデモです。話した内容がその場でどんどん文字になり、音声データは一切サーバーに送られません。
#リアルタイム#ブラウザ完結#プライバシー重視
※この説明はAIが公式READMEから自動生成したものです。内容は必ず公式ページでもご確認ください。
これは何?ブラウザで使えるサービス
できること
マイクに向かって話すと、リアルタイムで文字起こしされます。25のヨーロッパ言語に対応し、確定した部分と認識中の部分が色分け表示されます。
誰に効く?
通話や会議の内容をその場で文字にしたい人
用意するもの
ブラウザだけ(初回はモデル読み込みに少し時間)
時間のめやす
3分
使えるようになるまでの手順をひらく
- 下の「GitHubで見る」ボタンで公式ページを開く
- ページ内の公式サイトリンク(Website / Cloud など)へ進む
- アカウント登録(メールアドレスなど)をする
- そのままブラウザ上で使えます
迷ったらこれ:いつも使っているAIチャット(ChatGPT・Claude・Geminiなど)にこのツールのGitHubリンクを貼って 「これを使いたい。私のPCでの始め方を一歩ずつ教えて」と頼むのが一番の近道です。
注意点
日本語は対応言語に含まれていません。英語や欧州言語向けです。
ひとことメモ
として公開されています。内容は公式ページでもご確認ください。