よくある質問

Whisperly の無料AI音声ジェネレーターとデバイス内テキスト読み上げの仕組みについての手早い回答です。登録不要、AI音声、オフライン利用などについてご説明します。

Whisperlyは無料ですか?

はい。Whisperlyは完全に無料のAI音声ジェネレーターで、アカウントも、登録も、APIキーも不要です。音声はあなた自身のデバイス上で生成されるため、文字あたりの費用も、利用枠も、レート制限もありません。

Whisperlyはどうやって収益を得ているのですか?

今のところ収益はありません。Whisperlyは無料で、購入するものも広告もありません。このアプリの中心であるデバイス内テキスト読み上げは無料のままです。複数のデバイス間でセッションを同期し続ける任意の Cloud Sync 機能を計画しており、それが将来このプロジェクトを支えうる追加機能となります。一方でコアとなるアプリは無料で使えるままです。

WhisperlyはAI音声ジェネレーターですか?

はい。Whisperlyは無料のAI音声ジェネレーター兼テキスト読み上げアプリです。ブラウザ内で直接動くニューラルモデル(KokoroとPiper)を使って、テキストを自然なAI音声に変換します。ほとんどのAI音声ツールと違ってデバイス上で動作し、それこそが無料でプライバシーに配慮し、オフラインで使える理由です。

本当に登録も文字数制限もないのですか?

そのとおりです。登録も、ログインも、APIキーもなく、AI音声はあなた自身のデバイス上で動くため文字数制限もありません。一文から記事まるごとまで、何でも変換できます。これは正真正銘、無料で無制限のAIテキスト読み上げです。

私のテキストはデバイスの外に出ますか?

いいえ。Whisperlyはすべてブラウザ内で動作するため、テキストも生成された音声もデバイスの外に出ることはなく、サーバーに送られることもありません。それらを見られるバックエンドは存在しません。

何かインストールする必要はありますか?

いいえ。Whisperlyは最新のブラウザならどれでも動作し、ダウンロードやインストールするものはありません。音声を初めて使うとき、そのモデルが一度だけ取得されてブラウザにキャッシュされ、その後は即座に読み込まれます。お好みであれば、Whisperlyをブラウザからデバイスにインストールして、通常のアプリのように独立したウィンドウで開くこともできます。ただし、どちらの方法でも動作はまったく同じです。

なぜ最初の変換に少し時間がかかるのですか?

音声を初めて使うとき、Whisperlyはそのモデルをダウンロードします。これがデバイス上でのオフライン音声合成を可能にしているのです。ダウンロードは一度だけ行われ、その後はブラウザにキャッシュされるため、それ以降の変換はすべて高速です。

オフラインで動作しますか?

はい、音声モデルを一度ダウンロードすればオフラインで動作します。モデルはブラウザにキャッシュされるため、まったくネットワーク接続がない状態でもテキストを音声に変換できます。

Whisperlyはクラウド型のテキスト読み上げツールとどう違うのですか?

ほとんどのテキスト読み上げツールはクラウドで動きます。テキストを送信すると文字ごとに課金され、インターネット接続と、たいていはアカウントが必要です。Whisperlyは代わりに音声をあなた自身のデバイス上で動かします。それこそが、登録不要で、無料でプライバシーに配慮し、オフラインで使える理由です。

どの音声と言語が利用できますか?

Whisperlyには多言語対応のKokoroモデルが搭載されています。英語、中国語、ドイツ語、スペイン語、フランス語、イタリア語、ポルトガル語、日本語、ヒンディー語にわたる数十種類の音声に加え、Amy(米国英語)やThorsten(ドイツ語)といった専用のPiper音声も利用できます。どの音声でも話す速さを調整できます。

ブラウザ内のテキスト読み上げはどう動くのですか?

Whisperlyは、WebAssemblyにコンパイルされたニューラルTTSエンジン sherpa-onnx を動かします。音声モデルはブラウザのタブ内でCPU上で直接動くため、音声合成はリモートサーバーではなくローカルで行われます。

生成した音声をダウンロードできますか?

はい。Whisperlyはあなたのテキストを音声に変換し、再生したり、MP3としてダウンロードしてお好きな場所で使ったりできます。

Whisperlyを配信用の無料TTSとして使えますか?

はい。Whisperlyは配信者向けの無料テキスト読み上げとしてよく機能します。AI音声クリップを生成し、MP3をダウンロードして、配信環境で再生してください。登録も文字数制限もなく、音声を一度ダウンロードすればオフラインでも動き続けます。

生成した音声を商用利用できますか?

はい。Whisperlyに搭載されている音声モデルは寛容なオープンソースライセンス(MIT、Apache-2.0、CC0、CC BY 4.0)で公開されているため、生成した音声は動画やその他の商用プロジェクトを含め、自由に使えます。各モデルのライセンスと必要なクレジット表記は、アプリの音声設定に表示されます。

ダウンロードした音声はどこに保存され、削除できますか?

音声モデルはサーバーではなく、あなたのブラウザ(IndexedDB)に保存されます。アプリ内のモデルキャッシュのダイアログから、使用している容量を確認したり、個々のモデルを削除したり、すべてをクリアしたりできます。

Whisperlyはスマートフォンで動作しますか?

はい。Whisperlyは最新のモバイルブラウザで動作し、タッチ操作に適したレイアウトを備えています。音声合成は引き続きあなたのデバイス上で行われるため、非常に大きな音声モデルはノートパソコンよりもスマートフォンへの負荷が大きくなりますが、小さめの音声は問題なく動作します。

どのブラウザに対応していますか?

WhisperlyはChrome、Edge、Firefox、Safariの最新バージョンで動作します。WebAssemblyと(SharedArrayBufferのための)クロスオリジン分離コンテキストが必要ですが、これらは最新のブラウザが提供しています。

変換できるテキストの量に制限はありますか?

いいえ。すべてがあなたのデバイス上で動くため、利用上の制限はありません。長いテキストは音声合成に少し時間がかかるだけで、長い処理は一時停止して再開できます。