HN 日本語サマリー

← 一覧へ戻る
AI・機械学習

Show HN: OfflineTTS — ローカルで動作する無料のブラウザベースTTS&STT

Show HN: OfflineTTS — Free browser-based TTS & STT that runs locally (offlinetts.com)

7 pointsby twainyoung3 コメント

要約

OfflineTTSは、ブラウザ上で動作するプライベートAIオーディオツールキットです。テキスト読み上げ(TTS)、音声認識(STT)、字幕生成、EPUBやPDFなどのドキュメントを音声化する機能を備えています。全ての主要ツールはブラウザ内で実行され、一部機能はオフラインでも利用可能です。サインアップやAPIキーは不要で、無料で利用できます。

全文翻訳

ブラウザ上のプライベートAIオーディオツール無料テキスト読み上げ、音声認識、字幕生成、電子書籍の音声化。OfflineTTSは、ブラウザベースのテキスト読み上げ、音声からテキストへの変換、字幕生成、EPUB、PDF、またはTXTから音声へのワークフローを、一つのプライベートAIオーディオツールキットにまとめます。TTSを開始 STTを開始 電子書籍を音声化設計上プライベート無料利用サインアップ不要ブラウザファースト4つのローカルTTSエンジン99のSTT言語TXT SRT / VTTエクスポートEPUB PDF / TXT音声ワークフローディレクトリ適切なプライベートAIオーディオワークフローを見つける無料テキスト読み上げ、音声認識、字幕ジェネレーター、クリエイターボイスオーバー、またはEPUB、PDF、TXTリスニングから始めましょう。全ツールを見る → Whisper STT 99言語音声からテキストへプライベートブラウザトランスクリプション(アップロードされたオーディオまたはビデオ用)と、トランスクリプトおよび字幕対応のエクスポート付き。TXT SRT VTTブラウザWhisperオーディオまたはビデオファイルをアップロードトランスクリプトまたは字幕をエクスポートメディアをデバイス上に保持ワークフローを開く → キャプション SRT + VTT字幕ジェネレータークリエイターメディア、レビュー、アクセシビリティワークフロー用の字幕対応SRTおよびVTTファイルを生成します。SRT VTTタイムスタンプ字幕エクスポートを中心に構築ショートおよびリールに最適字幕クリーンアップツールと連携ワークフローを開く → クリエイター音声 WAV + MP3ボイスオーバーワークフローブラウザで直接クリエイターナレーション、顔出しなしチャンネルのオーディオ、ショートフォームスクリプトのボイスオーバーを生成します。YouTube TikTok顔出しなしスクリプトを貼り付けてナレーションを生成WAVまたはMP3をエクスポート繰り返し可能なクリエイターワークフロー向けに構築ワークフローを開く → リーディングワークフローEPUB / PDF / TXT電子書籍を音声化EPUB、PDF、TXTの読書資料を、学習、アクセシビリティ、オーディオブックドラフトリスニングのために音声に変換します。EPUB PDF TXT WAV/MP3長文読書資料を解析生成前にセクションを確認リスニング対応オーディオをエクスポートワークフローを開く → プラットフォーム機能TTS、STT、キャプション、ドキュメント音声用のローカルエンジンボイス生成、トランスクリプション、字幕、リーディングワークフローのために、同じブラウザファーストプラットフォームからKokoro、Kitten、Piper、Supertonic、またはWhisperを選択してください。全てのコアツールはブラウザで実行されます。英語TTSとWhisper STTは、モデルダウンロード後にオフラインで動作します。54のボイス・9言語Kokoroプライマリ無料テキスト読み上げエンジンで、自然なブラウザボイス生成と多言語ボイスワークフローを実現します。8つの表現・軽量Kitten軽量ローカルTTSで、高速ドラフト、小型デバイス、クイックボイスオーバー実験に対応します。25のボイス・CPUフレンドリーPiper CPUフレンドリーな音声合成で、オフラインナレーションと信頼性の高い長文オーディオドラフトを作成します。5言語・ローカルSupertonic多言語ブラウザTTSで、英語、スペイン語、ポルトガル語、フランス語、韓国語のスタイルプリセットを利用できます。99言語・トランスクリプションWhisper音声からテキストへの変換、ビデオトランスクリプション、タイムスタンプ、SRT字幕、VTTキャプションエクスポート。ユースケースクリエイター、アクセシビリティ、学習、プライベートリサーチ向けに構築ホームページは、薄っぺらいランディングページではなく、実際のツールへのリンクを提供します:音声を生成する、音声を文字起こしする、字幕を作成する、ドキュメントをリスニング可能な素材に変換する。クリエイタースクリプトやクリップをサードパーティのダッシュボードに移動させることなく、ナレーション、トランスクリプトのラフカット、字幕、再利用可能なアセットを生成します。アクセシビリティテキスト、ドキュメント、話されたメディアを、リスニング、キャプション付け、検索、レビューしやすい形式に変換します。学習とドキュメント読書キュー、TXTエクスポート、EPUB、論文、PDFを、レビューやハンズフリーレビューのためのリスニングワークフローに変換します。チームとリサーチプライバシーがクラウドの利便性よりも重要な場合、インタビュー、会議、ソース資料にローカルトランスクリプションを使用します。証明チームがアップロードファーストのオーディオツールよりもOfflineTTSを選ぶ理由OfflineTTSは、プライベートブラウザ処理、無料利用、ボイス、トランスクリプト、字幕、ドキュメント音声作業のための直接エクスポートパスを中心に構築されています。機能OfflineTTSElevenLabsNaturalReaderMurf価格無料$5–$22/月$9.99/月+ $23–$79/月使用制限無制限文字ごと無料ティアキャップ文字ごとオフラインモードはいいいえいいえプライバシーモデルオンデバイス/ブラウザファーストサーバーサイドサーバーサイドサーバーサイドサインアップまたはAPIキーゲートなし英語TTSはモデルダウンロード後に完全にオフラインで動作しますWhisperトランスクリプションはブラウザで実行されますツールはTTS、STT、字幕生成、ドキュメントリスニングをカバーしています生成された音声は商用利用できますか?ほとんどのクリエイターワークフローでは、はい。大規模な商用展開の前に、使用している正確なエンジンのアップストリームモデルの条件を確認してください。どのようなオーディオ形式をエクスポートできますか?ボイスワークフローからWAVまたはMP3をエクスポートできます。WhisperトランスクリプションはTXT、SRT、VTTをエクスポートします。試してみる準備はできましたか?必要なオーディオワークフローから始めましょうボイスワークスペースを開く、トランスクリプションを開始する、または字幕クリーンアップとEPUB、PDF、TXTリスニングワークフローのツールディレクトリにアクセスします。TTSワークスペースを開くSTTワークスペースを開くツールをブラウズ