オープンソースの音声入力と文字起こし
OSI 承認ライセンスでコードを公開している音声入力と文字起こし5件を、根拠に基づいてプライバシー評価。おすすめを先頭に、その後はスコア順。
Buzz グレード B
Whisper モデルを使い、音声・動画ファイルやマイクからのライブ入力をオフラインで文字起こし・翻訳するデスクトップアプリ。代わりに OpenAI Whisper API をオプションで使うこともできます。
MIT license. ソースコード
Handy グレード B
プッシュトゥトーク方式の音声入力のための、無料でオープンソースのデスクトップアプリ。音声はローカルの Whisper または Parakeet モデルでデバイス上でオフラインで文字起こしされ、アクティブなテキスト欄に入力されます。
MIT license. ソースコード
Whisper グレード B
ローカルのコンピューター上で多くの言語の音声を文字起こし・翻訳する、OpenAI によるオープンソースの音声認識モデルと Python のコマンドラインツール。
Code and model weights are MIT-licensed. ソースコード
whisper.cpp グレード B
OpenAI の音声認識モデル Whisper の C/C++ 移植版で、ローカルデバイスの CPU または GPU で文字起こしを実行します。ライブラリおよびコマンドラインツールとして使われるほか、多くの音声入力アプリのエンジンとしても使われています。
MIT license. ソースコード
Anarlog グレード D
ボットを使わずにデバイスの音声を録音し、文字起こしと AI による要約を作成する、ローカルファーストのオープンソース会議メモアプリ(旧 Hyprnote)。文字起こしは対応する Mac ではデバイス上で、または選択したクラウドプロバイダーを通じて実行できます。
The app, including the optional hosted services, is MIT-licensed; separate enterprise components are commercially licensed. ソースコード
音声入力と文字起こし全17件を比較(オープンソースかどうかを問わず)。