音声・動画の文字起こし
録音や動画の音声トラックを認識し、修正してTXT・SRT・WebVTTへ保存。会議音声や字幕作成の用途に合うか確認します。
開発の相談POTEST LAB / Potetoss(ぽてとす)・無料ベータ
社内の録音を文字起こししたい。ローカルAIで議事録を作りたい。でも、GPUサーバーを買う前に、今あるPCでどれくらい動くか確かめたい。
Potetossは音声認識・議事録生成・字幕出力を手元のPCで試す、無料のオンプレミスAI動作・性能検証アプリです。ぽてすとの開発技術を、実際に触れて確かめられる形にしています。
録音や動画の音声トラックを認識し、修正してTXT・SRT・WebVTTへ保存。会議音声や字幕作成の用途に合うか確認します。
モデルごとの処理速度、メモリ、LLMの生成速度を確認。GPUなしのPCでも文字起こしを試せます。処理速度と認識精度は別に評価します。
任意参加の承認済み社内PCで音声区間を分担。台数を増やしても必ず速くなるわけではありません。

CPUで動くかを確認したあと、GPUが利用できる環境では同じ音声と認識モデルで比較します。議事録生成はOllamaのモデルと設定も揃えてください。速さだけでなく、固有名詞・数字・決定事項の認識も原音と照合します。
このページには、条件を確認できた実測結果はまだ掲載していません。特定のPCでの速度や認識精度を保証するものではありません。
認識・議事録生成はローカルまたは指定した社内PCで処理します。ChatGPT等の外部生成AI APIへ音声や本文を送る構成ではありません。ただし初回のモデル取得にはインターネット通信が必要です。
グループ参加時は音声と用語ヒントを承認済みPCへ転送します。原本・結果・設定・用語集・モデル・履歴・ログは残ります。OSのスワップやダンプも保証対象外です。オンプレでも情報漏洩ゼロとは限りません。自動テレメトリーや広告はありません。
ローカル構成では、音声認識とAI議事録生成を手元のPCで処理します。ChatGPT等の外部生成AI APIへ音声や本文を送る構成ではありません。社内LANで分担する場合は、承認済みPCに音声区間と用語ヒントを転送します。
必要な音声モデル、Ollamaのモデル、FFmpegなどを事前に準備し、ローカルで処理する構成であれば、文字起こし・議事録生成をオフラインで試せます。初回のダウンロードやモデル取得には通信が必要です。社内PCで分担する場合には社内LANへの接続が必要です。
動画の音声トラックを文字起こしし、SRT・WebVTT形式で字幕を保存できます。動画や圧縮音声の処理にはFFmpegの準備が必要です。字幕時刻や読みやすさは原音を確認し、編集ソフトで調整してください。
文字起こしはCPUでも動作します。速度はPCやモデルで異なります。GPUがある場合も実測してください。
実行するPCにOllamaとモデルを準備します。文字起こしだけならOllamaは必須ではありません。
Windows版を中心に検証しています。Mac版は実機ビルドと確認が必要な試験版です。全環境の動作保証はありません。
原音で確認してください。発言者や決定事項を誤る場合があります。字幕時刻や読みやすさは編集ソフトで調整してください。
ありません。オフラインヘルプ・既知の制限・診断情報で確認してください。自社向けのシステム開発は別の案件としてご相談いただけます。
Potetoss 0.1.3 beta / ZIP:186,778,780 bytes(約187 MB)
検証用・個別サポートなしの条件をご確認のうえダウンロードしてください。
Windows版 0.1.3 betaをダウンロードSHA-256(ダウンロードしたファイルの照合用)
4a4f6dce1dcf166de4e3ea487d74cc59bfdec7dc2d65b6a680390fe8e9816152
本体ソースは非公開。Ollama・モデル・GPU追加パック・FFmpegは本体に同梱しません。第三者ライブラリの権利は各ライセンスに従います。同梱の説明・ライセンス文書を確認してください。
ぽてすとは既存システムの調査・改修と、Python・AIを使った業務の仕組み化を行う開発会社です。社内の音声・文書を扱う仕組みや既存システムとの連携について、目的と環境を整理する段階からご相談ください。
こちらは開発案件の相談窓口です。Potetossの無料個別サポート窓口ではありません。
自社向けのAI開発を相談する