音声ファイルの自動文字起こしツール
概要
音声ファイルをアップロードすると自動でテキストに変換し、編集・エクスポートまで行えるWebアプリ。会議録・インタビュー・講演の文字起こしの手間削減を目的に、企画から開発まで個人で構築した。
課題・背景
手作業の文字起こしは時間とコストがかかる。高精度な自動化と、変換後その場で修正・書き出しできる編集体験の両立が必要だった。
アプローチ
音声認識に OpenAI Whisper を採用し、精度と多言語対応を確保。変換結果をブラウザ上で編集・整形し、そのまま書き出せるフローに設計した。専門知識のないユーザーでも完結できることを優先した。
成果
手作業に比べて文字起こしの所要時間を大幅に短縮。録音から編集済みテキストの取得までを1つのツールで完結できる運用を実現した。
担当範囲
企画/要件定義/設計/開発
技術スタック
Python/OpenAI Whisper