音声ファイルを自動でテキスト化し、議事録などのドキュメントとして出力するPythonスクリプトです。
OpenAIのAPIを活用してテキストに変換し、それを統合して最終的なアウトプットとして保存します。
会議の議事録やインタビューのテキスト化など、長い音声を効率よく処理することを目的としています。
20MBごとに音声ファイルを分割し、処理しやすいサイズにします。Whisperの処理可能ファイルサイズ上限の25MB以下になるよう自動分割。
OpenAIのWhisperモデルを使用して、音声をテキストに変換します。分割された音声ファイルを個別に処理し、高精度な文字起こしを実現。
複数のテキストファイルを統合し、一つのファイルとして出力します。生成された分割テキストを統合したのち、ChatGPTにより議事録を生成。
ChatGPTを使用して、会話内容を元に議事録を生成し、読みやすくまとめます。議題ごとに整理され、アクションアイテムも明確化。
音声ファイルをWhisperの処理可能ファイルサイズ上限の25MB以下になるよう分割し、生成された分割テキストを統合。 特に、会議の議事録やインタビューのテキスト化など、長い音声を効率よく処理することを目的としています。
OpenAIのWhisperモデルによる高精度な音声認識と、ChatGPTによる文脈を理解した議事録生成により、 会議内容を正確に、かつ読みやすい形式でドキュメント化します。
議事録作成にかかる時間を大幅に削減し、会議参加者は議論に集中できるようになります。 また、議事録の品質が統一され、重要な決定事項や行動項目の見落としがなくなります。