活用ガイド|Discordの文字起こし

Discordの会話を、話者ごとに分けて文字にする。

Discord VCの会話を文字起こしするBotをお探しの方向けのガイドです。誰の発言かが明確に分かれた文字起こしデータを、実用的な会議記録として活用する手順を解説します。

推測に頼らない、話者ごとの文字起こしの仕組み。

一般的な議事録ツールでは、1つの混ざり合った音声ファイルからAIが話者を推測するため、誤判定が起きやすい課題があります。一方、Discordはユーザーごとに独立した音声ストリームを受信できる仕組みを備えています。Gresonaはこの構造を活用し、音声をユーザー単位で直接文字起こしするため、発言が最初から話者ごとに分かれます。

文字起こしテキストは長文になりやすいため、AIによる要約・決定事項・TODOの抽出も同時に行います。全文を読み返さなくても、会議の要点を瞬時に把握できます。

文字起こしと活用のステップ

  1. BotがVCに参加して音声を受信

    「録音開始」を押すとBotがボイスチャンネルに参加し、参加者それぞれの音声ストリームを個別に取得します。

  2. 録音中から確定した発言をリアルタイム表示

    会議画面上では、録音の進行に合わせて確定した発言から順次文字起こしテキストが表示されます。

  3. 録音停止時に全文が確定・AI要約を生成

    録音を停止すると文字起こしの全文が確定し、続けてAIによる要約・決定事項・TODOが自動生成されます。

  4. キーワード検索やテキスト出力で活用

    文字起こしデータは発言者やキーワードで横断検索できるほか、テキストファイル形式での一括ダウンロードが可能です。

話者別の文字起こし画面

発言ごとに話者名とタイムコードが記録され、前後の会話の流れをスムーズに追跡できます。

文字
起こし
  1. たく 22:15

    QAの残件が3つあるので、木曜リリースは危ないと思う

  2. さき 22:17

    課金まわりだけ切り離せば、来週頭に出せます

  3. れん 22:19

    じゃあ課金は次のスプリントに回して、月曜の朝に判断で

ご利用にあたっての留意点

  • 対応している言語は日本語です。
  • 音声認識エンジンの特性上、極度の早口やマイク環境のノイズ、重なった発言などは正しく認識されない場合があります。
  • 1つのDiscordアカウントを複数名で共有して発言した場合、システム上は同一の話者として記録されます。
  • 録音を開始する際は、事前に参加者全員へ録音の旨を共有してください。

よくある質問

文字起こしを、録音中に見られますか?

はい、リアルタイムで確認可能です。録音中も確定した発言から順次、会議画面にテキストが表示されます。

文字起こしをファイルで保存できますか?

はい。文字起こしの全文テキストをテキストファイル(.txt)形式でダウンロードいただけます。

音声認識には何を使っていますか?

Google Cloud Speech-to-Text エンジンを採用し、日本語音声の文字起こしを行っています。

次の会議から、誰が何を話したかを話者別に記録。

Googleで無料で始める 14日間・合計60分まで無料 料金を見る