課題
AI関連のセミナーは専門用語や新しい用語が多く、聞き手が話についていけなくなりやすい。
アプローチ
登壇者の音声をリアルタイムに文字にし、専門用語を検出して、画面の横にその意味と解説を表示する。用語の抽出は2段階で行い、検出した用語はライブラリとして蓄積する。
工夫した点
- 音声認識に faster-whisper を使い、ローカルLLMでのオフライン運用にも対応
- 2段階の用語抽出で、解説の精度と速度を両立
- 講演の現場から生まれた道具として、登壇の場でそのまま使える
Works / Domain AI
講演の音声をリアルタイムに認識し、専門用語を自動で解説するツール
AI関連のセミナーは専門用語や新しい用語が多く、聞き手が話についていけなくなりやすい。
登壇者の音声をリアルタイムに文字にし、専門用語を検出して、画面の横にその意味と解説を表示する。用語の抽出は2段階で行い、検出した用語はライブラリとして蓄積する。