開発事例 / 商談のライブ文字起こしと整理
商談をその場で文字にして、終わったら整理まで済ませる
ブラウザのマイクから話し言葉をその場で文字にし、終了後にAIが音声から確定版の文字起こしを作って整理する仕組みを構築。録音の同意確認を組み込んでいる。
※ 顧客名は秘密保持のため非公開です。業種・課題・実装範囲・運用状況は実際の案件どおりに記載しています。
相談のきっかけ
商談の内容を後から思い出して書くため、記録が薄くなり、担当者によって粒度が揃わなかった。
この案件の中身
- 運用状況
- 実運用中(2026年9月時点)
- 対象業務
- 商談中のリアルタイム文字起こし、終了後の確定文字起こしと整理、記録の保存
- 導入前の手間
- 商談が終わってから記憶をたどって記録を書いていたため、時間が経つほど内容が薄くなっていた。担当者によって書く粒度も違い、あとで見返しても状況が掴みにくかった。
- 実装した範囲
-
- —ブラウザのマイクから、話している内容をその場で画面に表示(一時停止・再開・終了に対応)
- —表示された文章をその場で手直しでき、コピーやテキスト保存もできる
- —元の音声を保存し、終了後にAIが音声から確定版の文字起こしを作る
- —確定版をもとに、聞き取りの誤りを整理して読める形にする
- —録音の同意確認を組み込み、同意なしには始まらない
- —マイクが許可されない・認識が止まる・対応していないブラウザ、それぞれの場合に何が起きているかを画面に出す
- 確認できている成果
-
- —商談中に画面で文字を見ながら進められるようにした
- —終了後にAIが音声から確定版を作り、聞き取りにくかった部分を補える形にした
- 開発期間・体制
- まずリアルタイム表示だけを作って使ってもらい、確定文字起こしと整理はあとから足した
- 費用目安
- 月額2万〜5万円(税別)。既存のCRMや社内システムへ書き込む場合は個別見積
- 対応できない条件
-
- —複数人が同時に話す場面や、騒がしい環境では精度が落ちる
- —対応するブラウザが限られる(ChromeとEdgeを想定)
- —録音の同意は仕組みで確認するが、同意を得る運用そのものは会社側で決める必要がある
- 今つくる場合の構成
- 音声認識、Gemini、GPT、ブラウザマイク、フルスクラッチ開発
同じような相談をお持ちの方へ
この事例と近い状況であれば、上の「対応できない条件」に当てはまらないかを確認したうえで、同じ範囲を初期費用0円・月額制で作れます。稼働するまで課金は始まりません。まず状況を聞かせてください。