開発事例 / 商談のライブ文字起こしと整理

商談をその場で文字にして、終わったら整理まで済ませる

ブラウザのマイクから話し言葉をその場で文字にし、終了後にAIが音声から確定版の文字起こしを作って整理する仕組みを構築。録音の同意確認を組み込んでいる。

※ 顧客名は秘密保持のため非公開です。業種・課題・実装範囲・運用状況は実際の案件どおりに記載しています。

相談のきっかけ

商談の内容を後から思い出して書くため、記録が薄くなり、担当者によって粒度が揃わなかった。

この案件の中身

運用状況
実運用中(2026年9月時点)
対象業務
商談中のリアルタイム文字起こし、終了後の確定文字起こしと整理、記録の保存
導入前の手間
商談が終わってから記憶をたどって記録を書いていたため、時間が経つほど内容が薄くなっていた。担当者によって書く粒度も違い、あとで見返しても状況が掴みにくかった。
実装した範囲
  • —ブラウザのマイクから、話している内容をその場で画面に表示(一時停止・再開・終了に対応)
  • —表示された文章をその場で手直しでき、コピーやテキスト保存もできる
  • —元の音声を保存し、終了後にAIが音声から確定版の文字起こしを作る
  • —確定版をもとに、聞き取りの誤りを整理して読める形にする
  • —録音の同意確認を組み込み、同意なしには始まらない
  • —マイクが許可されない・認識が止まる・対応していないブラウザ、それぞれの場合に何が起きているかを画面に出す
確認できている成果
  • —商談中に画面で文字を見ながら進められるようにした
  • —終了後にAIが音声から確定版を作り、聞き取りにくかった部分を補える形にした
開発期間・体制
まずリアルタイム表示だけを作って使ってもらい、確定文字起こしと整理はあとから足した
費用目安
月額2万〜5万円(税別)。既存のCRMや社内システムへ書き込む場合は個別見積
対応できない条件
  • —複数人が同時に話す場面や、騒がしい環境では精度が落ちる
  • —対応するブラウザが限られる(ChromeとEdgeを想定)
  • —録音の同意は仕組みで確認するが、同意を得る運用そのものは会社側で決める必要がある
今つくる場合の構成
音声認識、Gemini、GPT、ブラウザマイク、フルスクラッチ開発

同じような相談をお持ちの方へ

この事例と近い状況であれば、上の「対応できない条件」に当てはまらないかを確認したうえで、同じ範囲を初期費用0円・月額制で作れます。稼働するまで課金は始まりません。まず状況を聞かせてください。

関連する事例

導入事例の一覧に戻る 料金の考え方