お問い合わせ

音声認識

英語表記
Speech Recognition / ASR
読み
おんせいにんしき
別名
ASR/音声のテキスト化

話し言葉をテキストに変換する技術。通話の可視化や後処理の自動化に使われる。

解説

音声認識は、話し言葉をテキストに変換する技術です。コールセンターでは、通話内容を文字にして扱えるようにすることで、さまざまな活用が可能になります。

文字にして後処理の削減や品質確認に使う

  • 通話内容をテキスト化し、後処理の入力を減らす
  • 全件の通話を文字で検索できるようにし、品質確認や調査に使う
  • 禁句や要説明事項の言い漏れを自動で検出する
  • 応対中に関連するFAQを画面に提示する
  • ボイスボットの入力部分を担う

周囲の騒音や固有名詞の多さが認識精度を下げる

周囲の騒音、回線の音質、話す速度、方言、二重発話が精度に影響します。固有名詞や商品名は誤変換されやすいため、自社の用語を登録できる仕組みがあるかどうかは、選定時の確認点になります。

完璧な文字起こしを前提にすると期待を下回りますが、検索や傾向把握に使うのであれば多少の誤りがあっても実用に耐えます。