合成音声読み上げ時の音声情報理解力を定量化 -視覚障害者一人ひとりに「ちょうどいい」読み上げ速度を提供するために-

2026-09-25 産業技術総合研究所

産業技術総合研究所(産総研)などの研究チームは、視覚障害者がスクリーンリーダーの音声を理解できる適切な読み上げ速度を個人ごとに定量化する手法を開発した。従来は、音声を理解できなかった場合に「文章が難しい」のか「読み上げ速度が速い」のか「利用者の理解能力による」のかを区別することが困難だった。そこで、学力テストなどで用いられる項目反応理論(IRT)とベイズ統計を応用し、文章の難易度と利用者の音声理解能力を共通の尺度で推定した。視覚障害者11人を対象に毎分150~500語の音声を評価したところ、最適速度には大きな個人差があり、全盲者は弱視者より高速でも理解を維持する傾向が確認された。今後は大規模調査を行い、個人に適した読み上げ速度を自動提示する評価ツールの開発を目指す。

合成音声読み上げ時の音声情報理解力を定量化 -視覚障害者一人ひとりに「ちょうどいい」読み上げ速度を提供するために-

<関連情報>

ベイズ項目応答理論を用いた視覚障害者向けスクリーンリーダー利用者の発話速度能力のプロファイリング
Profiling Speech Rate Abilities of Visually Impaired Screen Reader Users by Bayesian Item Response Theory

Takahiro Miura, Masatsugu Sakajiri, Masaki Matsuo, Keiichi Yasu, Junji Onishi, Ken-ichiro Yabu, Tohru Ifukube
Interspeech 2026

1504数理・情報
ad
ad
Follow
ad
タイトルとURLをコピーしました