ニュース紹介
「合成音声読み上げ時の音声情報理解力を定量化~視覚障害者一人ひとりに「ちょうどいい」読み上げ速度を提供するために~」
産業技術総合研究所の三浦貴大上級主任研究員、筑波技術大学の坂尻正次教授、東京大学先端科学技術研究センターの藪謙一郎特任研究員らは、スクリーンリーダー(パソコンやスマートフォンの文字情報を、速度を調整できる合成音声で読み上げるソフトウエア)を使う視覚障害者の音声理解力を定量化する手法を開発しました。項目反応理論を応用し、読み上げられた文章が理解できなかったときに、その原因が文章の難しさにあるのか読み上げ速度が速すぎたことにあるのかを区別して、文章の難易度と利用者の理解能力を同じ指標で表します。
この手法により、全盲の利用者は弱視(ロービジョン)の利用者に比べ、より速い読み上げ速度でも高い理解を保つことが明らかになりました。研究グループは、得られた基盤データから個人差や習熟の過程、能力向上の可能性を評価し、「速すぎて聞き取れない」「遅すぎてもどかしい」といった不便の軽減につなげたいとしています。成果は、2026年9月27日から10月1日にオーストラリア・シドニーで開かれる音声処理の国際会議「Interspeech 2026」で発表される予定です(論文題目:Profiling Speech Rate Abilities of Visually Impaired Screen Reader Users by Bayesian Item Response Theory)。
出典:科学技術振興機構(JST) 2026年9月25日 プレスリリース
https://www.jst.go.jp/pr/announce/20260925/index.html



