BrailleBench: Investigating Multi-Criteria Braille Comprehension in Large Language Models

LLMのブレイル文字理解を評価するベンチマーク。視覚障害者・盲ろう者がLLMを同じ機能で利用できるか検証。6つのLLM評価では、英語とブレイルのアクセシビリティギャップが存在し、特にブレイル2等級の入力側で問題が顕著。

視覚障害, 生成AI, テスト・検証, 支援技術