Caption: Generating Informative Content Labels for Image Buttons Using Next-Screen Context

モバイルアプリの画像ボタンに不足しがちなコンテンツラベルを、次画面の文脈情報を活用したLLMで自動生成するシステムCaptionを提案する論文。スクリーンリーダーによるアクセシビリティ向上を目的とする。

スクリーンリーダー, モバイル, 代替テキスト・alt, 生成AI