シェアされたアックリップです。

arXiv

モバイルアプリの画像ボタンに不足しがちなコンテンツラベルを、次画面の文脈情報を活用したLLMで自動生成するシステムCaptionを提案する論文。スクリーンリーダーによるアクセシビリティ向上を目的とする。