Chaoyu Li 最新论文
Li 等人提出 VideoA11y 方法,利用多模态大模型生成视障友好视频描述,构建包含 4 万条描述的最大数据集,质量媲美人类注释。
https://hci.top/zh/authors/15067?source=all