visAware
面向 NVDA 用户的视觉辅助插件,帮助你阅读书籍插图、浏览社交媒体内容,并协助完成复杂交互。
当前状态
它能做什么
图像描述
为书籍插图、界面截图和社交媒体内容生成文字描述,并支持追问图片细节。
OCR 与数学公式识别
识别图片里的文字、图表或数理化公式等内容,并提供可交互的阅读方式。
协助交互
利用 AI Computer Use 技术,遵循用户指令协助操作计算机,适用于无障碍支持存在缺陷的自绘界面。
示例
以下摘录来自 visAware 对常见图片的描述。完整示例和图片来源见使用场景页。
适合谁
visAware 适合使用 NVDA 屏幕阅读器的视觉障碍用户。
典型场景
别人发来的图片里有什么。
社交媒体上的图片如何理解。
用图片呈现的公式是什么。
未考虑无障碍的自绘界面如何操作。
原则
visAware 由视障者为视障者设计,提供实用功能和便捷的交互体验。