AI辅助技术弥合明眼人与视障人士之间的差距

AI 有望彻底改变盲人的感知能力与独立性
- 搭载 GPT-4 的 AI 革命性地提升了盲人的感知体验,提供更丰富的细节并增强其独立性。
- Envision 和 Be My Eyes 集成 GPT-4,架起了明眼人与盲人社区之间的桥梁。
- 挑战包括准确性和偏见问题,但 AI 承诺将带来变革性的盲人体验。
通过整合OpenAI的GPT-4,辅助技术服务正在彻底改变视障人士体验世界的方式,为他们提供更丰富的视觉细节和全新的独立性。通过利用人工智能,这些进步旨在弥合明眼人与视障人士社区之间的差距,使视障人士能够通过面部线索和表情与他人建立联系。随着人工智能的不断发展,改变视障人士生活的潜力变得日益令人充满希望。
AI辅助技术的进步
Envision是一款利用OpenAI GPT-4的AI助手,已成为视障人士的一项突破性解决方案。Envision最初于2018年作为智能手机应用推出,随后扩展了功能,包括读取照片中的文本和回答基本问题。现在,随着整合了OpenAI的GPT-4用于图像转文本描述,Envision能够为用户提供关于其周围环境的全面信息。
长期致力于协助盲人用户识别物体的应用Be My Eyes也在今年3月采用了GPT-4。OpenAI的主要投资者微软已开始将其GPT-4整合到其SeeingAI服务中。这些合作反映了业界对AI在彻底改变视障人士导航和理解世界方式方面的巨大潜力的广泛认可。
赋予用户更强的独立性
将AI整合到辅助技术中为视障人士带来了巨大的希望,相比前几代技术有了显著改善。盲人计算机科学家兼无障碍顾问Sina Bahram解释说,结合Be My Eyes和GPT-4带来了数量级上的差异,为用户提供无缝体验,无需具备广泛的技术技能。这些AI驱动系统的新兴能力增强了视障用户的独立性和自信心,使他们能够更有效地与周围环境互动。
虽然AI辅助技术的潜在好处显而易见,但也出现了挑战和伦理考量。科罗拉多大学博尔德分校计算机科学助理教授Danna Gurari对将视障人士置于技术进步前沿既感到兴奋又表示担忧。随着GPT-4等AI模型仍在不断发展,存在信息不完整或不准确的风险。Gurari的研究显示,一些图像转文本模型可能会“幻觉”出信息,向视障用户提供不可靠的细节。这带来了潜在风险,特别是当错误识别物体或药物可能导致危及生命的后果时。
用于训练AI模型的数据集中固有的偏见带来了进一步的挑战。已知AI系统会误判年龄、种族和性别,从而延续现有的社会偏见。Gurari建议将置信度分数整合到AI系统中,以为用户提供更多的透明度和知情决策依据。但是,视障人士认为,尽管AI存在固有的偏见和不完美,他们有权获取与明眼人相同的信息。挑战在于如何在为视障用户提供全面信息的同时,确保信息的准确性和可靠性之间取得平衡。
尽管AI辅助技术无法替代视障人士所需的基本移动技能,但Ask Envision的早期测试用户对其功能印象深刻。然而,仍有一些局限性需要解决。用户希望系统能够阅读乐谱,并提供更详细的空间背景信息,例如房间内物体或人的位置和方向。随着AI的进步,在进一步改变盲人体验方面拥有巨大潜力,为他们提供对周围世界更深刻的理解。
如果您正在阅读这篇文章,说明您已经领先一步。请继续通过我们的通讯保持关注。
免责声明。 本文提供的信息不构成交易建议。 Cryptopolitan.com 对于基于本页信息进行的任何投资,我们不承担任何责任。我们强烈建议在进行任何投资决策之前,进行独立研究或咨询合格的专业人士。

Aamir Sheikh
Aamir 是一位科技记者,在加密货币和科技行业拥有近六年的经验。他毕业于 MAJ 大学,获得金融与市场营销 MBA 学位。目前他在 Cryptopolitan 工作,报道加密货币市场的最新发展和价格预测。
















