谷歌 Gemini Live 推出 Guided Vision 辅助功能

手机 驱动中国 陆离 1,235次阅读
分享 微 Q 信
AI摘要
由 AI 生成 · 仅供参考

谷歌近日在 Gemini Live 中推出名为 Guided Vision 的新功能,专为视障及低视力用户设计。该功能允许用户通过语音指令调整手机摄像头角度,并实时获取周围环境描述,从而提升移动设备在无障碍场景下的实用性。

驱动中国10月2日消息,谷歌(Google)正式向 Gemini Live 用户推出名为“Guided Vision”的新功能,旨在为视障及低视力群体提供更高效的视觉辅助体验。该功能通过整合实时语音交互与摄像头视觉识别技术,帮助用户更直观地获取周围环境信息,并指导用户调整拍摄角度以优化识别效果。

据外媒 Android Authority 报道,Guided Vision 的核心价值在于解决视障用户在使用手机摄像头时面临的“看不见”痛点。过去,对于视力受损的用户而言,单纯将手机摄像头对准物体往往难以获得有效反馈,因为设备无法主动告知用户当前画面是否清晰或完整。谷歌在过去一年多的时间里,持续完善 Gemini Live 的视觉引导能力,此前已尝试通过屏幕高亮等方式辅助用户定位物体,而此次推出的 Guided Vision 则标志着该功能正式转向以无障碍为核心的实用工具阶段。

在功能实现上,Guided Vision 允许用户在 Gemini Live 中共享摄像头画面。一旦启用,系统不仅能实时语音描述用户周边的环境状况,还支持用户通过语音提出后续问题,进一步获取细节信息。更为关键的是,该功能具备主动引导能力:当人工智能检测到当前视角不利于准确识别时,会通过语音指令提示用户进行微调,例如“向右平移”、“向下倾斜”或“后退一步”等。这种交互式引导机制显著降低了视障用户操作摄像头的门槛,使其能够更精准地捕捉目标对象。

从兼容性来看,Guided Vision 目前面向运行 Android 9 及更高版本系统的设备开放,但仅限于已支持 Gemini Live 服务的市场地区。这一限制表明,谷歌正在逐步将先进的生成式人工智能能力下沉至移动终端,并优先在具备基础服务条件的区域验证其无障碍应用价值。

此次更新体现了科技巨头在人工智能落地过程中对社会责任的关注。通过将大模型的视觉理解能力与语音交互相结合,谷歌试图打破视障群体在数字生活中的信息壁垒。Guided Vision 不仅是一项技术迭代,更是移动设备无障碍设计从“被动辅助”向“主动交互”转变的典型案例,为后续人工智能在辅助科技领域的应用提供了参考方向。

版权声明:本文由驱动中国整理发布,转载需注明出处与原文链接。如有疑问请联系 editor@qudong.com。
来源:驱动中国 · 原文链接:https://www.qudong.com/article/524909.html
本文价值 ★★★★★ 4 3 人已评
登录后为本文打分
网友评论0 条评论
正在回复 的评论取消
评论加载中…
🔐

登录后参与互动

评论、点赞均可赚积分
连续签到、邀请好友也有奖励 🎁

电脑端: 微信扫码登录 微信内: 一键登录
✎ 我要投稿有独家观点或行业线索?向驱动中国投稿,审核采用后署名发布并获积分奖励。 去投稿 ›

微信扫一扫

打开微信「扫一扫」,分享本文到朋友圈或好友