谷歌新推Guided Vision功能,助你读懂细则
1 小时前 1 阅读来源:The Verge AI

AI 中文改写
原文为英文,由 AI 改写为中文报道,内容完整。如需参考原文请点击下方链接
谷歌正在把AI视觉辅助能力推向更日常的使用场景。其最新功能Guided Vision(引导视觉)已从今天起在Gemini Live中上线,兼容的安卓设备用户可以直接调用。简单来说,用户只需在Gemini Live中共享手机摄像头画面,谷歌的AI就能对镜头对准的任何东西进行实时语音描述——包括朗读细小文字、描述周围环境、寻找或识别身边的物体,以及讲解某个具体物品的细节。这一功能与苹果此前在iPhone和Vision Pro上推出的VoiceOver Live Recognition(旁白实时识别)思路类似,主要面向视障人士、低视力人群,以及在某些场景下需要额外辅助的普通用户。除了Gemini应用本身,Guided Vision还将在更多入口开放。
这项功能的推出,背后是谷歌和苹果在AI辅助无障碍领域的新一轮角力。过去,视障用户依赖读屏软件和人工协助来理解周围环境,而多模态大模型的成熟让“用摄像头当眼睛”成为可能。对跨境电商卖家和出海从业者来说,这一趋势也值得留意:一方面,AI实时识别文字和物体的能力,未来可能被集成到选品、比价、验货等环节,比如快速读取海外商品包装上的小字说明或标签信息;另一方面,Gemini Live的摄像头共享意味着AI助手正从“对话工具”变成“环境感知工具”,这对依赖视觉信息的电商运营、海外仓管理、直播带货等场景都可能带来新的效率提升空间。目前该功能仅限部分安卓设备,iOS用户还需等待,但可以预见,视觉辅助类AI功能将成为各大平台下一阶段的标配。
这篇文章对你有帮助吗?
觉得有用?分享给更多人
留言 · 0 条
暂无留言,来说两句吧
