5 小可 3周前 151次点击
大疆的DJI Mimo 配合云台具备“智能跟随”功能,能够锁定画面中的目标并使其始终保持在屏幕中央,无论目标如何移动,云台都能自动调整角度进行追踪。这一功能极大地解决了视障用户在拍摄视频时难以找准主体的痛点。
然而,“框选目标”这一交互环节本身却构成了新的无障碍障碍。由于缺乏视觉反馈,我们很难通过触摸精准地在屏幕上划定跟随区域,导致该功能难以独立使用。目前来看,唯有 AI 技术能完美破局。
设想一下,如果“天坦”具备此类能力:当屏幕上出现需要框选的操作时,我只需下达语音指令,例如“帮我框选画面中的桌子”,天坦便能自动识别并完成点击操作。这种“言出法随”的体验将彻底消除界面交互的壁垒,让任何页面都不再存在障碍。
好在 DJI Mimo 自带基础的智能跟随逻辑作为替代方案:虽然无法通过手动框选指定特定物体,但它能自动追踪占据画面面积超过 10% 的显著物体。这在一定程度上缓解了操作难题,但仍期待未来能通过 AI 实现更精准、更自由的语音控制跟随。
积分:761
你正在路边儿自拍呢,路上一个行人从你旁边走过,他就跟着行人跑了。
这种功能还是跟手机厂商反馈吧,安卓这边第三方软件都没办法调用MPU,都没有统一的API,现在离线文字OCR都是靠CPU软件算的,大概率安卓平台未来十几20年读屏都没办法拥有本地的agent
那你可能要等一辈子了,这种事情苹果华为都好做,哪怕苹果华为没有第三方读屏,第三方相机开发者也是可以做类似的无障碍支持调用本地NPU的,就安卓不行。