这几天在玩大疆的手机云台,产生了一个需求,不知道天坦能否解决

1 小可 1小时前 49次点击

大疆的DJI Mimo 配合云台具备“智能跟随”功能,能够锁定画面中的目标并使其始终保持在屏幕中央,无论目标如何移动,云台都能自动调整角度进行追踪。这一功能极大地解决了视障用户在拍摄视频时难以找准主体的痛点。

然而,“框选目标”这一交互环节本身却构成了新的无障碍障碍。由于缺乏视觉反馈,我们很难通过触摸精准地在屏幕上划定跟随区域,导致该功能难以独立使用。目前来看,唯有 AI 技术能完美破局。

设想一下,如果“天坦”具备此类能力:当屏幕上出现需要框选的操作时,我只需下达语音指令,例如“帮我框选画面中的桌子”,天坦便能自动识别并完成点击操作。这种“言出法随”的体验将彻底消除界面交互的壁垒,让任何页面都不再存在障碍。

好在 DJI Mimo 自带基础的智能跟随逻辑作为替代方案:虽然无法通过手动框选指定特定物体,但它能自动追踪占据画面面积超过 10% 的显著物体。这在一定程度上缓解了操作难题,但仍期待未来能通过 AI 实现更精准、更自由的语音控制跟随。

共 5 条评论
这种技术早就有了,比如老美的自杀无人机,还有我们自己造的某些自杀无人机,就可以自动标目标、自动跟踪。这种技术也不是什么高含量的,当然,如果要无障碍操控的话,,可能还真得靠人工智能
小可 [楼主] 30分钟前
0 
关键是它自动标的目标不一定是你想要的呀。画面里有两个人,它自动标了左边的,但是我想让它以右边那个为主。这个时候还得是手动去矿选。其实,我觉得这东西就跟天坦的点选验证或者滑块验证差不多。
不过这个也存在一个问题,如果是靠计算机的人工智能程序标的话,万一如果你的目标为一辆车,这时候出现很多辆车,你只想标其中一辆,那这时候我们应该
小可 [楼主] 32分钟前
0 
我们应该没有这么高的需求。拍视频也就拍静态的最多,比如说,跟着人拍,跟着动物拍,或者拍桌面。哪怕是有两辆车,你也可以说是左边那一辆,还是右边那一辆。
暖风清吹 4分钟前
0 

你正在路边儿自拍呢,路上一个行人从你旁边走过,他就跟着行人跑了。

添加一条新评论

登录后可以发表评论 去登录