加载中...

人体姿态估计(Human Pose Estimation)指从图像或视频中检测人体关键点(如头、肩、肘、腕、膝等)的位置,并连接成骨架来描述人体姿态的技术,分为二维与三维姿态估计。
多人场景有两类路线:自顶向下方法先检测每个人再逐人估计关键点,精度高但耗时随人数增长;自底向上方法先检测整图所有关键点,再分组归属到个体,代表如 OpenPose 的部件亲和场。热力图回归是关键点定位的主流表示方式,近年基于 Transformer 的方法进一步提升精度。
遮挡、罕见姿态、密集人群和运动模糊是主要难点;三维姿态还面临深度歧义问题。
广泛用于体感游戏与健身指导、动作捕捉与动画制作、运动员技术分析、跌倒检测与康复评估等场景。

登录 后参与讨论
暂无讨论,来发表第一条评论吧