姿态估计

一种通过图像或视频检测人体关节与关键点位置的计算机视觉技术。

什么是姿态估计?

**姿态估计(Pose estimation)**是一种计算机视觉技术,用于识别图像或视频流中人体关节(肩膀、手肘、手腕、臀部、膝盖、脚踝)的位置。其输出结果是一组关键点坐标,这些坐标通常会连接成一个描述人物姿势的骨架。

在虚拟试穿系统中,姿态估计回答了“这个身体的姿势是怎样的?”这一问题。该答案决定了服装的落点、角度和缩放比例。

在照片上叠加显示检测到的人体骨架
在照片上叠加显示检测到的人体骨架

工作原理

  1. 人物检测:在画面中定位目标人物。
  2. 关键点预测:神经网络预测17至33个人体关节的坐标。
  3. 骨架组装:将关键点连接成一个跟踪姿势和肢体角度的结构。
  4. 时间平滑(仅限视频):在多个帧之间平滑预测结果以减少抖动。

在虚拟试穿中的作用

  • 基于图像的试穿:单张照片的姿态估计能够引导服装迁移,确保衣袖贴合手臂,下摆高度准确。
  • 实时AR试穿:逐帧姿态估计将3D商品(如鞋子、手表)锚定在运动的身体上。
  • 身体测量:关节位置有助于为3D人体模型和尺码推荐评估身材比例。

不准确的姿态估计会导致错位:如裙子倾斜角度错误,或者鞋子偏离脚部。

常见问题

常见问题解答。

姿态估计和人体扫描是一回事吗?

不是。姿态估计是通过普通图像在2D(或2.5D)空间中检测关节位置。而人体扫描则是构建人体表面的完整3D网格,这需要专门的硬件或多角度拍摄。

相关术语

图像分割
一种计算机视觉技术,可将图像精确划分至像素级区域,例如区分出人物、衣物及背景。
服装迁移
利用 AI 技术将产品照片中的服装逼真地渲染到人物图像上的整个过程。
AR 虚拟试穿
一种实时互动体验,可将 3D 产品模型叠加到购物者的实时摄像头画面中。
3D人体模型
一种可调整的人体数字化网格模型,根据测量数据或照片生成,用于模拟服装的合身度及推荐尺码。

在您自己的产品上查看效果。

只需几分钟即可在 Shopify 上安装 Genlook,让顾客在购买前预览上身效果。