姿態估計

一種電腦視覺技術,可偵測影像或影片中人體關節與特徵點的位置。

什麼是姿態估計?

姿態估計 (Pose estimation) 是一種電腦視覺技術,能夠在影像或影片串流中識別出人體關節(如肩膀、手肘、手腕、臀部、膝蓋、腳踝)的位置。系統會輸出一組特徵點座標,通常會將其連接成描述人體姿勢的骨架。

在試穿系統中,姿態估計解決的核心問題是:這個人的身體處於什麼姿勢? 得到的答案將決定衣物落下的位置、角度及縮放比例。

覆蓋在照片上的偵測人體骨架
覆蓋在照片上的偵測人體骨架

運作原理

  1. 人物偵測:在畫面中定位出主體人物。
  2. 特徵點預測:透過神經網路預測 17 到 33 個身體關節的座標。
  3. 骨架組裝:將特徵點連接成一個結構,用來追蹤姿勢和肢體角度。
  4. 時間平滑化(僅限影片):跨幀平滑化預測結果,以減少畫面抖動。

在虛擬試穿中的作用

  • 基於圖片的試穿:單張照片的姿態估計能引導衣物轉換,確保袖子貼合手臂,且下擺落在正確的高度。
  • 即時 AR 試穿:每一影格的姿態估計能將 3D 產品(如鞋子、手錶)精準錨定在移動的身體上。
  • 身體測量:關節位置有助於估算3D 人體模型的比例及提供尺寸建議。

如果姿態估計不準確,就會產生錯位問題,例如洋裝垂墜角度錯誤,或是鞋子偏離了雙腳。

常見問答

為您解答疑問。

姿態估計和人體掃描一樣嗎?

不一樣。姿態估計是從一般影像中偵測 2D(或 2.5D)的關節位置;而人體掃描則是建立身體表面的完整 3D 網格,這需要特殊硬體或多角度捕捉技術才能實現。

相關術語

影像分割
一種電腦視覺技術,能將影像精確劃分至像素等級的區塊,例如將人物、服裝與背景分離。
服裝轉換
服裝轉換是將 2D 產品圖上的服裝渲染至人物照片上的 AI 處理過程。
AR 虛擬試穿戴
一種將 3D 產品模型即時疊加到消費者相機畫面上的互動體驗。
3D 人體模型
透過測量數據或照片生成的數位人體網格模型,可自由調整,用於模擬服裝合身度與尺寸建議。

在您自己的產品上查看效果。

只需幾分鐘即可在 Shopify 上安裝 Genlook,讓購物者在購買前預覽產品。