姿態估計
一種電腦視覺技術,可偵測影像或影片中人體關節與特徵點的位置。
什麼是姿態估計?
姿態估計 (Pose estimation) 是一種電腦視覺技術,能夠在影像或影片串流中識別出人體關節(如肩膀、手肘、手腕、臀部、膝蓋、腳踝)的位置。系統會輸出一組特徵點座標,通常會將其連接成描述人體姿勢的骨架。
在試穿系統中,姿態估計解決的核心問題是:這個人的身體處於什麼姿勢? 得到的答案將決定衣物落下的位置、角度及縮放比例。

運作原理
- 人物偵測:在畫面中定位出主體人物。
- 特徵點預測:透過神經網路預測 17 到 33 個身體關節的座標。
- 骨架組裝:將特徵點連接成一個結構,用來追蹤姿勢和肢體角度。
- 時間平滑化(僅限影片):跨幀平滑化預測結果,以減少畫面抖動。
在虛擬試穿中的作用
- 基於圖片的試穿:單張照片的姿態估計能引導衣物轉換,確保袖子貼合手臂,且下擺落在正確的高度。
- 即時 AR 試穿:每一影格的姿態估計能將 3D 產品(如鞋子、手錶)精準錨定在移動的身體上。
- 身體測量:關節位置有助於估算3D 人體模型的比例及提供尺寸建議。
如果姿態估計不準確,就會產生錯位問題,例如洋裝垂墜角度錯誤,或是鞋子偏離了雙腳。
常見問答
為您解答疑問。
姿態估計和人體掃描一樣嗎?↓
不一樣。姿態估計是從一般影像中偵測 2D(或 2.5D)的關節位置;而人體掃描則是建立身體表面的完整 3D 網格,這需要特殊硬體或多角度捕捉技術才能實現。
相關術語