Enciclopedia Boulder v1.0

Inicio · Capítulos · 14. Señales para visión artificial

En esta página

15.4 14.1.3 Modelo canónico por capas

El catálogo no depende de una única red. BlazePose produce 33 puntos corporales en tiempo real [P41-R1, P41-R2]; MediaPipe Hands produce 21 landmarks por mano [P41-R3]; OpenPose y COCO utilizan topologías distintas [P41-R10, P41-R13]. Por ello, cada backend se conecta mediante un adaptador al esquema CLIMB-POSE-73F-v1.

15.4.1 Niveles de disponibilidad

Nivel Nombre Requisitos Uso permitido
T0 Core2D single or multi-person track
at least 17 mapped body joints
pixel coordinates
confidence
coarse posture and sequence
T1 ClimbBody33 33 body landmarks
2D
temporal track
body orientation, foot proxies, gross contact candidates
T2 MetricBody33 T1
depth or calibrated 3D lifting
camera/world coordinates
COM path, wall distance, metric velocity
T3 HandDetailed73F T2
21 landmarks for visible hand regions
grip family candidates, match, piano match, regrip
T4 DenseSurface T3
person/shoe/hand masks or body mesh
contact patch, torso/knee/elbow scums, false-contact rejection

Una clasificación puede ejecutarse con un nivel inferior, pero debe reducir su confianza y no puede fabricar señales ausentes. Por ejemplo, T1 puede proponer un candidato a toe hook, pero la orientación fina del empeine y la carga requieren T2–T4.

15.4.2 Conteo canónico