En esta página
15.2 14.1.1 Objetivo
Este capítulo establece el contrato geométrico y temporal común para todas las señales de visión artificial de la enciclopedia. Su función es impedir que una posición en píxeles, una profundidad relativa de una red monocular, una coordenada métrica de la cámara y una coordenada de pared se mezclen como si fueran equivalentes.
La representación debe soportar posturas no erguidas, oclusión severa, extremidades cruzadas, rotaciones del tronco, contactos de torso, manos parcialmente cerradas, pies apoyados en cantos pequeños y movimientos fuera del plano de la pared. Los datasets especializados muestran que la escalada necesita recuperar no sólo pose compleja, sino también posición global e interacción con la escena [P41-R7, P41-R8, P41-R9].
15.2.1 Incluido
- Representación corporal 2D y 3D para boulder.
- Compatibilidad con RGB, profundidad estéreo, point cloud y reconstrucción multimodal.
- Convenciones de coordenadas, transformaciones, unidades, tiempo, calidad e incertidumbre.
- Base común para detectar contactos, fases, cinemática y clasificación multietiqueta.
15.2.2 No incluido
- Inferir fuerza real únicamente desde pose.
- Diagnosticar lesión o estado psicológico.
- Declarar contacto funcional sólo por solapamiento 2D.
- Imponer un proveedor o red neuronal específica.