Enciclopedia Boulder v1.0

Inicio · Capítulos · 14. Señales para visión artificial

15.184 14.7.10 Protocolo por capas

Capa Regla operativa
Escena Anotar una sceneRevision preferentemente sin atleta; trackear visibilidad durante el intento; separar clase, instancia, superficie y semántica de ruta.
Pose Usar keypoints y regiones con estado de visibilidad; no inventar 3D métrico cuando calibración o profundidad son inválidas.
Contacto Crear candidatos por región–objeto; separar touch, onset de carga, soporte, sliding y release.
Fases Anotar lanes y eventos antes de etiquetas globales; almacenar onset/offset como intervalos cuando sea necesario.
Cinemática Generar por receta reproducible; el humano revisa artefactos y validez, no dibuja jerk o velocidad a mano.
Movimiento Aplicar jerarquía y ficha canónica; permitir multietiqueta, candidatos y unknown.
Fallo Exigir consecuencia observable y diagnóstico diferencial; no inferir intención sólo por resultado.

Los datasets CIMI4D, ClimbingCap y The Way Up muestran la utilidad de combinar interacción humano–escena, posición global, identidad/uso de presas, orden, tiempo y oclusión [P46-R21, P46-R22, P46-R23]. El contrato aquí propuesto añade la procedencia y la separación de capas necesarias para auditar esas señales.