Enciclopedia Boulder v1.0

Inicio · Capítulos · 14. Señales para visión artificial

En esta página

15.142 14.6.1 Objetivo

Clasificar episodios de escalada mediante una representación jerárquica, multietiqueta, composicional y abierta, diferenciando movimientos cercanos con evidencia física y temporal, probabilidades calibradas, rechazo explícito y revisión humana.

Las secciones 14.1–14.5 construyeron pose, escena, contactos/carga, fases y características cinemáticas. Esta sección define cómo convertir ese conjunto de evidencia en hipótesis de movimiento, cómo diferenciar entidades cercanas y cuándo el sistema debe rechazar, conservar un conjunto ambiguo o pedir revisión.

Un estudio reciente de boulder clasificó siete etiquetas de movimiento por frame usando pose 2D y un Transformer sobre 71 videos; demuestra viabilidad inicial, pero su espacio pequeño y cerrado no valida por sí mismo una ontología de 310 movimientos [P46-R1]. Los datasets CIMI4D, AscendMotion/ClimbingCap y The Way Up aportan pose global, interacción humano–escena y uso de presas, pero tampoco ofrecen etiquetas completas para esta taxonomía [P46-R21, P46-R22, P46-R23].

Por ello, esta entrega es una especificación de clasificación, no una afirmación de exactitud entrenada. Cada etiqueta queda vinculada a su ficha canónica y marcada como OntologyReady_EmpiricalDatasetRequired.

15.142.1 Incluido

15.142.2 Fuera de alcance