Responsabilidad · Technology Camp 2026 Facultad de Ingeniería · Universidad Militar Nueva Granada

El puente

Del lenguaje a la acción: dónde la frase se vuelve trayectoria

Una frase equivocada se corrige leyéndola. Una frase equivocada que ya se compiló en una trayectoria se corrige con la pieza rota en la mano.

Auditorio D · Sede Campus Nueva Granada, Cajicá Jueves 10 de septiembre de 2026 3:00 – 4:00 p. m. 5 enfoques de la colección · 54 papers
La frase

«La ejecución de bajo nivel sigue siendo clásica (MoveIt 2, controladores PID): el puente semántico→acción es el cuello de botella.»

awesome-embodied-ai — research-gaps.md, §2: Planificación semántica y agentes robóticos, 2026.

«Low-level execution remains classical (MoveIt 2, PID controllers) — the semantic→action bridge is the bottleneck.»

Tesis

El fallo silencioso de la fase anterior es del robot. Pero encima de la política de control ya no hay solo control: hay un modelo de lenguaje decidiendo qué hacer, y entre lo que ese modelo dice y lo que el actuador ejecuta queda un hueco que nadie ha estandarizado.

Ahí el fallo cambia de naturaleza. Cuando el modelo escribe texto, la salida equivocada la lee una persona y, con suerte, la corrige: una frase se corrige leyéndola. Cuando el modelo está al otro lado del puente, esa misma salida ya es una consigna de movimiento — y la corrección llega después del contacto, con la pieza rota en la mano.

La conclusión de la fase no es tranquilizadora ni catastrofista: el puente no se cierra con un modelo mejor, sino con una capa de verificación. Y esa capa no se entrena — se diseña.

Cinco maneras de tender el puente

Son los cinco enfoques que aparecen en la colección de referencia. Lo revelador no es lo que cada uno logra, sino el límite que cada uno declara — porque ese límite marca dónde queda trabajo.

Intuición Física 07 · Animación Interactiva

El Puente Semántico→Acción: con y sin Capa de Verificación

Una instrucción en lenguaje cruza hacia el actuador. Observa qué ocurre cuando el plan es infactible y no hay nada entre la frase y el movimiento — y qué cambia cuando el filtro de afordancias se interpone.

PLAN: — VERIFICACIÓN: ninguna EN TRÁNSITO
💡
Intuición clave: la capa de verificación no hace al modelo más listo ni elimina la confabulación: la contiene. Con una instrucción factible, ambos puentes se comportan igual — el filtro no estorba. La diferencia aparece justo cuando el plan es plausible y falso, que es el único caso en el que hacía falta.
📄 Base científica: SayCan (Ahn et al., 2022) · Code as Policies (Liang et al., 2022) · Inner Monologue (Huang et al., 2022) · Harness Engineering (2026)
La frontera, 2025–2026

Los cinco enfoques comparten algo más que su límite: ninguno elimina la confabulación. Los cinco la contienen, interponiendo algo verificable entre el lenguaje y el actuador — una afordancia, un código revisable, un plan comprobable, un grafo, un humano en el lazo.

Conviene mirar dónde termina cada uno de esos límites. En SayCan, en lo que alguien anticipó. En Code as Policies, en quien lee el código. En LLM+P, en quien escribe la traducción. En SayPlan, en quien construyó el mapa. En Inner Monologue, en quien cierra el lazo. Los cinco puentes, mirados de cerca, terminan en una persona.

De ahí sale el trabajo de ingeniería de esta fase, y no es investigación en aprendizaje automático: decidir qué se comprueba antes de actuar, contra qué referencia, con qué latencia y qué ocurre cuando la comprobación falla. La fase siguiente pregunta quién responde cuando esa capa no estaba.

Para profundizar

Los cinco enfoques, con la ficha de cada uno en la colección de referencia.

Continuar el recorrido

Paso anterior: 5 · Fallo silencioso — El error que no se anuncia.

Siguiente paso: 7 · El hueco de responsabilidad — Las 3 condiciones de responder.

/ o Espacio para navegar · P modo presentación