Open access
Aug 2026
Large Language Model-Driven Symbolic Planning for Long-Horizon Robotic Manipulation Tasks
VLA-SP (Vision-Language-Action via Symbolic Planning), a two-stage Embodied Vision-Language-Action framework, enabling fully automated robotic execution from speech and vision inputs is proposed, demonstrating the strong interpretability, executability, and cross-platform applicability of the framework.
Hanzhuo Zhang, Jiahao Xu, Yicheng Xu et al.
· Tsinghua Science and Technol... · 0 citations