Stanford: Physically Grounded Vision-Language Models for Robotic Manipulationhttps://arxiv.org/abs/2309.02561 by socratic1 • 3 years ago 1 0 3 years agoARarxiv.org