Octopus: Embodied Vision-Language Programmer from Environmental Feedback
Jingkang Yang, Yuhao Dong, Shuai Liu +8 authors
Octopus, a novel vision-language model, integrates multimodal perception and reasoning to perform diverse tasks using GPT-4 and Reinforcement Learning with Environmental Feedback in an experimental environment called OctoVerse.