Qwen introduce Qwen-Drive-1.0, un modello vision-language per la guida autonoma
· By Antonio Sedino, CTRO · Published by Reinventy Solutions Corp.
Nuovo modello unisce 3D perception e visual question answering al pretraining stage, estendendo al motion planning mantenendo il VLM pretrainato intatto

Ricercatori di Qwen hanno introdotto Qwen-Drive-1.0, descritto come il primo modello vision-language per la guida autonoma. Il modello unisce 3D perception e visual question answering al pretraining stage e si estende ulteriormente alla motion planning, mantenendo l'architettura VLM pretrainata completamente intatta. Il modello si basa sull'architettura Qwen nativamente multimodale.
