Qwen introduit Qwen-Drive-1.0, modèle foundation vision-langage pour la conduite autonome
· By Antonio Sedino, CTRO · Published by Reinventy Solutions Corp.
Nouveau modèle unifiant la perception 3D et la réponse visuelle à la question lors de l'étape d'apprentissage préalable, s'étendant au plan de mouvement tout en maintenant l'architecture VLM pré-entraînée intacte

Des chercheurs de Qwen ont introduit Qwen-Drive-1.0, décrit comme le premier modèle foundation vision-langage pour la conduite autonome. Le modèle unit la perception 3D et la réponse visuelle à la question lors de l'étape d'apprentissage préalable et étend ensuite au plan de mouvement, tout en maintenant entièrement l'architecture VLM pré-entraînée. Le modèle est construit sur l'architecture Qwen multimodale native.
