Reinventy Solutions Corp. · Technology intelligencePrivate control
ReinventyHERALD
Evidence-led daily edition
← Front pageAutonomy

Qwen introduit Qwen-Drive-1.0, modèle foundation vision-langage pour la conduite autonome

· By Antonio Sedino, CTRO · Published by Reinventy Solutions Corp.

Nouveau modèle unifiant la perception 3D et la réponse visuelle à la question lors de l'étape d'apprentissage préalable, s'étendant au plan de mouvement tout en maintenant l'architecture VLM pré-entraînée intacte

Qwen-Drive-1.0: An Initial Step towards a Vision-Language Foundation Model for Autonomous Driving

Des chercheurs de Qwen ont introduit Qwen-Drive-1.0, décrit comme le premier modèle foundation vision-langage pour la conduite autonome. Le modèle unit la perception 3D et la réponse visuelle à la question lors de l'étape d'apprentissage préalable et étend ensuite au plan de mouvement, tout en maintenant entièrement l'architecture VLM pré-entraînée. Le modèle est construit sur l'architecture Qwen multimodale native.

Read the original source at Qwen Research ↗