Qwen-VLA – 阿里通义推出的通用视觉语言动作具身智能模型

Qwen-VLA是阿里通义实验室推出的通用视觉-语言-动作模型,支持机器人操作、视觉语言导航、轨迹预测和跨本体控制。模型基于Qwen3.5-4B与DiT动作解码器构建,具备多任务学习、动态物体操作和真实环境泛化能力,适用于具身智能与机器人控制场景。

新闻资讯 2026-05-16 PPISO
2 0

文章摘要

Qwen-VLA是阿里通义实验室推出的通用视觉-语言-动作模型,支持机器人操作、视觉语言导航、轨迹预测和跨本体控制。模型基于Qwen3.5-4B与DiT动作解码器构建,具备多任务学习、动态物体操作和真实环境泛化能力,适用于具身智能与机器人控制场景。

特别声明

本文内容由 PPISO 编辑整理发布,仅作为工具选择、资料整理与效率实践参考。涉及第三方网站功能、价格和服务条款时,请以对应官方网站信息为准。

原文链接:http://ainav.ppiso.com/xwzx/3703.html

本文标签

这篇文章暂未设置标签。

相关阅读

暂无相关阅读。

评论交流

暂无评论,欢迎留下你的看法。