2024-01-05
技术前沿
新一代视觉 - 语言 - 动作模型 VLA-2.0 正式发布

中京领航今日正式发布新一代视觉 - 语言 - 动作(Vision-Language-Action)模型 VLA-2.0,该模型在复杂任务理解和执行能力上实现重大突破。
核心技术突破
VLA-2.0 采用先进的多模态融合架构,将视觉感知、语言理解和动作控制统一到一个端到端的模型中。相比前代产品,新模型在以下方面取得显著进步:
多步骤推理能力:能够理解并执行包含多个子任务的复杂指令,自动分解任务并规划执行顺序。
长程规划能力:支持跨时间跨度的任务规划,能够在执行过程中保持对长期目标的追踪。
环境适应性:通过在线学习和迁移学习,快速适应新环境和新任务,减少重新训练成本。
应用场景
VLA-2.0 模型已在中京领航的多款产品中落地应用,包括智能服务机器人、工业自动化系统、智慧物流解决方案等。实测数据显示,采用新模型的系统任务完成率提升 40%,错误率降低 60%。
—— 中京领航技术团队
