Alpamayo-R1 - 英伟达开源的带推理能力的视觉-语言-行动模型

作者:Jam 发布时间: December 3, 2025 分类:技术 No Comments

Alpamayo-R1是英伟达研发的具有推理能力的视觉-语言-行动（VLA）模型，专为提升自动驾驶在复杂场景中的决策能力设计。通过引入因果链推理机制，让车辆能像人类驾驶员一样分析场景因果关系（如“因前方有行人需减速”），而非单纯执行预设指令。模型采用多摄像头输入和轻量级编码技术降低计算成本，并通过强化学习优化轨迹规划，实测在长尾场景中使事故风险降低35%。创新点包括结构化因果标注数据集和模块化设计，支持实时推理延迟低于100毫秒。 Alpamayo-R1 - 英伟达开源的带推理能力的视觉-语言-行动模型

>>展开阅读

Jam's Blog II

JamLee.Life 心情演绎

Alpamayo-R1 - 英伟达开源的带推理能力的视觉-语言-行动模型