全球首次!镜识科技VIVA实现人机实时四手联弹
镜识科技近日发布灵巧手VIVA,全球首次实现实时人机四手联弹,让机器人从“弹得准”迈向“弹得好”。公司同时宣布完成VIVA × CADA阶段里程碑,机器人音乐智能进入“会创作、能演奏、可持续学习”的新阶段。
VIVA源自拉丁语词根viv,寓意生命,也呼应音乐术语vivace,并致敬《Viva La Vida》。CADA取名自古典音乐术语Cadenza(华彩乐段),象征自由抒发。VIVA × CADA寄寓“Viva cada dia”——享受每一天。
VIVA试图从硬件根源破解力量、速度、灵巧的“不可能三角”。镜识科技以人手为标杆,采集钢琴家演奏数据,提取核心指标,经理论建模与拓扑优化,使复杂手型变换、多指尖协同和精细轨迹控制接近人手能力边界。
在灵巧手领域,功率限制迫使力量与速度权衡,更高自由度又限制单驱动功率。镜识科技通过正向设计应对这一难题。
团队分析人类钢琴家演奏数据,提取设计指标,进行理论建模和拓扑优化。最终,VIVA在复杂手型变换、多指尖配合和精细轨迹控制上达到接近人手的运动边界。
关键在于首创的腱绳-连杆复合式传动系统。腱绳传动将驱动器后置,减轻远端质量,使手指高速运动;机械连杆保证刚度和力传递,支撑指尖大输出;复合传动复现人手关节自然协同,让落键、抬指贴合真人轨迹。
高性能驱动系统使关节转速突破1000°/s,单指指尖峰值力达33N,覆盖完整音量动态范围。快速音阶、颤音、重复音等高难度技法均可稳定实现,为人机实时合奏提供性能保障。
专业钢琴演奏对力量、速度和灵巧提出极端要求。与人类协同演奏的高难度《康康舞曲》,正是攻克灵巧手“不可能三角”的挑战目标。
VIVA × CADA:VIVA是灵巧演奏家,CADA是音乐具身大模型。
让VIVA拥有“思想”的,是镜识科技自研的CADA音乐具身大模型。VIVA是演奏的“身体”,CADA是赋予音乐能力的“大脑”。
CADA打通从音乐理解、创作到具身演奏、反馈学习的闭环:通用大模型理解自然语言指令与音乐意图,音乐生成模型完成旋律和编曲,演奏策略模型将音乐表达转化为指法、触键、力度与时序控制,最终由VIVA在真实钢琴上演奏。
每次演奏都不是终点。系统持续感知声音、动作与表现结果,对比目标与实际效果,进行误差分析和策略调整,形成“创作—演奏—感知—评估—学习”闭环,让同一首曲目越弹越好。
本次演奏的《Viva la Vida:Nueva Vida》由该大模型与人交互生成,机器人自主完成学习与校正,表达属于它的浪漫。
让机械拥有生命,让音乐成为表达。镜识科技表示,VIVA不只是一只弹琴的机械手:当它触碰琴键、控制力度、感受旋律并呈现音乐时,机械开始拥有丰富情绪的表达。
镜识科技认为,音乐高度融合认知、创造、表达与精密操作,是探索大模型与机器人深度融合的理想载体。
通用大模型提供理解、推理与交互能力,场景专用模型将通用智能转化为专业技能,机器人本体负责真实世界执行,持续环境反馈让技能不断进化——这是未来机器人发展的重要方向。
从“理解音乐并弹奏音乐”出发,团队希望最终让机器人具备理解、创造、行动、交互与持续学习的能力。
让机器拥有身体,让身体涌现思想,让思想能被听见。
VIVA × CADA阶段里程碑,让机器人从“执行动作”走向“艺术表达”,推动智能从数字世界走向物理世界。