大型语言模型等基础模型引入了AI新范式:无需数据标注,通过海量数据自监督训练的大模型可学习通用能力。该范式最著名的应用集中在语言、图像和视频生成领域。但这一技术还能应用于何处?
在某机构,答案在于管理机器人集群。今年6月,我们宣布开发出新型基础模型DeepFleet,用于预测物流中心和分拣中心内移动机器人的交互行为。尽管仍需完善,但DeepFleet已能协助分配任务并规避拥堵,使机器人部署效率提升10%,从而实现更快速、低成本的包裹配送。
为何需要基础模型?
尽管清楚机器人的运行算法,但实时模拟数千台机器人的交互需消耗巨额计算资源。相比之下,学习型模型能快速推断交通流模式。我们将位置预测视为预训练任务,如同基于下一词预测训练的聊天机器人能回答多样化问题,基于位置预测的预训练可使AI为移动机器人集群生成通用解决方案。
数据与算力优势
某机构拥有部署超百万台机器人积累的数十亿小时导航数据,同时作为最大云计算服务商,具备训练海量模型的计算能力。研究证实,与其他基础模型类似,机器人集群模型的性能随训练数据量增加持续提升。
架构迁移与挑战
将LLM架构适配于机器人位置预测时,需解决关键问题:输入输出应包含单机器人状态还是整个场地状态?场地如何表征(相对特征/图像/图结构)?时间维度如何处理?
四种实验模型
所有模型均将作业场地建模为网格单元,包含机器人(载货/空载)、障碍物、存储位等元素。模型采用Transformer架构生成输入数据的嵌入表示:
采用动态时间规整距离和拥堵延迟误差两项指标评估:
扩展实验表明,模型性能随训练数据量增加持续提升。目前正推进前三类模型的开发应用,初期用于拥堵预测,长期目标为生成任务分配与目标定位方案。
技术细节详见arXiv完整论文
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系 cloudcommunity@tencent.com 删除。
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系 cloudcommunity@tencent.com 删除。