快速发布求购| | | | | 加微群|
关注我们
本站客户服务

线上客服更便捷

仪表网官微

扫一扫关注我们

|
客户端
仪表APP

安卓版

仪表手机版

手机访问更快捷

仪表小程序

更多流量 更易传播


您现在的位置:仪表网>通信测试>资讯列表>沈阳自动化所在大模型赋能“感-通-算-控”协同优化研究方面取得进展

沈阳自动化所在大模型赋能“感-通-算-控”协同优化研究方面取得进展

2026年07月10日 11:57:48 人气: 13595 来源: 中国科学院沈阳自动化研究所
  【仪表网 研发快讯】工业信息物理系统(Cyber-Physical Systems, CPS)是感知、通信、计算、控制(简称 S3C)深度耦合的复杂系统,广泛支撑智能制造、工业机器人集群、边缘智能等核心场景。当前该类系统普遍存在高维状态空间、非凸优化目标、局部观测受限等痛点:传统独立优化策略难以实现四域全局协同;常规多智能体强化学习(MADRL)缺乏先验知识引导,探索效率低下,极易收敛至局部最优,难以满足工业场景低时延、高精度控制需求。
 
  针对上述瓶颈,中国科学院沈阳自动化研究所工业控制网络与系统研究室科研团队,提出大语言模型(LLM)增强的多智能体迁移强化学习算法框架 LLMPT-MADRL,充分挖掘大模型语义推理、先验知识输出能力,提升多维度协同优化性能。相关成果近期发表于IEEE/CAA Journal of Automatica Sinica。
 
  科研团队将“感-通-算-控”联合优化问题建模为部分可观察马尔可夫决策过程,设计了包含LLM模块、MADRL模块和策略选择模块的算法架构。其中,LLM模块通过提示词输出优质指导策略;MADRL模块采用Actor-Critic结构完成策略优化;策略选择模块依靠概率机制动态融合两类输出,实现训练阶段策略平滑切换。同时,他们还设计了自适应迁移损失函数,以解决LLM与强化学习网络规模异构问题,保障知识有效迁移。科研团队以降低系统时延与控制误差为目标,对采样系数、通信带宽、计算频率、控制输入等“感-通-算-控”开展联合优化仿真,选取MADDPG、MATD3、MAPPO作为对比基线,采用集中训练、分布式执行模式完成验证。
 
  研究结果表明,LLMPT-MADR各项指标均优于传统多智能体算法,相比基线方法综合奖励提升16.8%,系统时延降低24.5%,控制误差减少10.4%。证明了大模型可加速策略学习,抑制策略波动,显著提升系统稳定性与控制效果。
 
  相关成果以LLM-Enhanced Multi-Agent Transfer Reinforcement Learning for Sensing, Communication, Computing, and Control Co-Optimization in Cyber-Physical Systems为题发表,硕士生张俊远为论文第一作者,许驰研究员为通讯作者。该研究得到了国家自然科学基金项目、辽宁省科技计划项目和辽宁省“兴辽英才”计划项目的支持。
 
  引用:沈阳自动化所在大模型赋能“感-通-算-控”协同优化研究方面取得进展  中国科学院沈阳自动化研究所 【2026年7月10日】
全年征稿/资讯合作 联系邮箱:ybzhan@vip.qq.com
版权与免责声明
1、凡本网注明"来源:仪表网"的所有作品,版权均属于仪表网,未经本网授权不得转载、摘编或利用其它方式使用上述作品。已经本网授权使用作品的,应在授权范围内使用,并注明"来源:仪表网"。违反上述声明者,本网将追究其相关法律责任。
2、本网转载并注明自其它来源的作品,目的在于传递更多信息,并不代表本网赞同其观点或证实其内容的真实性,不承担此类作品侵权行为的直接责任及连带责任。其他媒体、网站或个人从本网转载时,必须保留本网注明的作品来源,并自负版权等法律责任。
3、如涉及作品内容、版权等问题,请在作品发表之日起一周内与本网联系,否则视为放弃相关权利。
4、合作、投稿、转载授权等相关事宜,请联系本网。
联系我们

客服热线: 0571-87759942

加盟热线: 0571-87756399

媒体合作: 0571-87759945

投诉热线: 0571-87759942

关注我们
  • 下载仪表站APP

  • Ybzhan手机版

  • Ybzhan公众号

  • Ybzhan小程序