> 数据图表我想了解一下给定程序图和设备耦合图的量子比特分配问题示意图2026-5-1耦合图进行图神经网络编码,并在逐步分配过程中输出可行动作的掩码策略。奖励函数不在每一步立即反馈,而是在完整映射生成后根据由当前布局导致的SWAP 数量计算。这样,策略网络学习的是从线路结构和设备拓扑中概括出的布局启发式,而不是固定规则。国泰海通综合其他