How Can Reinforcement Learning Achieve Expert-Level [Chip] Placement?a month agohttps://arxiv.org/abs/2604.25191芯片布局在物理设计中至关重要,但专注于线长优化的基于强化学习的方法通常难以达到专家级的布局质量。奖励设计被认为是性能与专家水平存在差距的主要原因。该方法通过学习专家布局直接推导出奖励模型,从而绕过了形式化复杂过程的需要。它从最终专家布局中推断出逐步的专家轨迹。更多...