DiDrive: een risicobewust hiërarchisch diffusieraamwerk voor veilige offline reinforcement learning in autonoom rijden
arXiv:2609.01609v1 Aankondigingstype: nieuw Samenvatting: Hoewel diffusiemodellen multimodale gedragspriors voor autonoom rijden effectief vastleggen, blijven offline reinforcement learning (RL)-beleidsregels gevoelig voor distributieverschuiving, zwaarstaartige risicosignalen, out-of-distribution (OOD) actiegeneratie en hoogdimensionale toestandsredundantie. Om deze uitdagingen aan te pakken stellen we DiDrive voor, een distributiegestuurd offline diffusieraamwerk met twee synergetische componenten: de Risk-Aware Hierar
🔗 lees originele bron