← terug naar overzicht

Anthropic schaalt Claude-infrastructuur op met een Lambda-deal van 35 miljard dollar

analyse 📅 2026-09-03
arXiv:2609.01609v1 Aankondigingstype: nieuw Samenvatting: Hoewel diffusiemodellen effectief multimodale gedragspriors voor autonoom rijden vastleggen, blijven offline reinforcement learning (RL)-beleidsregels gevoelig voor distributieverschuiving, zwaarstaartige risicosignalen, out-of-distribution (OOD) actiegeneratie en hoogdimensionale toestandsredundantie. Om deze uitdagingen aan te pakken, stellen we DiDrive voor, een distributiegestuurd offline diffusieraamwerk met twee synergetische componenten: de Risk-Aware Hierar...

🔗 lees originele bron