Meta har offentliggjort en ny artikel, der identificerer, hvorfor forstærkningslæring ofte fejler ved kodeoptimering, og tilbyder en metode til at imødegå disse mangler. Arbejdet kan ændre, hvordan software udvikles, ved at gøre automatisk kodeforbedring mere pålidelig.
Hvorfor forstærkningslæring kæmper med kode
Forstærkningslæring, eller RL, har vist lovende resultater inden for områder som spil og robotteknologi. Men når det kommer til at optimere kode – at få den til at køre hurtigere eller




