Hoved Streamingtjenester AI lærer å jukse på Q * bert på en måte som ingen mennesker har gjort før

AI lærer å jukse på Q * bert på en måte som ingen mennesker har gjort før



En AI har klart å jukse med det beste menneskeheten har å tilby etter å ha oppdaget en utnyttelse i det klassiske arkadespillet Q * bert og kjørt med det.

Mens tidligere iterasjoner av AI ville spille Q * bert riktig, oppdager det på et tidspunkt i sin læring av hvordan spillet fungerer, en utnyttelse som lar det samle vanvittige poeng. Naturligvis, som en hvilken som helst poengjaktende spiller, gjentar den prosessen slik at den kan øke poengsummen på den mest effektive måten.

Du kan se AI arbeide seg rundt plattformer i videoen nedenfor. Først ser det ut som om det hopper uten mål mellom plattformene. I stedet for å se spillet gå videre til neste runde, blir Q * bert sittende fast i en løkke der alle plattformene begynner å blinke - det er her AI kan deretter gå på en score-vanvidd og samle enorme poeng.

LES NESTE: En av de mest kontroversielle spillplatene er endelig blitt diskreditert

hvordan du slår på personlig hotspot

Hvordan AI vant Q * bert-krigen

Han slo rekorden om tittelen hele tiden, og AI fikk en umulig høy poengsum takket være utviklingsstrategi-algoritmeprogrammering. Evolusjonsstrategier (ES) skiller seg fra den vanlige forsterkningslæringen (RL) som tradisjonell AI bruker, da den blir sett på som mer skalerbar på grunn av generasjonslæring.

Hver læringssløyfe blir referert til som en generasjon og den fortsetter sin oppgave til en angitt betingelse er oppfylt (i dette tilfellet en høy score). For hver påfølgende generasjon absorberer AI kunnskapen fra den forrige generasjonen og er derfor bedre til å oppnå det samme målet og overgå det. Fortsett, og du vil ende opp med en AI som er helt uovertruffen i sin oppgave. Det var akkurat det som skjedde her med Q * bert-poengsummen.

Skissert i avisen , publisert forrige uke av forskere ved universitetet i Freiburg, Tyskland, ser det ut til at feilen ikke var en kjent mengde. Faktisk, selv om de ikke er så overrasket over å finne feilen, er det interessant å se hvordan AI deretter gikk videre og lærte å utnytte den hver gang den spilte for å maksimere poengpotensialet.

LES NESTE: Denne kunstige intelligensen har lært å mestre Super Mario Bros

For å finne feilen måtte agenten først lære å fullføre det første nivået - dette ble ikke gjort med en gang, men ved å bruke mange små forbedringer, forklarte forskerne til Registeret . Vi mistenker at en av avløsningsløsningene på et tidspunkt under opplæringen møtte feilen og fikk en mye bedre poengsum sammenlignet med søsknene, som igjen økte sitt bidrag til oppdateringen - vekten var den høyeste i det vektede gjennomsnittet. Dette sakte flyttet løsningen inn i rommet der flere og flere avkom begynte å møte den samme feilen.

Vi kjenner ikke de nøyaktige forholdene der feilen vises; det er mulig at det bare vises hvis agenten følger et mønster som virker suboptimalt, [for eksempel når agenten kaster bort tid, eller til og med mister et liv]. Hvis det var tilfelle, ville det være ekstremt vanskelig for standard RL å finne feilen: Hvis du bruker trinnvise belønninger, lærer du strategier som raskt gir litt belønning, i stedet for læringsstrategier som ikke gir mange belønninger på en stund og så plutselig vinne stort.

Se relatert Dragster-mester Todd Rogers har nettopp mistet kronen etter 35 år Denne kunstige intelligensen har lært å mestre Super Mario Bros 1-2 i 17 dager Se denne AI lære å kjøre i GTA V på Twitch

Til tross for botens fantastiske resultater sier forskerne imidlertid ikke at dette er en sak for å forkjempe ES-læring over RL. Faktisk har begge systemene sine egne problemer, og en kombinasjon av de to blir i stor grad sett på som det beste alternativet fremover.

Den samme ES-metoden på andre Atari-spill førte ikke til nær de samme positive resultatene. På den annen side er RL ansvarlig for å knuse rekorder til venstre, høyre og sentrum, inkludert å slå verdens beste GO-spiller. ES har fortsatt sin egen plass i ting skjønt, og det er faktisk hvordan Nvidia utfører mye av sin AI-trening på grunn av at det krever mer beregningskraft, men å oppnå bedre resultater over lengre tid.

Uansett hvilken vei som vil bli fremtiden for AI-utvikling, er i det minste denne bot-juksingen ikke så ille som denne nå vanæret videospill verdensmester .

Interessante Artikler

Redaksjonens

Dekorer Windows 10 til jul og nyttår
Dekorer Windows 10 til jul og nyttår
Det er på tide å dekorere Windows 10 Desktop for feiring av jul og det kommende nyttåret. De fleste dekorerer husene sine med et juletre, opplyste kanker, snømenn og andre figurer. Hvis du også vil få PCen din i julefeiringen, har vi et sett med veldig spesielle godbiter for deg.
Hva du skal gjøre hvis det ikke kommer lyd fra Vizio TV-en
Hva du skal gjøre hvis det ikke kommer lyd fra Vizio TV-en
Vizio er et TV-merke som dukket opp i 2002 og raskt ble en stor aktør på det innenlandske TV-markedet. Selv om selve TV-ene er laget på lisens i Kina, er Vizio selv basert i Irvine, California, og
Kan du legge PC-en din på teppe – er den bra eller dårlig? [Forklart]
Kan du legge PC-en din på teppe – er den bra eller dårlig? [Forklart]
Hvordan laste ned en TikTok til MP3
Hvordan laste ned en TikTok til MP3
Alle elsker å lage og dele videoer på nettet med TikTok, spesielt de med engasjerende musikk og vokal. Hvis du vil lagre lyden fra TikTok-videoer, hjelper det å konvertere den til MP3-format. Dette lar deg bruke
Last ned Windows 10 Build 18290 offisielle ISO-bilder
Last ned Windows 10 Build 18290 offisielle ISO-bilder
Microsoft ga i dag ut de offisielle ISO-bildene for Windows 10 Build 18290, som representerer Windows 10-kodenavnet '19H1', den kommende funksjonsoppdateringen, også kjent som 'versjon 1903'. Den opprinnelige versjonen av Windows 10 Build 18290 ble utgitt 28. november 2018. De medfølgende ISO-bildene kommer med en oppdatert utløpsdato. Nedlastingen er tilgjengelig
Slik streamer du Netflix på Kodi
Slik streamer du Netflix på Kodi
Med så mange online streamingtjenester er det vanskelig å velge de å stole på. Heldigvis, takket være Kodi, er det nå mye lettere å gå fra den ene tjenesten til den andre. Hvis du ikke har hørt det, er Kodi et media
Hvordan spille Killer in Dead by Daylight
Hvordan spille Killer in Dead by Daylight
Dead by Daylight er et av de mest morsomme skrekkspillene med et bredt spekter av drapsmenn inspirert av kjente figurer fra filmer og bøker. Å spille en overlevende i et slikt spill kan selvfølgelig være ekstremt stressende, noe som betyr at