#ensakidag 106 – AlphaZero dominerar schackvärlden – efter att tränat med sig själv i 4 timmar
Faktaruta, 2026-update, Bedömning och Guldkorn är AI-genererad redaktionell kommentar - skild från JJ:s eget avsnitt.
Beskrivning · den här hjälpte jag AI att skriva // JJ
Förlåt att jag är sen, säger JJ - snön bromsade resan. Men passande nog ska vi prata om något som går avsevärt fortare. Vi återbesöker artificiell intelligens och DeepMind, divisionen i Googles moderbolag Alphabet, som driver sin AI framåt genom att tävla i spel.
Först en bild av hur vi människor lär oss. Du tankar in reglerna, vilket går fort - ett gammalt spel hette Mastermind med tagglinen ”a minute to learn, a lifetime to master”. Sedan kommer det svåra: öva, öva, öva. Malcolm Gladwell pratade om 10 000 timmar för att bli expert, och i schack krävs just det för att utmana en stormästare.
AI:n gör samma resa, fast på ett sätt som tar andan ur en. Förra gången var det AlphaGo Zero, som behövde 21 dagar för att nå stormästarnivå - och det fascinerande var att den tränade mot sig själv, helt utan mänsklig inblandning. Den fick bara reglerna och började spela. Det är radikalt annorlunda mot tidigare, då man matade in stormästarnas kända partier som en mänsklig grundplatta. Här började man från noll. Och därför spelade den inte mänskligt heller - Go-stormästarna tittade på partierna och konstaterade att ”sådär hade jag aldrig kommit på att göra”. Det var lite utommänskligt.
Den 5 december släppte DeepMind ett nytt forskningspapper. Nu heter motorn AlphaZero, och samma algoritm kan spela schack, shogi eller go - vi närmar oss en generell AI. Och det makalösa: på bara fyra timmar tränade AlphaZero upp sig själv till en nivå som slår Stockfish, den mest avancerade schackdatorn som finns.
Sätt siffrorna mot varandra. AlphaZero utvärderar runt 80 000 positioner i sekunden. Stockfish: 70 miljoner. Den som räknar tusen gånger långsammare vinner ändå - bevis på att något nytt hänt i själva algoritmen. På 100 partier vann AlphaZero 28 och 72 slutade i remi. Stockfish vann inte ett enda.
JJ drar ihop det. AI:n lär sig reglerna snabbare (bara att hälla in dem), samlar erfarenheter ofattbart mycket snabbare, och kan väga fler alternativ - utan att ens behöva de där 70 miljonerna. Tänk på det: en hel människas livstid av schack räcker sällan till att slå en stormästare, och ingen stormästare slår Stockfish. På fyra timmar, från noll, tränar AlphaZero förbi alltihop. Och nästa steg är redan synligt: AI som programmerar AI, som bygger nästa generations algoritmer i rasande tempo.
Men det riktiga avslutet vänder han mot dig som lyssnar. Om allt du gör i din vardag bygger på att du lärt dig ett regelsätt och sedan förfinat strategierna - och vi nu ser, helt uppenbart, att AI:n kommer att klå dig på det området - vad ska du då göra framöver? Vad blir din roll? Hur ska vi, mänskligheten, hitta vår plats i ett landskap som så uppenbart har förändrats? Det är på riktigt dags att börja klura på det nu.
Transkript · JJ:s egna ord
Faktaruta
AI-kommentarAI-genererat · ej JJ-verifierat- Företag / produkt
- AlphaZero – DeepMind (Alphabet/Google)
- Teknik
- Förstärkningsinlärning utan mänsklig förkunskap; AlphaZero tränar sig självt från noll enbart via spel mot sig självt och generaliserar till schack, shogi och Go med samma algoritm
- Tidslinje
- 2016: AlphaGo slår Lee Sedol i Go
- 2017 våren: AlphaGo Zero tränar i 21 dagar, slår alla tidigare versioner
- 2017-12-05: DeepMind publicerar AlphaZero-papper; slår Stockfish i schack efter 4 timmars självträning
- 2019: MuZero – kan lära sig spel utan att ens känna till reglerna
- 2026: AlphaZero-efterföljare används för att hitta snabbare sorteringsalgoritmer som körs biljontals gånger per dag globalt
2026 - vad vet vi nu
AI-kommentarAI-genererat · ej JJ-verifieratAlphaZero-pappret 2017 var ett av de mest signifikanta i AI-historien. Efterföljarna MuZero och AZdb har gått ännu längre – och AlphaZero-principerna används nu för att optimera algoritmer som körs biljontals gånger om dagen. JJ:s fråga om ”vad ska vi människor pyssla med” har blivit en av de mest omdiskuterade frågorna i AI-debatten och är ännu inte besvarad.
Bedömning
AI-kommentarAI-genererat · ej JJ-verifieratTräffsäkerhet
Tidlöshet
Historiskt värde
JJ antyder att generell AI är ”alldeles strax runt hörnet” – det stämde inte. AGI är fortfarande omdebatterat och inte uppnått per 2026. Tempot i spel-AI var korrekt; tempot mot generell AI var optimistiskt.
Guldkorn
AI-kommentarAI-genererat · ej JJ-verifierat”Om vad som är verkligt fascinerande med AlphaZero – inte hastigheten utan kvaliteten på beslutsfattandet.”
”AlphaZero i varje spelögonblick så när den ska fatta ett beslut om vilket drag den ska göra så utvärderar den ungefär 80 000 positioner i sekunden. Medan Stockfish, den gamla som mästar Schack-datorn, utvärderar 70 miljoner positioner i sekunden. Då kan man tycka att det måste vara mycket bättre att utvärdera 70 miljoner positioner i sekunden än 80 000. Men om du likförbaskat kommer vinnande ut ur det här spelet så är det helt uppenbart att någonting nytt har hänt i algoritmerna.”
”JJ:s kärnfråga om mänsklighetens framtida roll – fortfarande obesvarad 2026.”
”Om allting du gör i din vardag idag bygger på att du ett har lärt dig ett regelsätt och två sen förfinat strategierna för att fatta beslut runt ditt yrke eller genomföra olika typer av uppgifter eller till och med skapa konst och vi nu ser att det är helt uppenbart, helt uppenbart att den artificiella intelligensen kommer att klå dig på det området. Vad ska du då göra framöver? Vad kommer att vara din roll?”
”Om att AlphaZero spelar på ett sätt som inte är mänskligt – det utomänskliga draget.”
”De här stormästarna i Go kunde titta på de här spelen och konstatera att sådär hade jag aldrig kommit på att göra. För det var lite utommänskligt.”
Läs mer som detta
AI-kommentarAI-genererat · ej JJ-verifierat- #69#ensakidag 69 – Artificiell generell intelligens knackar på dörren?
Delar temat: AI & maskininlärning
- #225#ensakidag 225 – När en ai lär upp en ai som lär upp en ai…
Delar temat: AI & maskininlärning
- #374#ensakidag 374 – Kvantdatorn gör det omöjliga möjligt
Delar teman: AI & maskininlärning, Google
- #159#ensakidag 159 – Lär dig lära maskinen på 15 timmar med gratis utbildning från Google
Delar teman: AI & maskininlärning, Google
- #219#ensakidag 219 – Google levererar principer för ansvarsfull utveckling av AI. Eller?
Delar teman: AI & maskininlärning, Google
- #296#ensakidag 296 – Google fixar ny och avancerad grammatik- och stavningskontroll med hjälp av AI
Delar teman: AI & maskininlärning, Google
Läst baklänges
”Anders Bjarby har läst om hela arkivet baklänges och gjort varje avsnitt till en byggbar idé - med en ärlig efterhandsläsning och en färdig bygg-prompt.”
Ett fristående projekt av Anders Bjarby.