#ensakidag 366 – När AI blir tool builders faller ännu en mänskligt unik egenskap...
Faktaruta, 2026-update, Bedömning och Guldkorn är AI-genererad redaktionell kommentar - skild från JJ:s eget avsnitt.
Beskrivning · den här hjälpte jag AI att skriva // JJ
Det här är ett av de mest mindblowing experiment JJ läst om på länge. En forskargrupp på OpenAI tog två lag av AI och släppte in dem i ett inhägnat område fullt av väggar, kuber och ramper. Sedan lät man dem spela kurragömma. Två enkla, välkända principer styrde: lagen tävlar mot varandra, och inom varje lag lär man sig genom trial and error, om och om igen.
Och så börjar det. Först springer gömmarna och kröker sig bakom objekten. Efter tiotals miljoner försök upptäcker de att de kan flytta väggar och mura in sig i ett litet fort. Sökarna kontrar genom att rulla fram ramper och kika över muren. Gömmarna kontrar tillbaka genom att låsa fast ramperna innan de bygger. Steg för steg, drag för motdrag. Någonstans efter en halv miljard körningar avbryts försöket, och gömmarna har vunnit: de hade låst fast allt, även kuberna som sökarna lärt sig att surfa på.
Det häftiga, och lite obehagliga, är vad som händer på vägen: algoritmerna blir tool builders. Verktygsbyggare. De tar objekt och använder dem på sätt som aldrig var tänkta. Och just det har vi gärna betraktat som typiskt mänskligt. JJ påminner om Steve Jobs gamla bild av människan som verktygsbyggaren: kondoren var naturens mest energieffektiva varelse och människan hamnade långt ner på listan, ända tills någon satte människan på en cykel och vi sköt i topp. Datorn, sa Jobs, är en cykel för tanken.
Men i den här lilla arenan ser JJ något som nästan liknar livets uppkomst i miniatyr: dumma, enkla individer som börjar samarbeta, bygga verktyg, gå den extra milen bortom den enskilda organismens förmåga. Och i kampen mellan människa och AI faller den ena särskiljande egenskapen efter den andra. Superhäftigt. Och emellanåt, erkänner han, lite läskigt. Men det är väl just det som är charmen med det vi håller på med.
Transkript · JJ:s egna ord
Faktaruta
AI-kommentarAI-genererat · ej JJ-verifierat- Företag / produkt
- OpenAI – Hide and Seek multi-agent reinforcement learning experiment
- Teknik
- Multi-agent reinforcement learning, self-play, emergent tool use
- Tidslinje
- Sep 2019: OpenAI publicerar hide-and-seek-experimentet
- ~500 miljoner iterationer: agenter utvecklar 6 distinkta strategier och motstrategier
- Gömmarna vinner slutligen genom att låsa fast alla objekt
- 2020–2023: OpenAI fokuserar på language models (GPT-3, GPT-4) snarare än multi-agent
- 2026: Emergent tool use i RL-agenter är ett etablerat forskningsfält; experimentet ses som en milstolpe
2026 - vad vet vi nu
AI-kommentarAI-genererat · ej JJ-verifieratExperimentet är numera ett klassiskt referensexempel på emergent tool use och multi-agent reinforcement learning, och citeras i forskning och undervisning globalt. OpenAI lämnade denna forskningslinje relativt snart till förmån för storskaliga språkmodeller. Idag är tool use dock återaktuellt på ett annat sätt: moderna LLM-agenter använder externa verktyg som kod, webbsökning och API:er. Övergången från att AI lär sig använda fysiska objekt i simulering till att AI kallar på digitala verktyg i produktionsmiljö gick snabbare än de flesta förutsåg 2019.
Bedömning
AI-kommentarAI-genererat · ej JJ-verifieratTräffsäkerhet
Tidlöshet
Historiskt värde
Hårda påståenden i facit har stämts av mot källor.
Inga egentliga missar. JJ är medvetet osäker på siffrorna och det är ärligt – de exakta iterationsantalen spelade liten roll för insikten.
Guldkorn
AI-kommentarAI-genererat · ej JJ-verifierat”Kärnobservationen om vad som faktiskt hände i experimentet”
””Och det som är så fräckt med detta är att det som händer här är att AI:n blir toolbuilders. Alltså verktygsbyggare. De börjar skapa, av de här objekten börjar skapa verktyg som de använder på ett annat sätt än vad det var tänkt.””
”Jobs-referensen om människan som verktygsbyggare – och vad det innebär att AI nu gör samma sak”
””Men sen var det någon som kom på att sätta människan på en cykel. Och genast så var vi på toppen av listan igen. Och det är det som, och hans tes där, Steve Jobs han är så fin.””
”Den ärliga dubbla känslan – fascination och obehag”
””Jag tycker det här är superhäftigt. Och faktiskt emellanåt så kan jag bli lite såhär. Nu börjar det bli otäckt. Men det är väl det som är charmen med det vi pysslar med.””
Läs mer som detta
AI-kommentarAI-genererat · ej JJ-verifierat- #225#ensakidag 225 – När en ai lär upp en ai som lär upp en ai…
Delar temat: AI & maskininlärning
- #69#ensakidag 69 – Artificiell generell intelligens knackar på dörren?
Delar temat: AI & maskininlärning
- #400#ensakidag 400 – Ännu en AI designad för att lura AI – den här gången gäller det text.
Delar temat: AI & maskininlärning
- #468#ensakidag 468 – we are all the hackers, we are all the best.
Delar temat: AI & maskininlärning
- #288#ensakidag 288 – Bilder på människor som inte finns, texter som är falska och hur vi pratar om AI
Delar temat: AI & maskininlärning
- #494#ensakidag 494 – Sci-fi framtiden är här med Figure 01: Fascination möter oro(?)
Delar temat: AI & maskininlärning
Läst baklänges
”Anders Bjarby har läst om hela arkivet baklänges och gjort varje avsnitt till en byggbar idé - med en ärlig efterhandsläsning och en färdig bygg-prompt.”
Ett fristående projekt av Anders Bjarby.