IT-lexikon AI & ML AlphaGo

AlphaGo

AI & ML In English → Uppdaterad: 2026-07-28
Mer info
Skapad av
DeepMind
År
Typ
Go-program

DeepMinds go-program som slog Lee Sedol 4–1 i mars 2016, ett decennium före vad experterna trodde.

Go var det sista brädspelsfästet: sökrymden är för stor för brute force. Lösningen var två neurala nät — ett policynät som föreslår drag, ett värdenät som bedömer ställningar — som styr en Monte Carlo-trädsökning. Först tränat på mänskliga partier, sedan förbättrat genom självspel.

Drag 37 i parti två var så okonventionellt att kommentatorerna antog att det var ett misstag; det visade sig avgöra partiet. Efterföljaren AlphaGo Zero (2017) skippade mänskliga partier helt och blev ändå starkare.

← Tillbaka till lexikonet