AlphaGo
Mer info
- Skapad av
- DeepMind
- År
- Typ
- Go-program
DeepMinds go-program som slog Lee Sedol 4–1 i mars 2016, ett decennium före vad experterna trodde.
Go var det sista brädspelsfästet: sökrymden är för stor för brute force. Lösningen var två neurala nät — ett policynät som föreslår drag, ett värdenät som bedömer ställningar — som styr en Monte Carlo-trädsökning. Först tränat på mänskliga partier, sedan förbättrat genom självspel.
Drag 37 i parti två var så okonventionellt att kommentatorerna antog att det var ett misstag; det visade sig avgöra partiet. Efterföljaren AlphaGo Zero (2017) skippade mänskliga partier helt och blev ändå starkare.