
O que você precisa saber
Você talvez se lembre do grande feito da DeepMind, uma empresa subsidiária do Google, que criou a inteligência artificial AlphaGo capaz de dominar o jogo de tabuleiro Go, vencendo até mesmo o campeão mundial na modalidade. Agora a empresa foi além: criou a AlphaGo Zero, uma nova versão de seu algoritmo que foi capaz de fazer o mesmo em menos tempo e sem intervenção humana.
O software original impressionou até os mestres jogadores de Go pela sua capacidade e refinamento, mas o fato é que para chegar até esse ponto, o sistema dependeu de jogadores humanos e seus talentos para aprender a melhor forma de mover suas peças. Para começar, a empresa precisou injetar um conjunto de dados de 100 mil jogos de Go para dar à máquina o conhecimento básico.
Enquanto isso, a AlphaGo Zero, foi programada apenas com as informações que forneceram ao sistema as regras básicas do jogo, sem orientações de como transformar essas premissas básicas em técnicas de jogo eficientes. Bastaram apenas 40 dias para dominar um jogo de 3 mil anos e se tornar o novo campeão mundial.
Como o computador chegou a esse nível? Em vez de usar um banco de dados com base em jogos entre humanos, a máquina aprendeu jogando contra si mesmo inúmeras vezes. No começo, a IA apenas jogava peças de forma aleatória no tabuleiro. A cada vitória, o sistema era atualizado; ou seja: ele aprendia algo novo. Repetindo isso milhões de vezes, a máquina conseguiu começar a desenvolver suas próprias estratégias.
Depois de três dias aprendendo a jogar nesse esquema, a AlphaGo Zero foi colocada para jogar contra a versão de sua antecessora que havia vencido Lee Se-dol, o coreano 18 vezes campeão mundial na modalidade. Foram 100 partidas e 100 vitórias para versão Zero.
Mas o avanço não parou por aí. Na sequência, ela passou a treinar para enfrentar a versão mais avançada da AlphaGo, descrita como um ‘deus’ após derrotou chinês Ke Jie, número 1 de Go no planeta. Em 40 dias, a taxa de vitórias da Zero sobre a AlphaGo era de 90%.
Entre para comentar.