Google lança dois chips de IA para bater de frente com a Nvidia

O Google quer provar que pode liderar a corrida da inteligência artificial. Durante o evento Google Cloud Next, nesta quarta-feira (22/04), a companhia anunciou a oitava geração das suas Unidades de Processamento Tensorial (TPUs) — chips criados sob medida pela empresa para acelerar cálculos complexos.
A novidade desta vez é a estratégia. De forma inédita, o hardware foi dividido em dois processadores com funções diferentes: o TPU 8t e o TPU 8i. A dupla chega para preparar a infraestrutura de nuvem da empresa para a nova era dos agentes autônomos (sistemas de IA capazes de tomar decisões e realizar tarefas sozinhos) e, claro, acirrar a disputa contra a poderosa Nvidia.
Segundo o vice-presidente sênior de infraestrutura de IA do Google, Amin Vahdat, as novas TPUs chegam ao mercado ainda este ano. O desenvolvimento teve forte participação do laboratório Google DeepMind, garantindo que o hardware rode nas ferramentas de código aberto mais populares entre os desenvolvedores.
Até então, um mesmo chip tentava fazer tudo. Mas o Google percebeu que as duas fases de uma IA — o treinamento e a inferência — passaram a exigir diferenças. Para criar um modelo inteligente, é preciso uma força bruta colossal de computadores trabalhando sem parar durante meses para “devorar” e aprender com montanhas de dados.
Já a inferência é o uso prático. É o momento em que a IA (como o Gemini) já está pronta para responder às perguntas de milhões de usuários ao mesmo tempo. Aqui, o que manda é uma velocidade de resposta imediata (baixa latência) e um acesso ultrarrápido à memória para que o sistema não trave.
Sundar Pichai, CEO da Alphabet, explicou no blog da companhia que essa separação garante a capacidade exata para rodar múltiplos agentes de IA trabalhando em equipe, entregando respostas na hora e, principalmente, reduzindo o gasto de energia e o custo operacional dos servidores.
Fonte: Tecnoblog
Entre para comentar.