GitHub vai treinar IA com dados de usuários

O GitHub anunciou que vai utilizar dados de interação dos usuários para treinar e aprimorar os modelos de inteligência artificial do GitHub Copilot a partir de 24 de abril de 2026. A mudança afeta a base global de programadores que assinam os planos Free, Pro e Pro+ e vai operar no formato de exclusão voluntária — ou seja, quem não quiser compartilhar suas informações terá que desativar a opção manualmente.
Em comunicado oficial no blog da companhia, o diretor de produtos do GitHub, Mario Rodriguez, afirmou que a medida visa ajudar a IA a entender os fluxos de trabalho reais, fornecer sugestões mais seguras e detectar possíveis falhas com mais precisão e rapidez.
A lista de informações que o GitHub passará a extrair durante as sessões de programação inclui:

O conteúdo será compartilhado com empresas afiliadas ao grupo corporativo do GitHub, o que engloba a dona do serviço, a Microsoft. Contudo, a empresa garante que não repassará os dados a fornecedores terceirizados de IA ou provedores independentes.
Para justificar a atualização, a plataforma aponta que outras empresas do setor, como a Anthropic, adotam políticas semelhantes de telemetria. Segundo Rodriguez, testes internos demonstraram melhorias na taxa de aceitação de sugestões de código após o treinamento com dados de uso. O GitHub acrescentou que também iniciará a coleta de informações dos próprios funcionários para esse fim.
A coleta de dados em repositórios privados vai ocorrer exclusivamente enquanto o usuário estiver interagindo com o Copilot no ambiente de desenvolvimento. Isso significa que o sistema processa e armazena os trechos apenas durante o uso em tempo real da assistência de IA. Nesse momento, os dados são capturados e enviados para a base de treinamento.
Fonte: Tecnoblog
Entre para comentar.