Cybercode
tecnoblog
tecnoblog
Tecnologia · · 2 min de leitura ·

Wikipédia sofre com aumento de tráfego causado por robôs de IA

Wikipédia sofre com aumento de tráfego causado por robôs de IA

A Wikimedia Foundation, responsável pela Wikipédia e por outros projetos colaborativos, revelou que o uso de banda da Wikimedia Commons teve um aumento de 50% desde janeiro de 2024. Os principais responsáveis por isso são robôs que baixam fotos e vídeos para treinar sistemas de inteligência artificial.

Outros números comprovam o grande número de acessos automatizados. A fundação afirma que 65% do tráfego intensivo de dados tem sido feito por robôs, mas apenas 35% dos acessos a páginas vêm dessas ferramentas.

Gráfico de linha intitulado "Multimedia bandwidth demand" mostrando a demanda por largura de banda multimídia de 2021 até o início de 2025. O eixo vertical representa o nível de tráfego em relação à média histórica (1.0), variando de 0 a 4. O gráfico exibe um aumento significativo no tráfego ao longo do tempo, com picos notáveis em 2024 e início de 2025. Dois eventos estão anotados com setas: "US Election Day" (Dia da Eleição nos EUA) e "Jimmy Carter’s death" (Morte de Jimmy Carter), ambos associados a picos acentuados no tráfego.
Tráfego vem crescendo desde 2024 (imagem: reprodução/Wikimedia Commons)

O acesso massivo de robôs ao acervo do Wikimedia Commons tem causado lentidão para os leitores da Wikipédia e aumento de custos para a organização.

O comunicado da Wikimedia Foundation traz um exemplo: em dezembro de 2024, quando o ex-presidente dos Estados Unidos Jimmy Carter morreu, alguns usuários acessaram um vídeo de uma hora e meia, com um debate entre Carter e o também ex-presidente Ronald Reagan.

Em condições normais, isso não seria um problema, já que é possível mudar as rotas das conexões. Mesmo assim, a enciclopédia online sofreu com lentidão, pois seus sistemas estão sendo constantemente usados pelos robôs e é difícil gerenciar este uso.

Ilustração com o texto "AI" ao centro
Inteligência artificial demanda grande quantidade de dados para treinamento (ilustração: Vitor Pádua/Tecnoblog)

Além de prejudicar a experiência, os “raspadores” de conteúdo também aumentam os custos da operação. A organização explica que leitores humanos tendem a visitar algumas páginas frequentemente, dependendo dos assuntos em evidência.

Fonte: Tecnoblog

Publicidade