Guerra Judicial pelo Controle da Internet: Google e Reddit Perdem Batalha contra Scrapers, mas a Guerra Está Longe de Acabar

O Contexto da Disputa: Scraping, IA e o Futuro da Internet

A internet está em meio a uma batalha judicial que pode redefinir as regras de acesso e uso de dados públicos. No centro dessa disputa estão gigantes como Google e Reddit, que recentemente enfrentaram derrotas significativas em processos contra empresas especializadas em web scraping — a prática de extrair dados de sites de forma automatizada. O caso mais emblemático envolve a SerpApi, uma empresa acusada de contornar barreiras tecnológicas para coletar dados de resultados de busca do Google e do conteúdo do Reddit.

Embora as plataformas argumentem que o scraping viola seus termos de serviço e direitos autorais, as decisões judiciais recentes têm favorecido as empresas de scraping, reforçando que dados públicos não são propriedade exclusiva de plataformas digitais. Essa controvérsia levanta questões cruciais: Quem realmente possui os dados na internet? Até que ponto as plataformas podem controlar o acesso a informações públicas?

O Caso Google vs. SerpApi: Uma Derrota que Abala o DMCA

Em maio de 2026, um tribunal federal da Califórnia rejeitou as alegações do Google em um processo contra a SerpApi, no qual a gigante das buscas acusava a empresa de violar o Digital Millennium Copyright Act (DMCA), uma lei americana que criminaliza a circumvenção de medidas tecnológicas de proteção. O Google argumentava que a SerpApi estava burlando seus sistemas anti-bots para extrair dados de resultados de busca, mas o juiz responsável pelo caso decidiu que resultados de busca não são protegidos por direitos autorais e, portanto, não podem ser objeto de uma ação baseada no DMCA.

A decisão foi um golpe para o Google, que havia adotado uma estratégia legal considerada “bizarra” por especialistas. Meredith Rose, conselheira sênior de políticas da organização Public Knowledge, afirmou em entrevista à Ars Technica que o uso do DMCA nesse contexto é “um desvio do que a lei pretendia originalmente”. Segundo ela, o Google e o Reddit estão “agarrando-se a qualquer ferramenta disponível” para conter o avanço do scraping, especialmente após o boom da inteligência artificial, que aumentou exponencialmente a demanda por dados.

O tribunal também destacou que o Google não é proprietário dos dados exibidos em seus resultados de busca, o que enfraquece ainda mais sua argumentação. A SerpApi, por sua vez, celebrou a decisão, afirmando que “Google e Reddit não são donos da internet“.

Reddit e a Estratégia do DMCA: Uma Batalha em Andamento

O Reddit adotou uma abordagem semelhante à do Google, mas com um foco diferente. Em outubro de 2025, a plataforma processou a SerpApi, a Perplexity AI e outras empresas por scraping em larga escala de seu conteúdo. Diferentemente do Google, o Reddit argumentou que as rés estavam burlando suas medidas tecnológicas de proteção, como limites de taxa e CAPTCHAs, violando a Seção 1201 do DMCA.

No entanto, o caso do Reddit enfrenta obstáculos semelhantes aos do Google. A plataforma não é proprietária da maioria dos conteúdos postados por seus usuários, o que dificulta a alegação de violação de direitos autorais. Além disso, as rés argumentam que estão coletando dados públicos, acessíveis a qualquer pessoa sem a necessidade de login, o que as protegeria de acusações baseadas em termos de serviço.

O caso ainda está em fase de descoberta pré-julgamento, mas já gera debates acalorados. Enquanto o Reddit alega que as empresas de scraping estão agindo como “ladrões”, as rés contra-argumentam que estão apenas acessando informações públicas, sem violar leis de propriedade intelectual.

O Precedente Bright Data: Um Marco para o Scraping Legal

Um caso anterior, X Corp. (antigo Twitter) vs. Bright Data, estabeleceu um precedente importante para a discussão atual. Em janeiro de 2024, um tribunal federal dos EUA decidiu a favor da Bright Data, afirmando que a empresa não violou os termos de serviço do Twitter ao coletar dados públicos enquanto estava deslogada da plataforma. A decisão reforçou que termos de serviço não podem ser usados para impedir o acesso a dados públicos, pois isso criaria um “sistema privado de direitos autorais” que compete com as leis federais.

Esse precedente tem sido citado em defesa das empresas de scraping nos casos envolvendo Google e Reddit. A Bright Data, em comunicado, celebrou a decisão como uma vitória para “o direito do público de acessar e coletar dados públicos”, reafirmando seu compromisso de manter a internet “universalmente acessível e livre”.

Implicações para o Futuro da Internet e da IA

As decisões recentes têm implicações profundas para o futuro da internet e, especialmente, para o desenvolvimento da inteligência artificial. Empresas como Google, Reddit e Meta dependem de grandes volumes de dados para treinar seus modelos de IA, mas enfrentam um dilema: como monetizar dados públicos sem violar princípios de acesso aberto?

Enquanto algumas plataformas, como o Reddit, têm buscado acordos de licenciamento com empresas de IA (como OpenAI e Google), outras resistem a essas parcerias, argumentando que os dados pertencem aos usuários, não às plataformas. Essa resistência tem levado a uma onda de processos judiciais, com resultados mistos.

Para especialistas, o uso do DMCA como ferramenta anti-scraping é uma estratégia arriscada. Como observou o Capstone DC, “essas alegações enfrentam obstáculos significativos nos tribunais”, pois as plataformas geralmente não possuem direitos autorais sobre o conteúdo gerado por usuários. No entanto, uma vitória das plataformas poderia ter consequências severas, desencorajando a inovação e limitando o acesso a dados públicos.

Conclusão: Uma Guerra que Está Apenas Começando

Embora Google e Reddit tenham sofrido derrotas recentes, a guerra judicial pelo controle dos dados na internet está longe de acabar. As plataformas continuam explorando novas estratégias legais, enquanto empresas de scraping e defensores do acesso aberto à informação comemoram vitórias importantes. O que está em jogo não é apenas o futuro do scraping, mas o próprio conceito de internet aberta e democrática.

Enquanto os tribunais não chegam a um veredicto definitivo, uma coisa é certa: a batalha pelos dados da internet moldará o futuro da tecnologia, da inteligência artificial e da sociedade digital.

Deixe um comentário

O seu endereço de e-mail não será publicado. Campos obrigatórios são marcados com *