Google sofre revés na Justiça dos EUA em processo contra empresa de web scraping

Renê Fraga
9 min de leitura

Principais destaques

  • Justiça dos Estados Unidos rejeitou parte da ação do Google contra a SerpApi por considerar insuficientes as alegações de violação de direitos autorais.
  • Tribunal afirmou que resultados públicos de pesquisa, como links, snippets e dados factuais, não são protegidos pela legislação de copyright.
  • Google ainda poderá reformular a ação em até 21 dias caso consiga comprovar autorização dos detentores dos direitos autorais sobre determinados conteúdos.

O Google enfrentou uma derrota importante na Justiça dos Estados Unidos em um processo que pode ter impactos relevantes para empresas que trabalham com coleta automatizada de informações disponíveis na internet.

A gigante da tecnologia viu parte de sua ação contra a SerpApi ser rejeitada por uma juíza federal, que concluiu que a empresa não apresentou elementos suficientes para comprovar que houve violação da legislação de direitos autorais.

A decisão foi assinada pela juíza Yvonne Gonzalez Rogers, do Tribunal Distrital do Norte da Califórnia. Embora o caso ainda esteja longe do fim, a decisão representa um obstáculo significativo para a estratégia jurídica do Google e pode influenciar futuras disputas envolvendo web scraping, prática utilizada por empresas para coletar automaticamente dados disponíveis em páginas da internet.

Apesar da rejeição de parte das alegações, o tribunal permitiu que o Google apresente uma nova versão da ação dentro de um prazo de 21 dias. Para isso, a companhia precisará demonstrar que possui autorização dos verdadeiros titulares dos direitos autorais sobre determinados conteúdos exibidos em seus serviços.

Como começou a disputa entre Google e SerpApi

O processo teve início em dezembro de 2025, quando o Google acusou a SerpApi de acessar seus resultados de pesquisa utilizando métodos desenvolvidos para contornar mecanismos de proteção contra robôs automatizados.

A SerpApi é uma empresa conhecida por fornecer uma API que permite a desenvolvedores e empresas obter resultados do Google de forma estruturada para integração em aplicativos, plataformas e sistemas de análise. Esse tipo de serviço é bastante utilizado em monitoramento de preços, pesquisas de mercado, ferramentas de SEO, inteligência competitiva e desenvolvimento de aplicações baseadas em buscas.

Segundo o Google, a empresa empregava técnicas consideradas enganosas para superar o sistema interno conhecido como SearchGuard. Entre essas práticas estariam a alteração da identificação dos navegadores, a rotação constante de endereços IP e a resolução automática de CAPTCHAs, recursos normalmente utilizados para impedir acessos em larga escala por programas automatizados.

Na visão da companhia, essas práticas configurariam uma violação da Seção 1201 da Digital Millennium Copyright Act (DMCA), legislação norte-americana que protege mecanismos tecnológicos criados para restringir o acesso a obras protegidas por direitos autorais.

Já a SerpApi apresentou uma defesa bastante diferente. A empresa argumentou que apenas coleta informações que já são públicas e acessíveis a qualquer usuário da internet, sustentando que seu funcionamento não difere, em essência, da forma como mecanismos de busca percorrem e indexam páginas da web.

Por que a Justiça rejeitou parte da ação

Ao analisar o caso, a juíza destacou um ponto considerado central para a disputa: a legislação invocada pelo Google protege apenas mecanismos tecnológicos destinados a restringir o acesso a obras protegidas por direitos autorais.

Segundo a decisão, elementos presentes nas páginas de resultados de pesquisa, como URLs, pequenos trechos de texto, títulos das páginas e outros dados factuais, são informações disponibilizadas publicamente e não se enquadram, por si só, como obras protegidas pelo Copyright Act.

Dessa forma, a magistrada concluiu que o Google não pode utilizar a legislação de direitos autorais para impedir que terceiros coletem informações públicas presentes nos resultados do buscador.

Essa conclusão levou ao arquivamento definitivo dessa parte específica da ação, sem possibilidade de alteração futura, já que o tribunal entendeu que, mesmo com uma nova petição, essa fundamentação jurídica não seria suficiente para sustentar o pedido.

A decisão chama atenção porque diferencia claramente o acesso a informações públicas da proteção conferida às obras intelectuais, um debate que há anos acompanha o crescimento de ferramentas de coleta automatizada de dados.

O impasse sobre conteúdos de terceiros

Outro ponto importante analisado pela Justiça envolve conteúdos exibidos pelo Google que pertencem a outros produtores de conteúdo.

A juíza observou que muitos elementos presentes em recursos como o Painel de Conhecimento, respostas enriquecidas e outros componentes da página de resultados são derivados de informações criadas por terceiros.

Por isso, caso o Google deseje utilizar a proteção prevista na DMCA para esses conteúdos, será necessário demonstrar que recebeu autorização dos respectivos detentores dos direitos autorais para aplicar mecanismos de controle de acesso em nome deles.

Na ação apresentada, essa autorização não foi demonstrada.

Por esse motivo, essa parte do processo também foi rejeitada, mas, diferentemente da questão envolvendo os resultados públicos, o tribunal permitiu que o Google tente corrigir essa deficiência documental em uma nova versão da ação.

Caso consiga apresentar provas suficientes dentro do prazo determinado pela Justiça, essa discussão poderá voltar ao processo.

A decisão também trouxe um ponto favorável ao Google

Embora a maior parte das análises tenha destacado a vitória obtida pela SerpApi, a decisão também reconheceu alguns argumentos favoráveis ao Google.

A juíza concordou que técnicas utilizadas para contornar o SearchGuard, como alteração da impressão digital do navegador, mudança frequente de IPs e superação automática de CAPTCHAs, podem ser consideradas formas de contornar mecanismos tecnológicos de proteção previstos na DMCA.

No entanto, isso não significa automaticamente que houve violação da lei.

Segundo o entendimento do tribunal, essas ações somente configurariam uma infração caso os mecanismos estivessem efetivamente protegendo obras cobertas por direitos autorais e essa proteção tivesse sido autorizada pelos titulares desses direitos.

Em outras palavras, o simples fato de ultrapassar uma barreira técnica não basta para caracterizar uma violação da legislação de copyright.

O que essa decisão pode representar para o mercado

Especialistas em direito digital avaliam que o julgamento representa uma das decisões mais relevantes dos últimos anos envolvendo web scraping e acesso automatizado a informações públicas.

Diversas empresas utilizam técnicas semelhantes às da SerpApi para desenvolver ferramentas de monitoramento de preços, comparação de produtos, pesquisa acadêmica, inteligência de mercado, análise de SEO e monitoramento de concorrentes.

Caso o entendimento da Justiça seja mantido nas próximas etapas do processo, a decisão poderá servir como referência para disputas semelhantes envolvendo plataformas digitais e empresas especializadas em coleta de dados.

Isso não significa que toda forma de web scraping passa a ser automaticamente permitida. Outras legislações, contratos de uso dos serviços, regras de acesso, proteção de dados e diferentes interpretações judiciais ainda podem limitar esse tipo de atividade.

Mesmo assim, o resultado inicial é visto como uma vitória importante para empresas que dependem da coleta de informações públicas disponíveis na internet.

Agora, todas as atenções se voltam para os próximos passos do Google. Se a companhia conseguir apresentar novos argumentos e comprovar a autorização dos titulares dos direitos autorais, parte da disputa poderá continuar.

Caso contrário, a decisão tende a fortalecer ainda mais o entendimento de que informações públicas exibidas em mecanismos de busca não podem ser protegidas pela DMCA apenas por estarem presentes na página de resultados.

Apoie o Eurisko
Este conteúdo é independente, sem anúncios e feito por pessoas.
A inteligência artificial e as mudanças recentes do Google reduziram significativamente o alcance dos sites independentes. Se este conteúdo foi útil para você, considere apoiar o Eurisko e todo o ecossistema de projetos com qualquer valor.
Quero apoiar
Seguir:
Renê Fraga é fundador do Google Discovery (GD) e editor-chefe do Eurisko. Profissional de marketing digital, com pós-graduação pela ESPM, acompanha o Google desde os anos 2000 e escreve há mais de duas décadas sobre tecnologia, produtos digitais e o ecossistema da empresa. Criador do Google Discovery em 2006, tornou-se referência na cobertura do Google no Brasil e foi colunista do TechTudo (Globo.com), compartilhando análises e conhecimento com um grande público.
Nenhum comentário