Startup de IA Anthropic é acusada de coleta de dados; entenda

Publicado por

Isabella Caminoto

29 de julho de 2024 13:00

A startup de inteligência artificial (IA) Anthropic, avaliada em US$ 18,4 bilhões (cerca de R$ 92 bilhões), está sendo acusada por líderes de empresas, como Matt Barrie, CEO do marketplace de freelancers Freelancer.com (listada na ASX), de coletar dados agressivamente de sites para treinar seus sistemas. Esse processo pode violar os termos de serviço dos sites afetados.

Desenvolvedores de IA precisam de grandes quantidades de dados de diversas fontes para criar modelos de linguagem avançados, a tecnologia por trás de chatbots como o ChatGPT da OpenAI.

A Anthropic foi fundada por ex-pesquisadores da OpenAI com a promessa de desenvolver sistemas de IA “responsáveis”.

No entanto, Barrie acusa a empresa sediada em San Francisco de ser “a scraper mais agressiva de longe” em seu portal para freelancers, que tem milhões de visitas diárias.

Outras editoras web ecoaram as preocupações de Barrie, afirmando que a Anthropic está sobrecarregando seus sites e ignorando suas instruções para parar de coletar conteúdo para treinar seus modelos.

O Freelancer.com recebeu 3,5 milhões de visitas de um “rastreador” da web ligado à Anthropic em apenas quatro horas, de acordo com dados compartilhados com o Financial Times. Isso torna a Anthropic “provavelmente cerca de cinco vezes o volume do segundo” rastreador de IA, disse Barrie.

As visitas de seu bot continuaram a aumentar mesmo depois que o Freelancer.com tentou recusar seus pedidos de acesso, usando protocolos padrão da web para orientar rastreadores. Depois disso, Barrie decidiu bloquear completamente o tráfego dos endereços de internet da Anthropic.

“Tivemos que bloqueá-los porque eles não obedecem às regras da internet”, disse Barrie. “Isso é uma raspagem absurda que torna o site mais lento para todos que operam nele e acaba afetando nossa receita.”

A Anthropic disse estar investigando o caso e que respeita os pedidos dos editores, buscando não ser “intrusiva ou disruptiva”.

Coletar dados publicamente disponíveis na web geralmente é legal. Porém, a prática é controversa, pode violar os termos de serviço dos sites e ser onerosa para os provedores de hospedagem.

Sites usam um protocolo conhecido como “robots.txt” para tentar impedir rastreadores e outros robôs da web de acessar partes de seus sites. No entanto, ele depende da conformidade voluntária.

A raspagem de dados não é uma prática nova, mas aumentou drasticamente nos últimos dois anos como resultado da corrida armamentista da IA. Isso impôs novos custos aos sites.

Leia também:

Apple adia lançamento de recursos de IA; saiba o motivo

Este post foi modificado pela última vez em 29 de julho de 2024 11:54

Isabella Caminoto

Advogada e mestranda em Direito Internacional, tenho a democracia e a liberdade como bandeiras irrenunciáveis. Sou apaixonada pelos animais e acredito que o bem-estar do nosso planeta deveria ser o destaque diário da pauta da nossa sociedade.

Próximo Turbulência no mercado acionário dos EUA coloca lupa nas avaliações das Big Techs »

Anterior « IA revoluciona as Olimpíadas de 2024

Publicado por

Isabella Caminoto

Tags: AnthropicClaudedadosFinancial Timesinteligência artificialstartup

29 de julho de 2024 13:00

Posts recentes

Inteligência Artificial

OMS reúne 37 países para definir regras globais sobre inteligência artificial na saúde

A Organização Mundial da Saúde reuniu ministros, autoridades governamentais e especialistas de 37 países em…

15 de julho de 2026

Inteligência Artificial

IA promete eficiência na saúde, mas Harvard alerta para risco de desumanização do cuidado

A inteligência artificial (IA) já começa a transformar hospitais, consultórios e sistemas de saúde, assumindo…

10 de julho de 2026

Inteligência Artificial

GPT-5.6: OpenAI apresenta sua IA mais poderosa, mas restringe acesso a poucos parceiros

A OpenAI apresentou oficialmente o GPT-5.6, sua mais nova geração de modelos de inteligência artificial…

29 de junho de 2026

Inteligência Artificial

OpenAI entra na guerra dos chips e desafia Nvidia e Google na corrida pela infraestrutura da IA; conheça o Jalapeño

A OpenAI deu um passo que pode redefinir o equilíbrio de poder no setor de…

25 de junho de 2026

Inteligência Artificial

OpenAI ajuda a desvendar doenças raras infantis e dá nova esperança a casos sem diagnóstico

Um dos maiores desafios da medicina moderna está nos chamados "casos sem resposta": pacientes que…

23 de junho de 2026

Inteligência Artificial

Argentina quer criar empresas comandadas por IA — e acende debate global sobre responsabilidade e poder

A Argentina deu um passo inédito na corrida global pela inteligência artificial (IA). O governo…

22 de junho de 2026

Startup de IA Anthropic é acusada de coleta de dados; entenda

Posts relacionados

Posts recentes

OMS reúne 37 países para definir regras globais sobre inteligência artificial na saúde

IA promete eficiência na saúde, mas Harvard alerta para risco de desumanização do cuidado

GPT-5.6: OpenAI apresenta sua IA mais poderosa, mas restringe acesso a poucos parceiros

OpenAI entra na guerra dos chips e desafia Nvidia e Google na corrida pela infraestrutura da IA; conheça o Jalapeño

OpenAI ajuda a desvendar doenças raras infantis e dá nova esperança a casos sem diagnóstico

Argentina quer criar empresas comandadas por IA — e acende debate global sobre responsabilidade e poder