#Web Scraping
5 artigos

Nitter renasce: o front-end que Musk não conseguiu matar
Após receber cartas de 'cease-and-desist' da X Corp, o projeto open-source que permite ler a plataforma sem conta ou anúncios retorna, amparado por aconselhamento jurídico.

Feyn lança Pulpie — modelo que reduz custo de extração de dados web em 95%
Startup aposta em arquitetura encoder para superar limitadores de memória e baratear a limpeza de dados para treinamento de modelos de linguagem.

Cloudflare trava bots de IA em sites com anúncios — entenda a mudança
A partir de setembro de 2026, a gigante da infraestrutura web bloqueará por padrão o scraping de bots que misturam busca e treinamento de modelos de IA em páginas monetizadas.

Infraestrutura de dados web torna-se o novo gargalo para o avanço da IA
Modelos de linguagem dependem cada vez mais de fluxos de dados em tempo real, forçando empresas a buscar novas camadas de coleta para garantir precisão e relevância nas respostas.

Dados de 146 mil profissionais imobiliários franceses são expostos em scrape na rede
A plataforma Superimmo teve listagens públicas compiladas por um agente de ameaças, levantando questões sobre os limites entre coleta automatizada e segurança digital.

