Documentos judiciais divulgados nos Estados Unidos revelaram que funcionários da Microsoft e da OpenAI discutiram internamente os possíveis impactos da inteligência artificial sobre sites, veículos de comunicação e outros produtores de conteúdo que abastecem a própria web.
Os registros fazem parte do processo movido pelo The New York Times e outros veículos contra OpenAI e Microsoft por supostas violações de direitos autorais no desenvolvimento de sistemas de inteligência artificial.
Entre os documentos apresentados no processo aparece uma preocupação particularmente relevante: ferramentas de IA podem utilizar grandes quantidades de conteúdo produzido na internet para funcionar e, ao mesmo tempo, reduzir a necessidade de os usuários visitarem os sites responsáveis por produzir essas informações.
Um documento interno da Microsoft chegou a descrever essa dinâmica como um “ciclo vicioso” capaz de prejudicar simultaneamente a web e o desempenho futuro dos próprios modelos de inteligência artificial.
A discussão atinge diretamente o modelo econômico de sites de notícias, blogs e produtores independentes que dependem de audiência, assinaturas e publicidade para financiar a produção de novos conteúdos.
IA pode responder sem que o usuário visite a fonte
Uma das questões apresentadas nos documentos está relacionada à mudança na maneira como as pessoas procuram informações na internet.
Durante anos, mecanismos de busca funcionaram principalmente como intermediários: o usuário fazia uma pesquisa e recebia uma lista de páginas que poderiam conter a resposta.
Com chatbots e mecanismos de busca baseados em inteligência artificial, parte desse processo muda.
A tecnologia pode consultar ou utilizar informações de diferentes fontes e entregar uma resposta diretamente ao usuário. Dependendo da consulta, isso pode reduzir a necessidade de acessar os sites originais.
Em depoimento citado nos documentos judiciais, o CEO da Microsoft, Satya Nadella, reconheceu que conversas com chatbots podem substituir visitas que anteriormente seriam feitas diretamente aos sites dos produtores de conteúdo.
Nick Turley, responsável pelo ChatGPT na OpenAI, também aparece nos registros afirmando internamente que os produtos da companhia poderiam funcionar, em determinados casos, como substitutos das fontes originais.
As declarações estão sendo utilizadas pelos veículos que processam as empresas como parte de seus argumentos na disputa sobre direitos autorais.
Microsoft discutiu um “ciclo vicioso” para a internet
Um dos documentos internos apresentados no processo descreve um problema que vai além da simples queda de audiência.

Grandes modelos de linguagem dependem de enormes quantidades de textos e outros materiais para treinamento e desenvolvimento. Parte importante desse conteúdo é produzida por empresas e profissionais que dependem economicamente das visitas dos usuários.
Se sistemas de IA diminuírem significativamente esse tráfego, os produtores podem perder receita.
Com menos receita, existe o risco de redução da produção de conteúdo original.
E, se menos conteúdo original for produzido, os próprios sistemas de inteligência artificial poderão encontrar uma internet com menos material novo e de qualidade disponível para alimentar futuras gerações de modelos.
É essa dinâmica que aparece descrita internamente como um “doom loop”, expressão que pode ser traduzida como ciclo vicioso ou ciclo de deterioração.
Segundo os documentos apresentados no processo, a Microsoft chegou a reconhecer internamente que existe uma situação incomum na qual um produto pode ameaçar economicamente os próprios fornecedores da matéria-prima necessária para seu funcionamento.
Queda nos cliques está no centro da discussão
Os veículos também apresentaram dados atribuídos à Microsoft para sustentar que sistemas de inteligência artificial podem diminuir significativamente os cliques enviados aos sites originais.
Segundo a petição parcialmente tornada pública, dados internos citados pelos autores da ação apontariam reduções expressivas nas taxas de cliques para conteúdos jornalísticos quando respostas produzidas por IA são apresentadas aos usuários.
Os números fazem parte dos argumentos apresentados pelos veículos no processo e não devem ser interpretados isoladamente como uma medição geral de todo o tráfego da internet.
Ainda assim, a questão já ultrapassa a disputa judicial.
O crescimento de ferramentas como ChatGPT, Copilot e respostas produzidas diretamente por mecanismos de busca criou uma discussão global sobre o chamado “zero-click”: situações em que o usuário encontra a informação desejada sem precisar visitar outra página.
Para publishers, isso representa uma mudança importante. Um conteúdo pode continuar sendo encontrado ou utilizado para responder a uma consulta, mas a visita que anteriormente chegaria ao site pode não acontecer.
Google também tenta responder à preocupação dos publishers
A transformação não está restrita à OpenAI e à Microsoft.

O Google incorporou respostas geradas por inteligência artificial à busca por meio de recursos como AI Overviews e AI Mode.
A empresa afirma que vem modificando essas experiências para destacar links, conteúdos originais e fontes relevantes e sustenta que as ferramentas podem levar os usuários a uma diversidade maior de sites. O Google também desenvolveu mecanismos que permitem aos publishers controlar determinados usos de seus conteúdos por sistemas generativos.
Para produtores de conteúdo, porém, a questão central permanece: qual será o valor econômico de produzir uma informação se uma plataforma puder utilizá-la para responder ao usuário sem necessariamente gerar uma visita à página original?
Documentos também expõem debate sobre direitos autorais
A disputa sobre tráfego acontece paralelamente a uma discussão ainda maior sobre como os modelos foram treinados.
O New York Times e outros veículos acusam OpenAI e Microsoft de utilizar grandes quantidades de conteúdo jornalístico protegido por direitos autorais sem autorização adequada.
Documentos apresentados pelos autores da ação afirmam que conjuntos de dados utilizados pelas empresas continham milhares de cópias de obras produzidas pelos veículos.
Um diretor de ciência aplicada da Microsoft, Brent Hecht, chegou a classificar internamente a coleta de conteúdo para treinamento de IA como uma forma de apropriação de trabalho em escala sem precedentes.
A Microsoft, entretanto, afirmou que as declarações representam a perspectiva individual do funcionário, não constituem uma análise jurídica e não representam a posição oficial da companhia.
OpenAI e Microsoft contestam as acusações feitas pelos veículos.
As empresas defendem que o treinamento dos modelos envolve transformação do material utilizado e pode ser protegido pelo conceito de fair use, previsto na legislação dos Estados Unidos. A definição dos limites dessa proteção é justamente uma das questões centrais que estão sendo discutidas nos tribunais.
O que está em jogo para os sites de notícias
A discussão ultrapassa a disputa entre grandes empresas americanas.
Portais de notícias, blogs, sites especializados e produtores independentes construíram durante décadas modelos de negócio baseados, em diferentes proporções, em tráfego vindo de mecanismos de busca, acesso direto, redes sociais, publicidade e assinaturas.
A inteligência artificial adiciona um novo intermediário a essa relação.
Um conteúdo pode ser produzido por um veículo, localizado por uma plataforma e utilizado para ajudar a construir uma resposta entregue diretamente ao usuário.
Se a fonte recebe visibilidade e tráfego suficiente em troca, o modelo pode continuar alimentando a produção de novos conteúdos. Se isso não acontecer, surge o problema identificado nos próprios documentos: quem financiará a produção das informações que os sistemas de IA precisarão consultar no futuro?
A resposta ainda está sendo construída por empresas de tecnologia, veículos de comunicação, legisladores e tribunais.
Mas os documentos divulgados agora mostram que essa preocupação não existe apenas entre publishers. Ela também já era discutida dentro das próprias empresas responsáveis por algumas das principais tecnologias de inteligência artificial do mercado.


