---
title: "Seattle Times e Newsday processam OpenAI e Microsoft por uso de obras em modelos"
author: "Gustavo Ramos O. Klein"
date: "2026-09-07 06:15:00-03"
category: "Inteligência Artificial & Dados"
url: "http://desbugados.scale.press/portal/desbugados/post/2026/09/07/seattle-times-e-newsday-processam-openai-e-microsoft-por-uso-de-obras-em-modelos/md"
---

## Resumo
- Seattle Times e Newsday processaram OpenAI e Microsoft no Distrito Sul de Nova York.
- A petição acusa as empresas de usar conteúdo jornalístico protegido, inclusive material atrás de paywalls, para treinar modelos de IA.
- Os jornais pedem a destruição dos conjuntos de dados e dos modelos que incorporariam suas obras.
- A ação também menciona reprodução de passagens que poderia reduzir o tráfego nos sites dos veículos.
- A OpenAI defende o treinamento com dados públicos sob a doutrina do fair use, enquanto a Microsoft declarou surpresa e disposição para buscar soluções.
- O processo ainda está em andamento e não representa uma decisão definitiva sobre direitos autorais, marcas ou remoção de modelos.

---

No início de setembro de 2026, os jornais **Seattle Times** e **Newsday** moveram uma ação judicial contra duas empresas de tecnologia por suposto uso indevido de material jornalístico no treinamento de inteligência artificial. A petição foi apresentada no Tribunal Distrital dos Estados Unidos para o Distrito Sul de Nova York e pede, entre outras medidas, a destruição dos conjuntos de dados e dos modelos que incorporariam as obras. O ponto que costuma confundir esse debate é simples: há uma acusação formal, mas ainda não há decisão definitiva sobre responsabilidade ou sobre a destruição solicitada. Para entender o que está em disputa, é preciso separar o conteúdo usado no treinamento, as respostas geradas e a defesa jurídica apresentada pelas empresas processadas.

## O que a petição acusa

As duas empresas citadas na ação são a **OpenAI** e a **Microsoft**. Segundo a petição, elas usaram conteúdo jornalístico protegido por direitos autorais como dados de treinamento sem autorização, isto é, material empregado para ensinar modelos a reconhecer padrões e produzir respostas. A acusação não descreve um simples link para uma reportagem: afirma que o conteúdo teria entrado no processo de construção das ferramentas. Essa distinção leva a disputa para a relação entre quem produz informação e quem cria sistemas capazes de reorganizá-la.

O mecanismo apontado pelos jornais tem nome técnico: **scraping**, prática de coletar automaticamente páginas na internet. A petição, segundo a [Reuters](https://www.reuters.com/legal/government/seattle-times-newsday-sue-openai-microsoft-alleging-copyright-infringement-2026-09-05/), afirma que essa coleta alcançou inclusive textos protegidos por paywall, a barreira de acesso associada à assinatura, para treinar o ChatGPT e o Copilot. O processo também acusa a reprodução de passagens jornalísticas nas respostas, algo que, na visão dos autores, reduz as visitas aos sites originais. A ponte entre coleta, treinamento e resposta gerada é justamente o caminho que o tribunal terá de examinar.

## Quando o conteúdo vira disputa judicial

O pedido mais severo é a **destruição dos conjuntos de dados** e dos modelos que, segundo os autores, incorporam suas obras. Em termos práticos, os jornais querem que a disputa alcance tanto o material usado na preparação quanto os sistemas resultantes. A formulação aparece como um pedido dentro da ação, e não como uma ordem já expedida pela Justiça. Essa diferença impede que a notícia seja lida como se os modelos já tivessem sido condenados à remoção.

A petição também apresenta a reprodução de trechos como um problema econômico para os veículos, porque respostas que entregam passagens ao usuário podem reduzir o tráfego nas páginas que publicaram o material. A alegação transforma a interface de IA em uma nova porta de entrada para o texto, mas uma porta que, segundo os jornais, pode dispensar a visita ao endereço original. Por isso, a discussão passa pelo modo como o valor de uma reportagem é distribuído entre o site que a produz e a ferramenta que a reapresenta. O tribunal ainda terá de avaliar essa relação a partir das alegações e das provas do processo.

## Marcas e respostas fabricadas

Além dos direitos autorais, a **OpenAI** é acusada de diluição de marca registrada. A alegação citada nas fontes afirma que o sistema pode gerar conteúdo fabricado e atribuí-lo falsamente aos jornais, aproximando o nome de uma publicação de textos que ela não produziu. Esse eixo acrescenta à disputa uma questão de identidade editorial, porque uma resposta incorreta poderia circular com a aparência de autoria de um veículo conhecido. A acusação também questiona como os nomes dos jornais aparecem nas respostas produzidas pela ferramenta.

A linguagem usada na petição resume a crítica com uma imagem forte: a IA generativa, isto é, a tecnologia que produz conteúdo a partir de instruções, seria "uma cobra que come o próprio rabo". Os autores argumentam que a tecnologia consome conteúdo produzido por pessoas para gerar imitações que competem com os criadores originais. A frase é uma posição dos demandantes, não uma conclusão judicial sobre o funcionamento ou a legalidade dos modelos. Ela ajuda, porém, a mostrar por que o processo conecta autoria, distribuição e concorrência em uma mesma disputa.

## Como OpenAI e Microsoft respondem

A **Microsoft** respondeu que ficou surpresa com o processo, embora tenha declarado disposição para explorar soluções. A manifestação combina reação à abertura da ação com a indicação de que a empresa aceita discutir caminhos para o conflito. As fontes não apresentam, porém, um acordo anunciado nem uma medida capaz de encerrar o caso. Por enquanto, a posição pública da empresa está no campo da resposta às acusações formuladas pelos jornais.

Já a **OpenAI** defendeu que seus modelos são treinados com dados públicos sob a doutrina de "fair use", expressão jurídica americana traduzida como uso aceitável. A defesa tenta enquadrar o treinamento como uma utilização permitida, enquanto os jornais sustentam que houve coleta de conteúdo protegido. Essa tese será confrontada com a alegação de que a coleta alcançou textos atrás de paywalls e de que as respostas podem competir com a fonte. O conflito depende da interpretação que a Justiça dará ao uso de obras no treinamento e na saída dos modelos.

## Um caso dentro de uma disputa maior

A disputa ganhou uma camada adicional porque as duas empresas processadas já haviam financiado projetos e bolsas de jornalismo no jornal autor da ação. Essa relação anterior é mencionada pelas fontes como um dos motivos pelos quais o caso chama atenção, já que aproxima colaboração institucional e confronto judicial. O dado não altera o conteúdo da acusação nem antecipa o resultado do processo. Ele mostra que as relações entre empresas de tecnologia e veículos podem mudar quando a circulação de informação passa a ser mediada por modelos de IA.

O caso também se encaixa em uma sequência maior de ações contra empresas de IA. Um [relatório citado pelas fontes](https://pressgazette.co.uk/platforms/news-publisher-ai-deals-lawsuits-openai-google/) afirma que, em junho de 2026, mais de **30 jornais locais dos Estados Unidos** já haviam se unido a processos semelhantes por suposto "roubo sistemático" de artigos. Outros casos envolvem publicações como Wikihow e Editorial Perfil, segundo o mesmo levantamento. O número ajuda a dimensionar a pressão jurídica sobre o treinamento de modelos, embora cada processo ainda dependa de seus próprios fatos e decisões.

## Como interpretar o caso sem confundir acusação e decisão

Para o leitor, a diferença entre treinamento e resposta é a chave para acompanhar a discussão. Treinamento é a etapa em que dados são usados para ajustar um modelo; resposta é o texto produzido depois de um pedido do usuário. A petição tenta conectar as duas etapas ao afirmar que obras protegidas entraram nos dados e que passagens jornalísticas reaparecem nas respostas. A Justiça terá de verificar se essa conexão produz responsabilidade jurídica, e não apenas se um sistema consegue mencionar uma notícia.

Também é preciso observar a palavra **alegação** em cada atualização. Os jornais afirmam que houve uso sem permissão, coleta de páginas com paywall, reprodução de passagens e prejuízo ao tráfego; as empresas apresentam outra leitura sobre a legalidade do treinamento. Até aqui, as fontes descrevem uma petição e as respostas públicas das empresas processadas, sem indicar uma decisão final sobre direitos autorais, marca registrada ou destruição de modelos. Essa cautela evita transformar uma disputa em andamento em veredito.

## O que acontece agora

O próximo passo concreto é a tramitação da ação no **Distrito Sul de Nova York**, onde os argumentos dos jornais e das empresas serão examinados no processo. O pedido de destruir conjuntos de dados e modelos permanece, portanto, como uma solicitação dos autores, enquanto a defesa baseada em fair use permanece como posição da OpenAI. A notícia muda a conversa porque coloca, no mesmo documento judicial, a origem do conteúdo, a forma de coleta e o modo como a IA devolve informação ao público. O resultado ainda depende da Justiça.

Até que exista uma decisão, a caixa de ferramentas para entender o caso é separar três perguntas: o material foi usado no treinamento, a ferramenta reproduziu ou fabricou conteúdo atribuído aos jornais e esse uso violou direitos autorais ou marcas? A primeira e a segunda aparecem como acusações na petição; a terceira é a questão jurídica que permanece aberta. Para quem acompanha a tecnologia, essa separação funciona como uma ponte entre o debate técnico e o judicial, sem confundir uma ação protocolada com uma condenação.