Conformidade com a Lei de IA da UE
A OpenAI anunciou na segunda-feira que começará a incorporar uma marca d’água invisível em textos gerados pelo ChatGPT e pelo Codex para usuários da União Europeia, em alinhamento com as disposições de transparência da Lei de IA da UE, que entrou em vigor em 2 de agosto. A legislação exige que os provedores de IA marquem conteúdos sintéticos para que outros sistemas possam identificá-los.
Como a marca d’água funciona
A marca d’água não aparece como um símbolo visível. Em vez disso, o modelo da OpenAI introduz um viés sutil na escolha das palavras, criando um padrão oculto que pode ser detectado por um detector específico. Como a assinatura está inserida nas próprias palavras, ela acompanha o texto quando ele é copiado ou colado. A OpenAI enfatizou que a marca d’água não revela a identidade do usuário e que sua ativação não alterou o desempenho do modelo de forma mensurável.
Relatório técnico e método
Juntamente com o post no blog, a OpenAI publicou um relatório técnico intitulado textGrain, co-escrito com pesquisadores da Universidade da Pensilvânia e de Yale. O documento descreve uma técnica que utiliza uma chave secreta para reorganizar as previsões de palavras seguintes do modelo, completando frases com centenas de pequenos ajustes. Um detector equipado com a mesma chave pode então identificar textos gerados por IA usando apenas o trecho e a chave.
Limitações e desafios de detecção
Testes internos da OpenAI mostram que a marca d’água pode ser enfraquecida por edições. Substituir cerca de 10% das palavras por sinônimos reduziu a precisão da detecção de cerca de 92% para 66%. A empresa também observou que trechos curtos, respostas matemáticas e materiais traduzidos são mais difíceis de serem identificados de forma confiável.
“Estas limitações contribuem para a nossa decisão de fornecer acesso inicial ao detector apenas a pesquisadores aprovados e organizações especializadas, que podem nos ajudar a avaliar a confiabilidade e os usos responsáveis”, disse a OpenAI.
O que significa uma marca d’água ausente ou alterada
A OpenAI alertou que a ausência de uma marca d’água não comprova a autoria humana. Um trecho pode ser muito curto, fortemente editado ou gerado por outro sistema de IA. Por outro lado, uma marca d’água indica apenas que um sistema da OpenAI gerou ou processou parte do texto, e não a extensão do julgamento ou criatividade humana envolvidos.
Contexto do setor e reações
A iniciativa segue o anúncio da Anthropic, há dois meses, de que aplicaria uma marca d’água às saídas do Claude em todo o mundo, decisão que gerou reação de alguns usuários que sentiram que forneciam as instruções enquanto o Claude agia apenas como uma ferramenta. A OpenAI já havia desenvolvido um sistema de marca d’água, mas adiou seu lançamento, em parte por temor de que os usuários migrassem para concorrentes que não utilizavam marca d’água, segundo The Wall Street Journal em 2024.
A Anthropic, Google, Meta, Microsoft e OpenAI estão entre os signatários do código de práticas da UE para conteúdo gerado por IA, sinalizando uma mudança mais ampla do setor em direção ao cumprimento do novo marco regulatório.







