A OpenAI anunciou na segunda-feira, 5, uma nova tecnologia de marca d’água chamada textGrain, que será aplicada aos textos gerados pelo ChatGPT e pelo Codex. O recurso será ativado por padrão na União Europeia e estará disponível opcionalmente para usuários da API em todo o mundo.
Como a marca entra no texto
A marca d’água é incorporada durante o processo de geração da resposta, alterando sutilmente a escolha dos tokens com base em um padrão secreto e no contexto. O sistema agrupa o vocabulário e seleciona um grupo antes de escolher o token seguinte, preservando as probabilidades relativas dentro daquele conjunto. Isso mantém a diversidade das respostas, evitando que o modelo repita sempre a mesma sequência ao receber uma mesma instrução.
Como o detector vai reconhecer a marca
O detector utiliza a mesma chave secreta e as configurações correspondentes para reconstruir o padrão esperado. Ele compara as escolhas observadas no texto com o padrão estatístico e verifica se há uma associação maior do que seria esperada por acaso. Diferentemente de classificadores que analisam o estilo de escrita, o textGrain busca um sinal inserido durante a geração.
Impacto de edições, cópias e traduções
Segundo a empresa, copiar e colar o texto original deve manter o sinal, mas reescritas e traduções podem enfraquecê-lo. Testes realizados pela OpenAI mostraram que substituir 10% das palavras por sinônimos em trechos de 400 tokens reduziu a detecção de aproximadamente 92% para 66%. Com uma substituição de 25%, o índice caiu para 17%. A avaliação foi feita com respostas em inglês.
Implementação e disponibilidade
A marca será aplicada a textos elegíveis do ChatGPT e do Codex na União Europeia nas próximas semanas, em todos os planos. A medida atende às exigências de transparência do regulamento europeu de IA. No Brasil, o recurso não será ativado por padrão no ChatGPT, mas clientes da API poderão optar por habilitá-lo globalmente em modelos selecionados.
A Anthropic também anunciou planos de incluir marcas d’água nos textos gerados pelo Claude.
Limitações e considerações éticas
Encontrar a marca indica que um modelo da OpenAI foi usado, mas não mede a contribuição humana, não identifica o usuário e não comprova autoria, propriedade ou veracidade. Da mesma forma, a ausência do sinal não prova que o texto foi escrito por uma pessoa. A OpenAI prevê tanto falsos positivos quanto falsos negativos.
O acesso ao detector estará inicialmente restrito a pesquisadores e organizações especializadas aprovadas pela empresa.







