OpenAI lança marca d'água ChatGPT para textos de IA
Crédito: canaltech.com.br
Crédito: <a href="https://canaltech.com.br/inteligencia-artificial/chatgpt-copia-o-claude-e-tambem-comeca-a-carimbar-textos-feitos-por-sua-ia/" rel="nofollow noopener noreferrer" target="_blank">canaltech.com.br</a>

A OpenAI anunciou o desenvolvimento de uma nova tecnologia de marca d’água para textos gerados por inteligência artificial, chamada textGrain. O recurso, que ainda não tem data de lançamento global, permitirá identificar se um conteúdo provavelmente foi produzido ou editado por modelos da empresa, como o ChatGPT. A novidade segue uma tendência do setor, já que a Anthropic, concorrente direta, adotou recentemente uma solução semelhante para o Claude, baseada no SynthID-Text do Google DeepMind.

Por enquanto, usuários do ChatGPT no Brasil não devem receber o “carimbo” automaticamente. A OpenAI afirma que o lançamento ficará restrito à União Europeia em um primeiro momento, embora clientes da API em qualquer país já possam ativar a tecnologia voluntariamente em modelos compatíveis. A medida visa atender a demandas regulatórias e de transparência, especialmente em contextos onde a origem do conteúdo é relevante.

Como funciona a marca d’água invisível

A marca-d’água não aparece como uma etiqueta no texto e também não adiciona caracteres invisíveis, espaços extras ou informações escondidas ao copiar e colar uma resposta. Em vez disso, o textGrain atua durante a geração do conteúdo. Modelos de linguagem calculam diferentes possibilidades para a próxima palavra ou parte de palavra, conhecida como token. A tecnologia ajusta levemente essas probabilidades para que determinadas escolhas formem um padrão estatístico ao longo do texto.

Esse padrão pode ser procurado posteriormente por um detector da OpenAI. Segundo a empresa, a ferramenta consegue indicar se um sistema da companhia provavelmente participou da geração ou edição daquele conteúdo. A abordagem é semelhante à utilizada pelo Claude. A Anthropic adotou uma versão do SynthID-Text, tecnologia criada pelo Google DeepMind, que também modifica a aleatoriedade envolvida na escolha das palavras sem inserir elementos visíveis no conteúdo.

A OpenAI desenvolveu uma solução própria e afirma que, em seus testes, o textGrain igualou ou superou a capacidade de detecção de outras técnicas avaliadas, incluindo o SynthID para textos. A companhia também pretende disponibilizar a tecnologia como código aberto, o que pode ampliar a adoção e a auditoria por parte da comunidade científica.

Limitações e riscos de falsos positivos

A presença do carimbo não permite afirmar com certeza que um texto inteiro foi escrito pelo ChatGPT. A tecnologia indica que um modelo da OpenAI provavelmente participou da produção ou edição daquele conteúdo, mas não consegue medir quanto do material veio de uma pessoa. Isso significa que um texto híbrido, com trechos humanos e de IA, pode ser sinalizado sem distinguir a proporção de cada contribuição.

Editar o conteúdo também pode reduzir significativamente a chance de identificação. Em um experimento com textos de 400 tokens, substituir 10% das palavras por sinônimos fez a taxa de detecção cair de aproximadamente 92% para 66%. Com a troca de 25% das palavras, ela caiu para 17%. Esses números mostram que a marca d’água é frágil diante de edições simples, o que pode limitar sua eficácia em cenários reais.

Por causa dessas limitações e do risco de falsos positivos, a OpenAI não vai disponibilizar seu detector para qualquer pessoa inicialmente. O acesso será oferecido a pesquisadores e organizações especializadas aprovadas pela companhia. A ideia é evitar usos indevidos, como a rotulação injusta de trabalhos acadêmicos ou a censura de conteúdos legítimos.

Privacidade e veracidade não são cobertas

A OpenAI afirma que a marca também não revela quem utilizou o ChatGPT, qual foi o prompt enviado ou a conversa em que aquele conteúdo foi produzido. O sistema tampouco verifica se as informações do texto são verdadeiras. Ou seja, a marca d’água serve apenas como um indicador de origem provável, sem fornecer detalhes sobre autoria ou precisão factual.

Essa distinção é importante para entender o alcance da tecnologia. Enquanto a marca d’água pode ajudar a identificar conteúdo gerado por IA em larga escala, ela não resolve problemas de desinformação ou plágio. A fonte não detalhou se haverá integração com outras ferramentas de verificação de fatos ou sistemas de moderação de conteúdo.

A adoção de marcas d’água por grandes empresas de IA reflete uma pressão crescente por transparência. Reguladores europeus, em particular, têm defendido mecanismos que permitam rastrear a origem de textos gerados artificialmente. A OpenAI, ao restringir o lançamento inicial à União Europeia, parece alinhar-se a essa tendência regulatória.

O que esperar do futuro

Embora a tecnologia ainda não esteja disponível para o público geral, a abertura do código-fonte pode acelerar seu desenvolvimento e adoção. Pesquisadores poderão testar a robustez do textGrain e propor melhorias. A concorrência com o SynthID-Text também deve estimular avanços na área de detecção de conteúdo sintético.

Para usuários comuns, a principal mudança prática será a possibilidade de verificar, em alguns casos, se um texto foi gerado por IA. No entanto, as limitações atuais indicam que a marca d’água não é uma solução definitiva. A fonte não detalhou se a OpenAI planeja expandir o recurso para outros idiomas ou regiões além da União Europeia.

Enquanto isso, a discussão sobre autenticidade e responsabilidade no uso de IA continua. A marca d’água é uma ferramenta a mais nesse debate, mas não substitui a necessidade de pensamento crítico e verificação humana.

Fonte

By

0 0 votos
Classificação
guest

Resolva a soma:
+ 20 = 28


0 Comentários
mais antigos
mais recentes Mais votado
Feedbacks embutidos
Ver todos os comentários