ÚLTIMAS NOTÍCIAS
SELECIONADO PARA VOCÊ

A OpenAI irá marcar com marca d'água o texto do ChatGPT apenas na UE

PorMicah AbiodunMicah Abiodun 3 min de leitura
  • A OpenAI adicionará marcas d'água invisíveis ao texto elegível do ChatGPT e do Codex na UE.
  • O seu sistema textGrain incorpora um sinal estatístico nas escolhas de palavras, em vez de metadados visíveis.
  • A edição pode enfraquecer significativamente a deteção, pelo que a OpenAI está a limitar o acesso ao detector no lançamento.

A OpenAI começou a rotular o texto gerado pelos seus sistemas de IA, ChatGPT e Codex, para utilizadores na região da UE, anunciou a empresa na segunda-feira, devido ao requisito de transparência estabelecido pelo Regulamento Europeu de Inteligência Artificial (AI Act), implementado em 2 de agosto.

Essas regras exigem que as empresas de IA rotulem o conteúdo gerado por máquina em um formato legível por outros sistemas, com violações do Artigo 50 acarretando penalidades de até €15 milhões ou 3% da receita anual global. A implementação atingirá contas elegíveis em todos os planos nas próximas semanas, mas apenas dentro do bloco.

É possível que desenvolvedores que acessam a API de qualquer local ativem o recurso para determinados modelos a partir de hoje, embora o recurso permaneça inativo até que um cliente o ative, segundo a TechCrunch.

O textGrain oculta a marca d'água nas escolhas de palavras do modelo

O sistema textGrain da OpenAI funciona direcionando ligeiramente as palavras escolhidas pelo ChatGPT quando várias alternativas seriam igualmente adequadas. Ao longo de um texto suficientemente longo, essas pequenas decisões criam um padrão estatístico invisível a olho nu, mas detectável por software especializado.

Como a marca d'água está embutida na própria estrutura do texto, e não armazenada nos metadados do arquivo, ela pode permanecer detectável mesmo após o texto ser copiado e colado em outro local.

A OpenAI desenvolveu o sistema em colaboração com pesquisadores da Universidade da Pensilvânia e da Yale. O seu artigo técnico explica que o textGrain utiliza uma chave secreta para classificar as possíveis palavras seguintes e favorecer sutilmente certas escolhas. Quando suficientes dessas escolhas aparecem num texto, um software com acesso à mesma chave pode identificar o padrão e determinar que o texto foi provavelmente gerado ou processado por um modelo da OpenAI.

A OpenAI afirma que a marca d'água não contém nenhuma informação que identifique o usuário que gerou o texto. A empresa também informa que seus testes não revelaram queda significativa no desempenho do GPT-6 Astra quando o textGrain estava ativado.

Edições leves podem enfraquecer drasticamente a detecção da marca d'água

A OpenAI também publicou as limitações do sistema. Em seus testes, a substituição de apenas 10% das palavras por sinônimos reduziu a taxa de detecção de cerca de 92% para 66%. A marca d'água também é mais difícil de detectar em trechos curtos, respostas matemáticas e textos traduzidos.

Devido a essas limitações, a OpenAI restringirá temporariamente o uso de suas ferramentas de detecção a pesquisadores autorizados e organizações especializadas. A empresa também menciona que a incapacidade de detectar marcas d'água não confirma que o texto foi escrito por humanos. O texto pode ser simplesmente muito curto, ter sido extensamente editado ou até mesmo produzido por um modelo de outra empresa.

Uma marca d'água pode indicar que um sistema da OpenAI gerou ou processou parte de um texto, mas não revela quanto julgamento humano, edição ou criatividade foi empregado.

– OpenAI

Anthropic opta pela marca d'água global enquanto a OpenAI inicia na Europa

Em agosto, a Anthropic começou a aplicar marcas d'água nas saídas do Claude em escala global. Inicialmente, isso parecia uma política mais abrangente em comparação com a OpenAI, que estava aplicando apenas na Europa, mas a razão era técnica: a Anthropic ainda não possuía um sistema para restringir a marca d'água por região.

Ambas as empresas já haviam assinado o Código de Prática da UE sobre Transparência de Conteúdo Gerado por IA em julho, junto com cerca de 190 outras organizações, incluindo Google, Meta, Microsoft e Mistral. Consequentemente, seus esforços de marca d'água são uma resposta aos mesmos requisitos de transparência da UE, que entraram em vigor em 2 de agosto.

A implementação da Anthropic ainda recebeu críticas de alguns usuários, que argumentavam que eles estavam fornecendo as ideias, instruções e julgamento, enquanto o Claude ajudava principalmente na redação.

De acordo com o Wall Street Journal, a OpenAI havia criado um sistema de marca d'água para textos anos antes, mas optou por não torná-lo público devido ao receio de que os usuários migrassem para outros sistemas de IA que não aplicam marca d'água em suas saídas.

Se você está lendo isso, já está à frente. Mantenha-se assim com nosso boletim informativo.

Micah Abiodun

Micah Abiodun

Micah Abiodun faz bom uso de sua especialização em Engenharia e Gestão Ambiental (MSc) na Universidade de Tecnologia de Tallinn (TalTech) para refinar notícias sobre previsão de preços e conteúdo no Cryptopolitan. Agora em seu 7º ano no espaço de mídia cripto, ele cobre principais criptomoedas, altcoins, DeFi, stablecoins, tendências macroeconômicas e tecnologias emergentes.

MAIS … NOTÍCIAS