OpenAI detalha estratégia de marcação de texto em resposta às regulamentações da UE sobre IA
A OpenAI delineou sua abordagem para a marcação de texto em conformidade com o AI Act da UE, que exige que os provedores de IA generativa tornem o texto gerado identificável por meio de sinais legíveis por máquina. A empresa planeja introduzir a marcação de texto para modelos selecionados em todo o mundo, a partir de hoje, com a opção de ativação para clientes da API. Na União Europeia, usuários elegíveis do ChatGPT e do Codex receberão marcas d'água invisíveis nas próximas semanas. A OpenAI também está abrindo o acesso ao seu detector de marcas d'água para pesquisadores e organizações experientes aprovados, para avaliar e melhorar a tecnologia.
A tecnologia de marcação de texto, chamada textGrain, adiciona um sinal estatístico invisível às saídas do modelo. No entanto, o sistema tem limitações, incluindo taxas de detecção reduzidas para textos mais curtos e conteúdo editado. Por exemplo, a uma taxa de falsos positivos de 1%, as taxas de detecção para passagens de 200 tokens eram de cerca de 80%, em comparação com 95% para passagens de 40.000 tokens. A edição também pode enfraquecer a marca d'água, com a substituição de 10% de palavras reduzindo a detecção de 92% para 66%.
A OpenAI enfatiza que as marcas d'água não estabelecem a propriedade, verificam a precisão ou identificam os usuários. A empresa planeja expandir o acesso ao detector à medida que os resultados se tornam mais interpretáveis e continua a refinar sua abordagem em resposta aos padrões e regulamentos em evolução.