A Anthropic anunciou na sexta-feira que o chatbot Claude começará a incorporar marcas d'água invisíveis em cada peça de texto que gera, uma medida destinada a cumprir o Código de Transparência da Lei de IA da União Europeia. O post do blog da empresa explica os mecanismos, o impacto esperado nos usuários e o plano de lançamento de uma API de detecção.

De acordo com a Anthropic, a marca d'água funciona inserindo um padrão sutil em escolhas de palavras de baixo risco — como descrever o céu como "nublado" ou "cinzento". Para um leitor humano, o texto parece inalterado; para qualquer pessoa com a chave de decodificação adequada, o padrão é detectável. A empresa enfatiza que a marca d'água não degrada a qualidade da saída do Claude, afirmando que uma resposta com marca d'água é "indistinguível de uma sem marca d'água".

A Anthropic empregará o método SynthID-Text pioneiro pelo Google DeepMind no início deste ano. A abordagem difere das ferramentas comerciais de detecção de IA que procuram por "dicas" linguísticas. Em vez disso, incorpora uma assinatura criptográfica que pode ser verificada diretamente. A empresa planeja tornar uma API de detecção de marca d'água disponível publicamente, permitindo que terceiros confirmem se um determinado trecho originou-se do Claude.

A reação nas mídias sociais foi mista. Uma thread no Reddit explodiu após a empresa dar uma dica inicial sobre a marca d'água, com um postador chamando a iniciativa de "uma conspiração contra usuários inocentes do Claude". No X, dezenas de usuários anunciaram que estavam cancelando suas assinaturas, citando preocupações de que a marca d'água pudesse ser usada para rastrear ou restringir seu conteúdo. O Business Insider relatou a mesma onda de cancelamentos.

A Anthropic abordou a pergunta mais comum — a marca d'água pode ser removida por edição? A empresa admite que uma edição leve — mudanças menores de palavras ou revisão — provavelmente deixará a marca d'água intacta. Somente uma reescrita completa, onde cada palavra é substituída, removeria totalmente a assinatura. Nesse cenário, o texto pode não mais se qualificar como gerado por IA, observou a Anthropic.

O blog também abordou como a marca d'água afetará a geração de código. Porque o código funcional oferece menos escolhas de palavras discretas, a pegada da marca d'água será mínima. No entanto, em áreas onde os desenvolvedores podem escolher entre sinônimos — como comentários ou nomes de variáveis — a marca d'água ainda pode ser aplicada. A Anthropic assegura aos usuários que a marca d'água não interferirá na correção do código.

Além disso, a Anthropic afirmou que outros grandes desenvolvedores de modelos assinaram o mesmo Código de Prática e estarão implementando suas próprias soluções de marca d'água. A empresa encara a iniciativa como um passo proativo em direção à transparência, em vez de uma reação à pressão regulatória.

Em resumo, o novo sistema de marca d'água da Anthropic incorpora um padrão invisível e verificável criptograficamente no texto do Claude, prometendo não haver perda de qualidade, e será detectável por meio de uma API futura. Embora os detalhes técnicos visem tranquilizar, um segmento da base de usuários permanece cético, com alguns optando por sair do serviço.

Cet article a été rédigé avec l'assistance de l'IA.
News Factory APP - actualités agentiques pour booster votre SEO et AEO.