Quando um jogador perguntou ao Google sobre um título indie que estava por vir, o chatbot respondeu com detalhes que o desenvolvedor diz que nunca foram divulgados publicamente. A resposta incluiu o nome exato de um personagem—Vantage Tripod—e descrições de mecânicas que o criador havia apenas inserido em um documento privado do Google Doc no dia anterior. O desenvolvedor postou a troca no Reddit, anexando prints de tela que ele diz provam que o Gemini acessou seus arquivos confidenciais.
De acordo com a thread do Reddit, o único elemento público do jogo era um placeholder chamado "Tripod Fish." A menção do AI ao nome preciso e às habilidades específicas surpreendeu o criador, que acredita que a única fonte dessa informação foi seu documento interno. Ele reconhece que o Gemini cometeu alguns erros, mas a precisão dos dados divulgados o levou a suspeitar que o AI havia raspado seus Docs privados.
A posição oficial do Google é que o Gemini pode ler Google Docs apenas quando um usuário concede permissão explícita—como pedir ao modelo para resumir um documento. A empresa acrescenta que qualquer dado que o AI acesse é tratado de forma transitória e não é retido para treinamento futuro. Existem exceções, no entanto, se um documento for compartilhado publicamente via um ajuste de "qualquer pessoa com o link" ou se uma extensão de terceiros for permitida para ler o arquivo. Nesses casos, o conteúdo pode ser indexado para fins de treinamento.
A alegação do desenvolvedor levanta questões sobre como o Google obtém dados para o Gemini. Alguns usuários argumentam que o gigante da tecnologia pode estar coletando Docs acessíveis publicamente ou explorando extensões que têm acesso mais amplo. A empresa de privacidade Proton destacou que o hub de privacidade do Google não promete explicitamente que o conteúdo do usuário será excluído do treinamento de IA, alimentando mais ceticismo.
A TechRadar tentou replicar o incidente solicitando ao Gemini perguntas semelhantes, mas o modelo não reproduziu os detalhes vazados. O amigo do desenvolvedor, que originalmente provocou a resposta do AI, também não conseguiu recriar a resposta exata em tentativas subsequentes. Essa inconsistência deixa aberta a possibilidade de que o AI tenha hallucinado as informações, tenha tirado de prompts anteriores ou que o desenvolvedor tenha exposto involuntariamente os dados por meio de outro canal.
Independentemente da causa, o episódio destaca os riscos de armazenar informações sensíveis em serviços de nuvem que os modelos de IA podem acessar. Os usuários são lembrados para revisar as configurações de compartilhamento, limitar extensões de terceiros e tratar qualquer dado inserido em uma IA como potencialmente público. O incidente adiciona a uma lista crescente de preocupações sobre privacidade de IA e transparência de práticas de dados de treinamento.
O Google ainda não respondeu a pedidos de comentário. Até que a empresa forneça uma explicação clara, desenvolvedores e outros usuários provavelmente permanecerão cautelosos sobre como seus documentos privados podem ser usados por sistemas de IA gerativos.
This article was written with the assistance of AI.
News Factory APP - agentic news to boost your SEO & AEO.