2 pontos por GN⁺ 2024-07-16 | 1 comentários | Compartilhar no WhatsApp
  • Kevin Bankston afirmou que, ao abrir um documento pessoal no Google Drive/Docs, o Gemini fez um resumo sem solicitação, levantando controvérsia sobre o comportamento padrão dos recursos de IA do Workspace e os limites do consentimento do usuário
  • O caso começou com o PDF de sua declaração de imposto e, depois, o foco do problema passou a se concentrar mais no comportamento de arquivos abertos no Google Drive do que no próprio Google Docs
  • Mesmo após verificar as configurações, o toggle de resumos do Gemini no Gmail, Drive e Docs já estava desativado, e a localização indicada pelo Gemini para essa configuração não correspondia à real, dificultando para o usuário entender o estado de controle
  • Bankston observou um padrão em que, após clicar no botão do Gemini em um documento no Drive, ao abrir depois documentos do mesmo tipo de arquivo o Gemini parecia ser executado automaticamente
  • O Google rebateu dizendo que os dados do Workspace não são usados para treinamento nem armazenados, mas a relação entre o estado do painel lateral do Gemini no Drive e as configurações de resumo continua sendo um ponto que o usuário precisa verificar por conta própria

Polêmica sobre resumo automático do Gemini iniciada em documentos pessoais

  • Kevin Bankston publicou no X que, ao abrir sua declaração de imposto no Google Docs, o Gemini a resumiu sem solicitação
  • Ele questionou se o Gemini estaria processando automaticamente documentos pessoais abertos no Google Docs e demonstrou preocupação com a necessidade de descobrir e desativar configurações que o usuário talvez nem soubesse que existiam
  • Depois, o contexto passou a apontar mais para documentos abertos dentro do Google Drive do que para o próprio Google Docs
    • O tipo de documento era PDF
    • Ainda permanece a possibilidade de que isso também possa se aplicar ao Docs

Toggle de resumo já desativado e orientações de configuração conflitantes

  • Bankston tentou localizar a configuração de privacidade indicada pelo Gemini, mas disse não ter encontrado essa opção no local real
  • Depois, ao verificar os toggles relacionados, Gemini summaries in Gmail, Drive, and Docs já estava desativado
  • A localização da configuração também era diferente das duas páginas web inicialmente indicadas pelo bot Gemini
  • Essa experiência ampliou a preocupação com a falta de controle do usuário sobre informações pessoais sensíveis

Padrão de execução automática por tipo de arquivo observado no Drive

  • O problema visto por Bankston parece estar restrito ao Google Drive
  • Foi observado que, após pressionar o botão do Gemini em pelo menos um documento, ao abrir documentos do mesmo tipo de arquivo o Gemini passava a ser executado automaticamente
    • No caso relatado, o tipo de arquivo era PDF
    • Depois disso, arquivos do mesmo formato abertos no Google Drive se tornavam alvo do gatilho automático
  • Bankston também levantou a possibilidade de que o Google Workspace Labs, ativado em 2023, possa ter sobrescrito as configurações pretendidas do Gemini AI

Contestação do Google e explicação sobre proteção de dados

  • Um porta-voz do Google explicou que os recursos de IA generativa foram projetados para oferecer escolha ao usuário e controle sobre os dados
  • A posição do Google é que o uso do Gemini no Google Workspace exige ativação prévia do usuário
  • Segundo a empresa, quando o usuário ativa o recurso, o conteúdo é usado de forma compatível com a privacidade para gerar respostas úteis aos prompts, e não é armazenado separadamente sem permissão
  • O Google afirma em um post do blog sobre proteção de dados no Workspace que os dados do Workspace não são coletados nem usados para treinamento
  • A empresa acrescenta que, se o recurso estiver ativado, ele pode resumir o conteúdo de documentos abertos, mas esse conteúdo não é retido

Solução via painel lateral e a carga restante de verificação pelo usuário

  • O Google sugeriu que Bankston pode ter usado o painel lateral do Gemini no Drive e que fechar esse painel poderia resolver o problema
  • Na experiência de Bankston, porém, as configurações de resumo relacionadas já estavam desativadas, mantendo uma diferença entre o estado de desativação esperado pelo usuário e o comportamento real
  • Ao abrir documentos sensíveis armazenados no Google Drive, o usuário acaba tendo de verificar por conta própria o estado de ativação do Gemini, o estado do painel lateral e o comportamento por tipo de arquivo

1 comentários

 
GN⁺ 2024-07-16
Opiniões no Hacker News
  • Isso mostra novamente que dados enviados a um provedor de nuvem, no fim, não são controlados como se fossem meus
    Desta vez houve um sinal claro, mas acredito que os sistemas do Google já leem e agregam dados dentro de documentos privados há muito tempo
    Essa preocupação existe desde o lançamento do Gmail, 20 anos atrás; na época, as pessoas ficaram surpresas com a ideia de que “o Google lê e-mails para mostrar anúncios”, mas a caixa de entrada de 1 GB e a nova UI eram bastante convincentes
    Depois, em produtos como o Google Drive, eles aprenderam a fazer isso parecer menos assustador ou menos explícito, e provavelmente também porque queriam o dinheiro de clientes corporativos

    • É óbvio que o Google lê e agrega dados de documentos privados
      Caso contrário, como ele ofereceria busca em documentos?
    • Quando se trata de dados em provedores de nuvem, confio mais no ProtonDrive
      Porque ele é criptografado tanto em trânsito quanto em repouso
      A Apple também agora criptografa a maior parte dos dados em trânsito e em repouso, e documenta quais dados são protegidos
      Ainda assim, não tenho certeza se uma Apple futura vai querer usar meus dados para treinar modelos públicos
      O projeto de anexar uma camada de ajuste fino substituível, baseada em treinamento local, ao grande modelo de linguagem central pré-treinado da Apple parece bom em termos de privacidade, mas, na prática, não sei
      Tendo a confiar menos no Google Drive porque dei acesso ao Drive para o Colab Pro e alguns terceiros; se este texto for verdadeiro, essa confiança cai ainda mais
      A analogia com o Gmail inicial é apropriada
      Usei o Gmail por convite privado de Peter Norvig três anos antes de ele ser lançado publicamente, e na época eu gostava dos anúncios relevantes ao lado do Gmail
      Também dei a um serviço de US$ 20 por mês, chamado Google AI Plus ou algo assim, acesso a todos os meus ativos do Google, porque queria experimentar a utilidade de grandes modelos de linguagem integrados a um ambiente como o Workplace
      No fim, entreguei voluntariamente minha privacidade nos serviços do Google
    • A frase “os sistemas do Google leem e agregam dados dentro de documentos privados há muito tempo” está correta, porque é assim que a busca funciona
      Mas, se a sugestão é que os dados privados de todo mundo foram raspados e inseridos em grandes modelos de linguagem, isso é claramente uma teoria da conspiração
      É surpreendente acreditar que o Google teria convencido dezenas de milhares de engenheiros a esconder silenciosamente uma conspiração enorme de abuso dos dados privados de todos
    • Fiz uma reserva na Expedia e o e-mail do itinerário chegou ao Gmail; alguns minutos depois, apareceu na tela inicial do Android um botão nativo de chamada para ação pedindo para configurar o produto de viagens do Google
      Depois disso abandonei o Android, mas largar o Gmail é mais difícil
  • Toda IA, tanto para treinamento quanto para varredura, deve exigir consentimento explícito
    O usuário deve marcar pessoalmente uma caixa dizendo “quero usar recursos de IA”, e o texto explicando o que isso significa deve ser muito claro
    Isso deveria ser obrigatório e imposto, com multas rigorosas para empresas que não cumprirem

    • Entendo a questão do treinamento, mas não vejo por que a varredura também seria um problema
      É literalmente apenas rodar um algoritmo sobre os meus dados e me mostrar o resultado
      Fundamentalmente, não é diferente de um corretor ortográfico ou de gerar automaticamente um sumário a partir dos estilos de título
      Se o resultado permanecer privado apenas para mim, como neste caso, não vejo qual é a preocupação
      O fato de o algoritmo ser baseado em grandes modelos de linguagem não tem relação com privacidade ou segurança
    • A IA está se tornando a nova mídia social
      O usuário não é o cliente, é o produto
      Em vez de fornecer dados para empresas de mídia social venderem anúncios, agora fornecemos dados para treinamento de IA e, em troca, usamos o serviço gratuitamente
    • Fico me perguntando o que exatamente significa “varredura”
      Parece se referir a ler temporariamente um documento e fornecer um resumo, não para fins de treinamento; não entendo por que isso deveria ser regulado
    • Também precisamos de uma extensão do robots.txt para permitir excluir arquivos acessíveis publicamente de conjuntos de dados de treinamento de IA
      Lembro que havia uma tentativa inicial chamada ai.txt, mas ainda não sei bem quem a segue
    • Fico me perguntando qual é exatamente o impacto do treinamento de IA na privacidade
  • Deixando de lado o fato de que este texto foi escrito de forma claramente propensa a mal-entendidos, seguem os links compartilhados na thread de tweets mencionada
    Gerenciamento de atividade do Gemini: https://myactivity.google.com/product/gemini
    Página que tem a maioria das respostas sobre opt-out no Google Workspace e em vários apps do Google: https://support.google.com/docs/answer/13447104#:~:text=Turn...

  • O título deixa este caso um pouco pouco claro
    Se você pede ao Gemini para resumir um documento, não é surpreendente que ele o resuma
    Aqui, a palavra “varredura” está fazendo trabalho demais, e o título sugere que o Google está treinando o Gemini com documentos privados
    A questão real é que, em uma situação em que o usuário acreditava ter desativado isso explicitamente, o Gemini foi executado usando um documento privado como entrada e o resumiu
    Ainda assim, o fato de a configuração não ter sido respeitada é um bug significativo na infraestrutura do Google, e pode levar quem é totalmente contra o uso da nova geração de IA a revisar sua estratégia de saída

    • Quando você pede ao Gemini para resumir um PDF, não é surpreendente que ele resuma esse PDF
      Mas, se depois de pedir uma vez para resumir um PDF o Gemini passa a resumir todos os PDFs no Drive, isso sim seria surpreendente
  • Acho que o título é enganoso
    Pensei que fosse sobre varredura para treinamento ou testes, mas era uma função de resumir o texto que o usuário está visualizando
    Por isso, a expressão “caught” é desonesta
    Você não diz que “pegou” alguém fazendo algo que essa pessoa informou que estava fazendo

    • Como as permissões estavam desativadas, qualquer coisa que ele tenha feito com o documento foi sem autorização
      O título está correto
  • É questão de tempo até alguém extrair algo valioso dos modelos do Google
    Pode ser uma senha de banco ou chaves de criptomoedas
    O caso da pizza com cola mostra que eles estão simplesmente empurrando isso de qualquer jeito

  • É parecido com a disputa por dados de saúde que aconteceu durante a pandemia de COVID
    Vários grupos aproveitaram a crise para tentar espremer os dados para fora do tubo de uma vez, e alguns conseguiram
    Porque o custo de levar uma bronca é baixo, enquanto o valor de obter os dados é alto
    Essencialmente, é uma manobra burocrática feita na calada
    Para quem já trabalhou na área de privacidade, é decepcionante, mas previsível, e a maioria finge surpresa e segue em frente
    Porque a carreira depende da capacidade de continuar sustentando uma narrativa absurda de “boas intenções”
    As mensagens SMS hackeadas na AT&T provavelmente serão as próximas, e, se as teclas digitadas no celular vazarem ou uma atualização de SO de uma plataforma comercial adicionar um agente de coleta para treinamento de modelos, todos ficarão igualmente surpresos
    Claro, isso também virá embalado como reforço de privacidade para satisfação do usuário
    Se os gerentes de produto e engenheiros que criaram isso não forem usados como exemplo, da próxima vez vai se repetir de forma pior e em escala maior

  • O tweet original e este texto misturam os termos de propósito para induzir a um mal-entendido
    A ideia é fazer parecer que um modelo de linguagem grande ter contato com um documento de alguma forma é a mesma coisa que esse documento ser incluído no conjunto de dados de treinamento do modelo
    Esse é o ponto caça-cliques do texto e do tweet original, mas a thread do tweet acaba reconhecendo a diferença e muda de direção para ficar com raiva da própria existência de recursos de IA
    Não há nada de substancial nessa história além de um usuário irritado do Twitter com um pop-up de IA ter escrito uma thread para provocar indignação, apresentando tudo como algo muito mais sinistro

  • É surpreendente que, especialmente até no HN, tanta gente seja enganada com sucesso sobre o que realmente está acontecendo
    Fico me perguntando se ainda existe alguém que poste depois de ler o texto

  • Será que é surpreendente que o Google não vá longe o suficiente em privacidade e acesso a dados?
    Eles falam disso, mas nunca chegam ao ponto em que seus próprios serviços não possam acessar os dados
    Todos os dados armazenados remotamente deveriam chegar ao ponto em que o servidor não pudesse descriptografá-los e eles fossem descriptografados apenas nos nossos dispositivos
    Caso contrário, é como permitir que a empresa minere os dados o quanto quiser, e não temos absolutamente nenhum jeito de saber o que estão fazendo
    Claro que ainda resta o problema de precisar acreditar que eles realmente não conseguem descriptografar, e não há uma boa solução para isso
    O acesso da IA a dados pessoais deveria ser processado no dispositivo e, se for necessário processamento no servidor, deveria haver um aviso claro de que os dados serão enviados para fora do dispositivo, mesmo esperando que isso seja um problema de curto prazo
    Mesmo que não estejam sendo usados para treinamento de modelos neste momento, não é irracional pensar que dados que passaram pelo Gemini ou por algum servidor remoto possam ficar registrados em logs e depois ser usados para treinamento adicional, ficar em logs em texto puro ou ser vistos por testadores

    • No fim, é nesse ponto que tudo desmorona
      No final, a estrutura vira a empresa dizendo “confie em nós”, e é bastante claro que empresas não são confiáveis para receber esse tipo de responsabilidade