1 pontos por GN⁺ 2023-06-29 | 1 comentários | Compartilhar no WhatsApp
  • Em uma audiência do Comitê de Ciência da Câmara dos EUA, o CEO da Hugging Face, Clement Delangue, destacou que ciência aberta e IA de código aberto estão fortemente alinhadas com os valores e interesses dos Estados Unidos
  • Delangue considera que ferramentas de código aberto criadas nos EUA, como PyTorch, Tensorflow, Keras, transformers e diffusers, têm sustentado o avanço da IA e a posição de liderança americana
  • O depoimento veio duas semanas após senadores questionarem as possibilidades de uso indevido após o vazamento do LLaMA da Meta, incluindo spam, fraude, malware, violação de privacidade e assédio
  • Ele explicou que a abertura ética dá à sociedade civil, organizações sem fins lucrativos, academia e formuladores de políticas a capacidade de conter grandes empresas privadas e reduzir sistemas de caixa-preta
  • A Hugging Face busca combinar abertura e salvaguardas por meio de model cards, restrição de acesso, lançamento gradual, moderação da comunidade e conjuntos de dados com opt-in e opt-out

Defesa da IA de código aberto em audiência da Câmara dos EUA

  • O CEO da Hugging Face, Clement Delangue, depôs na audiência plenária do Comitê de Ciência da Câmara dos EUA Artificial Intelligence: Advancing Innovation Towards the National Interest
  • Também participaram da mesma audiência o CEO da RAND Corporation, Jason Matheny, o general partner da Lux Capital, Shahin Farshchi, a fellow de IA responsável da Harvard University, Rumman Chowdhury, e o diretor-executivo do Center for Security and Emerging Technology da Georgetown University, Dewey Murdick
  • Delangue considera que os avanços recentes em IA só foram possíveis sobre a base da ciência aberta e do código aberto
    • PyTorch, Tensorflow, Keras, transformers e diffusers foram citados como tecnologias de código aberto criadas nos EUA
    • Ele afirmou que, sem essas tecnologias, os EUA talvez não fossem líderes em IA

Abertura ética proposta em meio à controvérsia do LLaMA

  • O depoimento de Delangue ocorreu duas semanas após senadores questionarem Mark Zuckerberg sobre o vazamento do LLaMA, o LLM de código aberto da Meta
    • A carta demonstrava preocupação com a possibilidade de o LLaMA ser usado para spam, fraude, malware, violação de privacidade, assédio e outras condutas inadequadas e prejudiciais
    • A disseminação do LLaMA elevou consideravelmente o nível de sofisticação dos modelos de IA acessíveis ao público em geral, ampliando também as preocupações com uso indevido ou abuso
  • A Hugging Face é uma startup sediada em Nova York que, no ano passado, recebeu uma avaliação de US$ 2 bilhões e se consolidou como um hub de código e modelos open source
    • Em abril, Delangue reuniu mais de 5.000 pessoas em um meetup de tecnologia open source realizado no Exploratorium, em San Francisco
  • Delangue afirmou que ciência aberta e código aberto impulsionam dezenas de milhares de startups que utilizam IA
  • A abertura ética fornece à sociedade civil, organizações sem fins lucrativos, academia e formuladores de políticas a capacidade necessária para equilibrar o poder de grandes empresas privadas
    • Ajuda a evitar sistemas de caixa-preta e aumentar a responsabilização das empresas
    • Pode contribuir para mitigar vieses, reduzir desinformação, fortalecer direitos autorais e compensar partes interessadas, incluindo artistas e criadores de conteúdo
  • A abordagem da Hugging Face reúne políticas institucionais, salvaguardas técnicas e incentivos da comunidade
    • Inclui documentação e model cards, entre eles os model cards pioneiros de Dr. Margaret Mitchell
    • Usa restrição de acesso a artefatos e lançamentos graduais como salvaguardas técnicas
    • Moderação da comunidade e conjuntos de dados com opt-in e opt-out também fazem parte da estrutura de incentivos
  • Nos últimos meses, com uma sequência de lançamentos de grandes modelos de linguagem e a reação de startups, coletivos e da academia contra a migração para LLMs fechados e proprietários, o debate sobre IA de código aberto ficou ainda mais acalorado

1 comentários

 
GN⁺ 2023-06-29
Comentários do Hacker News
  • Este é um microcosmo perfeito de como o sistema funciona. O cara está certo, mas chegou tarde demais, com pouco dinheiro e sem receber atenção suficiente
    Enquanto isso, Sam Altman é o rosto de um produto para o consumidor com uma excelente equipe de marketing e até lobistas, recebeu bilhões de dólares da Microsoft e ainda tem um produto que qualquer pessoa pode testar de graça
    Basta entrar primeiro e espalhar o discurso dos riscos da IA, convencendo os parlamentares de que a tecnologia mais recente é perigosa. Como a OpenAI logo passa a ser tratada como sinônimo da tecnologia de ponta, as pessoas seguem o líder do setor sem olhar direito para onde ele está indo, e acabamos chegando até aqui
    Eu gostaria que o software de código aberto fosse representado de forma justa nos tribunais, mas ideias não conseguem pagar as próprias contas e a voz do dinheiro é alta demais

    • Altman não foi ao Congresso para convencê-lo de que “a IA mais recente é perigosa”; foi Blumenthal quem o convidou para criar um pretexto que pudesse mostrar à imprensa
      O Congresso sente o peso de ter deixado as redes sociais correrem soltas e está ansioso para regular IA. Na audiência não houve divergência real, e as intenções do governo e da indústria coincidem perfeitamente. Estão estendendo o tapete vermelho para o controle centralizado, eliminando a concorrência por meio da regulação
    • Os interesses do governo provavelmente se alinham melhor com o lado da OpenAI, e talvez até fosse tolice não eliminar modelos abertos/locais
      O que roda localmente contorna a fronteira de rede onde dá para interceptar e vigiar. Perguntar algo ao Google fica registrado, o histórico de busca pode ser obtido com intimação, e o mesmo vale para registros de empréstimo de bibliotecas públicas. Um operador de pedágio como a OpenAI pode assumir esse papel e cobrar por ele
      Se você fizer a mesma pesquisa com algo como Vicuna-13B-ggml, ninguém consegue sniffar o que você está fazendo. Isso parece ótimo para quem quer ficar em paz, mas tem implicações assustadoras para quem precisa impedir usos mais maliciosos
      Infelizmente, nesses temas quase não há espaço para compromisso. O melhor cenário seria algo como a lei recente da Holanda, em que o governo pode invadir dispositivos pessoais se houver motivo suficiente, mas isso provavelmente não vai acontecer. A única alternativa favorável ao governo seria proibir os modelos locais e o próprio desenvolvimento open source deles
    • Também é terrível, em termos de percepção pública, que a OpenAI seja erroneamente associada a open source por causa do nome. Assim, duas abordagens opostas acabam parecendo misturadas para o público
    • Você realmente acha que já é tarde demais? Ainda não estamos só no começo?
    • Um motivo para otimismo é que os lobistas que querem fechar a IA têm a fraqueza de que o Congresso hoje em dia mal consegue fazer as coisas, e o status quo neste caso é “não fazer nada”
      Para vencer a resistência natural do status quo, seria necessário um grande apoio popular, e esse apoio não existe, além de ser muito caro tentar comprá-lo
  • Open source é um componente essencial para criar uma sociedade digital saudável mais próxima dos valores que defendemos
    A IA é importante, mas no conjunto dessa transformação ela acaba sendo só uma parte pequena. Vale lembrar que o Bitcoin, que tenta abalar os fundamentos da vida econômica, também é open source
    O processo evolutivo de implantar capacidades open source em escala social não é automático nem obviamente bom. O exemplo das criptomoedas acima mostra isso
    Ainda há muita tecnologia, instituições e modos de agir para imaginar, desenvolver, testar e difundir. Essa é uma boa tarefa para os engenheiros da “sociedade” digital do presente e do futuro arregaçarem as mangas e resolverem
    Tenho dificuldade de imaginar um universo que não seja distópico. Se alguém já apresentou uma visão monopolista que seja moralmente compatível com autonomia individual, liberdade e controle democrático, e ao mesmo tempo intelectualmente honesta sobre seus próprios incentivos, eu sinceramente gostaria de saber

  • O CEO da Hugging Face mandou bem. Compartilhei com amigos e familiares um link de YouTube de 5 minutos, e ele explicava muito bem as vantagens de modelos abertos e open source

    • Pode passar o link do vídeo?
  • Neste caso, parece um exemplo em que a diferença entre open source e software livre fica bem importante

    • No caso de LLMs, eu realmente queria que parassem de chamar de “open source” modelos cujo código-fonte ou pesos simplesmente vazaram
      O mesmo vale para modelos divulgados intencionalmente, mas com licença restrita a “uso não comercial” ou que só permite uso comercial quando não “concorre” com a empresa que os publicou
    • Mesmo sem ficar preso demais à semântica, o importante aqui é a troca livre de ideias, algoritmos e parte do código
      O progresso desta área nos últimos 20 anos foi enormemente acelerado por essa troca. Em vez de as empresas guardarem os resultados para si e protegerem seu molho secreto, elas compartilham muitos detalhes e validam o trabalho reproduzindo, melhorando e verificando os resultados umas das outras
      A OpenAI fez o ChatGPT, a Meta fez o Llama e o Google está com o Bard. O Llama foi liberado, até certo ponto, para a comunidade open source, e as pessoas agora o usam, melhoram e o comparam com seus próprios modelos e benchmarks
    • Open source sempre é importante. Sem open source, é difícil criar um bom pipeline de entrada de desenvolvedores. Outras áreas da engenharia também deveriam mirar algo parecido. Claro, isso não quer dizer que software fechado não possa existir
      Pelo menos em geração de imagens, parece que, com o treinamento sendo feito de forma colaborativa, os modelos abertos agora produzem resultados muito melhores
    • Sinceramente, sinto o contrário. Quanto mais software open source, melhor, mas não me parece que tornar LLMs open source vá reduzir muito o maior risco que eu vejo nos LLMs
  • É estranho ver a Hugging Face saindo nas notícias desse jeito. Lembro de ter contribuído com um patch por volta do verão de 2019, quando o projeto tinha algo como 4 mil estrelas, e eu já o achava bem popular naquela época

    • Imagine daqui a 5 anos ;)
  • Qual é o objetivo final da Hugging Face? Virar o GitHub para IA?

    • Sou o CEO da Hugging Face. Espero que sim, se isso puder ajudar a sustentar uma boa democratização da IA graças à ciência aberta e ao open source. Você acha isso útil?
    • A interface parece uns 90% com a do GitHub, então isso parece bem óbvio
      Eles também estão tentando expandir para treinamento de modelos de IA e execução de inferência. Mas o custo de inferência parece muito pouco competitivo em comparação com provedores de GPU como a CoreWeave
    • Seja lá o que for, eu realmente, realmente, realmente, realmente espero que não acabe nas mãos da Microsoft, do Google ou de empresas assim. Claro, no fim provavelmente vai acontecer e a enshittification virá junto
    • Já não é assim?
    • Ser adquirida pela AWS?
  • Gosto do fato de ele ainda parecer uma pessoa bastante acessível nas redes sociais

  • Por que o Congresso está se metendo até em software, open source e IA?

  • Queria saber se ele já viu o projeto Bittensor e qual é a opinião dele. Vale considerar alguma integração?
    Acho que pode ajudar projetos como esse e o movimento de IA open source

  • A maioria dos modelos no Hugging Face não está sob alguma licença estranha do tipo RAIL, em vez de open source?

    • Pelo menos no GitHub, a maioria dos projetos deles usa licença MIT ou Apache 2.0. Será que perdi alguma coisa?