- Em uma audiência do Comitê de Ciência da Câmara dos EUA, o CEO da Hugging Face, Clement Delangue, destacou que ciência aberta e IA de código aberto estão fortemente alinhadas com os valores e interesses dos Estados Unidos
- Delangue considera que ferramentas de código aberto criadas nos EUA, como PyTorch, Tensorflow, Keras, transformers e diffusers, têm sustentado o avanço da IA e a posição de liderança americana
- O depoimento veio duas semanas após senadores questionarem as possibilidades de uso indevido após o vazamento do LLaMA da Meta, incluindo spam, fraude, malware, violação de privacidade e assédio
- Ele explicou que a abertura ética dá à sociedade civil, organizações sem fins lucrativos, academia e formuladores de políticas a capacidade de conter grandes empresas privadas e reduzir sistemas de caixa-preta
- A Hugging Face busca combinar abertura e salvaguardas por meio de model cards, restrição de acesso, lançamento gradual, moderação da comunidade e conjuntos de dados com opt-in e opt-out
Defesa da IA de código aberto em audiência da Câmara dos EUA
- O CEO da Hugging Face, Clement Delangue, depôs na audiência plenária do Comitê de Ciência da Câmara dos EUA Artificial Intelligence: Advancing Innovation Towards the National Interest
- Também participaram da mesma audiência o CEO da RAND Corporation, Jason Matheny, o general partner da Lux Capital, Shahin Farshchi, a fellow de IA responsável da Harvard University, Rumman Chowdhury, e o diretor-executivo do Center for Security and Emerging Technology da Georgetown University, Dewey Murdick
- Delangue considera que os avanços recentes em IA só foram possíveis sobre a base da ciência aberta e do código aberto
- PyTorch, Tensorflow, Keras, transformers e diffusers foram citados como tecnologias de código aberto criadas nos EUA
- Ele afirmou que, sem essas tecnologias, os EUA talvez não fossem líderes em IA
Abertura ética proposta em meio à controvérsia do LLaMA
- O depoimento de Delangue ocorreu duas semanas após senadores questionarem Mark Zuckerberg sobre o vazamento do LLaMA, o LLM de código aberto da Meta
- A carta demonstrava preocupação com a possibilidade de o LLaMA ser usado para spam, fraude, malware, violação de privacidade, assédio e outras condutas inadequadas e prejudiciais
- A disseminação do LLaMA elevou consideravelmente o nível de sofisticação dos modelos de IA acessíveis ao público em geral, ampliando também as preocupações com uso indevido ou abuso
- A Hugging Face é uma startup sediada em Nova York que, no ano passado, recebeu uma avaliação de US$ 2 bilhões e se consolidou como um hub de código e modelos open source
- Em abril, Delangue reuniu mais de 5.000 pessoas em um meetup de tecnologia open source realizado no Exploratorium, em San Francisco
- Delangue afirmou que ciência aberta e código aberto impulsionam dezenas de milhares de startups que utilizam IA
- A abertura ética fornece à sociedade civil, organizações sem fins lucrativos, academia e formuladores de políticas a capacidade necessária para equilibrar o poder de grandes empresas privadas
- Ajuda a evitar sistemas de caixa-preta e aumentar a responsabilização das empresas
- Pode contribuir para mitigar vieses, reduzir desinformação, fortalecer direitos autorais e compensar partes interessadas, incluindo artistas e criadores de conteúdo
- A abordagem da Hugging Face reúne políticas institucionais, salvaguardas técnicas e incentivos da comunidade
- Inclui documentação e model cards, entre eles os model cards pioneiros de Dr. Margaret Mitchell
- Usa restrição de acesso a artefatos e lançamentos graduais como salvaguardas técnicas
- Moderação da comunidade e conjuntos de dados com opt-in e opt-out também fazem parte da estrutura de incentivos
- Nos últimos meses, com uma sequência de lançamentos de grandes modelos de linguagem e a reação de startups, coletivos e da academia contra a migração para LLMs fechados e proprietários, o debate sobre IA de código aberto ficou ainda mais acalorado
1 comentários
Comentários do Hacker News
Este é um microcosmo perfeito de como o sistema funciona. O cara está certo, mas chegou tarde demais, com pouco dinheiro e sem receber atenção suficiente
Enquanto isso, Sam Altman é o rosto de um produto para o consumidor com uma excelente equipe de marketing e até lobistas, recebeu bilhões de dólares da Microsoft e ainda tem um produto que qualquer pessoa pode testar de graça
Basta entrar primeiro e espalhar o discurso dos riscos da IA, convencendo os parlamentares de que a tecnologia mais recente é perigosa. Como a OpenAI logo passa a ser tratada como sinônimo da tecnologia de ponta, as pessoas seguem o líder do setor sem olhar direito para onde ele está indo, e acabamos chegando até aqui
Eu gostaria que o software de código aberto fosse representado de forma justa nos tribunais, mas ideias não conseguem pagar as próprias contas e a voz do dinheiro é alta demais
O Congresso sente o peso de ter deixado as redes sociais correrem soltas e está ansioso para regular IA. Na audiência não houve divergência real, e as intenções do governo e da indústria coincidem perfeitamente. Estão estendendo o tapete vermelho para o controle centralizado, eliminando a concorrência por meio da regulação
O que roda localmente contorna a fronteira de rede onde dá para interceptar e vigiar. Perguntar algo ao Google fica registrado, o histórico de busca pode ser obtido com intimação, e o mesmo vale para registros de empréstimo de bibliotecas públicas. Um operador de pedágio como a OpenAI pode assumir esse papel e cobrar por ele
Se você fizer a mesma pesquisa com algo como Vicuna-13B-ggml, ninguém consegue sniffar o que você está fazendo. Isso parece ótimo para quem quer ficar em paz, mas tem implicações assustadoras para quem precisa impedir usos mais maliciosos
Infelizmente, nesses temas quase não há espaço para compromisso. O melhor cenário seria algo como a lei recente da Holanda, em que o governo pode invadir dispositivos pessoais se houver motivo suficiente, mas isso provavelmente não vai acontecer. A única alternativa favorável ao governo seria proibir os modelos locais e o próprio desenvolvimento open source deles
Para vencer a resistência natural do status quo, seria necessário um grande apoio popular, e esse apoio não existe, além de ser muito caro tentar comprá-lo
Open source é um componente essencial para criar uma sociedade digital saudável mais próxima dos valores que defendemos
A IA é importante, mas no conjunto dessa transformação ela acaba sendo só uma parte pequena. Vale lembrar que o Bitcoin, que tenta abalar os fundamentos da vida econômica, também é open source
O processo evolutivo de implantar capacidades open source em escala social não é automático nem obviamente bom. O exemplo das criptomoedas acima mostra isso
Ainda há muita tecnologia, instituições e modos de agir para imaginar, desenvolver, testar e difundir. Essa é uma boa tarefa para os engenheiros da “sociedade” digital do presente e do futuro arregaçarem as mangas e resolverem
Tenho dificuldade de imaginar um universo que não seja distópico. Se alguém já apresentou uma visão monopolista que seja moralmente compatível com autonomia individual, liberdade e controle democrático, e ao mesmo tempo intelectualmente honesta sobre seus próprios incentivos, eu sinceramente gostaria de saber
O CEO da Hugging Face mandou bem. Compartilhei com amigos e familiares um link de YouTube de 5 minutos, e ele explicava muito bem as vantagens de modelos abertos e open source
Neste caso, parece um exemplo em que a diferença entre open source e software livre fica bem importante
O mesmo vale para modelos divulgados intencionalmente, mas com licença restrita a “uso não comercial” ou que só permite uso comercial quando não “concorre” com a empresa que os publicou
O progresso desta área nos últimos 20 anos foi enormemente acelerado por essa troca. Em vez de as empresas guardarem os resultados para si e protegerem seu molho secreto, elas compartilham muitos detalhes e validam o trabalho reproduzindo, melhorando e verificando os resultados umas das outras
A OpenAI fez o ChatGPT, a Meta fez o Llama e o Google está com o Bard. O Llama foi liberado, até certo ponto, para a comunidade open source, e as pessoas agora o usam, melhoram e o comparam com seus próprios modelos e benchmarks
Pelo menos em geração de imagens, parece que, com o treinamento sendo feito de forma colaborativa, os modelos abertos agora produzem resultados muito melhores
É estranho ver a Hugging Face saindo nas notícias desse jeito. Lembro de ter contribuído com um patch por volta do verão de 2019, quando o projeto tinha algo como 4 mil estrelas, e eu já o achava bem popular naquela época
Qual é o objetivo final da Hugging Face? Virar o GitHub para IA?
Eles também estão tentando expandir para treinamento de modelos de IA e execução de inferência. Mas o custo de inferência parece muito pouco competitivo em comparação com provedores de GPU como a CoreWeave
Gosto do fato de ele ainda parecer uma pessoa bastante acessível nas redes sociais
Por que o Congresso está se metendo até em software, open source e IA?
O Congresso tem o poder de regular o comércio com países estrangeiros, entre os estados e com as tribos indígenas
Queria saber se ele já viu o projeto Bittensor e qual é a opinião dele. Vale considerar alguma integração?
Acho que pode ajudar projetos como esse e o movimento de IA open source
A maioria dos modelos no Hugging Face não está sob alguma licença estranha do tipo RAIL, em vez de open source?