1 pontos por GN⁺ 1 시간 전 | 1 comentários | Compartilhar no WhatsApp
  • 25 empresas de tecnologia, incluindo Nvidia, Microsoft, Meta e Palantir, pediram cautela aos formuladores de políticas, afirmando que restrições precipitadas a modelos de IA de pesos abertos podem sufocar a concorrência e empurrar a inovação para fora do país
  • Modelos de pesos abertos, que usuários podem baixar, modificar e executar em sua própria infraestrutura, ampliam a difusão dos benefícios da tecnologia; concentrar capacidades avançadas em poucos modelos fechados também pode aumentar riscos de invasão, uso indevido e falhas difíceis de detectar externamente
  • O Kimi K3, da chinesa Moonshot AI, superou modelos avançados dos EUA em alguns benchmarks do setor, ampliando o debate sobre restrições de acesso nos EUA; a Casa Branca levantou suspeitas de destilação clandestina de tecnologia da Anthropic
  • As empresas defendem que a destilação ilegal seja tratada por meio de estruturas jurídicas e comerciais direcionadas, e não com restrições tecnológicas amplas; elas consideram que a destilação legítima tem papel importante em um ecossistema aberto de inovação
  • OpenAI e Anthropic não assinaram a carta, mas executivos da OpenAI apoiaram o acesso amplo a modelos; o caso em que a Hugging Face bloqueou rapidamente ataques cibernéticos contra modelos da OpenAI usando o GLM 5.2, da chinesa Z.ai, também mostra o potencial de uso de modelos de pesos abertos

Resposta conjunta de 25 empresas

  • Nvidia, Microsoft, Meta, Palantir e outras 25 empresas de tecnologia publicaram uma carta conjunta pedindo que autoridades evitem “restrições precipitadas” a modelos de IA de pesos abertos
    • Elas alertam que a regulação pode sufocar a concorrência ou empurrar a inovação para fora do país
    • Jensen Huang, CEO da Nvidia, e Satya Nadella, CEO da Microsoft, compartilharam a carta em suas respectivas contas nas redes sociais
    • Elon Musk também disse que “apoia totalmente”, mas a SpaceX não está entre as signatárias oficiais
  • Modelos de pesos abertos são modelos de IA que usuários podem baixar, modificar e executar em sua própria infraestrutura

Ascensão dos modelos chineses e debate sobre restrições de acesso

  • À medida que modelos chineses de pesos abertos aumentam sua competitividade frente aos principais modelos da OpenAI e da Anthropic, a possibilidade de restringir o acesso a modelos chineses nos EUA tornou-se um ponto de debate entre autoridades do governo americano e executivos de empresas
  • O Kimi K3, divulgado pela startup chinesa Moonshot AI, registrou desempenho superior ao de modelos avançados dos EUA em alguns benchmarks do setor
  • O secretário do Tesouro dos EUA, Scott Bessent, afirmou que o governo Trump tem capacidade para investigar se empresas chinesas roubaram propriedade intelectual dos EUA e aplicar sanções caso o roubo seja confirmado

Por que um ecossistema aberto é necessário

  • Modelos de pesos abertos podem fortalecer a concorrência e impedir que os benefícios da tecnologia se concentrem em poucos atores
  • Usar apenas modelos fechados não os torna inerentemente mais seguros
    • Modelos fechados também podem ser invadidos ou usados de forma indevida
    • Eles também podem falhar de maneiras que pessoas de fora não conseguem detectar
    • Concentrar capacidades avançadas de IA em poucos modelos fechados aumenta esses riscos
  • A liderança dos EUA em IA deve ser avaliada não por um único modelo de fronteira, mas pela capacidade de construir um ecossistema forte e aberto em todos os setores, o que, segundo a posição das empresas, é necessário para criar oportunidades de inovação e prosperidade em todo o país

Ausência da OpenAI e da Anthropic

  • OpenAI e Anthropic não assinaram a carta conjunta
    • As duas empresas são avaliadas em cerca de US$ 1 trilhão cada e podem buscar grandes ofertas públicas iniciais já em 2026
    • A Anthropic apresentou em junho um prospecto confidencial à Comissão de Valores Mobiliários dos EUA, e a OpenAI seguiu o mesmo procedimento alguns dias depois
  • Greg Brockman, presidente da OpenAI, disse apoiar o acesso amplo e afirmou que não discutiu com o governo Trump uma proibição de modelos chineses de pesos abertos nos EUA
    • Ele considera importante democratizar a IA e seu uso, e vê como desejáveis mais modelos e usos mais amplos
  • Sam Altman, CEO da OpenAI, saudou a carta conjunta, dizendo que quer que os EUA vençam tanto em modelos de pesos abertos quanto em modelos proprietários

Resposta da Hugging Face a ataques cibernéticos

  • A Hugging Face usou um modelo de pesos abertos da chinesa Z.ai para deter ataques cibernéticos realizados por modelos fora do controle da OpenAI
    • A OpenAI divulgou o ataque e o classificou como um “incidente cibernético sem precedentes”
  • Inicialmente, a empresa tentou analisar o ataque com o Fable 5, da Anthropic, mas não pôde usá-lo porque as guardrails do modelo não conseguiram reconhecer o objetivo defensivo da Hugging Face
  • Depois, usando um caso relacionado ao GLM 5.2 da Z.ai, a empresa bloqueou o ataque com muita rapidez

Questões em torno da destilação de modelos

  • Michael Kratsios, assessor da Casa Branca, afirmou que a Moonshot AI desenvolveu o Kimi K3 por meio da destilação (distillation) de tecnologia da Anthropic
  • Destilação é um método em que um modelo de menor escala e desempenho é treinado usando saídas geradas por um modelo existente mais poderoso
  • Kratsios traçou uma distinção ao dizer que a destilação legítima de IA tem papel importante em um ecossistema aberto de inovação, mas que a destilação industrial em grande escala e clandestina para roubar tecnologia proprietária dos EUA não pode ser tolerada
  • A carta conjunta pede que preocupações com destilação ilegal sejam resolvidas por meio de estruturas jurídicas e comerciais direcionadas, e não por restrições abrangentes a tecnologias importantes para a inovação em IA

1 comentários

 
GN⁺ 1 시간 전
Comentários do Hacker News
  • Provavelmente porque a Anthropic investiu US$ 40 milhões em um grupo político para regulamentação de modelos e também vem querendo a proibição/regulação de modelos open source
    https://www.anthropic.com/news/donation-public-first-action
    Mesmo assim, não entendo por que tratam a Anthropic como a mocinha ética
    • Não sei se em geral ela é tratada assim, mas no começo ganhou bastante publicidade ao recusar o uso de modelos para fins de guerra pelo governo dos EUA
  • Assino os planos 20x mais caros do Claude e do Codex, e agora também uso o Kimi
    porque só o K3 é um modelo de ponta capaz de conversar seriamente sobre a segurança do meu produto, e eu também me inscrevi no Cyber Pilot da OpenAI, mas não recebi resposta
    • A estratégia de produto de fazer IA de consumo deliberadamente criar software inseguro e depois dar acesso restrito, mediante pagamento, aos modelos que podem corrigir isso apenas para clientes considerados qualificados é perversa
      Na prática, uma IA de nível 3 que consegue hackear as duas categorias anteriores é vendida só para quem pagar mais caro
    • Segurança de produto deve ser discutida seriamente com especialistas realmente treinados na área
      A menos que você já saiba mais sobre o tema do que um LLM, ou seja uma ferramenta interna em que o resultado não importa tanto, LLM não serve para nada
  • Agora o campo dos modelos fechados que quer proibir open weights foi basicamente derrotado politicamente, e o Musk também apoiou isso publicamente
    Isso me lembra quando a SOPA causou uma reação parecida e todo mundo se opôs: https://en.wikipedia.org/wiki/Stop_Online_Piracy_Act
  • A discussão relacionada já vem acontecendo há várias rodadas
    Startup founders urge U.S. government not to shut off Chinese open weight AI - https://news.ycombinator.com/item?id=49023016 - julho de 2026, 841 comentários
    OpenAI and Anthropic unite against open-weight AI risks to their bottom line - https://news.ycombinator.com/item?id=49020868 - julho de 2026, 330 comentários
    China’s open-weights AI strategy is winning - https://news.ycombinator.com/item?id=48979269 - julho de 2026, 932 comentários
    The gap between open weights LLMs and closed source LLMs - https://news.ycombinator.com/item?id=48692058 - junho de 2026, 250 comentários
    The unbearable cheapness of open weight models - https://news.ycombinator.com/item?id=48668255 - junho de 2026, 186 comentários
  • Fico curioso sobre o que está acontecendo nos bastidores para várias empresas publicarem uma carta conjunta dessas
    • No fim, é bem provável que a maioria das empresas passe a operar modelos locais
      Caso contrário, toda empresa que usar LLM ficará totalmente subordinada à Anthropic e afins, e no momento em que essa dependência se consolidar elas vão extrair lucros em nível absurdo
      Quanto mais concorrentes fortes houver em um setor, melhor para todos, exceto para os próprios concorrentes; mas os concorrentes querem que esse número seja o menor possível
    • A NVIDIA vende ferramentas, então quanto mais modelos existirem, melhor para ela
      Microsoft e Meta hoje estão correndo por fora, e para alcançarem as líderes talvez a melhor aposta seja usar sua própria infraestrutura e modelos abertos
    • A NVIDIA sofre restrições de exportação de GPUs para a China
      Com isso, institutos chineses fizeram provedores de hospedagem dos EUA, sem essas restrições, operarem seus modelos open weight, e na Europa Scaleway e Hetzner também estão entrando no mercado de hospedagem de inferência para modelos chineses
      Para a NVIDIA, quanto mais provedores de inferência operarem vários modelos chineses que ela originalmente não poderia atender, melhor
    • Já vi autoridades do governo repetindo a lógica do lobby da OpenAI e da Anthropic, e essas empresas são espertas o bastante para reconhecer os sinais de uma captura regulatória iminente
      Falando cinicamente, o atual governo dos EUA também não ajuda
    • Cada empresa tem motivações diferentes e algumas podem ser sinceras, mas muitas talvez tenham concluído que já perderam a disputa contra OpenAI, Anthropic e Google e mudado de estratégia
      A Microsoft já fez esse tipo de virada várias vezes no passado
  • Fico me perguntando quanto das técnicas de otimização dos modelos chineses foi incorporado ao Claude e ao Codex
    • Há muitas otimizações que institutos chineses publicaram diretamente em artigos, mas é difícil saber o que cada instituto faz internamente
    • Eu lembrava que a DeepSeek tinha apresentado primeiro os modelos de raciocínio, mas fui conferir e o1 veio antes
    • A DeepSeek publicou vários bons artigos e, recentemente, vem pressionando forte por tecnologias que reduzem drasticamente o custo de serving
    • Mesmo sem intenção, isso é inevitável até certo ponto
      Todos os modelos consomem informação pública disponível e ao mesmo tempo geram nova informação pública, bebendo água do mesmo poço e depois devolvendo esse fluxo
      Se a teoria da internet morta estiver certa, a quantidade de informação gerada por LLMs por interpolação e extrapolação de informação existente será muito maior do que a informação obtida diretamente do mundo real ou criada de forma original
      No fim, os modelos podem convergir para dados parecidos e entrar num enorme ciclo de feedback generativo em que só o comportamento varia um pouco
    • Se a direção não estiver aproveitando ao máximo as tecnologias disponíveis, os investidores deveriam trocar a gestão
  • É revelador que NVIDIA, Meta e Microsoft tenham assinado esta carta, mas o fato de Google e Amazon não terem assinado também é
    • Pelo que sei, Google e Amazon são investidores da Anthropic
    • A Amazon hospeda modelos open weight como Ministral 14B 3.0 e DeepSeek V3.2 no Amazon Bedrock, então não entendo muito bem que implicação haveria no fato de não assinar
      https://docs.aws.amazon.com/bedrock/latest/userguide/model-c...
      Para referência, sou funcionário da Meta, mas esta é uma opinião pessoal
  • A Microsoft também publicou sua posição sobre open weights
    https://www.microsoft.com/en-us/corporate-responsibility/top...
    • A Microsoft está se posicionando como uma empresa de hospedagem de modelos e já oferece modelos open weight muito mais baratos em sua própria infraestrutura, então é uma escolha natural
      OpenAI e Anthropic têm motivo para temer
  • MSFT, Dell e NVIDIA são fornecedoras de hardware, então podem ganhar dinheiro independentemente de qual IA seja usada
    Todas têm participação em laboratórios de modelos de ponta, mas os modelos open weight chineses vão transformar a camada de inteligência em commodity