2 pontos por GN⁺ 15 시간 전 | 1 comentários | Compartilhar no WhatsApp
  • Kimi Work é um agente de IA para desktop que combina conexão com arquivos locais, automação de navegador, execução de código em segundo plano e tarefas agendadas para realizar trabalhos aprofundados
  • Com um motor Cron embutido, automatiza chamadas de agentes LLM e execuções de Python e Shell diariamente, por hora ou conforme condições, e também oferece suporte a tarefas noturnas com Keep Computer Awake
  • O WebBridge navega entre várias abas, realizando cliques, rolagem e extração de dados para conduzir pesquisas na web e tarefas de várias etapas de forma autônoma
  • O Agent Swarm, que coordena vários agentes especializados, processa tarefas complexas em paralelo e converte resultados de pesquisa em PowerPoint ou Excel
  • Fornece por padrão dados de ações da China continental, Hong Kong e Estados Unidos, e solicita aprovação explícita com Ask before acting antes de modificar ou sobrescrever arquivos locais e antes de executar código

Automação de trabalho no desktop

  • Diferente do app web do Kimi, mais adequado para chats rápidos e consultas, o Kimi Work é um agente local que monta pastas locais para executar trabalhos aprofundados
  • O agendador Cron integrado executa tarefas repetitivas em segundo plano
    • É possível chamar um agente LLM no início da manhã para redigir um briefing diário
    • À meia-noite, é possível processar grandes conjuntos de dados com um script Python
    • É possível iniciar chamadas de agentes LLM e execuções de Python e Shell diariamente, por hora ou de forma condicional
    • Em execuções noturnas, é possível ativar Keep Computer Awake nas configurações
  • O WebBridge recebe um objetivo por prompt e navega por várias abas, executando de forma autônoma cliques, rolagem e extração de dados
    • Pode verificar as últimas notícias de sites e resumi-las, ou coletar dados históricos de ações e salvá-los em um Excel local
  • O Agent Swarm coordena automaticamente vários agentes especializados para decompor e resolver problemas em várias camadas ao mesmo tempo
    • Pode converter resultados de pesquisa em apresentações profissionais de PowerPoint ou planilhas do Excel

Dados financeiros e controle de arquivos locais

  • Os dados de mercado de ações da China continental, Hong Kong e Estados Unidos já vêm integrados, podendo ser usados sem configurações complexas de API
    • Em linguagem natural, é possível carregar relatórios de resultados, analisar anomalias de mercado e conferir planilhas
  • O controle sobre os arquivos locais permanece com o usuário
    • A proteção Ask before acting solicita aprovação explícita antes de modificar ou sobrescrever arquivos em diretórios locais ou antes de executar código
    • Sem o consentimento do usuário, essas ações não são executadas

1 comentários

 
Comentários do Hacker News
  • Kimi Work é um agente local que monta pastas locais, navega na web com o WebBridge e executa código Python e tarefas agendadas em segundo plano
    O design lembra bastante o Codex, mas o objetivo do Kimi parece ser mais alcançar paridade de funcionalidades com os grandes laboratórios do que criar desde o início uma UI de agente futurista
    A principal vantagem competitiva é um modelo barato e próximo da fronteira, e tudo de que ele precisa é de uma camada de aplicativo para conectá-lo. O próprio clone também é uma boa demonstração de que a camada de aplicativo pode virar uma commodity genérica
    • Todo mundo já está clonando a camada de aplicativo. Já existem mais de 30 clones do Claude Code, o Codex também clonou o Cowork, e Grok e Gemini estão indo na mesma direção
    • Olhando para o Kimi Code, é difícil acreditar que ele foi feito sobre uma base de código diferente da do Claude Code
    • O Kimi tem vantagem de custo, então basta deixá-lo bom o suficiente e clonar. Isso pode ser o começo do declínio dos laboratórios dos EUA
    • Nesse caso, talvez devesse existir uma base open source para execução de agentes em torno da qual a demanda pudesse se concentrar
    • O K3 está superando o Fable em vários benchmarks. Então isso significa que o Fable 5 também não é um modelo de fronteira? Afinal, o que exatamente é considerado um modelo de fronteira?
  • Chamar de clone não está errado, mas se você consegue oferecer a mesma coisa por 1/5 do preço, então deixa de ser clone e vira um produto vencedor
    • Bicicletas, carros, câmeras, pontes, barragens e smartphones são todos parecidos. O essencial de UX é que seja utilizável e familiar para o usuário
      Chamar de mera cópia alguém que fez uma GPU que funciona como uma GPU é uma atitude de quem não entende engenharia. A parte difícil não é imaginar o conceito em alto nível, e sim implementar algo que realmente funcione; mesmo que se possa desmontar um produto e estudá-lo, projetá-lo e construí-lo por conta própria exige bastante especialização
      Não é difícil olhar para um computador pessoal e imaginar que seria bom se fosse mais rápido, menor e coubesse no bolso. Quanto menos se entende o funcionamento interno, mais a discussão exagera elementos superficiais como UI ou cantos arredondados
    • Tenho dúvidas de que o Kimi seja realmente 1/5 do preço. No Artificial Analysis, ele aparece com o mesmo preço do GPT 5.6 Sol e desempenho inferior
    • Se ele não consegue responder nem perguntas simples sobre os uigures ou a Praça da Paz Celestial, então mesmo que seja um produto vencedor, é um produto frágil
  • O Kimi parece ter copiado o Codex quase 1 para 1, o que o torna especialmente descarado. Já existiam Conductor e várias GUIs antes do Codex, mas desta vez parece até que copiaram o próprio código
    A orientação sobre privacidade também induz ao erro. Dizem que pedem aprovação antes de modificar ou sobrescrever arquivos e antes de executar código, mas não deixam claro que a permissão de leitura de arquivos é concedida de forma irrestrita e sem consentimento
    • Não é natural que um agente de programação tenha permissão para ler arquivos? É parecido com reclamar que o Dropbox tem acesso irrestrito aos arquivos
    • Fico me perguntando se as pessoas ainda acreditam que software chinês sempre vigia, enquanto software americano só vigia se avisar
      O mais razoável é presumir que software de qualquer país coleta o máximo de dados possível, dentro do que lhe é permitido. A menos que você esteja executando código open source compilado e auditado por você mesmo, não há como garantir nada
    • Em vez de parecer com o Codex, isso se parece mais com um site comum de chat com IA, com uma área de conversa com IA ao lado e ações frequentes no topo
    • O compartilhamento entre empresas de IA, seja por coleta de material na internet ou migração de funcionários entre companhias, já parece quase uma tradição do setor
    • O Codex não é Apache 2.0? https://github.com/openai/codex
  • É um clone bem descarado, mas isso também mostra como é fácil clonar. OpenAI e Anthropic tiveram a vantagem de quem chega primeiro, mas vantagens obtidas com facilidade podem desaparecer com facilidade
    • Neste ponto, dá para dizer que praticamente não existe barreira de entrada
  • O mais surpreendente no boom de IA é que ninguém conseguiu construir uma dependência séria de fornecedor. É fácil demais mudar para outro serviço
  • Seria bom ter opções como hospedagem nos EUA ou uma política de não retenção de dados (NDR). Gosto do preço e do desempenho, mas me preocupam a soberania dos dados e o vazamento de propriedade intelectual para empresas estrangeiras
    • Logo após a divulgação dos pesos do K3 em 27 de julho, é bem provável que vários provedores nos EUA passem a hospedar o modelo
      Isso é separado do próprio Kimi Work, mas parece provável que surjam opções nos EUA para acesso ao K3 dentro de uma semana. Dá para ver provedores que hospedam o K2.6 no OpenRouter: https://openrouter.ai/moonshotai/kimi-k2.6
    • Quando os pesos do K3 forem divulgados, há grande chance de ele entrar também no Amazon Bedrock
    • Não tenho intenção de enviar dados para uma empresa chinesa. Além da questão de propriedade intelectual, mesmo tentando apagar seu caráter chinês, como a ByteDance fez, a chance de sofrer restrições de serviço nos EUA continua muito alta
  • Eles copiaram a frase “Let's take something off your plate” da UI do Claude Cowork sem mudar uma única palavra e ainda a colocaram exatamente assim na primeira tela da imagem principal
  • Fico curioso para saber quando vão perceber que, mais do que execução local, a solução é auto-hospedagem on-premise
  • Seguindo o padrão do passado, talvez já na próxima semana apareça um modelo destilado inferior ao GPT 5.6 ou Mythos, mas que supere o Kimi K3 por uma margem pequena
  • Seria bom, como no Claude Code Desktop, integrar a UI de código em abas. Não há motivo para separar as ferramentas ou oferecer só uma TUI no terminal
    Ao instalar o Kimi CLI, já dá para rodar uma UI web local: https://www.kimi.com/help/kimi-code/cli-getting-started
    kimi server run --foreground
    Mas o botão para parar o rastreamento de subagentes não funciona, alguns toggles das configurações não podem ser alterados, e quando a conversa passa de 600 turnos ela fica tão lenta que a entrada pelo teclado atrasa vários segundos
    Pessoalmente, ainda achei o ZCode melhor. Pretendo escrever também sobre o uso do K3; a base de execução de agentes ainda precisa de mais polimento, mas o modelo em si é excelente