2 pontos por GN⁺ 2023-10-12 | 1 comentários | Compartilhar no WhatsApp
  • Depois que o ChatGPT alcançou 100 milhões de usuários em 2 meses, aumentou a chance de proliferarem slogans de vendas do tipo “AI for X”, e ficou mais difícil julgar o que é tecnologia real e o que é exagero
  • A vitória do AlphaGo em 2016 e o artigo dos Transformers em 2017 foram avanços importantes, mas o boom atual de IA não garante a substância técnica de todos os produtos
  • No campo comercial, houve casos de uso incorreto de nomes de algoritmos, de empacotar frases if-then como se fossem IA, e até de vender trabalho feito por pessoas como se fosse NLP
  • Ao avaliar um fornecedor, é preciso confirmar diretamente a categoria de machine learning, o algoritmo, a saída preditiva, a função objetivo, a métrica de desempenho, a frequência de mudanças no modelo e a proporção de intervenção humana
  • Se a interface para o usuário for apenas um wrapper fino sobre a API do GPT, ela pode só adicionar custo e trazer pouco benefício; mais importante do que o nome IA é como funciona e quais são os critérios de validação

O pano de fundo para o aumento dos slogans de vendas “AI for X”

  • A IA generativa já mostra capacidades fortes em resposta a perguntas, aprendizagem, geração de imagens e vídeos, e está melhorando rapidamente
    • A vitória do AlphaGo no Go em 2016 foi impressionante, mas foi um caso de aplicação de inteligência de máquina a um problema limitado
    • Em 2017, saiu o artigo dos Transformers
    • Em 2023, o ChatGPT alcançou 100 milhões de usuários em 2 meses
  • Junto com o avanço tecnológico, o hype também cresce, e a onda do GPT pode fazer surgir ainda mais mensagens de venda do tipo “AI for X”
    • Perto do IPO da Uber, surgiram muitas apresentações de startups no formato “Uber for X”; algumas deram certo, mas muitas fracassaram
    • Após a desaceleração das criptomoedas, também apareceu a tendência de “especialistas em cripto” virarem rapidamente “especialistas em IA”
  • O nome IA, por si só, não garante substância técnica
    • Houve pitches de suposta especialização em IA com nomes de algoritmos escritos de forma incorreta
    • Houve casos em que produtos “AI driven” na prática funcionavam com frases if-then
    • Também houve casos de empresas que vendiam a ideia de decompor e recombinar documentos e conhecimento com NLP, mas o trabalho real era feito por pessoas em escritórios no Sudeste Asiático usando teclado
  • Conhecer o nome não é conhecimento, e vender um nome nem sempre é vender tecnologia real

Perguntas para verificar a confiabilidade do fornecedor

  • É preciso perguntar qual categoria ampla de machine learning entra no produto
    • Ex.: aprendizado supervisionado, aprendizado não supervisionado, arquiteturas específicas de redes neurais etc.
  • É preciso confirmar o nome do algoritmo por trás da IA
    • Ex.: XGBoost, BERT etc.
  • É preciso confirmar o que o modelo prevê
    • Deve-se perguntar se a saída preditiva real é 1/0, yes/no ou um número
  • É preciso confirmar a função objetivo que o modelo otimiza
    • Também chamada de função de perda ou função de custo; é a pergunta sobre qual erro o modelo tenta reduzir
  • É preciso confirmar por qual métrica a utilidade do modelo é medida
    • Isso se conecta ao critério para julgar o quanto ele generaliza em dados que ainda não viu
  • É preciso perguntar com que frequência o modelo é alterado e por quê
  • É preciso confirmar quanto trabalho humano entra na “solução de IA”
    • Tarefas automatizadas como NER ou OCR de documentos podem estar em algum ponto do contínuo entre machine learning e Mechanical Turk
    • É preciso verificar a proporção entre machine learning e trabalho humano
  • É preciso verificar se a GUI para o usuário é apenas um wrapper fino sobre a API do GPT
    • Nesse formato, pode ser apenas “GPT as a service”, e o serviço pode só criar custo adicional sem trazer benefício extra

Uma postura de não se deixar intimidar pelos termos

  • Machine learning é poderoso, mas, junto com bons produtos de IA, também podem surgir produtos de baixa qualidade ou até produtos de IA que são lobos em pele de cordeiro
  • Mesmo os grandes termos da área de IA podem ser decompostos em explicações intuitivas, então não é preciso ter medo nem se confundir com linguagem que soa técnica
  • Na prática, quem realmente constrói essas coisas costuma chamar isso de machine learning, e quem compra deve perguntar menos pelo nome e mais pelo modo de funcionamento e pelos critérios de validação

1 comentários

 
GN⁺ 2023-10-12
Opiniões no Hacker News
  • Não sei quem disse isso, mas há uma ótima citação de que gosto: “Só é chamado de IA até começar a funcionar. Veja o autocompletar”
    Quando uma empresa diz que “faz IA”, para um engenheiro de software isso soa como se ela praticamente não soubesse aonde quer chegar com essa IA nem que serviço pretende oferecer

    • Li em algum lugar no HN a frase “inteligência artificial não é uma tecnologia, é uma ideologia”, mas não sei a fonte exata
      Por isso fico cauteloso com a abordagem do tipo “os fins justificam os meios” que projetos de IA costumam envolver. Cada um pode pensar diferente
    • Gosto muito dessa forma de colocar a questão
      Minha consultoria trabalha mapeando ideias que podem ser resolvidas ou aproveitadas com frameworks de machine learning para serviços ou soluções digitais
      O resultado final raramente é chamado de “IA”, mas no fim ainda usamos IA/machine learning. Estamos nisso há um pouco mais de tempo do que a atual febre de IA, e esse nicho é bem interessante
    • Em um livro universitário de IA de 20 anos atrás, um conjunto suficientemente grande de if-else, ou seja, um sistema especialista, também era visto como uma IA rudimentar
      Hoje chamaríamos isso de um monte de if-else hardcoded, mas 40 anos atrás era IA de ponta, e 20 anos atrás ainda valia entrar no livro-texto
    • Isso me lembra a frase que Steve Jobs teria dito quando encontrou a equipe do Dropbox: “Vocês têm um recurso, não um produto”. Concordando ou não, passa uma sensação parecida
    • Já lidei com empresas assim em modo FOMO
      Elas partem da IA, que é a solução, para procurar um problema a resolver, quando idealmente deveria ser o contrário
      É quase certo que vão queimar muito dinheiro repetindo, às pressas, uma abordagem sem sentido. Parece que isso acontece sempre que surge uma nova tecnologia de base, e imagino que houvesse muitas empresas assim na bolha ponto-com
  • Combina bem com a piada clássica: “machine learning costuma ser escrito em Python, e IA é escrita em PowerPoint

  • “Pouco antes do IPO da Uber em 2019, os fundos de venture capital estavam abarrotados de pitches de startups do tipo ‘Uber para X’. Algo como Uber para vagas de estacionamento”
    Argh. O atual presidente francês propôs famosamente “uberizar” a economia, e o que isso significava eram empregos precários que custavam menos para o empregador
    Os executivos C-level do meu trabalho já não param de falar de coisas como IA generativa. Não estou nada animado com a perspectiva de ouvir ainda mais papo furado de marketing sobre tornar tudo “IA” no futuro próximo

  • O engraçado é que o que chamávamos de “IA” parece ter migrado para aspectos que, quando chamamos um humano de “inteligente”, nunca consideraríamos parte da inteligência
    Pegue os robôs da Boston Dynamics como exemplo: não consideramos uma pessoa inteligente por distinguir um gato de uma cadeira, por caminhar sem cair ou por dar um backflip
    Mas, se ela consegue usar criativamente os dados e capacidades físicas que possui para resolver problemas, aí a consideramos inteligente
    Quando nos impressionamos com a “IA” em coisas como robôs, pelo que entendo essa IA está em grande parte na percepção (ir de dados brutos de sensores para um modelo rotulado do mundo) e no controle de atuação (transformar instruções como “avance 1 metro” ou “dê um backflip” em uma sequência real de ações dos atuadores)
    A “inteligência” de fato — decidir abrir uma porta, ir a outro cômodo e trazer pasta de amendoim e pão para concluir a tarefa “faça um sanduíche de pasta de amendoim” — costuma ser em grande parte lógica if-then clássica ou fornecida por um operador humano
    Vejo um padrão parecido em coisas como o ChatGPT. A capacidade de um aluno de decorar um livro-texto e repeti-lo perfeitamente pode ser impressionante, mas não chamaríamos esse aluno de “inteligente”
    Um aluno inteligente é aquele que, mesmo tendo esquecido a prova de um teorema ou a definição exata de algum termo, consegue chegar criativamente à solução correta diante de um novo problema. Os “alunos papagaio” geralmente fracassam miseravelmente nessa parte

    • Discutir o que é ou não é IA é bastante inútil. Não existe uma definição sólida
      Uma vez vi no YouTube um vídeo antigo de um sistema de automação muito primitivo, acho que para uma torre de controle de aeroporto. Provavelmente era dos anos 70, e a pessoa o chamava de IA
      Ela explicava em detalhes o que o software fazia e até mostrava o código, que era literalmente um monte de instruções if/else
      Quando nos acostumarmos com coisas como o ChatGPT, elas também deixarão de ser chamadas de IA, ou então passaremos a falar de “inteligência artificial geral” de forma mais ampla para o próximo alvo
      Até recentemente eu estava no grupo que achava que, se não fosse inteligência artificial geral, não deveríamos chamar de IA, mas, sinceramente, quem se importa? Palavras são apenas ferramentas para transmitir pensamentos
      Se a maioria das pessoas quer chamar o que fazemos hoje de IA, tudo bem, e nem está errado. Não é senciente, mas dá para argumentar que é inteligente segundo alguns critérios, e certamente é artificial. Basta nos entendermos
    • É preciso ser capaz de reter informações básicas para que o cérebro consiga construir algo por cima disso
    • Uma parte muito grande do cérebro é usada em tarefas de percepção e controle motor. Isso não é um problema fácil
      Inteligência não é só raciocínio. Só atravessar um cômodo e pegar um objeto já exige bastante capacidade cerebral
    • Pesquisadores de IA brincam que IA é simplesmente aquilo que computadores ainda não conseguem fazer
  • Nos anos 90, eu tinha um aspirador de pó que vinha com “lógica fuzzy”, que era um termo tecnológico da moda na época
    Quem sabe o que ele realmente fazia. Provavelmente significava apenas que havia ajustes intermediários de potência entre ligado e desligado

    • Eu queria que o ar-condicionado do meu carro, acho que modelo 2015 ou 2016, tivesse lógica fuzzy
      Parece haver uma pequena diferença entre um pouco quente e totalmente quente, mas existe uma troca abrupta entre um pouco frio e um pouco quente
      Às vezes eu só quero mover com o ventilador ar em temperatura ambiente, sem estar quente nem frio
    • Minha lavadora LG de 2010 também tinha lógica fuzzy
  • Acho notável que a Apple continue chamando isso de machine learning

  • IA sempre foi um termo voltado ao consumidor. Em jogos, por exemplo, várias coisas sempre foram chamadas de “IA”

    • Esse tipo de debate beira reescrever a história
      As pessoas basicamente sempre ficaram satisfeitas em chamar qualquer coisa de IA[1], e só quando a IA começa a se sair muito bem em áreas como linguagem natural é que reinventam a linguagem para rebaixá-la
      Durante a minha vida, IA se referiu a qualquer software que imitasse, mesmo que minimamente, algum aspecto de tomada de decisão humana
      Além disso, qual é o ponto? Recusar-se a chamar de IA não muda suas capacidades, para o bem ou para o mal
      Também não muda o fato de que os principais laboratórios de capacidades, exceto o FAIR, estão de fato tentando criar inteligência geral de verdade, e até o FAIR se chama Fundamental AI Research lab por um motivo
      [1] Ex.: a IA dos fantasmas de Pacman — uma expressão totalmente razoável para algo que se resume a algumas linhas de código rodando em um Z80. Wikipedia: “Each of the four ghosts has its own unique artificial intelligence (A.I.), or "personality": ...”
    • Curiosamente, a IA em jogos muitas vezes é truque
      Desenvolvedores frequentemente precisam deixar a IA do jogo bem burra para que ela pareça justa ao jogador, e então compensam dando bônus a ela
      Por exemplo, a IA de um jogo muitas vezes tem munição infinita, mas essas balas não causam muito dano ao jogador
    • Eu usaria a indústria de TVs como exemplo. Ela é bastante competente em aderir a qualquer modismo para fazer a TV parecer mais avançada que o modelo do ano anterior
      Dizem que há IA espalhada em algum lugar da minha TV Sony, mas não faço a menor ideia do que ela faz. O que eu realmente preciso é só de um grande display burro
    • Nos jogos há agentes destinados a simular humanos
  • Não poderíamos reconciliar os dois e chamar isso de “aprendizado estatístico”?

    • Talvez “estatística iterativa” seja o mais correto. Não sei exatamente o que estão chamando de “aprendizado”
  • “Quem escreve em Python chama isso de machine learning; quem escreve em PowerPoint chama de IA”

  • As pessoas pagam pelo furo, não pela furadeira

    • Eu uso furadeira também para coisas que não têm nada a ver com fazer furos, então paguei pela furadeira, não pelo furo
    • Não sei. Muita gente, inclusive eu, paga por uma furadeira que vai usar só algumas vezes. Com caminhonetes acontece o mesmo