2 pontos por GN⁺ 2 시간 전 | Ainda não há comentários. | Compartilhar no WhatsApp
  • O centro do software está se deslocando da tela e dos menus para conversa/delegação/execução em segundo plano, e o objeto do design de UX também está mudando: em vez de telas fixas, passa a ser sistemas que interpretam a intenção do usuário e agem
  • Chat não é uma interface que substitui todas as tarefas; quando o usuário sabe claramente o que quer, o ideal é usar uma GUI estruturada, e só quando o objetivo é ambíguo faz sentido usar uma interface conversacional
  • Como a voz é percebida como interação social, manter o contexto da conversa é mais importante do que comandos isolados, e latência/perda de contexto/recuperação de erros se tornam problemas muito mais críticos do que em interfaces baseadas em tela
  • IA agêntica pode executar tarefas sem interface, mas para que o usuário confie nela é preciso mostrar plano de ação, progresso, escopo de permissões e o ponto sem retorno; os padrões centrais são visibilidade do plano/delegação gradual/intervenção elegante
  • Os três paradigmas deslocam o centro da UX do fluxo de interação para intenção e relação de confiança, mas os princípios básicos permanecem: o usuário quer se sentir compreendido, manter o controle e ter seu tempo e atenção respeitados

A fragmentação da UX centrada na tela

  • Nos últimos 30 anos, design de UX significava projetar telas, menus, modais, botões, carrosséis e fluxos entre estados
    • A metáfora do desktop, composta por janelas, pastas e arquivos, forneceu um vocabulário comum para criar produtos digitais
  • Em vez de desaparecer, esse vocabulário está se fragmentando em vários modos de interação que quase não se parecem entre si
    • Usuários conversam com o software, delegam tarefas a ele e às vezes apenas conferem resultados já processados em segundo plano
    • A tela continua existindo, mas deixa de ser a superfície que representa o contrato básico entre pessoas e produtos
  • Os três paradigmas que estão reconfigurando a UX atual são chat, voz e IA agêntica, e cada um exige um contrato de interação diferente

Chat não é uma interface universal

  • Em 2022, poucas pessoas haviam digitado comandos em linguagem natural na interface de um produto, mas em 2025 73% das empresas passaram a usar algum tipo de interface conversacional nas interações com clientes
  • O campo de texto emergiu como elemento central da UI, mas chat por si só não garante uma boa UX
  • Conversational Design, de Erika Hall, distingue que a conversa só é apropriada quando sistema e usuário precisam negociar significado
    • Quando o usuário já sabe a ação desejada, como adicionar ao carrinho, filtrar por preço ou enviar formulário, uma interface estruturada é mais rápida, precisa e menos cansativa
    • A conversa é válida quando o usuário está explorando, o objetivo não está claro ou é difícil expressar a necessidade por cliques ou formulários
  • Produtos que aplicam isso não substituem todo o produto por chat; eles usam interfaces híbridas
    • O Notion AI não substitui o documento; ele funciona em uma barra lateral ao lado dele
    • A paleta de comandos do Linear cuida de tarefas que o usuário já conhece, como criar tickets, enquanto a IA responde perguntas ambíguas como “o que está bloqueando o time mobile?”
    • O GitHub Copilot não troca a IDE por uma janela de chat; ele oferece sugestões inline dentro do ambiente de trabalho existente
  • O critério central é: se a intenção do usuário está clara, use uma GUI estruturada; se a intenção é ambígua, use conversa
    • Tratar o chat como solução universal para qualquer problema de interface gera custo de interação desnecessário

A clareza da intenção determina a interface

  • A patente US20260065349A1, sobre sistemas de recomendação em múltiplos estágios baseados em intenção, divide as solicitações em dois níveis
    • Intenção micro: solicitações de alta confiança dentro da mesma categoria
    • Intenção macro: objetivos exploratórios que atravessam várias categorias
  • A escolha da interface não deve depender de o produto ser centrado em chat ou em GUI, mas de quão clara está a intenção do usuário
  • Em vez de apenas melhorar a caixa de busca, o Perplexity gera para cada pergunta uma página de resposta montada em tempo real com resumo, citações de fontes, perguntas de acompanhamento e dados estruturados
  • Na pesquisa, esse modelo em que o usuário diz o que quer e a interface adequada é montada na hora para aquele objetivo é chamado de Generative UI
    • Em vez de criar manualmente todos os estados de tela, o designer passa a projetar sistemas e regras que geram os estados adequados
    • Sai o papel de escrever frases prontas; entra o de criar a gramática que vai gerar essas frases

Projetando confiança em interfaces generativas

  • Em vez de mostrar o resultado gerado de uma vez, exibir o texto gradualmente faz o usuário perceber que o sistema está trabalhando, e não travado
  • Um botão de parar sempre visível durante a geração transmite ao usuário a sensação de que ele pode intervir em um processo opaco
  • Citações de fonte clicáveis transformam o chatbot de um oráculo que declara respostas certas em um colaborador com quem se revisa a evidência
  • Pequenas decisões de interação, como streaming, botão de parar e exibição de fontes, determinam a confiança e a viabilidade de adoção de todo o sistema

Voz não é um canal de comando, e sim um canal social

  • Interfaces de voz vêm sendo apresentadas desde a era dos smart speakers como peça central da computação ambiente, mas a experiência real ficou abaixo das expectativas
  • A partir do fim de 2025, o centro da mudança começa a se deslocar da tela para os ouvidos
  • O Siri AI, anunciado em junho de 2026, é apresentado não como um assistente de voz acoplado ao celular, mas como uma camada conversacional que atravessa dispositivos
    • Uma pergunta iniciada no iPhone pode continuar no iPad, com o contexto da conversa preservado
    • Ele reconhece o que está sendo visto na tela e usa contexto pessoal de e-mail, calendário e fotos
    • Solicitações sensíveis são tratadas por inferência on-device que preserva a privacidade, e os AirPods deixam de ser um acessório para se expandirem como interface principal
  • Wired for Speech, de Clifford Nass e Scott Brave, analisa que as pessoas percebem a voz não como canal de comando, mas como canal de interação social
    • Ao ouvir uma voz, ativamos sistemas cognitivos sociais que esperam reciprocidade, contexto e relação
    • O Siri anterior seguia um modelo transacional, em que se dá um comando, se recebe um resultado e a relação termina, contrariando essa expectativa
    • O novo modelo busca uma estrutura relacional que preserva contexto ao longo da conversa, dos dispositivos e do tempo

As condições de fracasso mostradas por Humane AI Pin e Rabbit R1

  • O Humane AI Pin, um wearable de voz sem tela que recebeu US$ 240 milhões em investimento, foi lançado em abril de 2024 por US$ 699, mas foi descontinuado antes de completar um ano
  • Em Designing Voice User Interfaces, Cathy Pearl aponta latência e recuperação de erros como variáveis centrais da experiência de voz
    • O AI Pin levava de 2 a 5 segundos até para perguntas cotidianas, e em interfaces de voz até 2 segundos já parecem muito longos
    • O estado era reiniciado a cada interação, falhando em oferecer o contexto contínuo que é condição básica de uma conversa
  • O Rabbit R1 sofreu do mesmo problema no lançamento, mas melhorou no fim de 2025 não por mudança de hardware, e sim porque o RabbitOS 2 passou a refletir as exigências da interação por voz
  • A UX de voz é muito mais sensível à latência e à perda de contexto do que a UX de tela
    • Na tela, o usuário pode varrer elementos ao redor e se localizar de novo
    • Na voz, não há marcos visuais que ajudem a memória espacial, então quando o fluxo da conversa se quebra a recuperação é difícil
    • A exigência de infraestrutura para resposta rápida, preservação de contexto e recuperação natural de erros também é maior

Novos elementos de design para ouvidos e corpo

  • O áudio espacial está surgindo como camada de feedback que pode substituir a tela
    • A análise em tempo real de cenas sonoras dos AirPods distingue sinais do ruído ambiente, permitindo usar o próprio som como meio de transmitir estado
  • A vibração tátil dos wearables permite confirmar a conclusão de uma ação sem olhar para uma tela
  • O paradigma de voz não trata apenas de conversar com o celular, mas de projetar interações que acontecem enquanto a pessoa faz outra coisa, como cozinhar, caminhar ou dirigir
    • A atenção do usuário está voltada ao produto apenas parcialmente
    • O contexto não está dentro da tela, mas nas atividades do corpo e no ambiente ao redor
    • Um modelo de design centrado apenas em layout de tela não dá conta disso

IA agêntica age sem interface

  • IA agêntica vai além de responder perguntas: ela usa ferramentas, navega na web, escreve código, envia e-mails e preenche formulários como uma sequência de ações
  • Entre 2024 e 2025, ela saiu das demos de pesquisa para produtos reais
    • O OpenAI Operator faz reservas em restaurantes
    • O Anthropic Claude manipula navegadores em nome do usuário via a API de computer use
    • O Salesforce Agentforce resolve casos de atendimento ao cliente do início ao fim sem intervenção humana
  • A Gartner projeta que a proporção de aplicações corporativas integrando agentes de IA especializados em trabalho, que era inferior a 5% em 2025, chegará a 40% no fim de 2026
  • Agentes não precisam de interface para executar tarefas, mas para que o usuário confie neles é necessária uma interface visível para entender e controlar suas ações

Elevar automação e controle humano ao mesmo tempo

  • Em Human-Centered AI, Ben Shneiderman considera que substituir o julgamento humano por agentes autônomos é tecnicamente precipitado e eticamente arriscado
  • A alternativa não é reduzir automação para garantir controle humano, nem eliminar controle humano para maximizar automação, mas oferecer alto controle humano e alta automação ao mesmo tempo
  • Em vez de minimizar o papel da pessoa, é preciso projetar a supervisão para que seja compreensível, acessível e pouco onerosa
  • O objetivo da UX agêntica não é escolher entre autonomia e controle, mas construir desde o início uma autonomia controlável

O paradoxo da transparência de agentes

  • Um agente que age em silêncio, sem explicação, pode ser eficiente, mas também causar medo
  • Um agente que explica continuamente cada ação pode parecer confiável, mas também cansar o usuário com logs do sistema
  • O design adequado deve mostrar o suficiente para que o usuário sinta controle, mas limitar a informação para que ele não seja sobrecarregado pela atividade interna do sistema
  • Padrões recorrentes em produtos agênticos já implantados são visibilidade do plano, delegação gradual e intervenção elegante

Visibilidade do plano

  • Antes de começar a agir, o agente deve mostrar ao usuário o que pretende fazer
  • Em vez de linguagem de sistema como POST /api/calendar/event를 실행합니다, deve-se usar algo compreensível para humanos, como “vou tentar reservar uma mesa às 19h no restaurante que você mencionou. Quer que eu verifique a disponibilidade primeiro?”
  • A prévia antes da execução é o ponto em que o usuário decide se vai confiar no sistema
  • O estudo sobre aprendizado por reforço multiagente também mostra que, para vários agentes manterem consistência no sistema, é preciso compartilhar o plano antes da ação

Delegação gradual

  • A autonomia do agente não deve ser entregue toda de uma vez; ela deve se expandir na medida em que conquista confiança
  • O agente da Intercom começa por tarefas simples e de alta confiança, e pede aprovação antes de executar ações mais arriscadas
  • O histórico de aprovações do usuário funciona como modelo de confiança, e à medida que o agente demonstra confiabilidade ele ganha permissões de ação mais amplas
  • A pessoa permanece no loop não executando diretamente o trabalho, mas definindo as fronteiras que o agente não deve ultrapassar

Intervenção elegante e ações irreversíveis

  • O usuário deve poder pedir a interrupção e retomar o controle em qualquer ponto do workflow do agente
  • Como agentes podem executar ações difíceis de desfazer, como enviar um e-mail ou reservar uma passagem aérea, um simples recurso de desfazer não basta
  • Em vez de tentar recuperar depois da ação, o sistema deve indicar claramente e pedir aprovação antes de ultrapassar o ponto sem retorno

Explicabilidade vira o próprio produto

  • Quando sistemas clínicos de IA exibiam apenas recomendações, sem fundamento, profissionais de saúde não os utilizavam
  • Depois que a interface passou a mostrar uma recomendação por vez, com painel de justificativa e opção de ignorar em um clique, a adoção avançou
  • Nem o modelo de IA nem o resultado da recomendação mudaram; só a interface foi alterada
  • Na UX agêntica, explicabilidade não é um recurso adicional para conformidade regulatória, mas a experiência central do produto que leva o usuário a aceitá-lo

De estados de tela para comportamento do sistema

  • Designers passam a projetar não só os estados visíveis da interface, mas também como o sistema se comporta quando o usuário não está olhando
  • A pergunta muda de “o que o usuário vê?” para “em que o usuário precisa poder acreditar para confiar neste sistema?”
  • Julgamentos sobre comportamento, responsabilidade, intenção e confiança tornam-se mais importantes do que composição visual

Da interação para a intenção

  • Em The Design of Everyday Things, Don Norman afirma que o design falha quando a forma como o usuário acredita que o sistema funciona difere de como ele realmente funciona
  • A UX tradicional pressupunha que o usuário já havia decidido a ação a executar antes de chegar à interface
    • O menu existe porque o usuário sabe qual menu abrir
    • O formulário existe porque o usuário sabe quais campos preencher
  • Na prática, o que o usuário traz muitas vezes não é uma intenção concreta, mas um objetivo mais abstrato
    • Essa suposição ignorada nunca foi totalmente precisa, mas foi útil o bastante por 30 anos para construir UX baseada em tela
  • As novas interfaces separam objetivo e intenção
    • No chat, o usuário expressa o objetivo em linguagem natural e o sistema concretiza a intenção
    • A voz permite expressar objetivos mesmo quando não se pode usar as mãos
    • O agente recebe o objetivo uma vez e executa um plano de múltiplas etapas para satisfazê-lo
  • A mudança comum que une os três paradigmas é que a intenção, e não a interação, virou o principal objeto de design

O designer projeta relações de confiança

  • O papel do designer sai de projetista de fluxos de interação para projetista da relação de confiança entre humanos e sistemas que agem em nome deles
  • Entre os novos objetos de trabalho estão
    • quanto trabalho o usuário vai delegar ao sistema
    • como o sistema vai interpretar pedidos ambíguos
    • como verificar a diferença entre o que o usuário disse e o que realmente queria
  • Isso exige novas ferramentas e novos métodos de avaliação
    • A pesquisa em interação humano-IA propõe avaliar não apenas se a tarefa foi concluída, mas se o usuário sentiu que recebeu informação suficiente e manteve o controle
  • Ao criar sistemas que julgam em nome do usuário, também são necessários critérios éticos sobre quais decisões podem ser delegadas

Os desafios de designers de chat/voz/agentes

  • Em interfaces de chat, o mais difícil não é decidir onde aplicar chat, mas onde não usá-lo
    • Produtos que têm bom desempenho não são os com a IA mais poderosa, e sim os que distinguem com precisão as tarefas adequadas para conversa e para formulário
    • Essa distinção é uma decisão de design, não de engenharia
  • Em interfaces de voz, é preciso projetar o que está fora da tela
    • Mais importante que layout é tempo de resposta, então é preciso projetar o tempo
    • É preciso projetar o contexto levando em conta o que o usuário consegue lembrar
    • É preciso projetar como recuperar a conversa quando o sistema não entende
    • Feedback em áudio, haptics, sinais espaciais e estratégias de recuperação conversacional tornam-se novas ferramentas
  • Sistemas agênticos são a área com menos padrões consolidados e maior risco
    • Decisões sobre transparência, controle de intervenção e delegação gradual determinam se o usuário vai se sentir empoderado ou vigiado
    • Isso também afeta, para além de produtos individuais, quanta autonomia as pessoas estarão dispostas a conceder à IA em vários setores
  • Quando os três paradigmas coexistem em um mesmo produto, surge ainda um problema de orquestração: conectar em uma experiência coerente interfaces com contratos de interação distintos

Princípios de UX que não mudam

  • Mesmo com o surgimento de novas interfaces, usuários continuam querendo sentir que estão sendo compreendidos
  • Continuam temendo perder o controle, evitando produtos opacos e confiando em produtos honestos
  • Produtos que fazem o usuário se sentir incapaz ou lento continuarão sendo rejeitados
  • O papel de um bom designer de UX sempre foi fazer o usuário se sentir competente e compreendido
  • Chat, voz e agentes são novos instrumentos para isso, e os critérios de clareza/confiança/prazer/respeito pelo tempo e pela atenção não mudam

Leituras adicionais

Ainda não há comentários.

Ainda não há comentários.