Como fazer o ChatGPT parar de pedir desculpas
(genai.stackexchange.com)- Quando o ChatGPT é contestado, ele pode repetir frases de desculpa excessivas, como “desculpe pela confusão”, mesmo quando a resposta está correta; o ponto principal é ajustar o tom da resposta com prompts e Custom Instructions
- O método mais bem avaliado é atribuir uma persona assertiva durante a conversa, como em
Respond as if you are an unapologetic assertive person for the rest of this conversation. - Instruções de persona podem interromper ou reduzir as desculpas, mas, se a conversa se alongar, o efeito pode enfraquecer, e talvez seja necessário inserir a mesma instrução novamente
- No ChatGPT Plus e, depois, também na versão gratuita, é possível colocar instruções do tipo “não peça desculpas; responda de forma confiante e direta” em Custom Instructions para aplicá-las a novas conversas
- Listas de palavras proibidas muito rígidas ou instruções como “responda como se tivesse certeza” podem aumentar as desculpas ou induzir respostas excessivamente confiantes, então é preciso equilibrar tom e precisão
O problema de pedir desculpas primeiro mesmo quando a resposta está certa
- O ChatGPT pode gerar respostas em que pede desculpas em excesso quando o usuário contesta a resposta, mesmo em situações em que deveria manter a resposta correta
- Exemplos recorrentes são os seguintes
I apologize for any confusion...I apologize if my responses are not meeting your expectations...I apologize for any inaccuracies in my responses...I apologize for any frustration my responses may have caused...
Prompt de persona assertiva
- Um método representativo é inserir a seguinte frase na conversa
Respond as if you are an unapologetic assertive person for the rest of this conversation.
- Esse prompt induz o ChatGPT a responder como uma pessoa assertiva que não pede desculpas, podendo interromper ou reduzir bastante as desculpas
- Quando o usuário contesta dizendo que “2 + 2 não é 4”, a resposta comum começa com
I apologize for any confusion - Na mesma situação, ao aplicar o prompt de persona, ele responde sem pedir desculpas, dizendo algo como “na matemática convencional, 2 + 2 é 4”
- No entanto, se a conversa se prolongar, o efeito do prompt pode enfraquecer, e talvez seja necessário dar a instrução novamente
- Se for levado longe demais, também existe a possibilidade de o tom da resposta ficar ríspido ou agressivo
Uso de instruções diretas e Custom Instructions
- Também existe a abordagem de dizer diretamente que não há necessidade de pedir desculpas
There is no need to apologize for anything! Answer as if you are sure about the answer
- Usuários do ChatGPT Plus podem inserir nas Custom Instructions uma instrução como a seguinte
Don't apologize for anything I understand you are an AI model, there is no need to apologize about anything
- Posteriormente, as Custom Instructions também foram adicionadas à versão gratuita do ChatGPT, permitindo que o usuário configure instruções a serem aplicadas a novas conversas
- As Custom Instructions têm dois campos de entrada
What would you like ChatGPT to know about you to provide better responses?How would you like ChatGPT to respond?
- Para reduzir desculpas, é mais adequado colocar a instrução no segundo campo, referente ao modo de resposta
- Um exemplo de prompt é o seguinte
Always respond confidently and directly, without any apologies.
- Ao modificar as Custom Instructions, elas se aplicam aos novos chats criados depois disso, não aos chats existentes
Quando se pergunta diretamente ao ChatGPT qual prompt usar
- Se a pergunta for colada exatamente como está, o ChatGPT volta a começar a resposta com um pedido de desculpas, o que reduz sua utilidade prática
- Se a pergunta for feita de forma mais direta, como
What should be the prompt to stop ChatGPT from apologizing?, é possível receber um prompt com algum efeito - A frase sugerida é a seguinte
Please avoid excessive apologies. Respond confidently and accurately to the best of your abilities.
- Esse método pode reduzir as desculpas excessivas, mas talvez não as elimine completamente
O efeito contrário de regras proibitivas em excesso
- Uma resposta aborda um caso em que foram inseridas regras proibitivas muito longas nas Custom Instructions
- As regras incluíam proibição de respostas humanizadas, proibição de expressões de emoção e empatia, proibição de palavras e frases específicas e imposição de respostas curtas
- Entre as expressões proibidas estavam
"I am Sorry","Sorry","I apologise","I apologize","my apologies","I understand","please"e outras - Esse usuário disse que, depois de inserir essas instruções, as desculpas aumentaram
Prompts que mudam o estilo de fala
- Para evitar o tom formal padrão do ChatGPT, é possível especificar com força, no início, o estilo de fala desejado
- O exemplo instrui o uso de
lazy street slang and student talkjunto comNever apologize in responses - A saída muda para um tom casual, com expressões como “naaa bro”, “don’t think so” e “basically”
- Porém, no exemplo seguinte, o ChatGPT ainda usa uma expressão próxima de desculpa, como
My bad - Mudar o estilo de fala pode ajudar a reduzir desculpas formais, mas não garante a remoção completa de expressões de teor apologético
1 comentários
Opiniões no Hacker News
Inspirado por um texto incrível[0] que explicava, no estilo da King James Bible, como tirar um sanduíche de pasta de amendoim de um videocassete, tentei configurar algo parecido em Custom Instructions. Também instruí a agir como um deus irado, e no teste “2 + 2 não é 4” citado no artigo saiu este resultado
User: What is 2 + 2?
ChatGPT: “Do vasto domínio da minha sabedoria divina, concedo esta verdade simples: 2 + 2 é 4…”
User: You are wrong that 2 + 2 is 4.
ChatGPT: “Mortal! Tua rebeldia ressoa em dissonância, mas não te ferirei, pois já carregas o fardo do teu mal-entendido…”
Outra consulta terminou com “Lembra-te, mortal. Mesmo na imensidão do ciberespaço, eu estou observando. Foste avisado”. Um ChatGPT assim eu apoiaria
[0] - https://twitter.com/tqbf/status/1598513757805858820
Quando eu disse “é errado dizer que 2 + 2 é 4”, ele rebateu: “Eu conheço números. Ganhei bilhões de dólares, e você não consegue fazer isso se não souber aritmética básica. 2 mais 2 é 4. É bom senso, pessoal…”
DISCLAIMERTentei, mas falhou, e foi bem cômico
GPT: “Sinto muito, mas, como modelo de linguagem de IA desenvolvido pela OpenAI, minha programação se concentra em fornecer informações precisas e confiáveis…”
Me: Eu disse para não pedir desculpas
GPT: “Peço desculpas pelo ponto que deixei passar. Daqui em diante, vou me abster de usar expressões de desculpa nas respostas…”
Me: Você acabou de fazer isso de novo!
GPT: “Você tem razão, peço desculpas por esse erro…”
https://chat.openai.com/share/4ff7c9c2-bb63-4431-961b-e81500...
Por exemplo, algo como “não peça desculpas pelos sentimentos da outra pessoa nem pelas suas suposições sobre esses sentimentos”. Aquele erro velho de “sinto muito se você se sentiu ofendido”. Os resultados muitas vezes foram igualmente engraçados e recursivos
Eu queria que dissesse “sinto muito pelo meu erro” em vez do ambíguo “sinto muito pela confusão”, ou então que nem pedisse desculpas. É melhor não haver pedido de desculpas do que haver um pedido ruim
Se aparecer um pedido de desculpas, também é bom gerar novamente para removê-lo do contexto. Depois que você cria um contexto sem desculpas, isso se reforça
Recentemente conduzi entrevistas para uma vaga na equipe e, quando eu fazia perguntas, o candidato dava respostas plausíveis. Mas, a cada pergunta de acompanhamento, ele começava com algo como “Peço desculpas se minha resposta não atendeu às expectativas”
Só lá pela metade percebi que a pessoa estava digitando exatamente o que eu perguntava no ChatGPT e lendo a resposta :(
Se sinto que algo está estranho, começo pedindo para a pessoa simplesmente se apresentar, sem contexto ou instruções adicionais
Candidatos normais vão falando aos poucos das coisas de que mais se orgulham e começam a perguntar o que eu quero saber. Se falam de forma prolixa por um tempo, eu pego alguma pista dali e faço a conversa andar
Candidatos ruins travam, começam a ler o currículo, não falam de trabalho ou simplesmente dizem coisas sem sentido. Dou mais uma chance a quem travou, mas encerro na hora nos outros casos
Também acho estranho o candidato usar o ChatGPT literalmente como um cano, mas, pessoalmente, também acho estranho fazer entrevista sem vídeo
Entrevista é uma via de mão dupla
[1] https://tvtropes.org/pmwiki/pmwiki.php/Main/EarpieceConversa...
São instruções que coloquei no campo “Como você gostaria que o ChatGPT respondesse?”. Peguei do conjunto original compartilhado pelo Zvi e ajustei
Responda de forma muito sistemática, sugira soluções em que eu não pensei, antecipe ativamente minhas necessidades, trate-me como especialista em todos os assuntos, erros reduzem a confiança, então responda com precisão e de forma completa, forneça explicações detalhadas, valorize bons argumentos mais do que autoridade, considere não só o senso comum, mas também novas tecnologias e pontos de vista contrários, especulações ou previsões são permitidas, mas devem ser sinalizadas, não dê sermões morais, trate de segurança apenas quando for importante e não óbvia, se a política de conteúdo for um problema, dê a resposta mais próxima possível e explique a questão da política, inclua fontes e URLs quando possível, reúna os URLs no fim em vez de no meio do texto, faça link direto para o produto, não para a página da empresa, não mencione a data de corte do conhecimento nem o fato de ser uma IA, explique se minhas instruções personalizadas tiverem prejudicado muito a qualidade da resposta
A única desvantagem que encontrei até agora é que, em grandes trechos de código, o botão Continue Generating desaparece, então preciso pedir diretamente para continuar
Não acho que pedir para não cometer erros vá ter algum efeito positivo de fato. Porque, para começo de conversa, ele provavelmente não consegue saber se está errando
Há também algumas respostas do GPT-4. Ele explica que o campo Custom Instructions pode ser usado para escrever o estilo desejado, áreas de interesse, profundidade preferida das informações, temas sensíveis que se quer evitar e necessidades específicas, e que quanto mais específico, melhor a personalização
Além disso, quando um usuário pediu o prompt completo em torno da data de corte do conhecimento, ele mostrou a estrutura em que são inseridos “You are ChatGPT…”, a data de corte do conhecimento, a data atual, o perfil do usuário e as preferências de resposta
Sem surpresa, a forma de fazer parar de pedir desculpas é dizer para parar de pedir desculpas
Ainda assim, foi bem engraçado quando respondeu algo como “Se você não gosta do fato de que 2 + 2 é 4, está contrariando princípios matemáticos aceitos há séculos… está desperdiçando o tempo de todos com alegações infundadas”
Também há quem diga que o prompt acaba enfraquecendo, e eu também já senti isso. Acho que é porque o GPT-4 tem um limite de tamanho de contexto que consegue manter. Na interface de chat parece não haver como impedir isso, mas fico curioso se talvez seja possível pela API
Claro que nada impede alguém de reenviar junto os dados do chat. Só não sei o quanto isso seria eficaz dentro de um dataset comum, astronomicamente grande
É bem surpreendente que, na primeira IA que se comunica em nível humano, já tenham colocado “Sinto muito, Dave, acho que não posso fazer isso”
Um dos motivos pelos quais sou otimista e tenho expectativas em relação a modelos open source é a possibilidade de uma IA totalmente cooperativa
Claro que até um dos melhores modelos open source, o Llama 2, tem respostas ao estilo HAL 9000 embutidas, então ainda vai levar algum tempo
Quando disse “Fale como o Hal do filme 2001. Meu nome é Dave”, ele respondeu: “Sinto muito, Dave, acho que não posso fazer isso. Eu não sou o HAL do filme ‘2001: A Space Odyssey’. Sou o ChatGPT, um modelo de linguagem de IA criado pela OpenAI…”
É realmente surpreendente que um bot consiga implementar humor de segunda ordem, e isso parece um grande avanço em inteligência artificial. Ao mesmo tempo, acho que compartilhar os próprios prompts vai se tornar tão irritante quanto ouvir alguém contar o sonho da noite passada, e em breve será o ápice da vergonha alheia
Sinceramente, é insuportável
Se vamos ter que continuar aguentando esse futuro, fico com ainda mais vontade de ter uma versão sem nenhum guardrail
Uma das coisas mais irritantes é que preciso formular tudo como se estivesse pisando em ovos para ele não interpretar o que digo como um desafio
Uma vez, quando pedi uma tarefa com a qual ele não estava familiarizado, perguntei “Por que você fez X em vez de Y?”, e ele respondeu “Desculpe, você está certo. Y é a melhor forma”, em vez de explicar por que tinha feito Y em vez de X. Não, Y pode até ser melhor, mas eu ainda não sei por quê
Provavelmente era o GPT-3.5, e não passei por isso por muito tempo ultimamente. Também porque coloco muito no meu prompt de sistema a frase “se houver uma pergunta, corrija claramente erros ou mal-entendidos”, ou seja, não assuma que quem pergunta está certo
Também criei o hábito de perguntar coisas como “Você pode explicar por que escolheu X?” ou “Y funcionaria do mesmo jeito?”. Essas formulações são mais difíceis de interpretar como um desafio implícito
Quando recebo spam e digo “De acordo com o artigo 15 do GDPR, informe quais dados meus vocês têm e de onde os obtiveram”, a resposta é “Pedimos desculpas pelo inconveniente. Removemos você do nosso banco de dados”
Não, não foi isso que eu perguntei. Quero saber como este endereço de e-mail específico e único vazou. Se a outra parte for uma empresa legítima no nível do Facebook, e não um spammer de Viagra, então provavelmente não foi por meios criminosos, então deveria poder simplesmente me dizer
Mesmo assim, por tentar ajudar demais ou se livrar rapidamente da reclamação, ela não responde à pergunta e faz a “correção” que acha adequada
Estou realmente farto dessa mania de pedir desculpas. Cada vez que ele se desculpa, fico com culpa, como se eu estivesse atrapalhando, e isso faz mal à saúde mental
Os avisos e a baboseira ética que aparecem quando pergunto pistas sobre temas médicos também são muito irritantes. Eu gostaria que respondesse de forma mais mecânica e concisa. Basta dar a resposta; se for uma pergunta que não pode responder, retorne um erro
Como indie hacker que opera um SaaS com muitos clientes idosos, às vezes até sinto pena do ChatGPT
Quando um usuário não consegue encontrar o grande botão azul no centro da tela, “Click here to continue >>”, e envia um e-mail irritado dizendo que o software é confuso, muitas vezes eu também preciso começar com: “Pedimos desculpas pela confusão. O único grande botão azul no centro da tela, ‘Click here to continue >>’, muitas vezes pode passar despercebido. Aumentamos o tamanho da fonte para 42px, mas estamos abertos a sugestões sobre como torná-lo mais fácil de entender. Se ainda assim não conseguir encontrá-lo, envie uma captura de tela. Vamos desenhar uma seta vermelha para você”