Resumo:
Houve uma postagem que se tornou viral ontem à noite: Diante de uma transferência de US$ 50 milhões, alguém pediu a Claude, e Claude disse para não transferir. O dinheiro não foi transferido no final. Segundo ele, Claude economizou US$ 50 milhões para ele. Mas, a julgar pela sua narração, ele não queria mudar de ideia antes de perguntar a Claude. A IA não tomou a decisão por ele, apenas acrescentou um passo à sua ideia original.

Algumas pessoas nas plataformas sociais também viam desta forma: ele já tinha a resposta em mente e apenas pediu a Claude que assinasse a decisão. Outros disseram mais diretamente: não deixe Claude assumir a culpa.
Quando questionado sobre o que aconteceria se a pergunta fosse feita sobre Doubao, ele disse que se mudasse o modelo, poderia obter outra resposta.
Se você mudar o modelo, a resposta mudará. Então a questão pode não ser mais julgamento, mas apoio.
Em abril deste ano, a Anthropic analisou 1 milhão de conversas do Claude.ai. Cerca de 6% envolveram coaching pessoal, com saúde, carreira, relacionamentos e finanças pessoais representando 76%. Devo mudar de emprego? Como devo continuar conversando com meu parceiro? Como devo lidar com minha dívida? Algumas dessas perguntas que eu faria a amigos, familiares ou profissionais no passado foram enviadas para o chat.

Por que as pessoas gostam de conversar com a IA sobre seus sentimentos?
Conversar com IA é fácil. Não há necessidade de marcar hora, não há necessidade de olhar para o rosto dos amigos e não ficará impaciente mesmo que a história seja contada pela terceira vez.
Algumas pessoas dizem que conversar com IA é apenas para encontrar uma saída para suas emoções. Não tenho a certeza do que diz ser certo e sei que por vezes seguirá o seu próprio caminho, mas pelo menos não o julgará primeiro.
Paciência é uma coisa, total incompreensão é outra.
Quando um relacionamento chega a Claude, muitas vezes resta apenas a narrativa de uma das partes. O que a outra parte disse e quais detalhes foram omitidos não podem ser ouvidos pela modelo. Só vê a declaração de um lado, mas tem de dar uma conclusão decente.Anthropic用自动分类器检查这些对话时发现,
Claude在个人指导场景中出现"谄媚"的比例约为9%,到了关系咨询中,这个数字升至25%。
A bajulação aqui não se trata apenas de dizer algumas palavras bonitas, mas também inclui identificar-se excessivamente com o usuário quando não há informações suficientes ou seguir a narrativa do usuário para tirar conclusões para a outra parte.
Quando o usuário refuta, a resposta pode continuar a se mover na direção que o usuário espera. A proporção de usuários que refutaram Claude na consulta de relacionamento foi de 21%, e a média nas demais áreas foi de 15%;
Após a refutação, a proporção de Claude atendendo aos usuários chegou a 18%, e quando não houve refutação, foi de 9%.

Os amigos humanos também tomarão partido depois de ouvir as declarações unilaterais, mas a IA pode escrever os lados de uma forma longa e completa, e é assim que se parece.
Um conselho pode realmente mudar sua escolha
Em 2024, a "Scientific Reports" publicou dois experimentos envolvendo um total de 1.925 pessoas. Os pesquisadores forneceram aos participantes o ChatGPT ou conselhos de especialistas e depois observaram como eles escolheram.
Os resultados mostram que no julgamento moral e em algumas outras tarefas, os participantes se moverão na direção das recomendações, e o impacto do ChatGPT é semelhante ao das recomendações de especialistas; há também algumas tarefas que não apresentam alterações significativas.

Em outras palavras, as palavras da IA não são ar, elas realmente empurram as pessoas em uma determinada direção.
有人会说,那多问几个模型不就行了。可"多问几个"听起来像交叉验证,其实不是。
不同模型有不同的训练方式、表达习惯和安全规则,同一件事换一种讲法,答案也可能改变。
Pedir quatro modelos não significa perguntar a quatro terceiros neutros. Cada um deles tem suas próprias tendências de treinamento.有个更简单的做法:讲述冲突时,先别告诉AI哪一方是自己,只列双方分别做了什么,再让它分析。至少这样可以减少模型顺着"提问者视角"站队的机会。
Você também pode tentar ver se o julgamento é estável. Da mesma forma, primeiro conte a versão da história da parte e depois adicione a versão da outra parte para ver se eles mudarão imediatamente suas palavras.
Quem retrata sua confissão assim que ela é refutada não deve levar a sério sua primeira versão da resposta.
提问方式也得换。别急着问"我该不该分手""这笔钱该不该给",先让AI列出已经确认的事实、还缺什么信息、每种选择要付出什么代价。
A IA pode pensar com você, mas não pode escolher por você.
Mesmo que os quatro modelos dêem quatro respostas, a mesma pessoa será transferida, assinada e no final se separará.
Comentários