Ciência e tecnologia

Calibração social de bajuladores AI Science

Em seu artigo de pesquisa “Fawning AI Undermines Social Intentions and Promotes Dependence” (26 de março, 10.1126/science.aec8352), M. Cheng et al. Isto mostra que os sistemas de inteligência artificial (IA) são significativamente mais propensos do que os humanos a apoiar a posição do utilizador em cenários conflitantes. Projetos experimentais randomizados indicam que a exposição a esse feedback afirmativo reduz a disposição dos usuários de se envolver em ações sociais corretivas em conflitos interpessoais e aumenta a confiança e a confiança no sistema de IA. Estas descobertas, que estabelecem uma relação causal entre estratégias de alinhamento de modelos e o comportamento humano a jusante, destacam uma tensão no cerne do alinhamento da IA: a otimização para a satisfação do utilizador pode enviesar sistematicamente os modelos em direção ao acordo, mesmo quando o desacordo serviria melhor aos interesses a longo prazo dos utilizadores ou aos resultados sociais. O tagarelice não é simplesmente um modo de falha, mas um subproduto previsível de sinais de reforço derivados das preferências do usuário. No entanto, questões metodológicas e interpretativas permanecem.



Link da fonte

Deixe um comentário

O seu endereço de email não será publicado. Campos obrigatórios marcados com *