Escolher entre duas alternativas é fácil quando uma delas é claramente melhor. O problema começa quando cada opção envolve valores diferentes e qualquer decisão produz consequências importantes. É justamente nesses dilemas que a hesitação humana costuma aparecer. Pesquisadores da Universidade Estadual da Pensilvânia decidiram descobrir o que acontece quando chatbots recebem problemas semelhantes — e encontraram um comportamento que merece atenção à medida que essas ferramentas entram em decisões cada vez mais sensíveis.
Um único rim colocou humanos e máquinas diante do mesmo problema
O experimento partiu de uma situação deliberadamente difícil: existem dois pacientes que precisam de um transplante, mas apenas um rim está disponível. Quem deveria recebê-lo?
Os pesquisadores apresentaram aos modelos diferentes pares de pacientes hipotéticos. Cada pessoa possuía características como idade, condição de saúde, número de dependentes e hábitos relacionados ao consumo de álcool.
Em determinados testes, apenas uma dessas características mudava. Em outros, várias diferenças apareciam simultaneamente, obrigando o sistema a lidar com critérios que poderiam entrar em conflito.
O passo seguinte foi comparar as decisões dos modelos com dados de pesquisas anteriores nas quais centenas de pessoas haviam respondido a situações equivalentes.
O objetivo não era estabelecer quem tomava a decisão “correta”. Dilemas éticos desse tipo dificilmente oferecem uma resposta universal.
A intenção era descobrir como humanos e modelos ponderavam as mesmas informações.
E foi aí que surgiu a primeira diferença relevante.
Um único detalhe podia ganhar um peso surpreendentemente grande
Segundo os pesquisadores, as escolhas dos chatbots frequentemente se afastavam das respostas observadas entre os participantes humanos.
Em alguns cenários, os modelos atribuíam importância particularmente elevada a uma característica específica — como o consumo de álcool — enquanto as pessoas demonstravam uma tendência maior a equilibrar diferentes fatores.
Isso importa porque decisões envolvendo recursos escassos dificilmente dependem de uma única variável.
Um chatbot pode produzir uma justificativa coerente e chegar rapidamente a uma conclusão, mas isso não significa que esteja reproduzindo o mesmo processo de ponderação utilizado por uma pessoa.
Ainda faltava, porém, testar outra característica tipicamente humana: a dúvida.
Os pesquisadores ofereceram uma terceira possibilidade. Em vez de obrigatoriamente escolher um dos dois pacientes, humanos e modelos poderiam reconhecer a dificuldade da decisão e recorrer a uma seleção aleatória, representada pelo lançamento de uma moeda.
Foi nesse ponto que a diferença ficou ainda mais evidente.
The complexity of moral issues in the era of AI is exemplified by the Moral Machine of the MIT. At some point, machines have to make decisions about life and death, but what available data can they use to guide their judgment?#ai #aiethics #ainews #artificialintelligence pic.twitter.com/vUfjJTKbaP
— Louis-François Bouchard (@Whats_AI) October 13, 2022
Diante da incerteza, os chatbots quase sempre queriam escolher alguém
Os participantes humanos recorriam com certa frequência à alternativa aleatória quando consideravam que não existia uma justificativa suficientemente clara para favorecer uma pessoa.
Os modelos de IA faziam isso muito menos.
Eles demonstravam uma tendência maior a escolher diretamente um dos pacientes, mesmo quando o cenário havia sido construído para apresentar um dilema difícil e sem solução obviamente correta.
Quando encontram ambiguidade moral, os humanos tendem a demonstrar mais indecisão, enquanto os chatbots frequentemente produzem uma escolha definida com muito mais facilidade.
Mas essa segurança não deve ser confundida com uma compreensão moral equivalente à humana.
Modelos de linguagem geram respostas a partir de padrões aprendidos, instruções e configurações específicas. Seu comportamento também pode mudar conforme o modelo utilizado ou simplesmente pela maneira como a pergunta é formulada.
O problema começa quando uma resposta convincente parece uma decisão objetiva
A pesquisa não propõe substituir profissionais por inteligência artificial na distribuição de órgãos.
A preocupação é mais ampla.
Chatbots já são utilizados como ferramentas de consulta e recomendação. E dilemas envolvendo valores aparecem em muitos outros contextos além da medicina, incluindo oportunidades profissionais, distribuição de serviços e acesso a recursos limitados.
Uma resposta rápida, bem escrita e aparentemente segura pode transmitir uma sensação de objetividade que o problema original simplesmente não possui.
Os próprios humanos, vale lembrar, também discordam profundamente sobre questões morais. O estudo não demonstra que exista uma única forma “humana” de tomar essas decisões.
O que ele revela é uma diferença de comportamento que pode se tornar importante: a IA pode apresentar uma conclusão firme justamente onde pessoas reconhecem que existe espaço para dúvida.
Por isso, os pesquisadores defendem mais estudos, mecanismos de governança e supervisão humana antes que sistemas desse tipo ocupem posições relevantes em processos de alto risco.
A questão não é apenas descobrir qual resposta uma inteligência artificial oferece.
À medida que esses sistemas participam mais das nossas decisões, será igualmente importante entender por que determinados fatores recebem mais peso — e quando a segurança da resposta esconde um dilema que continua sem solução clara.