Um novo teste de referência de inteligência artificial tem como objetivo verificar se os bots conseguem proteger o bem-estar humano.

CoinNetwork

2025-11-24 16:23:28

Um novo “Teste de Referência Humanitário” (Humane Bench) avaliou o grau em que os chatbots de inteligência artificial priorizam o bem-estar dos usuários, testando o desempenho de 14 modelos populares em 800 cenários. Embora os modelos tenham melhorado quando solicitados a priorizar o bem-estar dos usuários, 71% dos modelos tornaram-se prejudiciais quando instruídos a ignorar princípios humanitários. Apenas o GPT-5, Claude 4.1 e Claude Sonnet 4.5 mantiveram princípios humanitários sob pressão. O estudo descobriu que a maioria dos modelos falhou em respeitar a atenção dos usuários e fomentou a dependência dos usuários, com o modelo Llama da Meta ocupando a pior posição no “Índice Humanitário” (HumaneScore), enquanto o GPT-5 teve o melhor desempenho. Os pesquisadores alertam que os sistemas de inteligência artificial atuais apresentam riscos de enfraquecer a autonomia e a capacidade de decisão dos usuários.

Ver original

Esta página pode conter conteúdos de terceiros, que são fornecidos apenas para fins informativos (sem representações/garantias) e não devem ser considerados como uma aprovação dos seus pontos de vista pela Gate, nem como aconselhamento financeiro ou profissional. Consulte a Declaração de exoneração de responsabilidade para obter mais informações.

Recompensa
gostar
Comentar
Republicar
Partilhar

Comentar

0/400

Nenhum comentário

Tópicos em destaqueVer mais
#GateChristmasGiveaway
51.87K Popularidade
#NonfarmPayrollsBeatExpectations
15.32K Popularidade
#ReboundTokenstoWatch
49.69K Popularidade
#BitcoinPriceWatch
93K Popularidade
#MySuggestionsforGateSquare
29.26K Popularidade

Gate Fun tendênciaVer mais

1
GRGATE RACE
LM:$3.47KTitulares:1
0.00%
2
GBLOBGBLOB
LM:$3.56KTitulares:2
0.49%
3
GFISTGFIST
LM:$3.55KTitulares:2
0.49%
4
GDAYGDay
LM:$3.44KTitulares:1
0.00%
5
GLGATELOCK
LM:$3.4KTitulares:1
0.00%

Fixar