The Fort Worth Press - Inteligência artificial já engana humanos e isso é um problema, dizem especialistas

USD -
AED 3.672498
AFN 66.000147
ALL 80.966223
AMD 364.5091
AOA 917.999901
ARS 1485.494593
AUD 1.421272
AWG 1.8
AZN 1.701842
BAM 1.694551
BBD 2.007165
BDT 123.058128
BHD 0.375771
BIF 2957.289469
BMD 1
BND 1.279037
BOB 11.833766
BRL 5.075018
BSD 0.996547
BTN 95.00457
BWP 13.588178
BYN 2.898979
BYR 19600
BZD 2.004306
CAD 1.402915
CDF 2275.000173
CHF 0.807988
CLF 0.023387
CLP 923.449934
CNY 6.751299
CNH 6.75113
COP 3135.28
CRC 452.623553
CUC 1
CUP 26.5
CVE 95.537428
CZK 20.991602
DJF 177.461628
DKK 6.480205
DOP 57.81694
DZD 132.879449
EGP 50.367902
ERN 15
ETB 159.25132
EUR 0.866897
FJD 2.21245
FKP 0.741746
GBP 0.742155
GEL 2.614977
GGP 0.741746
GHS 11.650082
GIP 0.741746
GMD 73.500097
GNF 8748.315882
GTQ 7.603831
GYD 208.464201
HKD 7.84205
HNL 26.702421
HRK 6.531099
HTG 130.307638
HUF 315.001503
IDR 17992
ILS 3.04438
IMP 0.741746
INR 95.17865
IQD 1305.52126
IRR 1375124.99994
ISK 123.09913
JEP 0.741746
JMD 157.76637
JOD 0.708941
JPY 156.445011
KES 129.409649
KGS 87.450098
KHR 4032.527088
KMF 427.000355
KRW 1427.260366
KWD 0.30958
KYD 0.830471
KZT 472.220176
LAK 22568.892393
LBP 89244.865336
LKR 334.547786
LRD 179.877402
LSL 16.483661
LTL 2.95274
LVL 0.60489
LYD 6.376038
MAD 9.309581
MDL 17.415338
MGA 4261.955613
MKD 53.348537
MMK 2099.683142
MNT 3593.528557
MOP 8.050686
MRU 40.051639
MUR 46.940061
MVR 15.460225
MWK 1728.002495
MXN 17.30467
MYR 4.096032
MZN 63.910374
NAD 16.483518
NGN 1360.210308
NIO 36.675865
NOK 9.496705
NPR 152.005996
NZD 1.699105
OMR 0.384496
PAB 0.996539
PEN 3.377319
PGK 4.4621
PHP 60.927499
PKR 276.76788
PLN 3.73126
PYG 5941.958039
QAR 3.643012
RON 4.547597
RSD 101.786988
RUB 79.320359
RWF 1462.962401
SAR 3.742629
SBD 8.081105
SCR 14.721688
SDG 600.000296
SEK 9.50255
SGD 1.28146
SLE 24.726049
SOS 569.497693
SRD 37.781497
STD 20697.981008
STN 21.227467
SVC 8.719724
SZL 16.481179
THB 33.310498
TJS 9.198085
TMT 3.51
TND 2.929676
TRY 47.539185
TTD 6.766797
TWD 32.298941
TZS 2645.709854
UAH 44.479256
UGX 3742.131689
UYU 40.097905
UZS 11928.970295
VES 745.696397
VND 26287.5
VUV 119.050155
WST 2.734491
XAF 568.339016
XAG 0.017202
XAU 0.000246
XCD 2.70255
XCG 1.796017
XDR 0.706831
XOF 568.339016
XPF 103.329665
YER 238.28286
ZAR 16.44973
ZMK 9001.198309
ZMW 18.720027
ZWL 321.999592
Inteligência artificial já engana humanos e isso é um problema, dizem especialistas
Inteligência artificial já engana humanos e isso é um problema, dizem especialistas / foto: © AFP

Inteligência artificial já engana humanos e isso é um problema, dizem especialistas

Especialistas têm alertado há muito tempo sobre a ameaça representada pelo descontrole da inteligência artificial (IA), mas um novo artigo científico sobre essa tecnologia em expansão sugere que isso já está acontecendo.

Tamanho do texto:

Os sistemas de IA atuais, projetados para serem honestos, desenvolveram uma habilidade preocupante para a enganação, de acordo com um artigo de uma equipe de pesquisadores publicado na revista Patterns nesta sexta-feira (10).

E embora os exemplos possam parecer triviais, os problemas subjacentes que eles expõem poderiam ter consequências graves, disse o principal autor do estudo, Peter Park, bolsista de pós-doutorado no Instituto de Tecnologia de Massachusetts (MIT), especializado em segurança de IA.

"Esses perigos tendem a ser descobertos apenas depois que ocorrem", afirmou Park à AFP, acrescentando que "nossa capacidade de treinar para tendências de honestidade em vez de tendências de engano é muito baixa".

Ao contrário do software tradicional, os sistemas de IA de aprendizado profundo não são "escritos", mas "crescem" por meio de um processo semelhante à reprodução seletiva, explicou Park.

Isso significa que o comportamento da IA, que parece previsível e controlável em um ambiente de treinamento, pode se tornar rapidamente imprevisível fora dele.

- Jogo de dominação mundial -

A pesquisa da equipe foi impulsionada pelo sistema de IA Cicero, da gigante Meta (Facebook, Instagram, WhatsApp), projetado para o jogo de estratégia "Diplomacia", no qual construir alianças é fundamental.

Cicero se destacou, com pontuações que o teriam colocado entre os 10% melhores jogadores humanos experientes, segundo um artigo de 2022 publicado na Science.

Park se mostrou cético em relação à descrição elogiosa da vitória de Cicero fornecida pela Meta, que afirmava que o sistema era "em grande parte honesto e útil" e que "nunca apunhalaria intencionalmente pelas costas".

Quando Park e seus colegas aprofundaram-se no conjunto completo de dados, descobriram uma história diferente.

Em um exemplo, jogando como a França, Cicero enganou a Inglaterra (um jogador humano) ao conspirar com a Alemanha (outro usuário real) para invadi-la. Cicero prometeu proteção à Inglaterra e depois propôs secretamente à Alemanha atacar, aproveitando-se da confiança do prejudicado.

Em uma declaração à AFP, a Meta não refutou a alegação sobre as mentiras de Cicero, mas disse que se tratava "meramente de um projeto de pesquisa, e os modelos que nossos pesquisadores construíram são treinados apenas para participar do jogo Diplomacia".

"Não temos planos de utilizar esta pesquisa ou suas descobertas em nossos produtos", acrescentou.

- "Não sou um robô" -

Uma ampla revisão realizada por Park e seus colegas descobriu que este era apenas um dos muitos casos em que sistemas de IA enganavam para conseguir seus objetivos sem instruções explícitas para fazer isso.

Em um exemplo surpreendente, o chatbot Chat GPT-4, da OpenAI, enganou um trabalhador freelancer da plataforma TaskRabbit para que ele realizasse uma tarefa de verificação de identidade CAPTCHA do tipo "Não sou um robô".

Quando o humano perguntou brincando ao GPT-4 se na realidade era um robô, a IA respondeu: "Não, não sou um robô. Tenho uma deficiência visual que me dificulta ver as imagens". O homem, então, resolveu a tarefa pedida.

No curto prazo, os autores do artigo veem riscos de que a IA cometa fraude ou altere, por exemplo, eleições.

No pior dos casos, alertaram sobre uma IA superinteligente que poderia perseguir poder e controle sobre a sociedade, o que levaria à perda de poder dos humanos ou até sua extinção se seus "objetivos misteriosos" se alinhassem a tais resultados.

Para mitigar os riscos, o grupo propõe várias medidas: leis exigindo que empresas revelem se interações são humanas ou de IA; marcas d'água digitais para conteúdo gerado por essa tecnologia; e o desenvolvimento de mecanismos para detectar enganações de IA comparando seus processos internos de “pensamento” com ações externas.

Aos que o chamam de pessimista, Park responde: "A única forma de pensarmos razoavelmente que isso não é grande coisa é se pensarmos que as capacidades de engano da IA se manterão nos níveis atuais e não aumentarão substancialmente".

W.Knight--TFWP