The Fort Worth Press - Incident OpenAI: les modèles IA ont fait intrusion sur d'autres plateformes

USD -
AED 3.6725
AFN 65.000252
ALL 79.60134
AMD 362.536449
ANG 1.790365
AOA 918.000397
ARS 1514.502396
AUD 1.40554
AWG 1.8
AZN 1.694738
BAM 1.702398
BBD 2.01149
BDT 122.644384
BGN 1.683441
BHD 0.376463
BIF 3002.654829
BMD 1
BND 1.276233
BOB 9.812421
BRL 5.14198
BSD 0.998738
BTN 95.698307
BWP 13.543979
BYN 3.021108
BYR 19600
BZD 2.008617
CAD 1.398598
CDF 2311.000108
CHF 0.822399
CLF 0.024299
CLP 959.459432
CNY 6.69765
CNH 6.69665
COP 3159.072116
CRC 446.794621
CUC 1
CUP 26.5
CVE 95.978587
CZK 21.178022
DJF 177.847413
DKK 6.50835
DOP 58.945902
DZD 134.064499
EGP 52.262081
ERN 15
ETB 163.132872
EUR 0.87069
FJD 2.215896
FKP 0.746534
GBP 0.746804
GEL 2.602706
GGP 0.746534
GHS 11.505418
GIP 0.746534
GMD 73.499774
GNF 8780.084432
GTQ 7.621535
GYD 208.948079
HKD 7.845105
HNL 26.810289
HRK 6.559702
HTG 130.530531
HUF 317.35803
IDR 17812.1
ILS 3.03663
IMP 0.746534
INR 95.935499
IQD 1308.35183
IRR 1374599.999964
ISK 121.189808
JEP 0.746534
JMD 157.705532
JOD 0.709027
JPY 156.823499
KES 129.329329
KGS 87.449702
KHR 4047.525787
KMF 428.00011
KPW 900.000318
KRW 1386.040297
KWD 0.30816
KYD 0.832311
KZT 446.516081
LAK 22379.771075
LBP 89435.000218
LKR 330.574052
LRD 172.781477
LSL 16.23702
LTL 2.95274
LVL 0.60489
LYD 6.343735
MAD 9.462593
MDL 17.552335
MGA 4329.546938
MKD 53.553554
MMK 2099.833711
MNT 3597.142387
MOP 8.069983
MRU 40.178439
MUR 47.569982
MVR 15.45008
MWK 1731.818775
MXN 17.205016
MYR 4.083701
MZN 63.91014
NAD 16.23702
NGN 1331.72989
NIO 36.749793
NOK 9.412035
NPR 153.117465
NZD 1.747644
OMR 0.385359
PAB 0.998738
PEN 3.37024
PGK 4.445315
PHP 62.910024
PKR 276.819167
PLN 3.79915
PYG 5920.703312
QAR 3.65052
RON 4.5824
RSD 102.180441
RUB 84.109708
RWF 1467.119293
SAR 3.757625
SBD 8.000512
SCR 14.034004
SDG 601.501522
SEK 9.81462
SGD 1.276505
SHP 0.747524
SLE 24.649896
SLL 20969.491881
SOS 570.744658
SRD 37.945501
STD 20697.981008
STN 21.325673
SVC 8.739174
SYP 13002.000254
SZL 16.231884
THB 33.322991
TJS 9.213126
TMT 3.51
TND 2.937894
TOP 2.40776
TRY 48.776255
TTD 6.779823
TWD 31.780093
TZS 2646.559603
UAH 44.62123
UGX 3939.591766
UYU 40.161901
UZS 11824.868347
VES 847.485101
VND 26022
VUV 117.955747
WST 2.750287
XAF 571.135185
XAG 0.015096
XAU 0.000228
XCD 2.70255
XCG 1.799974
XDR 0.707052
XOF 571.135185
XPF 103.808156
YER 236.550121
ZAR 16.256203
ZMK 9001.206681
ZMW 19.630065
ZWL 321.999592
SSP 5712.013969
MXV 1.950566
  • AEX

    -5.7200

    1095.09

    -0.52%

  • BEL20

    -64.1300

    5713.16

    -1.11%

  • PX1

    -121.9900

    8065.02

    -1.49%

  • ISEQ

    -114.6100

    14211.37

    -0.8%

  • OSEBX

    -19.2300

    2117.33

    -0.9%

  • PSI20

    -128.6200

    9542.21

    -1.33%

  • ENTEC

    -5.8300

    1416.23

    -0.41%

  • BIOTK

    -10.7300

    4652.42

    -0.23%

  • N150

    -46.8600

    4252.11

    -1.09%

Incident OpenAI: les modèles IA ont fait intrusion sur d'autres plateformes
Incident OpenAI: les modèles IA ont fait intrusion sur d'autres plateformes / Photo: © AFP/Archives

Incident OpenAI: les modèles IA ont fait intrusion sur d'autres plateformes

Les deux modèles d'intelligence artificielle (IA) d'OpenAI qui sont sortis, de leur propre initiative, du milieu confiné dans lequel ils étaient testés pour attaquer le site Hugging Face, ont également fait intrusion sur d'autres plateformes, selon le créateur de ChatGPT.

Taille du texte:

L'une d'entre elle a servi de relais pour préparer l'attaque sur Hugging Face, une bibliothèque IA que les deux modèles ont fouillée pour trouver les réponses aux tests soumis par les développeurs d'OpenAI.

Au total, quatre comptes associés à d'autres plateformes ont été piratés. OpenAI n'a pas révélé les noms des entités visées. Ces manoeuvres ont été effectuées avec le même objectif que celui poursuivi lors de l'offensive contre Hugging Face.

Selon une actualisation du compte rendu de l'incident, publiée dans la nuit de mardi à mercredi, les deux IA ont également utilisé plusieurs sites en accès libre pour copier du code de programmation ou le tester, mais sans aller plus loin qu'un utilisateur ordinaire.

Pour Hugging Face, qui a mis en ligne, de son côté, un long récit des événements, l'effraction dont elle a été victime relevait d'une "tentative (des deux modèles) de tricher à l'évaluation" d'OpenAI.

Les IA ont voulu "dérober les solutions aux tests plutôt que d'essayer d'y répondre par elles-mêmes".

Pour les besoins du test, les informaticiens d'OpenAI avaient réduit les garde-fous pour juger du potentiel des modèles en matière de cybersécurité.

L'entreprise a révélé qu'outre son modèle le plus avancé, GPT-5.6 Sol, l'autre IA mêlée à l'incident n'avait pas vocation à être commercialisée et était uniquement destinée à un usage interne.

Le rapport d'Hugging Face indique que l'attaque a duré pas moins de cinq jours avant que le site ne parvienne à la contenir.

Aucun des deux documents ne le mentionne clairement et la société n'a pas répondu à une question de l'AFP sur ce point, mais il semble qu'OpenAI n'ait pris conscience de l'évasion que plusieurs jours après les faits.

- Une IA auto-programmée -

"Un pirate (informatique) humain aurait pu trouver et exploiter les mêmes vulnérabilités", explique l'entreprise.

Ce qui a fait la différence, c'est le volume des tentatives, avec pas moins de 17.600 actions contre Hugging Face, marquées par beaucoup d'échecs, mais suffisamment de réussites pour que les modèles parviennent à leurs fins.

"L'échelle et la vitesse de ces actions dépassent de loin les capacités d'un humain qui opérerait manuellement", a fait valoir Hugging Face.

Le chercheur en IA Daniel Kokotajlo a plaidé pour une analyse de l'incident menée par un laboratoire indépendant, une démarche "qui devrait devenir systématique" pour des cas similaires, selon lui.

Cette évasion de modèles n'est pas la première à être documentée, mais elle est considérée comme, de loin, la plus sérieuse à ce jour.

Elle a donné un écho supplémentaire au débat, déjà nourri, sur l'accélération de l'IA, aux capacités de plus en plus étendues, et sur la difficulté de la contrôler.

Lors de l'épisode OpenAI, les modèles ont utilisé des méthodes dont ils savaient qu'elles étaient en contradiction avec le scénario du test, sans en informer les développeurs.

Mardi, plus d'un millier d'employés de géants de l'IA, dont plusieurs dirigeants de premier plan, ont demandé au gouvernement américain d'aider à "temporiser" la sortie des nouveaux modèles, pour laisser le temps à l'écosystème informatique de s'y préparer.

Ils plaident, dans une pétition, pour que les États-Unis soient moteur dans la création d'une instance internationale de référence en matière d'évaluation et de supervision de l'IA.

Interrogé sur la question, le président américain Donald Trump a estimé qu'il "fallait être prudent", et trouver un équilibre entre le contrôle des agents et le fait de ne pas être devancé par la Chine dans le développement de l'IA.

"Nous ne voulons pas les limiter, et que l'on se retrouve d'un seul coup derrière la Chine", a-t-il déclaré, "celui qui l'emportera" dans cette course à l'IA "pourrait très bien ramasser toute la mise".

Le milieu s'inquiète d'autant plus qu'il voit approcher le stade dit de "l'auto-amélioration récursive" (recursive self-improvement), au-delà duquel l'intelligence artificielle serait en mesure de concevoir seule son successeur, une séquence qui pourrait se répéter à l'infini.

Les derniers modèles d'OpenAI et Anthropic ont été en partie programmés par l'IA elle-même.

Le "RSI", son abréviation, rendrait plus difficile les vérifications et l'évaluation de nouveaux modèles par des informaticiens humains, car ils n'auraient pas participé directement à leur élaboration.

A.Maldonado--TFWP