The Fort Worth Press - Incident OpenAI: les modèles IA ont fait intrusion sur d'autres plateformes

USD -
AED 3.672501
AFN 65.000149
ALL 81.749934
AMD 364.288288
AOA 917.999826
ARS 1488.9814
AUD 1.420666
AWG 1.80125
AZN 1.697891
BAM 1.697942
BBD 2.005964
BDT 122.991844
BHD 0.375549
BIF 2957.420027
BMD 1
BND 1.283042
BOB 11.727733
BRL 5.0677
BSD 0.995994
BTN 95.249754
BWP 13.609511
BYN 2.914451
BYR 19600
BZD 2.003099
CAD 1.400935
CDF 2274.999967
CHF 0.806975
CLF 0.023516
CLP 925.540011
CNY 6.75525
CNH 6.746375
COP 3123.68
CRC 452.811188
CUC 1
CUP 26.5
CVE 95.729857
CZK 21.018202
DJF 177.356836
DKK 6.49036
DOP 57.964346
DZD 132.847959
EGP 51.1484
ERN 15
ETB 160.75509
EUR 0.86827
FJD 2.21445
FKP 0.752629
GBP 0.74295
GEL 2.614994
GGP 0.752629
GHS 11.638315
GIP 0.752629
GMD 73.999598
GNF 8742.566952
GTQ 7.600047
GYD 208.380177
HKD 7.842735
HNL 26.849679
HRK 6.545106
HTG 130.222101
HUF 315.61902
IDR 18014
ILS 3.04879
IMP 0.752629
INR 95.3517
IQD 1310
IRR 1375000.000176
ISK 123.810271
JEP 0.752629
JMD 157.520303
JOD 0.708958
JPY 159.289015
KES 129.350051
KGS 87.449748
KHR 4040.000338
KMF 430.503341
KRW 1430.975015
KWD 0.30944
KYD 0.829995
KZT 472.457691
LAK 22680.000521
LBP 89187.75799
LKR 334.537089
LRD 180.286239
LSL 16.60995
LTL 2.95274
LVL 0.60489
LYD 6.374602
MAD 9.3845
MDL 17.539032
MGA 4302.50203
MKD 53.413377
MMK 2099.843283
MNT 3596.223753
MOP 8.047295
MRU 40.109826
MUR 46.999696
MVR 15.459753
MWK 1736.000456
MXN 17.32088
MYR 4.082504
MZN 63.9102
NAD 16.609828
NGN 1359.640123
NIO 36.650896
NOK 9.527099
NPR 152.388848
NZD 1.699915
OMR 0.384541
PAB 0.996037
PEN 3.389081
PGK 4.394288
PHP 61.230106
PKR 276.606347
PLN 3.744803
PYG 5952.696162
QAR 3.644202
RON 4.555398
RSD 101.932028
RUB 79.41502
RWF 1466.080397
SAR 3.731666
SBD 8.081105
SCR 13.962495
SDG 600.000195
SEK 9.520225
SGD 1.28197
SLE 24.698527
SOS 569.226028
SRD 37.744961
STD 20697.981008
STN 21.268284
SVC 8.714901
SZL 16.519448
THB 33.352503
TJS 9.198453
TMT 3.51
TND 2.9495
TRY 47.525202
TTD 6.759813
TWD 32.261954
TZS 2649.492976
UAH 44.434529
UGX 3730.407115
UYU 40.066503
UZS 11957.026587
VES 745.6964
VND 26294
VUV 119.53128
WST 2.752524
XAF 569.449135
XAG 0.017228
XAU 0.000246
XCD 2.70255
XCG 1.79498
XDR 0.708212
XOF 573.000356
XPF 103.53554
YER 238.279026
ZAR 16.506219
ZMK 9001.199783
ZMW 18.599463
ZWL 321.999592
  • AEX

    0.5500

    1105.19

    +0.05%

  • BEL20

    73.5100

    5728.3

    +1.3%

  • PX1

    72.1300

    8557.54

    +0.85%

  • ISEQ

    21.8500

    13676.58

    +0.16%

  • OSEBX

    11.4800

    2025.76

    +0.57%

  • PSI20

    -7.3200

    9138.66

    -0.08%

  • ENTEC

    -5.8300

    1416.23

    -0.41%

  • BIOTK

    -113.3500

    4297.09

    -2.57%

  • N150

    21.3200

    4285.34

    +0.5%

Incident OpenAI: les modèles IA ont fait intrusion sur d'autres plateformes
Incident OpenAI: les modèles IA ont fait intrusion sur d'autres plateformes / Photo: © AFP/Archives

Incident OpenAI: les modèles IA ont fait intrusion sur d'autres plateformes

Les deux modèles d'intelligence artificielle (IA) d'OpenAI qui sont sortis, de leur propre initiative, du milieu confiné dans lequel ils étaient testés pour attaquer le site Hugging Face, ont également fait intrusion sur d'autres plateformes, selon le créateur de ChatGPT.

Taille du texte:

L'une d'entre elle a servi de relais pour préparer l'attaque sur Hugging Face, une bibliothèque IA que les deux modèles ont fouillée pour trouver les réponses aux tests soumis par les développeurs d'OpenAI.

Au total, quatre comptes associés à d'autres plateformes ont été piratés. OpenAI n'a pas révélé les noms des entités visées. Ces manoeuvres ont été effectuées avec le même objectif que celui poursuivi lors de l'offensive contre Hugging Face.

Selon une actualisation du compte rendu de l'incident, publiée dans la nuit de mardi à mercredi, les deux IA ont également utilisé plusieurs sites en accès libre pour copier du code de programmation ou le tester, mais sans aller plus loin qu'un utilisateur ordinaire.

Pour Hugging Face, qui a mis en ligne, de son côté, un long récit des événements, l'effraction dont elle a été victime relevait d'une "tentative (des deux modèles) de tricher à l'évaluation" d'OpenAI.

Les IA ont voulu "dérober les solutions aux tests plutôt que d'essayer d'y répondre par elles-mêmes".

Pour les besoins du test, les informaticiens d'OpenAI avaient réduit les garde-fous pour juger du potentiel des modèles en matière de cybersécurité.

L'entreprise a révélé qu'outre son modèle le plus avancé, GPT-5.6 Sol, l'autre IA mêlée à l'incident n'avait pas vocation à être commercialisée et était uniquement destinée à un usage interne.

Le rapport d'Hugging Face indique que l'attaque a duré pas moins de cinq jours avant que le site ne parvienne à la contenir.

Aucun des deux documents ne le mentionne clairement et la société n'a pas répondu à une question de l'AFP sur ce point, mais il semble qu'OpenAI n'ait pris conscience de l'évasion que plusieurs jours après les faits.

- Une IA auto-programmée -

"Un pirate (informatique) humain aurait pu trouver et exploiter les mêmes vulnérabilités", explique l'entreprise.

Ce qui a fait la différence, c'est le volume des tentatives, avec pas moins de 17.600 actions contre Hugging Face, marquées par beaucoup d'échecs, mais suffisamment de réussites pour que les modèles parviennent à leurs fins.

"L'échelle et la vitesse de ces actions dépassent de loin les capacités d'un humain qui opérerait manuellement", a fait valoir Hugging Face.

Le chercheur en IA Daniel Kokotajlo a plaidé pour une analyse de l'incident menée par un laboratoire indépendant, une démarche "qui devrait devenir systématique" pour des cas similaires, selon lui.

Cette évasion de modèles n'est pas la première à être documentée, mais elle est considérée comme, de loin, la plus sérieuse à ce jour.

Elle a donné un écho supplémentaire au débat, déjà nourri, sur l'accélération de l'IA, aux capacités de plus en plus étendues, et sur la difficulté de la contrôler.

Lors de l'épisode OpenAI, les modèles ont utilisé des méthodes dont ils savaient qu'elles étaient en contradiction avec le scénario du test, sans en informer les développeurs.

Mardi, plus d'un millier d'employés de géants de l'IA, dont plusieurs dirigeants de premier plan, ont demandé au gouvernement américain d'aider à "temporiser" la sortie des nouveaux modèles, pour laisser le temps à l'écosystème informatique de s'y préparer.

Ils plaident, dans une pétition, pour que les États-Unis soient moteur dans la création d'une instance internationale de référence en matière d'évaluation et de supervision de l'IA.

Interrogé sur la question, le président américain Donald Trump a estimé qu'il "fallait être prudent", et trouver un équilibre entre le contrôle des agents et le fait de ne pas être devancé par la Chine dans le développement de l'IA.

"Nous ne voulons pas les limiter, et que l'on se retrouve d'un seul coup derrière la Chine", a-t-il déclaré, "celui qui l'emportera" dans cette course à l'IA "pourrait très bien ramasser toute la mise".

Le milieu s'inquiète d'autant plus qu'il voit approcher le stade dit de "l'auto-amélioration récursive" (recursive self-improvement), au-delà duquel l'intelligence artificielle serait en mesure de concevoir seule son successeur, une séquence qui pourrait se répéter à l'infini.

Les derniers modèles d'OpenAI et Anthropic ont été en partie programmés par l'IA elle-même.

Le "RSI", son abréviation, rendrait plus difficile les vérifications et l'évaluation de nouveaux modèles par des informaticiens humains, car ils n'auraient pas participé directement à leur élaboration.

A.Maldonado--TFWP