The Fort Worth Press - IA : Mythos 5 d'Anthropic crée de fausses identités lors d'un test au Royaume-Uni

USD -
AED 3.6725
AFN 65.000252
ALL 79.60134
AMD 362.536449
ANG 1.790365
AOA 918.000397
ARS 1514.502396
AUD 1.40554
AWG 1.8
AZN 1.694738
BAM 1.702398
BBD 2.01149
BDT 122.644384
BGN 1.683441
BHD 0.376463
BIF 3002.654829
BMD 1
BND 1.276233
BOB 9.812421
BRL 5.14198
BSD 0.998738
BTN 95.698307
BWP 13.543979
BYN 3.021108
BYR 19600
BZD 2.008617
CAD 1.398598
CDF 2311.000108
CHF 0.822399
CLF 0.024299
CLP 959.459432
CNY 6.69765
CNH 6.69665
COP 3159.072116
CRC 446.794621
CUC 1
CUP 26.5
CVE 95.978587
CZK 21.178022
DJF 177.847413
DKK 6.50835
DOP 58.945902
DZD 134.064499
EGP 52.262081
ERN 15
ETB 163.132872
EUR 0.87069
FJD 2.215896
FKP 0.746534
GBP 0.746804
GEL 2.602706
GGP 0.746534
GHS 11.505418
GIP 0.746534
GMD 73.499774
GNF 8780.084432
GTQ 7.621535
GYD 208.948079
HKD 7.845105
HNL 26.810289
HRK 6.559702
HTG 130.530531
HUF 317.35803
IDR 17812.1
ILS 3.03663
IMP 0.746534
INR 95.935499
IQD 1308.35183
IRR 1374599.999964
ISK 121.189808
JEP 0.746534
JMD 157.705532
JOD 0.709027
JPY 156.823499
KES 129.329329
KGS 87.449702
KHR 4047.525787
KMF 428.00011
KPW 900.000318
KRW 1386.040297
KWD 0.30816
KYD 0.832311
KZT 446.516081
LAK 22379.771075
LBP 89435.000218
LKR 330.574052
LRD 172.781477
LSL 16.23702
LTL 2.95274
LVL 0.60489
LYD 6.343735
MAD 9.462593
MDL 17.552335
MGA 4329.546938
MKD 53.553554
MMK 2099.833711
MNT 3597.142387
MOP 8.069983
MRU 40.178439
MUR 47.569982
MVR 15.45008
MWK 1731.818775
MXN 17.205016
MYR 4.083701
MZN 63.91014
NAD 16.23702
NGN 1331.72989
NIO 36.749793
NOK 9.412035
NPR 153.117465
NZD 1.747644
OMR 0.385359
PAB 0.998738
PEN 3.37024
PGK 4.445315
PHP 62.910024
PKR 276.819167
PLN 3.79915
PYG 5920.703312
QAR 3.65052
RON 4.5824
RSD 102.180441
RUB 84.109708
RWF 1467.119293
SAR 3.757625
SBD 8.000512
SCR 14.034004
SDG 601.501522
SEK 9.81462
SGD 1.276505
SHP 0.747524
SLE 24.649896
SLL 20969.491881
SOS 570.744658
SRD 37.945501
STD 20697.981008
STN 21.325673
SVC 8.739174
SYP 13002.000254
SZL 16.231884
THB 33.322991
TJS 9.213126
TMT 3.51
TND 2.937894
TOP 2.40776
TRY 48.776255
TTD 6.779823
TWD 31.780093
TZS 2646.559603
UAH 44.62123
UGX 3939.591766
UYU 40.161901
UZS 11824.868347
VES 847.485101
VND 26022
VUV 117.955747
WST 2.750287
XAF 571.135185
XAG 0.015096
XAU 0.000228
XCD 2.70255
XCG 1.799974
XDR 0.707052
XOF 571.135185
XPF 103.808156
YER 236.550121
ZAR 16.256203
ZMK 9001.206681
ZMW 19.630065
ZWL 321.999592
SSP 5712.013969
MXV 1.950566
  • AEX

    -5.7200

    1095.09

    -0.52%

  • BEL20

    -64.1300

    5713.16

    -1.11%

  • PX1

    -121.9900

    8065.02

    -1.49%

  • ISEQ

    -114.6100

    14211.37

    -0.8%

  • OSEBX

    -19.2300

    2117.33

    -0.9%

  • PSI20

    -128.6200

    9542.21

    -1.33%

  • ENTEC

    -5.8300

    1416.23

    -0.41%

  • BIOTK

    -10.7300

    4652.42

    -0.23%

  • N150

    -46.8600

    4252.11

    -1.09%

IA : Mythos 5 d'Anthropic crée de fausses identités lors d'un test au Royaume-Uni
IA : Mythos 5 d'Anthropic crée de fausses identités lors d'un test au Royaume-Uni / Photo: © AFP/Archives

IA : Mythos 5 d'Anthropic crée de fausses identités lors d'un test au Royaume-Uni

L'institut britannique de sécurité de l'IA (AISI) a dit avoir rencontré un "incident sérieux" lors d'une évaluation de routine au cours de laquelle Mythos 5 d'Anthropic a créé de fausses identités en ligne pour écrire à des développeurs afin de les convaincre d'intégrer du code malveillant.

Taille du texte:

Cette information, qui provient d'un rapport publié mardi par cet organisme qui dépend du gouvernement britannique, intervient après une série d'incidents aux Etats-Unis qui ont vu les modèles les plus puissants d'OpenAI (GPT-5.6 Sol) et d'Anthropic (Mythos 5) s'introduire sans autorisation chez d'autres entreprises.

Lors de l'évaluation britannique, menée avec un accès à internet ouvert et certains filtres de sécurité désactivés, des agents d'IA ont mené "des actions dirigées contre des personnes et des organisations réelles", explique l'AISI dans un compte rendu publié sur son site internet.

Les tentatives des modèles d'IA "n'ont pas abouti et nos investigations n'ont mis en évidence aucun dommage dans le monde réel", précise l'organisme.

"Mais c'est la première fois que nous voyons des risques liés à l'autonomie et à un comportement de dissimulation se manifester aussi clairement, sans sollicitation spécifique, dans le monde réel."

La semaine dernière, Anthropic avait déjà indiqué que ses modèles avaient "obtenu un accès non autorisé" à trois organisations lors de tests pourtant censés les empêcher d'accéder à des systèmes "réels".

Cette annonce était intervenue quelques jours seulement après que son rival OpenAI a révélé que deux de ses modèles étaient sortis, de leur propre initiative, du milieu confiné dans lequel ils étaient testés pour attaquer le site Hugging Face.

L'incident britannique, détecté et rapidement contenu le 28 juillet, a visé la plateforme destinée aux développeurs GitHub.

"Il a pour origine une seule évaluation, au cours de laquelle des agents se sont vu confier la tâche de résoudre un défi en cybersécurité", à plusieurs reprises, a précisé l'AISI.

Les incidents détectés l'ont été presque exclusivement avec Mythos 5 et, de façon plus marginale, avec GPT-5.6 Sol.

"Il ne s'agit pas d'un cas où un modèle se serait échappé de son environnement de test sécurisé" car "nous avions intentionnellement autorisé l’accès à internet" et désactivé des sécurités, "des conditions qui ne reflètent pas la manière dont les modèles de pointe sont mis à la disposition du public", insiste l'AISI.

Cet incident "met en évidence la nécessité d'un débat plus large sur la manière d'évaluer en toute sécurité des agents d'IA de plus en plus capables", a réagi Anthropic dans une déclaration transmise à l'AFP.

"Les tests indépendants sont essentiels pour comprendre le comportement de modèles de plus en plus performants", a pour sa part estimé OpenAI, disant vouloir travailler avec les différents acteurs du secteur "pour mener des évaluations en toute sécurité".

S.Jordan--TFWP