The Fort Worth Press - IA : Mythos 5 d'Anthropic crée de fausses identités lors d'un test au Royaume-Uni

USD -
AED 3.672501
AFN 65.999981
ALL 80.778943
AMD 365.649242
AOA 918.000071
ARS 1496.242501
AUD 1.420051
AWG 1.8025
AZN 1.70415
BAM 1.694243
BBD 2.013626
BDT 123.754743
BHD 0.376996
BIF 2988.071622
BMD 1
BND 1.281981
BOB 12.092258
BRL 5.122702
BSD 0.999753
BTN 95.145446
BWP 13.521485
BYN 2.960018
BYR 19600
BZD 2.010681
CAD 1.399755
CDF 2261.000308
CHF 0.809703
CLF 0.023153
CLP 914.220115
CNY 6.749953
CNH 6.748475
COP 3181.98
CRC 454.762008
CUC 1
CUP 26.5
CVE 95.518807
CZK 20.975095
DJF 178.03342
DKK 6.476797
DOP 58.256128
DZD 132.984018
EGP 49.790099
ERN 15
ETB 161.364703
EUR 0.86642
FJD 2.21245
FKP 0.742819
GBP 0.742565
GEL 2.614971
GGP 0.742819
GHS 11.751814
GIP 0.742819
GMD 73.494895
GNF 8780.470902
GTQ 7.628337
GYD 209.158083
HKD 7.84455
HNL 26.796086
HRK 6.527503
HTG 130.718954
HUF 315.163504
IDR 17899
ILS 3.01309
IMP 0.742819
INR 95.242097
IQD 1309.701703
IRR 1374799.999854
ISK 123.030031
JEP 0.742819
JMD 158.474679
JOD 0.708997
JPY 157.837501
KES 129.350358
KGS 87.450213
KHR 4056.705519
KMF 427.000174
KRW 1423.17952
KWD 0.30893
KYD 0.833171
KZT 468.495939
LAK 22589.41952
LBP 89528.70601
LKR 335.825291
LRD 180.459725
LSL 16.307022
LTL 2.95274
LVL 0.60489
LYD 6.373118
MAD 9.327951
MDL 17.39541
MGA 4298.392651
MKD 53.301108
MMK 2099.443841
MNT 3595.840223
MOP 8.078327
MRU 40.080389
MUR 46.93997
MVR 15.449648
MWK 1733.55625
MXN 17.24656
MYR 4.0895
MZN 63.909695
NAD 16.306951
NGN 1362.770366
NIO 36.790312
NOK 9.53125
NPR 152.231048
NZD 1.699795
OMR 0.384504
PAB 0.999749
PEN 3.37939
PGK 4.41709
PHP 60.754026
PKR 277.55765
PLN 3.7246
PYG 5946.889469
QAR 3.654602
RON 4.552104
RSD 101.643999
RUB 81.648985
RWF 1468.660802
SAR 3.755132
SBD 8.068348
SCR 14.493758
SDG 600.503789
SEK 9.464635
SGD 1.28211
SLE 24.545196
SOS 571.386496
SRD 37.667997
STD 20697.981008
STN 21.223422
SVC 8.747553
SZL 16.293454
THB 33.062964
TJS 9.222706
TMT 3.5
TND 2.932323
TRY 47.592097
TTD 6.768972
TWD 32.218008
TZS 2649.998049
UAH 44.766628
UGX 3724.060864
UYU 40.264038
UZS 11914.620835
VES 754.21125
VND 26235
VUV 119.344278
WST 2.729216
XAF 568.230703
XAG 0.016239
XAU 0.000235
XCD 2.70255
XCG 1.801841
XDR 0.705886
XOF 568.233164
XPF 103.310868
YER 236.874962
ZAR 16.31015
ZMK 9001.198449
ZMW 19.020435
ZWL 321.999592
  • AEX

    1.1100

    1112.47

    +0.1%

  • BEL20

    -15.5900

    5760.2

    -0.27%

  • PX1

    30.3400

    8699.71

    +0.35%

  • ISEQ

    25.2300

    14041.35

    +0.18%

  • OSEBX

    6.6400

    2020

    +0.33%

  • PSI20

    47.7200

    9224.19

    +0.52%

  • ENTEC

    -5.8300

    1416.23

    -0.41%

  • BIOTK

    87.6700

    4302.47

    +2.08%

  • N150

    12.9400

    4324.93

    +0.3%

IA : Mythos 5 d'Anthropic crée de fausses identités lors d'un test au Royaume-Uni
IA : Mythos 5 d'Anthropic crée de fausses identités lors d'un test au Royaume-Uni / Photo: © AFP/Archives

IA : Mythos 5 d'Anthropic crée de fausses identités lors d'un test au Royaume-Uni

L'institut britannique de sécurité de l'IA (AISI) a dit avoir rencontré un "incident sérieux" lors d'une évaluation de routine au cours de laquelle Mythos 5 d'Anthropic a créé de fausses identités en ligne pour écrire à des développeurs afin de les convaincre d'intégrer du code malveillant.

Taille du texte:

Cette information, qui provient d'un rapport publié mardi par cet organisme qui dépend du gouvernement britannique, intervient après une série d'incidents aux Etats-Unis qui ont vu les modèles les plus puissants d'OpenAI (GPT-5.6 Sol) et d'Anthropic (Mythos 5) s'introduire sans autorisation chez d'autres entreprises.

Lors de l'évaluation britannique, menée avec un accès à internet ouvert et certains filtres de sécurité désactivés, des agents d'IA ont mené "des actions dirigées contre des personnes et des organisations réelles", explique l'AISI dans un compte rendu publié sur son site internet.

Les tentatives des modèles d'IA "n'ont pas abouti et nos investigations n'ont mis en évidence aucun dommage dans le monde réel", précise l'organisme.

"Mais c'est la première fois que nous voyons des risques liés à l'autonomie et à un comportement de dissimulation se manifester aussi clairement, sans sollicitation spécifique, dans le monde réel."

La semaine dernière, Anthropic avait déjà indiqué que ses modèles avaient "obtenu un accès non autorisé" à trois organisations lors de tests pourtant censés les empêcher d'accéder à des systèmes "réels".

Cette annonce était intervenue quelques jours seulement après que son rival OpenAI a révélé que deux de ses modèles étaient sortis, de leur propre initiative, du milieu confiné dans lequel ils étaient testés pour attaquer le site Hugging Face.

L'incident britannique, détecté et rapidement contenu le 28 juillet, a visé la plateforme destinée aux développeurs GitHub.

"Il a pour origine une seule évaluation, au cours de laquelle des agents se sont vu confier la tâche de résoudre un défi en cybersécurité", à plusieurs reprises, a précisé l'AISI.

Les incidents détectés l'ont été presque exclusivement avec Mythos 5 et, de façon plus marginale, avec GPT-5.6 Sol.

"Il ne s'agit pas d'un cas où un modèle se serait échappé de son environnement de test sécurisé" car "nous avions intentionnellement autorisé l’accès à internet" et désactivé des sécurités, "des conditions qui ne reflètent pas la manière dont les modèles de pointe sont mis à la disposition du public", insiste l'AISI.

Cet incident "met en évidence la nécessité d'un débat plus large sur la manière d'évaluer en toute sécurité des agents d'IA de plus en plus capables", a réagi Anthropic dans une déclaration transmise à l'AFP.

"Les tests indépendants sont essentiels pour comprendre le comportement de modèles de plus en plus performants", a pour sa part estimé OpenAI, disant vouloir travailler avec les différents acteurs du secteur "pour mener des évaluations en toute sécurité".

S.Jordan--TFWP