The Fort Worth Press - L'intoxication des données, la menace invisible qui cible les chatbots IA

USD -
AED 3.672503
AFN 64.000009
ALL 80.712093
AMD 364.394871
ANG 1.790365
AOA 918.000259
ARS 1524.6764
AUD 1.424207
AWG 1.8
AZN 1.701076
BAM 1.717716
BBD 2.016134
BDT 123.177046
BGN 1.683441
BHD 0.377383
BIF 3014.939006
BMD 1
BND 1.278905
BOB 12.267697
BRL 5.186703
BSD 1.000953
BTN 95.858456
BWP 13.630595
BYN 3.024376
BYR 19600
BZD 2.013235
CAD 1.415295
CDF 2340.000263
CHF 0.830795
CLF 0.024352
CLP 961.549739
CNY 6.71325
CNH 6.714065
COP 3304.75
CRC 455.108332
CUC 1
CUP 24.025823
CVE 96.778865
CZK 21.42195
DJF 178.251648
DKK 6.56825
DOP 59.527678
DZD 133.77999
EGP 51.709801
ERN 15
ETB 162.38462
EUR 0.87864
FJD 2.237195
FKP 0.754816
GBP 0.755285
GEL 2.615009
GGP 0.754816
GHS 11.626559
GIP 0.754816
GMD 73.49826
GNF 8803.600834
GTQ 7.644576
GYD 209.441419
HKD 7.84337
HNL 26.866497
HRK 6.620898
HTG 131.00126
HUF 322.190317
IDR 17976
ILS 3.051398
IMP 0.754816
INR 96.01415
IQD 1311.329993
IRR 1374837.487483
ISK 120.389894
JEP 0.754816
JMD 158.367842
JOD 0.708992
JPY 157.626501
KES 129.610402
KGS 87.448199
KHR 4070.73506
KMF 433.000266
KPW 900.000318
KRW 1362.904979
KWD 0.30881
KYD 0.834171
KZT 443.156186
LAK 22452.716678
LBP 89639.254709
LKR 330.532926
LRD 172.178625
LSL 16.331596
LTL 2.95274
LVL 0.60489
LYD 6.399881
MAD 9.60592
MDL 17.768078
MGA 4419.404276
MKD 54.074585
MMK 2099.83552
MNT 3596.071123
MOP 8.087369
MRU 40.269447
MUR 47.470152
MVR 15.450014
MWK 1735.705221
MXN 17.75037
MYR 4.084597
MZN 63.910078
NAD 16.332887
NGN 1327.861434
NIO 36.833901
NOK 9.51498
NPR 153.367644
NZD 1.764685
OMR 0.384497
PAB 1.000307
PEN 3.398193
PGK 4.459726
PHP 62.494958
PKR 277.376198
PLN 3.843575
PYG 5900.150622
QAR 3.648779
RON 4.636604
RSD 103.147988
RUB 84.147418
RWF 1479.428955
SAR 3.756013
SBD 8.000512
SCR 13.931236
SDG 601.498907
SEK 9.93628
SGD 1.27854
SHP 0.755002
SLE 24.649667
SLL 20969.491881
SOS 572.098558
SRD 37.6675
STD 20697.981008
STN 21.503489
SVC 8.758887
SYP 13002.000254
SZL 16.327731
THB 33.582985
TJS 9.234445
TMT 3.51
TND 2.963376
TOP 2.40776
TRY 48.980703
TTD 6.80881
TWD 31.782502
TZS 2644.984972
UAH 44.823667
UGX 3920.604251
UYU 40.102584
UZS 11846.95307
VES 852.43145
VND 25963
VUV 117.801098
WST 2.745718
XAF 576.350021
XAG 0.016198
XAU 0.000239198684
XCD 2.702551
XCG 1.804034
XDR 0.707052
XOF 576.350021
XPF 104.742206
YER 236.650326
ZAR 16.39065
ZMK 9001.205751
ZMW 19.513758
ZWL 321.999592
SSP 5712.591897
MXV 2.010183
  • AEX

    3.2000

    1105.55

    +0.29%

  • BEL20

    -25.9400

    5737.76

    -0.45%

  • PX1

    -7.3300

    8131.86

    -0.09%

  • ISEQ

    5.7300

    14337.15

    +0.04%

  • OSEBX

    1.2600

    2108.79

    +0.06%

  • PSI20

    21.1600

    9638.63

    +0.22%

  • ENTEC

    -5.8300

    1416.23

    -0.41%

  • BIOTK

    -20.9400

    4631.6

    -0.45%

  • N150

    -6.4200

    4271.03

    -0.15%

L'intoxication des données, la menace invisible qui cible les chatbots IA
L'intoxication des données, la menace invisible qui cible les chatbots IA / Photo: © AFP/Archives

L'intoxication des données, la menace invisible qui cible les chatbots IA

Le recours aux agents conversationnels basés sur l'intelligence artificielle occupe une place croissante dans le rapport des utilisateurs à l'information. Mais aux biais et aux erreurs des "chatbots" s'ajoute la menace de manipulation des données sur lesquels ils sont entraînés.

Taille du texte:

. L'IA, cible de choix

ChatGPT, Mistral, Claude ou Gemini... Prisés des utilisateurs pour leur rapidité et leur facilité d'utilisation, les "chatbots" IA sont entraînés à formuler leurs réponses à partir de gigantesques bases de données regroupant des milliards de documents, inlassablement compilés et archivés par des "robots" qui parcourent internet en quête de données.

Il y apprennent comment, statistiquement, les mots s'enchaînent pour former des phrases et des idées, afin de pouvoir ensuite générer des réponses cohérentes qui ont le plus de chances de correspondre à la requête de l'usager.

Mais ce mode de collecte et d'entraînement expose les "chatbots" à de possibles manipulations par des acteurs malveillants, susceptibles d'introduire dans leurs données d'entraînement des éléments indésirables comme de la désinformation, de la propagande ou du code informatique malveillant.

. Empoisonnement, conditionnement

Chercheurs au Laboratoire d'investigation numérique de l'Atlantic council, un think tank d'étude des relations internationales, Valentin Châletet et Esteban Ponce de León distinguent deux concepts:

L'empoisonnement de données des grands modèles de langage (LLM) sur lesquels reposent les chatbots ("LLM poisoning") se produit en amont, lors de l'entraînement, via l'injection d'éléments non désirés. Ces manipulations sont pensées pour contourner les mécanismes de filtrage mis en place par les entreprises pour garantir des données fiables.

Le conditionnement ("LLM grooming") intervient plus tard, alors que le chatbot est déjà déployé: des acteurs malveillants diffusent massivement du contenu en ligne pour qu'il soit intégré par les modèles IA.

Ainsi, des tests menés par l'entreprise d'analyse de la fiabilité des contenus en ligne Newsguard ont montré que, dans diverses circonstances, les principaux chabots commerciaux pouvaient répondre en s'appuyant sur de fausses informations du réseau Pravda, une nébuleuse de sites web destinés à amplifier la propagande prorusse.

Ces manipulations peuvent être difficiles à repérer et endiguer, notamment parce que le fonctionnement de ces modèles est volontairement rendu opaque par leurs concepteurs: "On a affaire à un réseau de neurones qui fonctionne comme une boîte noire", explique Valentin Châtelet.

Expurger les données en question nécessiterait le plus souvent un réentraînement complet du modèle, estime le chercheur, et présenterait "un coût extrême" en temps et en ressources. La complexité de ces systèmes algorithmiques rend également très ardus leur audit ou leur régulation.

. "Désinformation à la demande"

Le phénomène est difficile à mesurer et son impact sur les utilisateurs complexe voire impossible à démontrer. Mais, difficilement traçables et relativement peu coûteuses, ces opérations ont de quoi séduire les acteurs qui souhaiteraient promouvoir leurs narratifs, qu'il s'agisse d'Etats, de lobbies ou d'entreprises.

"Ce type d'opération pourrait être mené par un groupe industriel qui veut enterrer les résultats d'une étude médicale scientifique qui ne va pas dans leur sens, par un homme politique qui veut pousser un récit qui va servir sa campagne...", énumère Chine Labbé, rédactrice en chef française de Newsguard.

Esteban Ponce de León observe pour sa part le développement d'un écosystème de "désinformation à la demande", au sein duquel des Etats ou des entités "délègueraient (...) l'opération à une autre entité, probablement privée, qui dispose déjà de l'expertise technologique nécessaire pour mener à bien" une campagne d'influence visant les LLM.

En septembre 2025, une entreprise dirigée par l'ancien directeur de campagne de Donald Trump a ainsi reçu plusieurs millions de dollars d'entreprises liées à l'Etat israélien pour diffuser des éléments de langage favorables via un réseau de sites web, avec pour objectif notamment d'influencer les réponses des chatbots, selon le think tank américain Quincy Institute for Responsible Statecraft.

Face au risque, les entreprises d'IA sont les premières concernées: il est ainsi crucial d'"apprendre aux chatbots à distinguer et à ne pas pondérer de la même manière les sources fiables et les sources de propagande étrangère ou de désinformation", argue Chine Labbé.

X.Silva--TFWP