The Fort Worth Press - Pour grandir, l'IA générative se tourne vers les livres

USD -
AED 3.672497
AFN 63.496236
ALL 80.15939
AMD 362.919823
ANG 1.790365
AOA 916.999719
ARS 1514.244199
AUD 1.414917
AWG 1.80125
AZN 1.691204
BAM 1.712962
BBD 2.013821
BDT 122.932477
BGN 1.683441
BHD 0.376962
BIF 3004.585047
BMD 1
BND 1.277595
BOB 11.923749
BRL 5.131303
BSD 0.99986
BTN 95.678145
BWP 13.595481
BYN 3.027431
BYR 19600
BZD 2.01093
CAD 1.40891
CDF 2311.000026
CHF 0.82285
CLF 0.024072
CLP 950.520259
CNY 6.6998
CNH 6.70685
COP 3210.07
CRC 453.685538
CUC 1
CUP 26.5
CVE 96.574587
CZK 21.3671
DJF 178.050457
DKK 6.551265
DOP 59.478089
DZD 133.645601
EGP 51.398897
ERN 15
ETB 163.319699
EUR 0.87636
FJD 2.237199
FKP 0.750528
GBP 0.75325
GEL 2.595013
GGP 0.750528
GHS 11.583045
GIP 0.750528
GMD 73.505167
GNF 8793.441704
GTQ 7.63211
GYD 209.186734
HKD 7.843325
HNL 26.837396
HRK 6.603201
HTG 130.683635
HUF 319.267505
IDR 17825
ILS 3.01575
IMP 0.750528
INR 95.73935
IQD 1309.814191
IRR 1374650.000003
ISK 120.929585
JEP 0.750528
JMD 157.538176
JOD 0.708982
JPY 157.929498
KES 129.310285
KGS 87.449804
KHR 4054.823313
KMF 429.999861
KPW 900.000318
KRW 1365.049996
KWD 0.30907
KYD 0.833209
KZT 444.620586
LAK 22404.007848
LBP 89537.860574
LKR 328.955608
LRD 172.465735
LSL 16.310417
LTL 2.95274
LVL 0.60489
LYD 6.383128
MAD 9.57123
MDL 17.695844
MGA 4393.217489
MKD 53.88149
MMK 2099.577364
MNT 3597.923561
MOP 8.077068
MRU 40.034859
MUR 47.880241
MVR 15.460197
MWK 1733.73447
MXN 17.439766
MYR 4.079696
MZN 63.88613
NAD 16.310274
NGN 1324.480236
NIO 36.793911
NOK 9.464115
NPR 153.084711
NZD 1.75705
OMR 0.384501
PAB 0.99986
PEN 3.375476
PGK 4.454546
PHP 62.558506
PKR 277.084952
PLN 3.83586
PYG 5925.912951
QAR 3.645178
RON 4.625896
RSD 102.932975
RUB 84.352215
RWF 1475.675439
SAR 3.756768
SBD 8.026013
SCR 13.74007
SDG 601.513532
SEK 9.87837
SGD 1.278335
SHP 0.74758
SLE 24.649746
SLL 20969.491881
SOS 571.398543
SRD 37.740486
STD 20697.981008
STN 21.4581
SVC 8.748774
SYP 13002.000254
SZL 16.306476
THB 33.287502
TJS 9.253737
TMT 3.5
TND 2.95341
TOP 2.40776
TRY 48.826011
TTD 6.795649
TWD 31.670374
TZS 2645.002947
UAH 44.878367
UGX 3889.609025
UYU 40.078651
UZS 11798.503182
VES 851.341303
VND 26010.5
VUV 118.348377
WST 2.752527
XAF 574.854365
XAG 0.015348
XAU 0.000232
XCD 2.70255
XCG 1.801955
XDR 0.707052
XOF 574.854365
XPF 104.452317
YER 236.550089
ZAR 16.34619
ZMK 9001.202171
ZMW 19.472654
ZWL 321.999592
SSP 5712.590503
MXV 1.976583
  • AEX

    3.2000

    1105.55

    +0.29%

  • BEL20

    -25.9400

    5737.76

    -0.45%

  • PX1

    -7.3300

    8131.86

    -0.09%

  • ISEQ

    5.7300

    14337.15

    +0.04%

  • OSEBX

    1.2600

    2108.79

    +0.06%

  • PSI20

    21.1600

    9638.63

    +0.22%

  • ENTEC

    -5.8300

    1416.23

    -0.41%

  • BIOTK

    -20.9400

    4631.6

    -0.45%

  • N150

    -6.4200

    4271.03

    -0.15%

Pour grandir, l'IA générative se tourne vers les livres
Pour grandir, l'IA générative se tourne vers les livres / Photo: © AFP/Archives

Pour grandir, l'IA générative se tourne vers les livres

Préserver les droits d'auteurs en négociant avec les plateformes: confronté aux besoins toujours plus grands de l'intelligence artificielle générative, le monde de l'édition commence lui aussi à passer des contrats avec ses acteurs pour monnayer ses contenus.

Taille du texte:

Le grand éditeur américain HarperCollins vient de proposer à certains de ses auteurs un contrat avec une société d'intelligence artificielle (IA) - dont l'identité est confidentielle - permettant à cette dernière d'utiliser leurs œuvres publiées pour entraîner son modèle d'intelligence artificielle générative.

Dans un courrier consulté par l'AFP, l'entreprise d'IA propose 2.500 dollars par livre sélectionné afin d'entraîner son modèle de langage (LLM) pour une période de trois ans.

Car pour pouvoir produire toutes sortes de contenus sur simple requête en langage courant, les modèles d'IA générative ont besoin d'être nourris d'une quantité de données sans cesse croissante.

Contacté, l'éditeur a confirmé l'opération. "HarperCollins a conclu un accord avec une société de technologie d'intelligence artificielle pour autoriser l'utilisation limitée de certains titres (...) pour entraîner des modèles d'IA, afin d'améliorer la qualité et les performances des modèles", écrit-il.

La maison d'édition explique également que l'accord "encadre clairement la production de modèles respectueux des droits d'auteur".

L'offre a toutefois été diversement appréciée dans le secteur de l'édition, et des écrivains comme l'Américain Daniel Kibblesmith l'ont sèchement déclinée: "je le ferais probablement pour un milliard de dollars. Je le ferais pour une somme d'argent qui ne me demanderait plus de travailler, puisque c'est le but final de cette technologie", s'est indigné l'auteur sur le réseau social Bluesky.

- Nouveaux matériaux -

Si HarperCollins est l'un des plus gros éditeurs à ce jour à passer ce type d'accord, il n'est pas le premier. L'éditeur américain de livres scientifiques Wiley a donné accès "au contenu de livres académiques et professionnels publiés pour une utilisation spécifique dans la formation des modèles, pour 23 millions de dollars, à une grande entreprise technologique", indiquait-il en mars cette année, lors de la présentation de ses résultats financiers.

Ce type de collaboration met en lumière les problèmes liés au développement des intelligences artificielles génératives, qui sont entraînées sur d'immenses quantités de données collectées sur le web avec, à la clef, de potentielles violations des droit d'auteurs.

Pour Giada Pistilli, responsable de l'éthique chez Hugging Face, une plateforme d'IA en accès libre franco-américaine, cette annonce est un pas en avant, puisque le contenu des livres est monétisé. Mais elle regrette une marge de négociation limitée pour les auteurs.

"Ce que l'on va voir, c'est un mécanisme d'accords bilatéraux entre entreprises de nouvelles technologies et éditeurs ou détenteurs de droits d'auteur, alors qu'il faudrait, à mon sens, une conversation plus large pour inclure un peu plus les parties prenantes", dit-elle.

"On part de tellement loin", commente de son côté Julien Chouraqui, le directeur juridique du syndicat français de l'édition (SNE). "C'est un progrès: le fait qu'il y ait un accord signifie qu'il y a eu un dialogue et une volonté d'aboutir à un équilibre entre l'utilisation de données sources, qui sont sous droit et qui vont générer de la valeur", dit-il.

Face à ces questions, les éditeurs de presse sont eux aussi en train de s'organiser. Fin 2023, le quotidien américain The New York Times a lancé des poursuites à l'encontre d'OpenAI, créateur du logiciel ChatGPT, ainsi que de Microsoft, son principal investisseur, pour violation des droits d'auteur. D'autres médias ont, eux, noué des accords avec OpenAI.

Les entreprises de la tech n'ont peut-être plus le choix pour améliorer leurs produits que de mettre la main au portefeuille, d'autant qu'elles commencent à manquer de nouveaux matériaux pour alimenter les modèles.

La presse américaine a récemment rapporté que les nouveaux modèles en développement semblent avoir atteint leurs limites, notamment chez Google, Anthropic et OpenAI.

"Sur le net, vous récoltez du licite et de l'illicite, et beaucoup de contenus piratés. Cela pose un problème juridique. Sans oublier le problème de qualité des données", observe Julien Chouraqui, du SNE: "si on a à cœur le développement d'un marché sur des bases vertueuses, il faut donc associer l'ensemble des acteurs."

M.Cunningham--TFWP