The Fort Worth Press - Un pas de plus dans l'interprétation du génome grâce à l'IA

USD -
AED 3.672997
AFN 64.99994
ALL 81.925024
AMD 362.820306
ANG 1.790365
AOA 916.99953
ARS 1524.814897
AUD 1.443097
AWG 1.8
AZN 1.700406
BAM 1.733158
BBD 2.015756
BDT 123.052656
BGN 1.683441
BHD 0.37702
BIF 2995
BMD 1
BND 1.281424
BOB 12.054428
BRL 5.218203
BSD 1.000833
BTN 96.45446
BWP 14.158233
BYN 3.014683
BYR 19600
BZD 2.012832
CAD 1.422025
CDF 2310.000381
CHF 0.831595
CLF 0.024862
CLP 981.70977
CNY 6.704598
CNH 6.71585
COP 3320.28
CRC 457.240078
CUC 1
CUP 24.018396
CVE 97.712812
CZK 21.7469
DJF 177.719711
DKK 6.64818
DOP 59.649878
DZD 133.649647
EGP 52.3194
ERN 15
ETB 163.475001
EUR 0.88935
FJD 2.252798
FKP 0.753812
GBP 0.757863
GEL 2.595018
GGP 0.753812
GHS 11.715008
GIP 0.753812
GMD 73.516576
GNF 8754.999849
GTQ 7.645479
GYD 209.346324
HKD 7.84708
HNL 26.865513
HRK 6.702099
HTG 130.978015
HUF 327.9005
IDR 17942.8
ILS 3.086099
IMP 0.753812
INR 96.09635
IQD 1310
IRR 1746539.000347
ISK 121.87041
JEP 0.753812
JMD 157.630753
JOD 0.709021
JPY 158.163005
KES 129.750032
KGS 87.447002
KHR 4053.132006
KMF 434.999516
KPW 900.000318
KRW 1359.799275
KWD 0.30888
KYD 0.834057
KZT 443.471634
LAK 22442.975382
LBP 89622.18589
LKR 330.728128
LRD 171.587828
LSL 16.694967
LTL 2.95274
LVL 0.60489
LYD 6.411393
MAD 9.760381
MDL 17.819861
MGA 4419.297095
MKD 54.561083
MMK 2099.783199
MNT 3598.053803
MOP 8.089432
MRU 40.068766
MUR 47.820222
MVR 15.459928
MWK 1735.373872
MXN 18.301203
MYR 4.084605
MZN 63.90389
NAD 16.694984
NGN 1328.679673
NIO 36.828953
NOK 9.58861
NPR 154.325085
NZD 1.785208
OMR 0.384504
PAB 1.000833
PEN 3.453202
PGK 4.464491
PHP 62.795499
PKR 277.237331
PLN 3.89312
PYG 5831.841625
QAR 3.648069
RON 4.753294
RSD 104.537973
RUB 83.374109
RWF 1476.791379
SAR 3.756193
SBD 8.064852
SCR 13.769888
SDG 601.502245
SEK 10.049794
SGD 1.2802
SHP 0.754575
SLE 24.600999
SLL 20969.491881
SOS 571.929887
SRD 37.672502
STD 20697.981008
STN 21.711004
SVC 8.757067
SYP 13002.000254
SZL 16.694979
THB 33.659686
TJS 9.217388
TMT 3.51
TND 2.997002
TOP 2.40776
TRY 49.093402
TTD 6.789784
TWD 31.903903
TZS 2635.004027
UAH 44.939475
UGX 3973.556883
UYU 40.28499
UZS 11829.395814
VES 859.10005
VND 25982
VUV 119.747847
WST 2.7762
XAF 583.375553
XAG 0.016394
XAU 0.000239382489
XCD 2.70255
XCG 1.803617
XDR 0.707052
XOF 583.375553
XPF 105.684789
YER 236.375004
ZAR 16.695503
ZMK 9001.196697
ZMW 19.680804
ZWL 321.999592
SSP 5712.591899
MXV 2.071202
  • AEX

    3.2000

    1105.55

    +0.29%

  • BEL20

    -25.9400

    5737.76

    -0.45%

  • PX1

    -7.3300

    8131.86

    -0.09%

  • ISEQ

    5.7300

    14337.15

    +0.04%

  • OSEBX

    1.2600

    2108.79

    +0.06%

  • PSI20

    21.1600

    9638.63

    +0.22%

  • ENTEC

    -5.8300

    1416.23

    -0.41%

  • BIOTK

    -20.9400

    4631.6

    -0.45%

  • N150

    -6.4200

    4271.03

    -0.15%

Un pas de plus dans l'interprétation du génome grâce à l'IA
Un pas de plus dans l'interprétation du génome grâce à l'IA / Photo: © AFP/Archives

Un pas de plus dans l'interprétation du génome grâce à l'IA

AlphaGenome, outil d'intelligence artificielle (IA) de Google rendu public mercredi, fait un pas de plus dans la compréhension du génome, en analysant comment des portions de l'ADN régulent l'activité des gènes dans la cellule.

Taille du texte:

Le déchiffrage de l'ensemble du génome humain en 2003, "nous a donné le livre de la vie, mais le lire reste un défi", a rappelé Pushmeet Kohli, vice-président de la recherche chez Google DeepMind, à l'occasion de la présentation d'AlphaGenome dans la revue Nature.

"Nous avons le texte" - la succession de 3 milliards de paires de nucléotides A, T, C et G qui composent l'ADN -, mais "comprendre la grammaire (...) et la manière dont cela gouverne la vie constitue la prochaine frontière majeure de la recherche", a-t-il souligné devant la presse.

Seules 2% des séquences d'ADN "codent" directement des protéines, indispensables au fonctionnement des organismes vivants.

Les 98% restants ont un rôle de "chef d'orchestre": elles coordonnent, protègent et régulent l'expression de l'information génétique dans chacune de nos cellules. Ces séquences, appelées "non codantes", contiennent de nombreux variants associés à des maladies.

Ce sont elles qu'étudie AlphaGenome, venant compléter les autres modèles développés par le laboratoire d'IA de Google: AlphaMissense (analyse des séquences codantes de l'ADN), AlphaProteo (conception de protéines) et AlphaFold (prédiction de la structure de protéines, prix Nobel de chimie en 2024).

Le modèle d'apprentissage profond (dans lequel un réseau de neurones apprend à reconnaître automatiquement des motifs complexes) a été entraîné avec des données provenant de grands consortiums publics, qui ont mesuré expérimentalement ces propriétés dans des centaines de types de cellules et de tissus chez l'homme et la souris.

Il est capable d'analyser une longue séquence d'ADN et de "prédire" l'influence de chaque paire de nucléotides sur différents processus biologiques dans la cellule: activer ou réprimer l'expression d'un gène, piloter l'assemblage de l'ARN (une "copie" de l'ADN qui transmet l'information génétique dans la cellule)...

- "Fondamental" mais "pas parfait" -

D'autres modèles existaient déjà. Mais ils devaient faire un compromis entre la longueur des séquences analysées et la finesse de la résolution.

Or, une longue séquence - jusqu'à un million de paires de nucléotides - est "nécessaire pour comprendre l'environnement régulateur complet d'un gène unique", explique Ziga Avsec, un des co-auteurs du projet.

Et la finesse de la résolution permet d'étudier l'effet de variants génétiques en comparant les prédictions de séquences mutées à celles de séquences non mutées.

Autre avancée, AlphaGenome modélise simultanément l'influence de la séquence sur onze processus biologiques, alors que les scientifiques devaient jusqu'à présent utiliser plusieurs modèles.

Cet outil "peut accélérer notre compréhension du génome en aidant à cartographier l'emplacement des éléments fonctionnels et à déterminer leurs rôles au niveau moléculaire", estime Natasha Latysheva, également co-autrice.

"Nous espérons que les chercheurs enrichiront avec davantage de données et de modalités" le modèle, déjà testé par 3.000 scientifiques de 160 pays et désormais disponible en open source pour la recherche non-commerciale, souligne M. Kohli.

"Identifier précisément les différences dans nos génomes qui nous rendent plus ou moins susceptibles de développer des milliers de maladies est une étape clé vers de meilleurs traitements", note Ben Lehner, responsable de la génomique générative et synthétique au Wellcome Sanger Institute de Cambridge.

Le chercheur, qui n'a pas participé au projet mais a testé le modèle, le juge "très performant", mais encore "loin d'être parfait".

"Les modèles d'IA ne sont bons que dans la mesure où les données utilisées pour les entraîner le sont", or la plupart des jeux de données existants "sont trop petits et insuffisamment standardisés", explique-t-il dans une réaction à l'organisme britannique Science Media Center (SMC).

AlphaGenome n'est pas une "solution miracle à toutes les questions biologiques", l'expression des gènes "étant influencée par des facteurs environnementaux complexes", mais il constitue un "outil fondamental", abonde Robert Goldstone, responsable de la génomique au Francis Crick Institute, cité dans le même texte.

Selon lui, ce nouvel outil permettra aux scientifiques "d'étudier et de simuler de manière programmatique les bases génétiques des maladies complexes".

F.Carrillo--TFWP