The China Mail - Un pas de plus dans l'interprétation du génome grâce à l'IA

USD -
AED 3.6725
AFN 66.000245
ALL 81.82833
AMD 362.253747
ANG 1.790365
AOA 916.999684
ARS 1524.826029
AUD 1.441057
AWG 1.8025
AZN 1.702147
BAM 1.739471
BBD 2.012612
BDT 122.851565
BGN 1.683441
BHD 0.376674
BIF 3014.617269
BMD 1
BND 1.278867
BOB 12.006155
BRL 5.213901
BSD 0.99928
BTN 96.807044
BWP 13.814757
BYN 3.009846
BYR 19600
BZD 2.009677
CAD 1.42822
CDF 2310.000111
CHF 0.830425
CLF 0.024807
CLP 979.509947
CNY 6.70455
CNH 6.709873
COP 3301.04
CRC 457.878797
CUC 1
CUP 23.981287
CVE 98.071304
CZK 21.820299
DJF 177.940248
DKK 6.67662
DOP 59.662995
DZD 133.636213
EGP 52.249599
ERN 15
ETB 163.212801
EUR 0.893302
FJD 2.253298
FKP 0.755263
GBP 0.75685
GEL 2.605028
GGP 0.755263
GHS 11.735826
GIP 0.755263
GMD 73.500677
GNF 8790.241169
GTQ 7.636412
GYD 209.021333
HKD 7.846735
HNL 26.827891
HRK 6.732202
HTG 130.85359
HUF 329.341501
IDR 17942
ILS 3.05195
IMP 0.755263
INR 96.243949
IQD 1309.040455
IRR 1746539.498985
ISK 122.570402
JEP 0.755263
JMD 158.196211
JOD 0.709022
JPY 157.779502
KES 129.890078
KGS 87.450144
KHR 4053.1526
KMF 438.000226
KPW 900.000318
KRW 1344.105006
KWD 0.30921
KYD 0.83267
KZT 448.958718
LAK 22445.267647
LBP 89483.505439
LKR 330.453112
LRD 170.863165
LSL 16.707565
LTL 2.95274
LVL 0.60489
LYD 6.399481
MAD 9.927646
MDL 17.857175
MGA 4415.17204
MKD 55.052146
MMK 2099.850161
MNT 3596.272149
MOP 8.076685
MRU 39.93098
MUR 48.560213
MVR 15.459705
MWK 1732.714877
MXN 18.215399
MYR 4.086502
MZN 63.901767
NAD 16.707565
NGN 1327.450222
NIO 36.769055
NOK 9.66105
NPR 154.896092
NZD 1.78803
OMR 0.3845
PAB 0.999253
PEN 3.462758
PGK 4.525422
PHP 62.692032
PKR 276.770538
PLN 3.919735
PYG 5846.252368
QAR 3.642282
RON 4.768597
RSD 104.90897
RUB 83.799642
RWF 1479.943076
SAR 3.74627
SBD 8.078071
SCR 14.029703
SDG 601.498676
SEK 10.078505
SGD 1.2811
SHP 0.75503
SLE 24.599033
SLL 20969.491881
SOS 571.110913
SRD 37.811501
STD 20697.981008
STN 21.791046
SVC 8.742946
SYP 13002.000254
SZL 16.704542
THB 33.689857
TJS 9.197848
TMT 3.5
TND 2.977543
TOP 2.40776
TRY 49.162102
TTD 6.775561
TWD 31.778502
TZS 2637.150945
UAH 44.962977
UGX 3987.245794
UYU 40.271978
UZS 11785.633285
VES 865.47815
VND 25998
VUV 119.582079
WST 2.788611
XAF 585.967602
XAG 0.016333
XAU 0.000241217861
XCD 2.70255
XCG 1.800887
XDR 0.707052
XOF 585.967602
XPF 106.071589
YER 236.297226
ZAR 16.697595
ZMK 9001.202058
ZMW 19.635154
ZWL 321.999592
SSP 5712.591527
MXV 2.059686
  • AEX

    3.2400

    1119.29

    +0.29%

  • BEL20

    9.1000

    5694.52

    +0.16%

  • PX1

    -0.8100

    8077.75

    -0.01%

  • ISEQ

    -37.6000

    14425.66

    -0.26%

  • OSEBX

    -4.6100

    2089.87

    -0.22%

  • PSI20

    7.7600

    9712.35

    +0.08%

  • ENTEC

    -5.8300

    1416.23

    -0.41%

  • BIOTK

    12.0700

    4481.36

    +0.27%

  • N150

    -2.5400

    4237.95

    -0.06%

Un pas de plus dans l'interprétation du génome grâce à l'IA
Un pas de plus dans l'interprétation du génome grâce à l'IA / Photo: © AFP/Archives

Un pas de plus dans l'interprétation du génome grâce à l'IA

AlphaGenome, outil d'intelligence artificielle (IA) de Google rendu public mercredi, fait un pas de plus dans la compréhension du génome, en analysant comment des portions de l'ADN régulent l'activité des gènes dans la cellule.

Taille du texte:

Le déchiffrage de l'ensemble du génome humain en 2003, "nous a donné le livre de la vie, mais le lire reste un défi", a rappelé Pushmeet Kohli, vice-président de la recherche chez Google DeepMind, à l'occasion de la présentation d'AlphaGenome dans la revue Nature.

"Nous avons le texte" - la succession de 3 milliards de paires de nucléotides A, T, C et G qui composent l'ADN -, mais "comprendre la grammaire (...) et la manière dont cela gouverne la vie constitue la prochaine frontière majeure de la recherche", a-t-il souligné devant la presse.

Seules 2% des séquences d'ADN "codent" directement des protéines, indispensables au fonctionnement des organismes vivants.

Les 98% restants ont un rôle de "chef d'orchestre": elles coordonnent, protègent et régulent l'expression de l'information génétique dans chacune de nos cellules. Ces séquences, appelées "non codantes", contiennent de nombreux variants associés à des maladies.

Ce sont elles qu'étudie AlphaGenome, venant compléter les autres modèles développés par le laboratoire d'IA de Google: AlphaMissense (analyse des séquences codantes de l'ADN), AlphaProteo (conception de protéines) et AlphaFold (prédiction de la structure de protéines, prix Nobel de chimie en 2024).

Le modèle d'apprentissage profond (dans lequel un réseau de neurones apprend à reconnaître automatiquement des motifs complexes) a été entraîné avec des données provenant de grands consortiums publics, qui ont mesuré expérimentalement ces propriétés dans des centaines de types de cellules et de tissus chez l'homme et la souris.

Il est capable d'analyser une longue séquence d'ADN et de "prédire" l'influence de chaque paire de nucléotides sur différents processus biologiques dans la cellule: activer ou réprimer l'expression d'un gène, piloter l'assemblage de l'ARN (une "copie" de l'ADN qui transmet l'information génétique dans la cellule)...

- "Fondamental" mais "pas parfait" -

D'autres modèles existaient déjà. Mais ils devaient faire un compromis entre la longueur des séquences analysées et la finesse de la résolution.

Or, une longue séquence - jusqu'à un million de paires de nucléotides - est "nécessaire pour comprendre l'environnement régulateur complet d'un gène unique", explique Ziga Avsec, un des co-auteurs du projet.

Et la finesse de la résolution permet d'étudier l'effet de variants génétiques en comparant les prédictions de séquences mutées à celles de séquences non mutées.

Autre avancée, AlphaGenome modélise simultanément l'influence de la séquence sur onze processus biologiques, alors que les scientifiques devaient jusqu'à présent utiliser plusieurs modèles.

Cet outil "peut accélérer notre compréhension du génome en aidant à cartographier l'emplacement des éléments fonctionnels et à déterminer leurs rôles au niveau moléculaire", estime Natasha Latysheva, également co-autrice.

"Nous espérons que les chercheurs enrichiront avec davantage de données et de modalités" le modèle, déjà testé par 3.000 scientifiques de 160 pays et désormais disponible en open source pour la recherche non-commerciale, souligne M. Kohli.

"Identifier précisément les différences dans nos génomes qui nous rendent plus ou moins susceptibles de développer des milliers de maladies est une étape clé vers de meilleurs traitements", note Ben Lehner, responsable de la génomique générative et synthétique au Wellcome Sanger Institute de Cambridge.

Le chercheur, qui n'a pas participé au projet mais a testé le modèle, le juge "très performant", mais encore "loin d'être parfait".

"Les modèles d'IA ne sont bons que dans la mesure où les données utilisées pour les entraîner le sont", or la plupart des jeux de données existants "sont trop petits et insuffisamment standardisés", explique-t-il dans une réaction à l'organisme britannique Science Media Center (SMC).

AlphaGenome n'est pas une "solution miracle à toutes les questions biologiques", l'expression des gènes "étant influencée par des facteurs environnementaux complexes", mais il constitue un "outil fondamental", abonde Robert Goldstone, responsable de la génomique au Francis Crick Institute, cité dans le même texte.

Selon lui, ce nouvel outil permettra aux scientifiques "d'étudier et de simuler de manière programmatique les bases génétiques des maladies complexes".

U.Chen--ThChM