The China Mail - Comprendre comment l'IA raisonne avant qu'elle ne devienne surpuissante, une urgence

USD -
AED 3.672502
AFN 64.50319
ALL 81.693593
AMD 360.913649
ANG 1.790365
AOA 917.000184
ARS 1516.505896
AUD 1.433137
AWG 1.8025
AZN 1.699971
BAM 1.743316
BBD 2.007889
BDT 122.918124
BGN 1.683441
BHD 0.376334
BIF 2990.172702
BMD 1
BND 1.278128
BOB 11.907744
BRL 5.017902
BSD 0.996903
BTN 96.431421
BWP 13.771588
BYN 3.051526
BYR 19600
BZD 2.004947
CAD 1.42261
CDF 2314.999821
CHF 0.83126
CLF 0.024783
CLP 978.59014
CNY 6.702302
CNH 6.693702
COP 3225.81
CRC 454.239554
CUC 1
CUP 23.925697
CVE 98.286351
CZK 21.706204
DJF 177.524234
DKK 6.661301
DOP 60.318663
DZD 134.59402
EGP 52.37168
ERN 15
ETB 162.835139
EUR 0.891103
FJD 2.24775
FKP 0.757083
GBP 0.755235
GEL 2.597487
GGP 0.757083
GHS 11.768691
GIP 0.757083
GMD 73.999439
GNF 8770.022016
GTQ 7.62117
GYD 208.570474
HKD 7.84733
HNL 26.758536
HRK 6.7135
HTG 130.54039
HUF 324.970499
IDR 17898
ILS 3.054545
IMP 0.757083
INR 96.723301
IQD 1510.308497
IRR 1732150.000209
ISK 121.919865
JEP 0.757083
JMD 158.367391
JOD 0.709023
JPY 158.177978
KES 129.849973
KGS 87.450145
KHR 4057.438786
KMF 439.999842
KPW 900.000318
KRW 1341.46504
KWD 0.31081
KYD 0.830782
KZT 449.390529
LAK 22403.265917
LBP 89273.397423
LKR 329.943221
LRD 170.473538
LSL 16.638589
LTL 2.95274
LVL 0.60489
LYD 6.408914
MAD 9.934351
MDL 17.829893
MGA 4451.476323
MKD 54.88506
MMK 2099.693915
MNT 3600.849225
MOP 8.05792
MRU 39.797651
MUR 47.460321
MVR 15.409914
MWK 1728.623955
MXN 18.181702
MYR 4.086102
MZN 63.900376
NAD 16.638663
NGN 1329.909541
NIO 36.688089
NOK 9.56885
NPR 154.289916
NZD 1.78264
OMR 0.384501
PAB 0.996889
PEN 3.429139
PGK 4.518268
PHP 62.820185
PKR 276.067209
PLN 3.901345
PYG 5737.715877
QAR 3.633916
RON 4.762198
RSD 104.607002
RUB 84.905687
RWF 1472.432558
SAR 3.756839
SBD 8.081105
SCR 13.829811
SDG 601.502255
SEK 9.959575
SGD 1.280035
SHP 0.755886
SLE 24.624984
SLL 20969.491881
SOS 569.755367
SRD 37.650502
STD 20697.981008
STN 21.838148
SVC 8.723208
SYP 13002.000254
SZL 16.63376
THB 33.529505
TJS 9.186496
TMT 3.5
TND 2.981259
TOP 2.40776
TRY 49.34243
TTD 6.771609
TWD 31.935599
TZS 2642.497961
UAH 44.77834
UGX 4082.451253
UYU 39.977716
UZS 11778.390833
VES 873.638701
VND 25880.5
VUV 120.049533
WST 2.785534
XAF 584.525169
XAG 0.016573
XAU 0.00023886558
XCD 2.70255
XCG 1.796699
XDR 0.707052
XOF 584.525169
XPF 106.303231
YER 236.150017
ZAR 16.54228
ZMK 9001.203315
ZMW 19.848914
ZWL 321.999592
SSP 5753.260075
MXV 2.054075
  • AEX

    3.2400

    1119.29

    +0.29%

  • BEL20

    9.1000

    5694.52

    +0.16%

  • PX1

    -0.8100

    8077.75

    -0.01%

  • ISEQ

    -37.6000

    14425.66

    -0.26%

  • OSEBX

    -4.6100

    2089.87

    -0.22%

  • PSI20

    7.7600

    9712.35

    +0.08%

  • ENTEC

    -5.8300

    1416.23

    -0.41%

  • BIOTK

    12.0700

    4481.36

    +0.27%

  • N150

    -2.5400

    4237.95

    -0.06%

Comprendre comment l'IA raisonne avant qu'elle ne devienne surpuissante, une urgence
Comprendre comment l'IA raisonne avant qu'elle ne devienne surpuissante, une urgence / Photo: © AFP/Archives

Comprendre comment l'IA raisonne avant qu'elle ne devienne surpuissante, une urgence

Des humains l'ont programmée mais ne la comprennent pas complètement. L'intelligence artificielle (IA) générative reste un mystère, que des ingénieurs s'efforcent de percer avant que ses capacités n'explosent, pour éviter des dérapages.

Taille du texte:

"Les gens étrangers à ce milieu sont souvent surpris et alarmés d'apprendre que nous ne comprenons pas comment fonctionnent nos propres créations IA", a écrit, dans un long essai fin avril, Dario Amodei, le co-fondateur d'Anthropic, fleuron du secteur.

"Ils ont raison d'être préoccupés", a-t-il poursuivi. "Ce défaut de compréhension est sans précédent dans l'histoire de la technologie."

A la différence des programmes traditionnels, effectuant uniquement les tâches demandées, les modèles d'IA générative ne sont, en effet, qu'une rampe de lancement.

C'est "un échafaudage", selon l'expression de Chris Olah, ancien d'OpenAI aujourd'hui passé chez Anthropic et considéré comme l'un des inventeurs de la "mechanistic interpretability", qui déconstruit l'intelligence artificielle.

Cette jeune science, née au milieu des années 2010, s'attache à décrypter le cheminement qui mène d'une requête à une réponse, à travers une forêt de probabilités.

"Appréhender la totalité d'un grand modèle de langage", qui sert de base aux ChatGPT ou Gemini, "est une tâche incroyablement ambitieuse", explique à l'AFP Neel Nanda, chercheur chez DeepMind, le laboratoire d'IA de Google.

"C'est un peu comme essayer de décoder complètement le cerveau humain", selon lui, "ce que les neuroscientifiques essayent de faire depuis des décennies, sans y parvenir."

Confidentiel il y a encore quelques années, la discipline prend aujourd'hui une dimension nouvelle.

"Elle attire beaucoup nos étudiants", observe Mark Crovella, professeur d'informatique à l'université de Boston, "du fait de son potentiel à améliorer la sécurité des modèles, mais aussi parce que c'est un champ très stimulant intellectuellement."

- Tromper les humains -

Pour étudier ces phénomènes au plus près, retrace l'universitaire, la "mech interp", de son nom de code, ne se contente pas d'observer le résultat qu'offre un assistant IA à une demande.

"On observe les calculs à mesure qu'ils sont réalisés" par le programme d'IA, décrit-il.

La start-up Goodfire, en pointe sur le sujet, utilise des modèles d'interprétation, algorithmes IA à même de représenter des données sous forme d'étapes de raisonnement.

L'objectif est de saisir suffisamment bien la mécanique de l'IA générative pour la guider et corriger ses possibles errements.

Il s'agit d'empêcher les erreurs, mais aussi l'utilisation à des fins nocives ou de voir un modèle suffisamment autonome tromper les humains sur la nature de ses actions.

"Cela ressemble à une course contre la montre", situe Eric Ho, le patron de Goodfire, "avant que nous ne lancions des modèles d'IA extrêmement intelligents sans comprendre comme ils marchent."

Fin avril, Dario Amodei a fait état de "progrès récents", qui lui laissent penser que "nous sommes sur le point de trouver la clef de l'interprétabilité", au point de fixer une échéance, en 2027.

"Vu les avancées actuelles, il me semble plausible que d'ici 2027, nous disposions des outils à même de détecter, de façon fiable, les biais d'un modèle et ses intentions nocives" éventuelles, abonde Anh Nguyen, professeur à l'université d'Auburn.

Mark Crovella relève qu'à la différence du cerveau humain, "nous avons une représentation de chaque neurone dans ces modèles". "Nous pouvons voir tout ce qu'il se passe. La question, c'est comment l'interpréter."

Entrer dans le secret de l'IA générative rendrait possible, selon Dario Amodei, l'adoption de cette technologie dans des domaines où "un petit nombre d'erreurs pourrait être très préjudiciable", notamment pour ceux qui présentent des enjeux de sécurité importants.

Pour Neel Nanda, l'interprétabilité ouvrirait aussi la voie à des découvertes pour les humains, à l'instar du modèle AlphaZero de DeepMind, qui a dévoilé de nouvelles combinaisons au jeu d'échecs.

Par ailleurs, les premiers à maîtriser le raisonnement de l'IA générative pourront délivrer un label de fiabilité aux grands modèles qu'ils testeront, les rendant ainsi plus attractifs aux yeux de leurs clients potentiels.

"Il est clair pour nous, et pour Anthropic", qui a investi dans Goodfire, "que nous serons les premiers à le commercialiser", affirme Eric Ho.

Une percée américaine repositionnerait aussi les Etats-Unis en tête de la pyramide IA, position aujourd'hui contestée par la Chine.

"L'IA surpuissante va définir le destin de l'humanité", prévient Dario Amodei, "et nous devons comprendre nos propres créatures avant qu'elles ne transforment notre économie, nos vies et notre avenir."

S.Davis--ThChM