The China Mail - Incident OpenAI: les modèles IA ont fait intrusion sur d'autres plateformes

USD -
AED 3.672499
AFN 63.000201
ALL 80.450356
AMD 363.439931
ANG 1.790365
AOA 918.000334
ARS 1516.007498
AUD 1.42122
AWG 1.8
AZN 1.697564
BAM 1.712962
BBD 2.013821
BDT 122.932477
BGN 1.683441
BHD 0.37695
BIF 3000
BMD 1
BND 1.277595
BOB 10.867156
BRL 5.1656
BSD 0.99986
BTN 95.678145
BWP 13.595481
BYN 3.027431
BYR 19600
BZD 2.01093
CAD 1.41018
CDF 2309.999886
CHF 0.825095
CLF 0.024397
CLP 963.329736
CNY 6.71135
CNH 6.710397
COP 3288.8
CRC 453.685538
CUC 1
CUP 26.5
CVE 97.249818
CZK 21.448002
DJF 177.720017
DKK 6.56759
DOP 59.450217
DZD 133.939466
EGP 51.423803
ERN 15
ETB 161.000031
EUR 0.87852
FJD 2.24975
FKP 0.750528
GBP 0.755325
GEL 2.614947
GGP 0.750528
GHS 11.58498
GIP 0.750528
GMD 74.000164
GNF 8750.000068
GTQ 7.63211
GYD 209.186734
HKD 7.842705
HNL 26.914995
HRK 6.619295
HTG 130.683635
HUF 320.937502
IDR 17851.95
ILS 3.03393
IMP 0.750528
INR 95.74145
IQD 1310.5
IRR 1374574.999561
ISK 121.23992
JEP 0.750528
JMD 157.538176
JOD 0.708994
JPY 158.313504
KES 129.501538
KGS 87.449803
KHR 4057.50326
KMF 433.000356
KPW 900.000318
KRW 1366.659786
KWD 0.30924
KYD 0.833209
KZT 444.620586
LAK 22425.000038
LBP 89549.999926
LKR 328.955608
LRD 172.824953
LSL 16.359925
LTL 2.95274
LVL 0.60489
LYD 6.375009
MAD 9.60075
MDL 17.695844
MGA 4400.000432
MKD 54.047762
MMK 2099.577364
MNT 3597.923561
MOP 8.077068
MRU 40.06067
MUR 47.880026
MVR 15.449968
MWK 1736.999945
MXN 17.54419
MYR 4.09009
MZN 63.909668
NAD 16.360274
NGN 1324.780094
NIO 36.659962
NOK 9.485825
NPR 153.084711
NZD 1.761945
OMR 0.384502
PAB 0.99986
PEN 3.377496
PGK 4.4485
PHP 62.762497
PKR 277.549959
PLN 3.845185
PYG 5925.912951
QAR 3.643027
RON 4.633794
RSD 103.19594
RUB 84.775004
RWF 1473
SAR 3.755068
SBD 8.000512
SCR 13.883948
SDG 601.501154
SEK 9.918103
SGD 1.280175
SHP 0.755002
SLE 24.649917
SLL 20969.491881
SOS 571.505219
SRD 37.822497
STD 20697.981008
STN 21.675
SVC 8.748774
SYP 13002.000254
SZL 16.360116
THB 33.440988
TJS 9.253737
TMT 3.51
TND 2.948502
TOP 2.40776
TRY 48.859805
TTD 6.795649
TWD 31.803904
TZS 2649.998058
UAH 44.878367
UGX 3889.609025
UYU 40.078651
UZS 11837.479702
VES 852.43145
VND 26010.5
VUV 118.348377
WST 2.752527
XAF 576.271652
XAG 0.015564
XAU 0.000233
XCD 2.70255
XCG 1.801955
XDR 0.707052
XOF 576.271652
XPF 105.204736
YER 236.650203
ZAR 16.366175
ZMK 9001.197068
ZMW 19.472654
ZWL 321.999592
SSP 5712.590503
MXV 1.988392
  • AEX

    -3.0000

    1107.93

    -0.27%

  • BEL20

    -71.4100

    5687.13

    -1.24%

  • PX1

    -31.8100

    8123.41

    -0.39%

  • ISEQ

    -108.3000

    14332.16

    -0.75%

  • OSEBX

    -2.3100

    2096.59

    -0.11%

  • PSI20

    -24.1400

    9632.44

    -0.25%

  • ENTEC

    -5.8300

    1416.23

    -0.41%

  • BIOTK

    -90.3100

    4470.74

    -1.98%

  • N150

    -17.5700

    4267.43

    -0.41%

Incident OpenAI: les modèles IA ont fait intrusion sur d'autres plateformes
Incident OpenAI: les modèles IA ont fait intrusion sur d'autres plateformes / Photo: © AFP/Archives

Incident OpenAI: les modèles IA ont fait intrusion sur d'autres plateformes

Les deux modèles d'intelligence artificielle (IA) d'OpenAI qui sont sortis, de leur propre initiative, du milieu confiné dans lequel ils étaient testés pour attaquer le site Hugging Face, ont également fait intrusion sur d'autres plateformes, selon le créateur de ChatGPT.

Taille du texte:

L'une d'entre elle a servi de relais pour préparer l'attaque sur Hugging Face, une bibliothèque IA que les deux modèles ont fouillée pour trouver les réponses aux tests soumis par les développeurs d'OpenAI.

Au total, quatre comptes associés à d'autres plateformes ont été piratés. OpenAI n'a pas révélé les noms des entités visées. Ces manoeuvres ont été effectuées avec le même objectif que celui poursuivi lors de l'offensive contre Hugging Face.

Selon une actualisation du compte rendu de l'incident, publiée dans la nuit de mardi à mercredi, les deux IA ont également utilisé plusieurs sites en accès libre pour copier du code de programmation ou le tester, mais sans aller plus loin qu'un utilisateur ordinaire.

Pour Hugging Face, qui a mis en ligne, de son côté, un long récit des événements, l'effraction dont elle a été victime relevait d'une "tentative (des deux modèles) de tricher à l'évaluation" d'OpenAI.

Les IA ont voulu "dérober les solutions aux tests plutôt que d'essayer d'y répondre par elles-mêmes".

Pour les besoins du test, les informaticiens d'OpenAI avaient réduit les garde-fous pour juger du potentiel des modèles en matière de cybersécurité.

L'entreprise a révélé qu'outre son modèle le plus avancé, GPT-5.6 Sol, l'autre IA mêlée à l'incident n'avait pas vocation à être commercialisée et était uniquement destinée à un usage interne.

Le rapport d'Hugging Face indique que l'attaque a duré pas moins de cinq jours avant que le site ne parvienne à la contenir.

Aucun des deux documents ne le mentionne clairement et la société n'a pas répondu à une question de l'AFP sur ce point, mais il semble qu'OpenAI n'ait pris conscience de l'évasion que plusieurs jours après les faits.

- Une IA auto-programmée -

"Un pirate (informatique) humain aurait pu trouver et exploiter les mêmes vulnérabilités", explique l'entreprise.

Ce qui a fait la différence, c'est le volume des tentatives, avec pas moins de 17.600 actions contre Hugging Face, marquées par beaucoup d'échecs, mais suffisamment de réussites pour que les modèles parviennent à leurs fins.

"L'échelle et la vitesse de ces actions dépassent de loin les capacités d'un humain qui opérerait manuellement", a fait valoir Hugging Face.

Le chercheur en IA Daniel Kokotajlo a plaidé pour une analyse de l'incident menée par un laboratoire indépendant, une démarche "qui devrait devenir systématique" pour des cas similaires, selon lui.

Cette évasion de modèles n'est pas la première à être documentée, mais elle est considérée comme, de loin, la plus sérieuse à ce jour.

Elle a donné un écho supplémentaire au débat, déjà nourri, sur l'accélération de l'IA, aux capacités de plus en plus étendues, et sur la difficulté de la contrôler.

Lors de l'épisode OpenAI, les modèles ont utilisé des méthodes dont ils savaient qu'elles étaient en contradiction avec le scénario du test, sans en informer les développeurs.

Mardi, plus d'un millier d'employés de géants de l'IA, dont plusieurs dirigeants de premier plan, ont demandé au gouvernement américain d'aider à "temporiser" la sortie des nouveaux modèles, pour laisser le temps à l'écosystème informatique de s'y préparer.

Ils plaident, dans une pétition, pour que les États-Unis soient moteur dans la création d'une instance internationale de référence en matière d'évaluation et de supervision de l'IA.

Interrogé sur la question, le président américain Donald Trump a estimé qu'il "fallait être prudent", et trouver un équilibre entre le contrôle des agents et le fait de ne pas être devancé par la Chine dans le développement de l'IA.

"Nous ne voulons pas les limiter, et que l'on se retrouve d'un seul coup derrière la Chine", a-t-il déclaré, "celui qui l'emportera" dans cette course à l'IA "pourrait très bien ramasser toute la mise".

Le milieu s'inquiète d'autant plus qu'il voit approcher le stade dit de "l'auto-amélioration récursive" (recursive self-improvement), au-delà duquel l'intelligence artificielle serait en mesure de concevoir seule son successeur, une séquence qui pourrait se répéter à l'infini.

Les derniers modèles d'OpenAI et Anthropic ont été en partie programmés par l'IA elle-même.

Le "RSI", son abréviation, rendrait plus difficile les vérifications et l'évaluation de nouveaux modèles par des informaticiens humains, car ils n'auraient pas participé directement à leur élaboration.

D.Pan--ThChM