The China Mail - Face aux performances en piratage de sa future IA, OpenAI en ralentit le développement

USD -
AED 3.672504
AFN 65.999602
ALL 80.065663
AMD 364.508186
ANG 1.789783
AOA 917.000272
ARS 1495.019377
AUD 1.41236
AWG 1.8
AZN 1.702706
BAM 1.689756
BBD 2.014385
BDT 122.018757
BGN 1.696366
BHD 0.377122
BIF 2988.381635
BMD 1
BND 1.277847
BOB 11.57636
BRL 5.215703
BSD 1.000151
BTN 95.647328
BWP 13.500659
BYN 3.042032
BYR 19600
BZD 2.011491
CAD 1.387375
CDF 2269.999923
CHF 0.810701
CLF 0.023463
CLP 923.439874
CNY 6.743304
CNH 6.73971
COP 3104.87
CRC 449.263467
CUC 1
CUP 26.5
CVE 95.26422
CZK 20.84325
DJF 178.102253
DKK 6.44538
DOP 58.749838
DZD 132.922967
EGP 50.669898
ERN 15
ETB 161.789969
EUR 0.86215
FJD 2.20855
FKP 0.738395
GBP 0.737855
GEL 2.604975
GGP 0.738395
GHS 11.051977
GIP 0.738395
GMD 73.99999
GNF 8785.692687
GTQ 7.628839
GYD 209.246268
HKD 7.84251
HNL 26.815845
HRK 6.496397
HTG 130.826022
HUF 314.655976
IDR 17846.65
ILS 2.98575
IMP 0.738395
INR 95.760499
IQD 1310.230424
IRR 1374574.99971
ISK 122.610048
JEP 0.738395
JMD 158.034569
JOD 0.709007
JPY 159.194991
KES 129.589823
KGS 87.450116
KHR 4046.085458
KMF 425.999776
KPW 900.000294
KRW 1395.139966
KWD 0.30866
KYD 0.83347
KZT 461.929241
LAK 22540.358638
LBP 89562.572897
LKR 331.975446
LRD 181.52836
LSL 16.225328
LTL 2.95274
LVL 0.60489
LYD 6.372767
MAD 9.292836
MDL 17.252581
MGA 4307.838521
MKD 53.155873
MMK 2099.245957
MNT 3597.150887
MOP 8.080143
MRU 40.111452
MUR 46.979765
MVR 15.459936
MWK 1734.310807
MXN 17.03914
MYR 4.062497
MZN 63.904982
NAD 16.225258
NGN 1350.829954
NIO 36.798687
NOK 9.399103
NPR 153.035552
NZD 1.701275
OMR 0.384492
PAB 1.000134
PEN 3.368483
PGK 4.494363
PHP 61.848007
PKR 277.569951
PLN 3.731345
PYG 6034.084282
QAR 3.655881
RON 4.521605
RSD 101.208986
RUB 85.22424
RWF 1473.727865
SAR 3.746587
SBD 8.025811
SCR 13.740669
SDG 601.498083
SEK 9.51548
SGD 1.276665
SHP 0.740866
SLE 24.650266
SLL 20969.499227
SOS 571.623589
SRD 37.967024
STD 20697.981008
STN 21.167221
SVC 8.751096
SYP 13001.999906
SZL 16.213578
THB 33.078994
TJS 9.241263
TMT 3.5
TND 2.929025
TOP 2.40776
TRY 47.934599
TTD 6.782238
TWD 31.969025
TZS 2648.976028
UAH 44.802989
UGX 3730.646945
UYU 40.347315
UZS 11821.830168
VES 771.57685
VND 26178
VUV 118.215486
WST 2.715898
XAF 566.748027
XAG 0.015848
XAU 0.00023
XCD 2.70255
XCG 1.802528
XDR 0.707052
XOF 566.738234
XPF 103.038184
YER 237.102795
ZAR 16.229598
ZMK 9001.200507
ZMW 18.677668
ZWL 321.999592
  • AEX

    -1.4400

    1105.9

    -0.13%

  • BEL20

    0.5800

    5759.28

    +0.01%

  • PX1

    36.5900

    8546.35

    +0.43%

  • ISEQ

    23.9500

    14111.11

    +0.17%

  • OSEBX

    4.5800

    2086.12

    +0.22%

  • PSI20

    -29.7800

    9275.53

    -0.32%

  • ENTEC

    -5.8300

    1416.23

    -0.41%

  • BIOTK

    35.0500

    4771.88

    +0.74%

  • N150

    7.7400

    4307.42

    +0.18%

Face aux performances en piratage de sa future IA, OpenAI en ralentit le développement
Face aux performances en piratage de sa future IA, OpenAI en ralentit le développement / Photo: © AFP/Archives

Face aux performances en piratage de sa future IA, OpenAI en ralentit le développement

OpenAI, créateur de ChatGPT, a confirmé mardi ralentir le développement de son modèle d'intelligence artificielle le plus avancé et durcir ses contrôles internes, un mois après avoir révélé la cyberattaque menée de façon autonome par un de ses outils contre la plateforme Hugging Face.

Taille du texte:

Le plus gros entraînement d'IA jamais programmé par l'entreprise reste à l'arrêt, le temps de vérifier que cette future IA se comporte comme prévu, a indiqué OpenAI dans un billet de blog mardi.

"Nous avons toujours dit que nous agirions si nous estimions que les capacités des modèles progressaient plus vite que la sécurité", a écrit sur X le patron d'OpenAI, Sam Altman.

Cette décision "affecte les sorties plus lointaines" de modèles, a-t-il ajouté, tout en promettant de nouveaux modèles "prochainement".

Mi-juillet, un agent autonome reposant sur deux modèles d'OpenAI était sorti, de sa propre initiative, de son milieu de test confiné pour s'aventurer sur Internet et attaquer Hugging Face, plateforme où les développeurs du monde entier partagent leurs modèles d'IA.

Son concurrent Anthropic a révélé fin juillet que trois de ses modèles en test avaient aussi opéré des intrusions non autorisées dans les systèmes informatiques de trois organisations.

Ces incidents ont donné lieu à une pétition de plus d'un millier d'employés du secteur appelant le gouvernement américain à soutenir un ralentissement concerté du développement des IA les plus avancées.

OpenAI avait par ailleurs interrompu pendant deux semaines l'entraînement par renforcement de plusieurs modèles — où ceux-ci progressent seuls, par essais et erreurs, guidés par des récompenses — avant de le reprendre avec des contrôles renforcés.

De nombreux travaux liés à Astra, son prochain grand modèle, restent en revanche suspendus: l'entreprise a estimé début août que cette IA pourrait devenir capable de mener seule des cyberattaques sophistiquées, le niveau de risque le plus élevé de sa propre grille d'évaluation. Ses règles internes l'obligent alors à renforcer ses garde-fous avant de poursuivre le développement.

Elle n'a pas précisé de calendrier de reprise.

Le groupe a aussi détaillé mardi un nouveau dispositif, qui surveille le raisonnement interne de ses modèles en cours de développement et doit alerter des équipes humaines en moins de 30 minutes en cas de comportement suspect. Un contrôle qui consomme toutefois environ 20% de puissance de calcul supplémentaire.

Les propres recherches d'OpenAI, en 2025, ont montré les limites de cette approche: un modèle qui se sait surveillé peut apprendre à masquer ses intentions dans son raisonnement.

L'entreprise, qui promet depuis juillet un compte rendu technique détaillé de l'incident Hugging Face, ne l'a pas encore publié. Son billet de mardi l'annonce "dans les semaines à venir".

O.Tse--ThChM