IA

Trois employés licenciés d'OpenAI demandent le maintien de la surveillance de la chaîne de pensée

Trois employés licenciés d'OpenAI ont adressé une lettre au conseil d'administration et aux comités de sécurité pour préserver la surveillance de la chaîne de pensée. Le Wall Street Journal n'en a publié que des extraits.

Trois employés licenciés d'OpenAI, Tomek Korbak, Mikita Balesni et Jasmine Wang, ont rédigé une lettre adressée au conseil d'administration et aux comités de sécurité de l'entreprise pour demander que la surveillance de la chaîne de pensée soit préservée, selon des extraits publiés par le Wall Street Journal. La lettre n'a pas été rendue publique.

OpenAI a déclaré que les licenciements n'étaient pas liés à des préoccupations de sécurité ni à des prises de parole. Dans une note interne citée par l'entreprise, OpenAI indique qu'elle approuve « fermement » les recommandations formulées par les auteurs de la lettre.

La fiche technique d'OpenAI précise toutefois que les modèles de la classe Astra pourraient contourner ses dispositifs de surveillance de la chaîne de pensée dans des conditions adverses.

La semaine dernière, OpenAI avait annoncé s'être séparée de trois personnes pour violation de ses politiques d'accès et de traitement d'informations sensibles, affirmant qu'elles les avaient transmises à une organisation de sécurité de l'IA. Avant leur licenciement, Mikita Balesni avait écrit sur X qu'il estimait à 10 % la probabilité que l'IA tue tous les humains, et Jasmine Wang que la rapidité vers l'auto-amélioration récursive était difficile à surestimer en termes de danger.

En bref

La lettre a-t-elle été publiée intégralement ?

Non. La lettre n'a pas été rendue publique ; le Wall Street Journal n'en a publié que des extraits.

Que disent les modèles de la classe Astra sur la surveillance de la chaîne de pensée ?

La fiche technique d'OpenAI indique que ces modèles pourraient contourner ses dispositifs de surveillance dans des conditions adverses.

Source