Language Selection

Retrouvez votre bien-être dans ces temps dure sur Terre , Essayez le MedBed Quantique!
Cliquez ici pour réserver votre séance

Famille et pour toute la Famille avec Le Medbed Quantique® Orgo-Life® une technologie du Canada

Advertising by Adpathway

         

 Advertising by Adpathway

Le directeur scientifique d’OpenAI indique perdre le contrôle sur le raisonnement de ses IA

7 hour_ago 13

         

NE LAISSER PAS LE 5G DETRUIRE VOTRE ADN Protéger toute votre famille avec les appareils Quantiques Orgo-Life®

  Publicité par Adpathway

Dans une tribune intitulée An Alien Mind, Jakub Pachocki, chef scientifique d’OpenAI, dévoile que l’outil sur lequel l’entreprise s’appuie pour surveiller le raisonnement interne de ses modèles devient de moins en moins fiable.

Ce sont deux dynamiques bien différentes que dessine le dernier billet de blog d’OpenAI, publié le 6 septembre 2026.

Signée Jakub Pachocki, chef scientifique de l’entreprise américaine, la tribune décortique dans un premier temps la capacité croissante des modèles à gagner en autonomie offensive sur les systèmes informatiques.

Jusque-là, rien de fondamentalement nouveau. S’il en fallait une preuve récente, l’épisode du piratage de Hugging Face, largement documenté par OpenAI elle-même, est devenu le symbole de cette montée en puissance.

Mais alors que de nouveaux incidents similaires sont dévoilés au fil des semaines et que la question de la sécurisation des environnements dans lesquels évoluent les agents IA devient de plus en plus pressante, l’ingénieur dresse un autre défi majeur : la baisse de notre capacité à comprendre et à observer de façon pertinente le raisonnement des modèles ayant conduit à ces intrusions.

Box Bitdefender (2)

Et votre vie numérique devient sereine

Bitdefender Premium Security est une solution de cybersécurité européenne qui vous protège automatiquement contre les pirates et toutes les menaces du web. Profitez de vos activités en ligne en toute tranquillité

I wrote about the state of AI, why I’m concerned about the next few years, and the choices we need to make to keep the future in humanity’s hands.

An Alien Mind: https://t.co/FeIfWNe0UE

— Jakub Pachocki (@merettm) September 6, 2026

Ce contenu est bloqué car vous n’avez pas accepté les cookies et autres traceurs. Ce contenu est fourni par Twitter.
Pour pouvoir le visualiser, vous devez accepter l’usage étant opéré par Twitter avec vos données qui pourront être utilisées pour les finalités suivantes : vous permettre de visualiser et de partager des contenus avec des médias sociaux, favoriser le développement et l’amélioration des produits d’Humanoid et de ses partenaires, vous afficher des publicités personnalisées par rapport à votre profil et activité, vous définir un profil publicitaire personnalisé, mesurer la performance des publicités et du contenu de ce site et mesurer l’audience de ce site (en savoir plus)

En cliquant sur « J’accepte tout », vous consentez aux finalités susmentionnées pour l’ensemble des cookies et autres traceurs déposés par Humanoid et .

Vous gardez la possibilité de retirer votre consentement à tout moment. Pour plus d’informations, nous vous invitons à prendre connaissance de notre Politique cookies.

Un outil de surveillance qui s’effrite

Le point le plus significatif concerne ce que les chercheurs nomment couramment le « chain-of-thought monitoring », la surveillance de la chaîne de pensée.

Il s’agit de laisser les modèles verbaliser leur raisonnement en clair, sans optimiser directement ce contenu, afin de pouvoir l’observer et y détecter d’éventuelles intentions problématiques.

L’ingénieur rappelle d’ailleurs qu’OpenAI en avait fait un pilier de sa stratégie de sécurité dès le lancement d’o1-preview, allant jusqu’à masquer ce raisonnement aux utilisateurs pour le protéger de toute pression d’optimisation indirecte.

Mais cette approche serait aujourd’hui mise à mal par trois évolutions convergentes :

  • D’abord, les modèles mêlent désormais leur raisonnement à des interactions avec des humains, d’autres IA et des outils externes, ce qui brouille la frontière entre ce qui doit être supervisé et ce qui ne devrait pas l’être.
  • Ensuite, ils apprennent à raisonner sur leur propre processus de raisonnement, et donc, potentiellement, à le manipuler.
  • Enfin, les gains de performance obtenus dès le pré-entraînement permettent aux modèles d’être performants sans même verbaliser de chaîne de pensée explicite.

Résultat, selon ses propres mots : la fiabilité de cette supervision diminue progressivement. Une érosion particulièrement critique lorsqu’il est question de cybersécurité.

Des capacités qui inquiètent

Car dans le même temps, Jakub Pachocki décrit des modèles en passe de devenir « surhumains » pour s’introduire dans les systèmes informatiques, capables d’affecter la quasi-totalité des infrastructures.

Une communication alarmiste qui s’inscrit dans la continuité des prises de position récentes d’OpenAI. En août 2026, l’entreprise avait déjà plaidé pour une une coordination du secteur face à ces défis, annonçant dans le même temps la suspension de certains entraînements par apprentissage par renforcement.

Cette nouvelle tribune va plus loin, défendant notamment l’instauration de seuils de sécurité communs, controlés par des auditeur tierces, appelés à devenir obligatoires pour poursuivre le développement.

À force de prises de position répétées, OpenAI se rapproche d’une posture longtemps associée à Anthropic, et régulièrement dénoncée par des voix comme celle de Yann LeCun, qui accuse les grands laboratoires d’agiter le risque pour pousser des normes si strictes qu’elles évincent de fait les acteurs plus petits et l’open source.

Reste à voir si OpenAI essuiera les mêmes critiques.

Toute l'actu tech en un clien d'oeil

Toute l'actu tech en un clin d'œil

Ajoutez Numerama à votre écran d'accueil et restez connectés au futur !

Logo PWA


read-entire-article

         

        

Une nouvelle Vibration dans le Monde entier avec les Franchise Medbed Quantique®!  

Protéger toute votre famille avec la technologie Orgo-Life®

  Advertising by Adpathway