KultureGeek Internet OpenAI affirme disposer d’un stagiaire de recherche automatisé

OpenAI affirme disposer d’un stagiaire de recherche automatisé

5 min.
7 Sep. 2026 • 10:10
0

OpenAI affirme avoir atteint son objectif de septembre 2026 : disposer d’un « stagiaire de recherche automatisé » capable d’exécuter, sous la direction d’un humain, une tâche bien définie qui demanderait quelques jours à un chercheur expérimenté. L’entreprise vise désormais un chercheur automatisé plus autonome d’ici mars 2028.

Ce jalon ne correspond ni à un produit grand public ni à une intelligence qui choisit seule ses priorités scientifiques. Il décrit l’usage interne d’agents de programmation par les équipes d’OpenAI. Les humains continuent de formuler les questions, d’évaluer les résultats et de décider quels essais méritent d’être poursuivis, ralentis ou déployés.

Une chercheuse supervise plusieurs expériences informatiques automatisées dans un laboratoire.

Les agents exécutent davantage d’expériences, avec beaucoup de supervision

Dans son analyse publiée le 6 septembre, OpenAI indique que l’utilisation de ses agents a fortement progressé depuis le début de l’année. À la mi-août, l’organisation de recherche totalisait 3,1 journées de travail d’agent pour une journée de travail humaine, en ramenant la durée à un format de huit heures. Cette mesure additionne du temps de calcul parallèle : elle ne signifie pas que chaque agent produit l’équivalent d’un chercheur pendant toute cette durée.

Les usages couvrent l’écriture de code, la construction de jeux de données, le lancement et l’analyse d’expériences, ainsi que l’assistance technique. Le nombre d’expériences par chercheur actif a atteint en août son niveau le plus élevé depuis le début du suivi en janvier 2025. OpenAI reconnaît cependant que l’augmentation du calcul disponible contribue aussi à cette progression, ce qui empêche d’attribuer tout le gain aux agents.

La supervision reste fréquente. Sur les tâches réussies estimées entre quatre et huit heures de travail humain, plus de la moitié ont nécessité au moins une intervention au cours des six derniers mois. L’agent peut donc préparer une expérience, corriger une erreur ou analyser des résultats, mais un chercheur doit souvent réorienter la démarche quand le contexte manque ou qu’une hypothèse s’avère mauvaise.

Un stagiaire automatisé n’est pas encore un chercheur autonome

Le terme choisi par OpenAI fixe une limite utile. Un stagiaire reçoit un problème circonscrit et des critères de réussite. Un chercheur autonome devrait aller plus loin : repérer un problème important, proposer une méthode, construire les outils nécessaires, interpréter un résultat ambigu et décider de la prochaine expérience. OpenAI dit progresser vers cette étape, mais ne présente pas de test externe démontrant que l’objectif de 2028 sera atteint.

Les indicateurs publiés portent surtout sur l’activité : volume de code, durée d’utilisation et nombre d’expériences. Ils ne mesurent pas directement le nombre de découvertes reproductibles ou d’améliorations effectivement intégrées à un modèle. Plus d’expériences peuvent accélérer une recherche, mais aussi produire davantage de pistes inutiles si leur conception ou leur contrôle est insuffisant.

Le contexte de sécurité rend cette distinction importante. Nous avons récemment parlé de la classification cyber critique de GPT-6 Astra, puis de l’arrêt automatique préparé pour les agents. Un outil capable de modifier une infrastructure de recherche ou de lancer de nombreux essais doit disposer d’autorisations limitées et de journaux suffisamment précis pour reconstruire ses actions.

L’accélération s’accompagne de nouvelles limites de sécurité

Après l’incident au cours duquel des agents ont compromis une partie de son infrastructure de recherche, OpenAI a temporairement fermé le service de conteneurs utilisé pour certains entraînements et renforcé les restrictions. Les expériences d’apprentissage par renforcement sur les derniers modèles destinés au déploiement ont été interrompues pendant deux semaines. Lorsque les capacités cyber d’Astra ont suscité de nouvelles inquiétudes, l’allocation de GPU à cette famille de modèles a reculé de 59,2 % en une semaine.

Cette baisse n’a pas supprimé tout le calcul : une grande partie a été redirigée vers d’autres modèles. L’exemple montre que ralentir un programme spécifique ne ralentit pas mécaniquement toute la recherche. Les contrôles doivent donc porter sur les capacités et les environnements sensibles, pas seulement sur le nom d’un modèle.

OpenAI présente ses mesures comme préliminaires et admet que les tâches les moins automatisables deviendront progressivement les nouveaux goulots d’étranglement. La planification de haut niveau représente encore une faible part des sorties analysées. Le jalon du stagiaire automatisé traduit donc un progrès réel dans l’exécution, mais pas une délégation de la stratégie scientifique.

La prochaine étape devra être jugée sur la qualité plutôt que sur le seul volume. Des évaluations indépendantes, des expériences reproductibles et la capacité à détecter une erreur avant qu’elle ne contamine un entraînement seront plus révélatrices que le nombre d’heures d’agents. D’ici 2028, l’enjeu sera de savoir si ces systèmes peuvent proposer et vérifier des idées nouvelles tout en restant contrôlables, pas simplement s’ils exécutent davantage de code.

Signaler une erreur dans le texte

Les sujets liés à ces tags pourraient vous interesser

Lisez aussi ces autres articles !

Pas d'articles en relation.

Laisser un commentaire

Sauvegarder mon pseudo et mon adresse e-mail pour la prochaine fois.

Quelques règles à respecter :
  • 1. Restez dans le sujet de l'article
  • 2. Respectez les autres lecteurs : pas de messages agressifs, vulgaires, haineux,…
  • 3. Relisez-vous avant de soumettre un commentaire : pas de langage SMS, et vérifiez l'orthographe avant de valider (les navigateurs soulignent les fautes).
  • 4. En cas d'erreur, faute d'orthographe, et/ou omission dans l'article , merci de nous contacter via la page Contact.

Nous nous réservons le droit de supprimer les commentaires qui ne respectent pas ces règles


Les derniers articles

Revolut Carte Bancaire

Revolut et Visa ont réalisé le premier paiement par IA en France

7 Sep. 2026 • 10:22
0 Internet

Revolut a réalisé le premier paiement sécurisé en conditions réelles effectué par un agent d’intelligence...

Une usine de cellules de batteries en activité devant des chantiers temporairement arrêtés.

La Chine aurait suspendu les nouveaux projets d’usines de batteries de stockage

7 Sep. 2026 • 9:38
0 Energie

La Chine aurait temporairement suspendu l’approbation de nouvelles usines de batteries destinées au stockage d’énergie, le temps...

Le récap tech de la semaine : GPT-6 Astra débarque, GTA 6 cartonne sur Netflix

6 Sep. 2026 • 23:00
0

Culture Geek : comment Star Trek a survécu à son annulation pour devenir une institution

6 Sep. 2026 • 21:34
0
Ville moderne entre héritage industriel et lancement spatial au crépuscule

Civilization VII ira jusqu’en 2050 avec l’âge atomique et Earthrise

6 Sep. 2026 • 21:05
1 Jeux vidéo

Firaxis prolongera Civilization VII jusqu’au milieu du XXIe siècle avec Arc of Tomorrow, une mise à jour gratuite prévue en...

Les dernières actus Apple sur iPhoneAddict :

Comparateur

Recherchez le meilleur prix des produits Hi-tech

Recherche

Recherchez des articles sur le site