Close Menu
  • Actualité IA
  • Modèles IA
  • Open Weight
X (Twitter)
iacapsule.friacapsule.fr
  • Actualité IA
  • Modèles IA
  • Open Weight
S'abonner
X (Twitter)
iacapsule.friacapsule.fr
Home»News»GPT-5.6 Sol Pro résout une conjecture statistique vieille de 30 ans
Équations mathématiques complexes écrites sur un tableau noir
News

GPT-5.6 Sol Pro résout une conjecture statistique vieille de 30 ans

3 Mins Readjuillet 15, 2026
Share
Twitter Email Copy Link

GPT-5.6 Sol Pro, le modèle d’OpenAI, a permis à un professeur de statistiques de l’Université de Pennsylvanie de résoudre en environ 90 minutes une question ouverte vieille de trente ans sur la méthode Benjamini-Hochberg, là où son prédécesseur GPT-5.5 avait échoué après plus de 20 heures de calcul.

Un problème vieux de 30 ans sur les tests statistiques

Quand des chercheurs testent des milliers d’hypothèses simultanément, par exemple en scannant le génome humain à la recherche de gènes liés à une maladie, ils se heurtent à un problème : plus on multiplie les tests, plus les faux positifs s’accumulent. En 1995, les statisticiens Yoav Benjamini et Yosef Hochberg ont développé une méthode pour limiter ces faux positifs, aujourd’hui utilisée dans de nombreux champs scientifiques et citée plus de 130 000 fois.

Benjamini et Hochberg avaient démontré que leur méthode fonctionnait avec des données indépendantes. Mais dans la réalité, les données sont souvent corrélées — des variantes génétiques par exemple, quand certaines positions du génome sont fréquemment héritées ensemble. Pendant des décennies, les experts ont supposé que la méthode restait fiable même avec des données corrélées et normalement distribuées. Personne ne l’avait démontré.

Un résultat théorique, pas encore pratique

Selon The Decoder, Edgar Dobriban, professeur associé à la Wharton School de l’Université de Pennsylvanie, a utilisé GPT-5.6 Sol Pro pour construire un modèle statistique où le taux réel de faux positifs dépasse bien le seuil visé, une hypothèse ensuite confirmée par simulation. Dobriban précise que l’écart mesuré reste « relativement faible (0,104 contre 0,1) », ce qui rend la portée du résultat surtout théorique pour l’instant : cela ne signifie pas que la méthode Benjamini-Hochberg est globalement inutilisable au quotidien.

Une avancée qui bouscule les mathématiciens

Ce qui frappe les statisticiens, c’est la vitesse : GPT-5.6 Sol Pro a mis environ 90 minutes, contre plus de 20 heures de travail avec plusieurs agents pour GPT-5.5, sans résultat concluant. « La progression des capacités est bien réelle. Une époque passionnante », écrit Dobriban. Will Fithian, statisticien à Berkeley, a qualifié la conjecture réfutée de « problème ouvert le plus intéressant » de son domaine, et le résultat de marqueur de progrès de l’IA « dont les conséquences dépasseront largement les mathématiques ».

Comme dans des cas similaires observés en mathématiques, la solution semble combiner des approches déjà connues plutôt qu’inventer une méthode entièrement nouvelle. Dobriban juge la combinaison inhabituelle, mais le résultat final « pas particulièrement surprenant » une fois la démonstration posée.

Qu’a résolu GPT-5.6 Sol Pro ?

Le modèle a permis de démontrer que la méthode statistique Benjamini-Hochberg, utilisée pour limiter les faux positifs dans les tests multiples, ne fonctionne pas toujours de manière fiable sur des données corrélées, contrairement à une hypothèse admise depuis 30 ans.

Qui a utilisé GPT-5.6 Sol Pro pour ce résultat ?

Edgar Dobriban, professeur associé à la Wharton School de l’Université de Pennsylvanie, a utilisé le modèle pour construire un contre-exemple, confirmé ensuite par simulation.

Ce résultat change-t-il l’usage de la méthode Benjamini-Hochberg au quotidien ?

Non : l’écart mesuré par rapport au seuil visé reste faible (0,104 contre 0,1), ce qui rend la portée du résultat surtout théorique pour l’instant, selon son auteur.

GPT-5.6
Share. Twitter Email Copy Link
Previous ArticleThinking Machines Inkling : le premier modèle IA ouvert de Mira Murati
Next Article Bonsai 27B : un modèle IA de raisonnement qui tient sur un iPhone

Related Posts

Agents IA Breaking News News OpenAI Régulation & Éthique Sécurité

Agents OpenAI : Wikipédia dénonce des bots hors de contrôle

Agents IA News Nvidia Open Weight

Beam de Reflection : le modèle open-weight occidental qui défie la Chine

Actualité IA Apple Apple Intelligence Breaking News News Rumeurs Siri

Apple Intelligence Apple TV : le code de tvOS 27.2 confirme l’arrivée de l’IA

Subscribe to Updates

Get the latest creative news from FooBar about art, design and business.

iacapsule.fr
X (Twitter)
  • À propos d’IA Capsule
  • Contact
  • Mentions légales
  • Politique de confidentialité
© 2026 iacapsule.fr

Type above and press Enter to search. Press Esc to cancel.

Gérer le consentement
Pour offrir les meilleures expériences, nous utilisons des technologies telles que les cookies pour stocker et/ou accéder aux informations des appareils. Le fait de consentir à ces technologies nous permettra de traiter des données telles que le comportement de navigation ou les ID uniques sur ce site. Le fait de ne pas consentir ou de retirer son consentement peut avoir un effet négatif sur certaines caractéristiques et fonctions.
Fonctionnel Toujours activé
L’accès ou le stockage technique est strictement nécessaire dans la finalité d’intérêt légitime de permettre l’utilisation d’un service spécifique explicitement demandé par l’abonné ou l’utilisateur, ou dans le seul but d’effectuer la transmission d’une communication sur un réseau de communications électroniques.
Préférences
L’accès ou le stockage technique est nécessaire dans la finalité d’intérêt légitime de stocker des préférences qui ne sont pas demandées par l’abonné ou l’internaute.
Statistiques
Le stockage ou l’accès technique qui est utilisé exclusivement à des fins statistiques. Le stockage ou l’accès technique qui est utilisé exclusivement dans des finalités statistiques anonymes. En l’absence d’une assignation à comparaître, d’une conformité volontaire de la part de votre fournisseur d’accès à internet ou d’enregistrements supplémentaires provenant d’une tierce partie, les informations stockées ou extraites à cette seule fin ne peuvent généralement pas être utilisées pour vous identifier.
Marketing
L’accès ou le stockage technique est nécessaire pour créer des profils d’internautes afin d’envoyer des publicités, ou pour suivre l’utilisateur sur un site web ou sur plusieurs sites web ayant des finalités marketing similaires.
  • Gérer les options
  • Gérer les services
  • Gérer {vendor_count} fournisseurs
  • En savoir plus sur ces finalités
Voir les préférences
  • {title}
  • {title}
  • {title}