ISC Paris
← Toutes les actualités
Modèles & recherche

OpenAI résout une conjecture d’Erdős vieille de 80 ans, l’IA franchit le seuil de la recherche autonome

Un modèle de raisonnement généraliste d'OpenAI a démontré de façon autonome que la conjecture des distances unitaires planaires d'Erdős, posée en 1946, était fausse, en identifiant une famille infinie de contre-exemples via la théorie algébrique des nombres. Le résultat, obtenu sans entraînement spécifique aux mathématiques, a été validé par des mathématiciens extérieurs et qualifié de jalon par un médaillé Fields.

Ce que ça change pour l’enseignement supérieur

L'IA se positionne désormais comme agent producteur de connaissance nouvelle sur des problèmes ouverts de recherche fondamentale, et non plus comme simple outil d'assistance. Ce signal oblige les formations doctorales à repenser la place de l'IA dans la production scientifique et l'évaluation des travaux de thèse. Les établissements et laboratoires devront clarifier leurs politiques d'usage de ces modèles dans les processus de recherche.

Analyse produite par l’AI Transformation Office de l’ISC Paris, co-écrite avec Claude (Anthropic).

À lire aussi

Modèles & recherche

Claude Fable 5.1 : benchmarks agentiques doublés, coût de cache divisé par quatre

Anthropic a publié le 1er septembre Claude Fable 5.1 ainsi que Mythos 5.1, une version à accès restreint réservée aux secteurs de la cybersécurité et des sciences de la vie. Les scores sur les benchmarks agentiques ont quasiment doublé par rapport à la version précédente, et le coût de lecture du cache a été divisé par quatre, tandis que les tarifs de base restent inchangés.

Lecture ESR

Ces gains de performance et de coût rendent les usages agentiques (recherche automatisée, génération de comptes rendus, veille documentaire) plus accessibles aux établissements d'enseignement supérieur et aux laboratoires de recherche. Les équipes pédagogiques et les enseignants-chercheurs peuvent désormais envisager d'intégrer ces outils dans leurs workflows sans que le coût soit un frein majeur, ce qui pose la question de la formation des étudiants et du personnel à ces nouveaux usages autonomes.

Modèles & recherche

Gemini 3.8 Flash : Google reprend la tête du coding agentique avec son 4e Flash en 4 mois

Google a publié le 2 septembre Gemini 3.8 Flash, son quatrième modèle Flash en quatre mois, optimisé pour l'ingénierie logicielle longue durée et les agents autonomes. Il obtient 89,4 % sur Terminal-Bench 2.1, devançant Claude Opus 5 (89,1 %) et GPT-5.6 Sol (88,8 %), ainsi que 71,0 % sur DeepSWE, pour un tarif d'entrée de 0,75 $/M tokens.

Lecture ESR

Le rythme de publication des nouveaux modèles rend obsolètes en quelques semaines les comparatifs utilisés dans les cours d'informatique et d'intelligence artificielle. Les formations en génie logiciel et en data science doivent revoir régulièrement leurs supports pédagogiques et privilégier l'apprentissage de méthodes d'évaluation plutôt que la mémorisation de classements figés.

Modèles & recherche

Runway Solaris : l’IA qui génère vos interfaces à la place du code

Runway a présenté Solaris, premier modèle de sa famille "Interface World Models" construit sur son moteur vidéo Gen-4.5, capable de générer des interfaces applicatives en temps réel sans code sous-jacent, en réagissant aux clics, glissements et commandes vocales. Selon une étude interne, il est préféré à un modèle concurrent sur le suivi d'instructions et le comportement naturel, et reste pour l'instant en accès anticipé de recherche.

Lecture ESR

Si ce paradigme se confirme, les formations en informatique, design d'interface et UX devront enseigner une nouvelle manière de concevoir des applications, davantage centrée sur le dialogue avec un modèle que sur l'écriture de code. Cela invite les établissements à revoir leurs référentiels de compétences numériques et à anticiper une évolution profonde des métiers du développement web.