OpenAI a donné un premier aperçu d’Astra, une famille de modèles non commercialisée conçue pour traiter des problèmes complexes nécessitant des efforts soutenus sur de longues périodes. L’entreprise affirme qu’une version interne du système a contribué à 10 avancées en mathématiques et en informatique théorique.
Dans une mise à jour de ses travaux de recherche, OpenAI a indiqué qu’aucun progrès n’avait été réalisé sur les résultats centraux de ces problèmes depuis au moins 10 ans, certains étant restés irrésolus bien plus longtemps. Les travaux ont porté notamment sur la géométrie en haute dimension, la théorie du codage, la complexité des circuits arithmétiques, la théorie des groupes, la complexité quantique, la cryptographie sur réseaux et la combinatoire extrémale.
OpenAI a cité plusieurs résultats à titre d’exemples, notamment des travaux sur les groupes non sofiques, une réfutation de la conjecture de rigidité de Connes, l’amélioration de bornes pour l’empilement de sphères en haute dimension et la résolution de plusieurs problèmes associés au mathématicien Paul Erdős. L’entreprise a estimé que la génération des solutions avait nécessité environ 2 000 dollars d’utilisation du modèle, selon les tarifs de l’API Sol.
La vérification formelle faisait partie du processus
Des chercheurs humains ont utilisé les résultats du modèle pour élaborer des manuscrits mathématiques formels. Astra a ensuite traduit chaque démonstration en un certificat pour Lean, un assistant de preuve capable de vérifier mécaniquement la validité du raisonnement formalisé. Cette étape de vérification supplémentaire vise à distinguer les conjectures ou arguments générés par une machine des preuves pouvant être vérifiées indépendamment par un logiciel.
OpenAI a décrit Astra comme son « prochain modèle majeur », mais n’a annoncé ni date de sortie ni nom définitif pour le produit. Des informations publiées par The Information indiquent également que l’entreprise développe une famille de modèles destinée aux charges de travail de longue durée, notamment aux tâches dans lesquelles des agents d’IA se répartissent entre eux différentes parties d’un problème plus vaste.
La marque définitive du modèle et sa disponibilité restent incertaines. Il pourrait, selon certaines informations, être lancé sous le nom de GPT-5.7, de GPT-6 ou sous une autre appellation. OpenAI pourrait également proposer largement une version moins performante tout en limitant l’accès à des variantes plus puissantes, à l’image des politiques de sécurité et d’accès adoptées par d’autres entreprises d’IA.
Les avancées mathématiques rapportées mettent en évidence le potentiel de systèmes capables de combiner raisonnement prolongé, collaboration et vérification formelle. Cependant, les affirmations d’OpenAI concernent des recherches internes et devront être évaluées plus en détail lorsque des informations techniques complémentaires, des résultats pouvant être examinés indépendamment et des informations sur le produit seront disponibles.
