GPT-6 Astra a complété le puzzle classique de Portal sans intervention humaine

- GPT-6 Astra a réussi à terminer le jeu classique Portal sans l'aide d'un humain.
- L'expérience a duré presque 24 heures et a coûté 571 dollars en frais d'API
- Le modèle a effectué plus de 3300 appels d'outils pour résoudre des énigmes spatiales
- Cette réalisation montre les progrès d'OpenAI dans le développement d'agents IA de jeu universels
Cette semaine, OpenAI a présenté le modèle de réseau neuronal GPT-6 Astra, qui a déjà démontré des capacités impressionnantes dans le traitement de l'information visuelle. L'utilisateur cozyblaze a décidé de tester ses capacités en connectant le modèle au jeu de puzzle classique Portal et en lui donnant pour mission de passer tout le contenu sans aucune intervention humaine.
Portal est un puzzle légendaire basé sur des problèmes spatiaux complexes. Le joueur doit comprendre la géométrie tridimensionnelle des pièces, utiliser correctement les portails mobiles et trouver un chemin entre différentes surfaces et niveaux. Pour réussir, il faut non seulement une pensée logique, mais aussi une compréhension de la physique du monde du jeu. Le modèle Astra recevait des informations visuelles directement de l'écran du jeu, avait accès aux coordonnées du personnage et disposait d'un ensemble d'outils pour exécuter des commandes.
Le système a été spécialement reconfiguré pour utiliser la nouvelle technologie de gestion de contexte, développée pour Astra. Cela a permis au modèle d'analyser des captures d'écran, de traiter les informations entrantes et de prendre des décisions réfléchies sur les actions suivantes. Le processus ressemblait à une stratégie étape par étape, où chaque décision était basée sur le contenu visuel fourni.
Échelle de calcul
Bien que la vidéo documentant le passage du jeu Astra dure deux heures, l'expérience elle-même s'est étendue sur presque une journée entière. La majeure partie de ce temps a été consacrée au traitement des informations : le modèle interrompait périodiquement le jeu pour analyser des captures d'écran, « réfléchir » à la situation et déterminer le meilleur coup suivant. Malgré la durée prolongée, Astra a finalement réussi à terminer le jeu par elle-même, sans commettre d'erreurs critiques.
Pour surmonter tous les obstacles et résoudre toutes les énigmes, le modèle a effectué 3336 appels à l'API OpenAI. Les coûts totaux d'utilisation des ressources informatiques se sont élevés à 571 dollars et 18 cents. C'est une somme considérable, reflétant l'énorme volume de traitement d'informations et de calculs nécessaires aux modèles modernes pour résoudre même un seul jeu.
Contexte et signification historique
Il est important de noter que Portal est un jeu classique sorti en 2007, dont le contenu et les mécaniques sont largement connus et documentés sur Internet. Il est donc possible que le modèle Astra ait déjà inclus dans ses données d'entraînement des informations détaillées sur ce jeu. Cela signifie qu'il a appliqué des connaissances déjà connues, plutôt que de découvrir quelque chose de fondamentalement nouveau.
Néanmoins, cette réalisation reste importante pour le développement de l'IA. OpenAI s'est fixé depuis 2016 un objectif technique ambitieux : créer un agent unique capable de jouer à un large éventail de jeux vidéo différents. La réussite dans Portal peut être considérée comme une étape vers la réalisation de cet objectif stratégique. La démonstration que le système peut analyser de manière autonome des tâches spatiales, planifier des solutions en plusieurs étapes et s'adapter à de nouvelles situations montre des progrès dans le développement d'agents basés sur de grands modèles linguistiques.
Source : 3DNews



