GPT-6 Astra ha completato il classico puzzle di Portal senza coinvolgimento umano

- GPT-6 Astra ha completato autonomamente il classico gioco Portal senza l'aiuto umano.
- L'esperimento è durato quasi 24 ore e ha costato 571 dollari in spese per l'API
- Il modello ha effettuato oltre 3300 chiamate agli strumenti per risolvere enigmi spaziali
- Il risultato mostra i progressi di OpenAI nello sviluppo di agenti AI di gioco universali
Questa settimana OpenAI ha presentato il modello di rete neurale GPT-6 Astra, che ha già dimostrato impressionanti capacità nel trattamento delle informazioni visive. L'utente cozyblaze ha deciso di testarne le capacità collegando il modello al classico gioco di puzzle Portal e assegnandogli il compito di completare tutto il contenuto senza alcun intervento umano.
Portal è un leggendario puzzle basato su complesse sfide spaziali. Il giocatore deve comprendere la geometria tridimensionale delle stanze, utilizzare correttamente i portali mobili e trovare un percorso tra diverse superfici e livelli. Per completare con successo il gioco è necessaria non solo una logica di pensiero, ma anche una comprensione della fisica del mondo di gioco. Il modello Astra riceveva informazioni visive direttamente dallo schermo del gioco, aveva accesso alle coordinate del personaggio e disponeva di un insieme di strumenti per eseguire i comandi.
Il sistema è stato appositamente riconfigurato per utilizzare una nuova tecnologia di gestione del contesto, sviluppata per Astra. Questo ha permesso al modello di analizzare gli screenshot, elaborare le informazioni in arrivo e prendere decisioni ponderate sulle azioni successive. Il processo assomigliava a una strategia passo-passo, in cui ogni decisione si basava sul contenuto visivo fornito.
Scala di calcolo
Sebbene il video che documenta il completamento del gioco Astra duri due ore, l'intero esperimento si è protratto per quasi un'intera giornata. Gran parte di questo tempo è stato speso dal sistema per elaborare le informazioni: il modello interrompeva periodicamente il gioco per analizzare gli screenshot, 'riflettere' sulla situazione e determinare la mossa successiva ottimale. Nonostante il lungo tempo, Astra è riuscita a completare il gioco da sola, senza commettere errori critici.
Per superare tutti gli ostacoli e risolvere tutti i rompicapi, il modello ha effettuato 3336 chiamate all'API OpenAI. I costi totali per l'uso delle risorse computazionali sono stati di 571 dollari e 18 centesimi. Questa è una somma significativa, che riflette l'enorme volume di elaborazione delle informazioni e di calcoli necessari ai modelli moderni per risolvere anche un solo gioco.
Contesto e significato storico
È importante notare che Portal è un gioco classico rilasciato nel 2007, il cui contenuto e meccaniche sono ampiamente conosciuti e documentati su internet. Pertanto, è possibile che il modello Astra avesse già incluso nei suoi dati di addestramento informazioni dettagliate su questo gioco. Ciò significa che ha applicato conoscenze già note, piuttosto che scoprire qualcosa di fondamentalmente nuovo.
Tuttavia, il traguardo rimane importante per lo sviluppo dell'IA. OpenAI dal 2016 si pone un'ambiziosa obiettivo tecnico: creare un agente unico in grado di affrontare un'ampia gamma di diversi videogiochi. Il completamento di Portal può essere considerato un passo verso il raggiungimento di questo obiettivo strategico. La dimostrazione che il sistema può analizzare autonomamente compiti spaziali, pianificare soluzioni a più fasi e adattarsi a nuove situazioni mostra progressi nello sviluppo di agenti basati su modelli linguistici di grandi dimensioni.
Fonte: 3DNews



