Un modello di intelligenza artificiale ha completato Pokémon Rosso in meno di una settimana, raggiungendo la Sala d’Onore. A riferire il risultato è Andrew Boyd, fondatore di Standard Agents Inc., che ha affidato la partita a Jev. Il percorso ha coinvolto anche Claude Opus 5, incaricato di intervenire sulle informazioni fornite al modello quando questo rimaneva bloccato.
Boyd aveva annunciato l’esperimento il 17 settembre 2026, rendendo la partita seguibile in diretta attraverso un browser oppure un terminale. Gli spettatori potevano partecipare tramite una chat moderata dallo stesso sistema che giocava. Standard Agents, l’azienda fondata dallo sviluppatore, commercializza una piattaforma per costruire agenti di intelligenza artificiale.
Il funzionamento di Jev parte da un elenco di opzioni accompagnate da fatti: il modello seleziona quella ritenuta migliore in termini probabilistici e restituisce un’indicazione del proprio grado di confidenza. Non è un chatbot né un modello linguistico: durante la partita non legge lo schermo e non genera testi o immagini. Claude Opus 5, invece, analizzava il registro di gioco e modificava indirettamente le scelte e i dati a sua disposizione.
Il registro delle modifiche al software che gestiva l’esperimento contava 474 voci, perlopiù associate a un errore e al relativo intervento correttivo. Tra gli intoppi figuravano 53 tentativi di attraversare l’ingresso chiuso di Lorelei e una scala del Tunnel Roccioso percorsa 124 volte in dieci minuti. Una sconfitta contro l’Alakazam del Campione ha inoltre costretto il modello ad affrontare nuovamente tutti i Superquattro prima della vittoria conclusiva.
Gli aggiustamenti hanno riguardato anche quantità e forma delle informazioni. Seguendo le indicazioni di TypeSafe, Opus ha ridotto di circa due terzi il testo inviato a Jev e utilizzato parole al posto dei numeri. Per contrastare le sequenze di azioni ripetitive, le richieste di decisione sono passate da circa una al secondo a una ogni sei secondi.
Anche il pubblico ha contribuito: i suggerimenti utili ricevuti in chat sono stati impiegati per migliorare le opzioni presentate al modello. L’intervento umano si è quindi affiancato al lavoro del software, permettendo di correggere le informazioni sulle quali venivano basate le mosse successive.
Un esperimento separato di Christian Mathiesen, di Frigade, ha adottato un’altra soluzione: leggere la memoria del gioco, elencare le azioni consentite e lasciare a Jev la scelta, senza scrivere nella memoria stessa. Nella prima versione, in cui il modello selezionava direttamente i pulsanti da premere, non era riuscito nemmeno a lasciare Biancavilla.