Il Prompt AI con Aspetto più Stupido Ha Battuto Mesi di Attenta Progettazione di Gioco
Solo due giorni dopo il lancio di Claude Opus 5, l'investitore in AI e ex CEO di HyperWrite, Matt Shumer, ha pubblicato un video di uno sparatutto in prima persona completamente giocabile che il modello aveva costruito interamente da solo.
"Claude Opus 5 ha creato questo gioco in un colpo solo," ha scritto, aggiungendo che non un singolo asset esterno è stato incluso nella costruzione.
Ora, potresti pensare che un output di così alta qualità richiedesse un prompt lungo, dettagliato e attento per guidare i modelli AI attraverso le complessità della creazione di uno sparatutto in prima persona rifinito.
Ripensaci.
Il prompt dietro di esso consisteva in tre brevi paragrafi, pubblicati per intero su GitHub. Diceva a Opus 5 di costruire uno sparatutto al livello degli ultimi giochi di Call of Duty, di distribuire subagenti—lavoratori che ciascuno ha la propria memoria separata e un compito specifico—per affrontare i pezzi individualmente, e di continuare a ripetere ogni pezzo con un critico separato e severo fino a quando non reggeva il confronto con i veri filmati di Call of Duty in un confronto cieco affiancato. Il risultato, secondo il prompt, doveva essere "completamente perfetto."
Questo è un'inversione di come gli ingegneri di prompt hanno insegnato alle persone a lavorare. Il consiglio durante il boom del vibe-coding era di specificare criteri invece di aggettivi: dire cosa significa "buono" invece di chiedere semplicemente di averlo. Cosa dovrebbe considerare il codice invece di dire "AAA."
La versione di Shumer fa quasi l'opposto, chiedendo ai propri subagenti di essere "completamente stupiti," e lasciando la definizione effettiva a un critico che Opus 5 ha costruito per se stesso.
Due caratteristiche di Claude Code portano quel ciclo. I subagenti si attivano in finestre di contesto isolate con le proprie istruzioni e accesso agli strumenti, quindi un critico che valuta il modello dell'arma non eredita le scuse del costruttore per il motivo per cui appare in un certo modo. L'Ultracode è un'impostazione di Claude Code che spinge il modello al massimo sforzo di ragionamento e gli consente di scrivere il proprio piano di orchestrazione, distribuendo il lavoro su un massimo di 16 agenti contemporaneamente, limitato a 1.000 per esecuzione.
La skill /loop integrata di Anthropic, progettata per cicli ripetuti di correzione-test-regolazione, è ciò che ha impedito all'esecuzione di fermarsi nel momento in cui il gioco sembrava decente. Shumer non ha mai specificato un numero di turni. Ha lasciato che il critico continuasse a nominare un nuovo gap e ha mantenuto il costruttore a inseguirlo per ore prima di chiudere lui stesso la sessione.
La costruzione finale gira su Three.js e WebGL2 semplice, con circa 55.000 righe di codice distribuite su 11 sottosistemi. Ogni texture, mesh, animazione e suono viene generato all'interno del browser al momento del caricamento—nessun modello scaricato, HDRI, file immagine o file audio. Il registro del critico pubblicato da Shumer mostra il punteggio salire da 3.59 su 10 verso poco sopra 5, continuando a rimanere indietro rispetto al gioco reale in ogni singolo turno.
Gli scettici hanno ipotizzato ore di codifica manuale nascosta, quindi Shumer ha pubblicato l'intero prompt e il codice sorgente. È stato allora che sono iniziati i copiatori.
James Altucher, ex gestore di hedge fund e podcaster, ha eseguito il prompt identico e ha riportato di aver speso "poco più di dieci ore" e circa 1,3 milioni di token su Opus 5 per arrivarci. La sua costruzione, Operation Blackout, gioca gratuitamente nel browser e appare fantastica.
Lo sviluppatore di Prompt Silo ha invece indirizzato la stessa richiesta al flagship rivale di OpenAI, pubblicando "Sol 5.6 Ultra con lo stesso prompt"—Sol essendo il livello più alto della famiglia di modelli GPT-5.6 che OpenAI ha reso generalmente disponibile il 9 luglio insieme a versioni più economiche Terra e Luna.
Lo sviluppatore Leon Lin ha provato il movimento opposto, optando per il solito prompt dettagliato. Invece di copiare la versione breve di Shumer, ha cercato di "ingegnerizzare un prompt per questo gioco," producendo un documento profondo circa 20 sezioni che spiega tutto, dalla fisica ragdoll alle mappe delle ombre a cascata. Ha alimentato questo in Cursor usando Opus 5 semplice con alto sforzo, senza subagenti e senza ultracode, e il risultato—uno sparatutto di mercato chiamato Dust Corridor—gioca anche nel browser e appare anche fantastico.
Nessuna delle costruzioni successive ha affrontato il test cieco che Shumer ha eseguito sul proprio progetto. Il suo registro del critico mostra ancora Call of Duty reale vincere ogni turno che ha registrato—la barra che Altucher e Atom Tan Studio stanno inseguendo con il suo esatto prompt di tre paragrafi, e quella che Leon Lin sta inseguendo con circa 20 sezioni proprie.
Quanto di tutto ciò è realmente nuovo?
Strumenti di codifica agentici come Claude Code scrivono software come potrebbe fare un ingegnere junior supervisionato: leggono file, eseguono codice, guardano gli screenshot che generano e assegnano pezzi del lavoro a subagenti e critici che controllano il risultato rispetto a un obiettivo dichiarato. Quel ciclo è reale, e il Gauntlet Loop di Shumer è un modo genuino per strutturarlo. Nessuno di questo, da solo, prova che il modello ha progettato un gioco dall'immaginazione piuttosto che ricombinare schemi di codice che aveva già assorbito.
Questo non rende Claude of Duty falso, ma rende "costruito da zero" un'affermazione più difficile da accreditare completamente, quindi prendi quei risultati con un pizzico di sale.
I ricercatori che studiano modelli di generazione di codice hanno un nome per il problema più ampio: contaminazione dei dati, quando un modello riesce bene in un compito principalmente perché esempi quasi identici erano già presenti nei suoi dati di addestramento, non perché ha ragionato su qualcosa di nuovo.
Nessuna delle costruzioni di sparatutto in prima persona pubblicate ha effettuato un controllo per quel tipo di contaminazione. Il repository di Shumer contiene la creatività di Claude, se è giusto chiamarla in questo modo. Questo è un motivo per leggere "ha creato un gioco AAA in un colpo solo" come un agente capace che lavora all'interno di uno dei generi più documentati nella programmazione, non come prova che un'AI ha progettato uno sparatutto senza arte precedente su cui basarsi.
Questo contenuto è fornito a solo scopo informativo generale e non costituisce consulenza finanziaria, di investimento, legale o fiscale. Qualsiasi evento, ricompensa, promozione online o informazione correlata menzionata nel presente documento non deve essere considerata una raccomandazione, una sollecitazione o un invito ad acquistare, vendere, fare trading o altrimenti negoziare criptovalute. Le criptovalute sono altamente volatili e possono comportare perdite. La disponibilità dei servizi, dei prodotti e degli eventi correlati di WEEX può variare a seconda della regione. È tua responsabilità assicurarti che la tua partecipazione sia conforme alle leggi e ai regolamenti locali applicabili.
Potrebbe interessarti anche

Mutui e garanzie: il governo prepara un nuovo sistema per ampliare l'accesso alla casa

Vacanze invernali: promozioni, rate e neve non bastano per riempire le destinazioni

OpenAI e Anthropic spingono per una revisione di 30 giorni per i modelli AI avanzati

Ho Scansionato L'intera Blockchain Di Bitcoin Per Immagini. Ciò Che Ho Trovato Ti Scioccherà

Ha lasciato il suo Tesla Cybertruck collegato per due settimane e non si è più acceso: cosa è realmente successo?

Cos'è e come funziona "Apple Upgrade", il piano ufficiale di noleggio di iPhone, iPad e Macbook

Matematica Rapida Sugli Acquisti di STRC: La Verità sul Bitcoin Netto per Azione e Accrescimento

Robinhood Chain supera Solana nel volume di azioni tokenizzate tramite coppie di memecoin

Tra sanzioni economiche e bombardamenti, la strategia degli Stati Uniti per negoziare con l'Iran

L'Iran ha diffuso un video con minacce contro Melania e Barron Trump: cresce la tensione con gli Stati Uniti

Intelligenza Artificiale: Vint Cerf vuole dare un'identità a ogni agente IA

Ondo abbandona la sua blockchain L1 e punta ora sull'esecuzione off-chain

SBI si espande oltre Ripple con l'unità Canton Network

Michael Saylor: Bitcoin ha già vinto, ma deve essere protetto dalla corruzione interna

Clear Creek rivela un portafoglio ETF di Bitcoin e criptovalute da 15 milioni di dollari

Flare rende XRPFi accessibile con una sola firma grazie a smart accounts v1.3

Bitcoin: il braccio di ferro tra balene e piccoli investitori annuncia un fondo?

La startup Ethereum EthSystems scommette che la privacy è la chiave per portare le banche sulle blockchain pubbliche

Il CEO di Nansen scommette sugli agenti AI per superare i trader umani entro due anni

AmericanFortress propone uno schema di portafoglio crittografico sicuro contro i quanti

Arthur Hayes acquista altri 6,39 milioni di dollari in ETH nonostante una perdita cartacea di 301.000 dollari: ecco su cosa sta scommettendo

Fortissimo impatto della volatilità globale: 8 investitori su 10 rafforzano le posizioni difensive

Emirates lancia il pagamento in criptovaluta con Crypto.com

Hyperliquid porta i contratti perpetui crypto nel mondo del 'LEGO monetario' di DeFi

"Oltre il portafoglio verso la finanza on-chain"... Exilist mette in luce la strategia di espansione delle "azioni tokenizzate" di MEW

Ethereum: BitMine detiene già il 4,8% dell'offerta di ETH

Raoul Pal: La correlazione dell'87% di Bitcoin con la liquidità globale supera utili e notizie

Credito opaco: Chanos espone la frode velata che minaccia il mercato

Consumo nei supermercati: quali prodotti gli argentini hanno smesso di acquistare e perché










