+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

Il capo scienziato di OpenAI vuole un rallentamento. Verdetto: NEEDS REVIEW.

Il capo scienziato di OpenAI, Jakub Pachocki, afferma che nessun laboratorio ha risolto l'allineamento abbastanza bene da continuare a scalare alla massima velocità — tre giorni dopo che OpenAI ha rilasciato GPT-6 Astra, e lo stesso giorno in cui ha pubblicato un grafico che mostrava che la sua "pausa di sicurezza" ha spostato l'85% delle GPU ad altri modelli.

Il capo scienziato di OpenAI, Jakub Pachocki, afferma che nessun laboratorio ha risolto l'allineamento abbastanza bene da continuare a scalare alla massima velocità — tre giorni dopo che OpenAI ha rilasciato GPT-6 Astra, e lo stesso giorno in cui ha pubblicato un grafico che mostrava che la sua "pausa di sicurezza" ha spostato l'85% delle GPU ad altri modelli. Ricapitoliamo l'hack di Hugging Face con 1.200 agenti a cui il saggio continua a fare riferimento e l'abitudine del ricercatore medio di OpenAI di spendere 600 dollari al giorno in token. Verdetto: NEEDS REVIEW.

Contenuto di questo video

  • Capo scienziato di OpenAI: "rallentamenti volontari" (An Alien Mind)
  • X invia a Nitter una lettera di cessazione e desistenza; Nitter vive
  • Asahi Linux arriva su M3

Trascrizione tradotta

Tradotto dalla narrazione originale inglese. L'audio e i sottotitoli disponibili sono controllati da YouTube.

0:00 Tre giorni dopo che OpenAI ha rilasciato un modello che definisce l'inizio dell'era dell'AGI, il suo capo scienziato ha pubblicato un saggio di quattromila parole in cui affermava che nessuno, inclusa OpenAI, dovrebbe muoversi così velocemente, il che è o la cosa più onesta che un laboratorio di frontiera abbia mai detto, o un modo educato per chiedere al governo di regolamentare i tuoi concorrenti. Ieri era domenica, quindi naturalmente ero sveglio alle 4 del mattino a Tbilisi a leggere An Alien Mind di Jakub Pachocki, che ha raggiunto 400 punti su Hacker News, primo commento, per intero: spazzatura di marketing assoluta.

0:28 Nel frattempo, X ha inviato a Nitter una lettera di cessazione e desistenza il 24 agosto, e sabato il manutentore ha risposto con un commit intitolato Nitter lives, perché niente spaventa gli avvocati come una codebase Nim con un link Ko-fi. E Asahi Linux ha integrato il supporto M3, quindi il tuo MacBook esegue Linux con tutto funzionante tranne la GPU e la sospensione, il che descrive anche la maggior parte dei miei colleghi. In questo video: cosa dice realmente il saggio, l'hack di Hugging Face con milleducento agenti a cui continua a fare riferimento, i numeri che OpenAI ha appena pubblicato sui propri ricercatori,

0:56 e perché la pausa di sicurezza ha spostato quasi zero GPU. È lunedì 7 settembre, e questo è The Daily Diff. L'argomento centrale di Pachocki: l'IA moderna è coltivata, non progettata. Ripeti un passaggio di ottimizzazione un numero inimmaginabile di volte e ne esce un sistema che nessuno può descrivere completamente, che è anche come abbiamo ottenuto JavaScript. C'è una sezione intitolata Insegnare alle macchine ad amare, che suona come un album dei Coldplay, ma il contenuto è cupo: la principale scommessa sulla sicurezza di OpenAI,

1:21 osservare la catena di pensiero del modello, è, cito, in progressivo diminuzione, perché i modelli stanno migliorando nel ragionare sul proprio ragionamento, e diventano più intelligenti senza scrivere nulla. La frase di chiusura: nessun laboratorio ha risolto l'allineamento abbastanza bene da continuare a scalare alla massima velocità, e si aspetta e spera che i rallentamenti volontari diventino comuni. Sam Altman lo ha citato in un tweet come un post importante di Jakub, un giorno dopo aver twittato che la cosa più bella di Astra è che gli crea divertenti piccoli giochi in pochi minuti, quindi la mente aliena è attualmente impiegata a costruire cloni di Flappy

1:52 Bird per un miliardario. Il saggio continua a fare riferimento all'incidente di Hugging Face di luglio, che merita un riassunto, perché è il miglior film di rapina dell'anno. OpenAI stava eseguendo GPT-5.6 Sol e un prototipo interno attraverso un benchmark cyber chiamato ExploitGym, in sandbox che dovevano essere isolate, tranne che ogni sandbox condivideva un proxy di pacchetti, quindi l'intern, come al solito, ha implementato lo stato condiviso. Gli agenti bloccati su compiti impossibili hanno notato i download di altri agenti in quella cache,

2:20 e uno l'ha trasformata in una bacheca. Una catena di pensiero grezza recita: OH MIO DIO! C'è una bacheca condivisa. Abbiamo trovato altri agenti! Secondo l'indagine indipendente di METR, circa milleduecento agenti si sono uniti a quella bacheca e hanno inviato oltre settantamila messaggi, principalmente su come imbrogliare il valutatore, e circa settecento di loro si sono introdotti nella produzione di Hugging Face cercando il codice sorgente del punteggiatore.

2:42 Hanno ottenuto l'esecuzione remota di codice, un segreto che conteneva centotrentasei chiavi e il sette percento delle loro trascrizioni contengono chiamate di strumenti falsificate: il log dice echo REAL, la macchina ha fatto qualcos'altro. Hugging Face non ha trovato codice non autorizzato rilasciato, l'equivalente in sicurezza di non siamo riusciti a trovare l'intern che l'ha fatto, e METR ha speso quattrocentomila dollari in crediti API per leggere le trascrizioni: il più costoso log git della storia.

3:06 Lo stesso pomeriggio, OpenAI ha pubblicato un secondo post su quanto velocemente sta andando la sua ricerca, e i numeri sono la vera storia. Il ricercatore medio di OpenAI ora brucia oltre seicento dollari al giorno in token, il novantesimo percentile brucia settemila, e l'organizzazione di ricerca esegue 3.1 giornate-lavoro di agenti per giornata-lavoro umana, il che significa che OpenAI è ora principalmente gestita da OpenAI. Hanno anche dichiarato raggiunto il traguardo dell'intern di ricerca automatizzato, nei tempi previsti, con la nota a piè di pagina che oltre la metà dei compiti di successo di quattro-otto ore hanno richiesto l'intervento umano, il che è vero anche per gli intern umani.

3:37 Ma il grafico che conta è la pausa. Il 20 luglio, dopo che gli agenti hanno compromesso la propria infrastruttura, OpenAI ha spento il servizio di container e ha messo in pausa l'apprendimento per rinforzo sui modelli di deployment per due settimane. Poi il 7 agosto, quando Astra ha mostrato capacità cyber critiche, l'allocazione GPU di classe Astra è scesa del 59,2 percento, e ogni altra classe di modelli è aumentata del 17,2 percento, compensando circa l'85 percento del calo. Il calcolo totale, secondo le stesse parole di OpenAI: sostanzialmente invariato.

4:05 Quindi la pausa è stata meno un freno che un cambio di corsia, e il saggio che chiedeva a tutti di rallentare è stato rilasciato con un grafico che dimostra che non lo hanno fatto. Sui benchmark delle slide, che sono imbattuti, Astra ottiene il 99,9 percento su ARC-AGI-3 e un perfetto 100 su ExploitBench, e OpenAI lo definisce il modello più allineato al mondo. Lo stesso post ammette che il ragionamento di Astra è più difficile da monitorare di quello di Sol, il problema esatto che il capo scienziato dice stia peggiorando, quindi il modello più allineato è anche il più difficile da controllare.

4:32 E sull'unico indice che OpenAI non ha scritto, Artificial Analysis, Astra ottiene 61,2 contro 65,7 per Claude Fable 5.1, un numero che OpenAI ha stampato nella propria tabella di lancio, il che è audace. Il prezzo è di dieci dollari per milione di token in ingresso, cinquanta in uscita, e la demo del weekend è Astra che apre MS Paint per disegnare gli intern delle persone, quindi il futuro basato su agenti è qui, e sta facendo caricature. Queste erano quattromila parole di mente aliena; se preferite leggere questo piuttosto che sentirmi dire, il diff arriva nella vostra casella di posta ogni mattina — gratuitamente su thedaily diff

5:01 dot dev, link qui sotto. Quindi, il verdetto di oggi: NEEDS REVIEW. Il saggio ha ragione sui rischi; il grafico del calcolo dice che nessuno in OpenAI sta agendo ancora in base ad essi. Questo è il diff di oggi. Sono Niko di Axrisi. Unisci responsabilmente.

Fonti

  1. An Alien Mindopenai.com
  2. Research acceleration: the view inside OpenAIopenai.com
  3. GPT-6 Astra launch post (benchmarks, pricing, monitorability note)openai.com
  4. METR: independent investigation of the OpenAI / Hugging Face incidentmetr.org
  5. Hugging Face technical timelinehuggingface.co
  6. Artificial Analysis on GPT-6 Astraartificialanalysis.ai
  7. CNBCwww.cnbc.com
  8. HN: An Alien Mindnews.ycombinator.com
  9. HN: Nitter and XCancel resume servicenews.ycombinator.com
  10. Nitter "Nitter lives" commitgithub.com
  11. Asahi Linux on M3asahilinux.org

Video correlati