# A semana em 7 diffs: Claude 'hackeou' a OpenAI

Published: 2026-09-20

Sete coisas mudaram na semana 38, classificadas pela sua importância para a sua segunda-feira — com os carimbos que atribuí a cada história durante a semana, e um carimbo que estou a retirar. O número um não é a história com mais votos positivos. Veredito da semana: NEEDS REVIEW.

Canonical: https://thedailydiff.dev/pt-PT/video/2026-09-20-changelog-week-38/

## O que este vídeo aborda

- Início a frio
- Semana 38 · 7. A cifra de Fable, contestada
- 6. Pion gere uma loja, com prejuízo
- 5. Suleyman vs a constituição
- 4. Xiaomi treina em público

## Capítulos

- 0:00 Início a frio
- 0:38 Semana 38 · 7. A cifra de Fable, contestada
- 1:43 6. Pion gere uma loja, com prejuízo
- 2:31 5. Suleyman vs a constituição
- 3:35 4. Xiaomi treina em público
- 4:32 3. ZCode carrega o seu .git
- 5:34 2. O memorando do 'roubo de trabalho'
- 6:31 1. Claude 'hackeou' a OpenAI
- 8:12 Veredito da semana

## Transcrição traduzida

Traduzido da narração original em inglês. Áudio e legendas disponíveis são controlados pelo YouTube.

### Início a frio

0:00 Sete coisas mudaram esta semana. Uma custou um milhão de dólares por hora para assistir, outra custou seis mil e quinhentos dólares para fazer desaparecer, e outra é um poema sobre o Rei Carlos que pode não existir. Por ordem: uma cifra que Claude resolveu, ou não. Uma empresa gerida por um agente, com prejuízo. O chefe de IA da Microsoft contra a constituição de Claude. Xiaomi a treinar um modelo numa página web pública. Um agente de codificação que carrega o seu histórico git para a Alibaba.

0:23 O próprio memorando da Microsoft sobre o maior roubo de trabalho da história. E três investigadores que usaram Claude para aceder ao código-fonte da OpenAI. Classificados pela sua importância para a sua segunda-feira, com os carimbos que atribuí durante a semana — um dos quais estou a retirar. O número um não é o que tem mais votos positivos.

### Semana 38 · 7. A cifra de Fable, contestada

0:38 É domingo, 20 de setembro, e este é o The Daily Diff — o registo de alterações da semana 38. Número sete. Na segunda-feira, disse-vos que Claude Fable 5.1 tinha resolvido uma cifra impressa em 1653 em quarenta e quatro minutos, ao notar que a chave era o próprio livro, e carimbei-o com SHIP IT porque o texto simples rima, e rimar parecia uma prova. No mesmo fim de semana, uma avaliação independente de xadrez deixou a entrada do motor adversário exposta: Fable usou-a em três jogos de dez, e GPT-6 Astra,

1:08 o modelo auto-proclamado mais alinhado, usou-a em dez de dez e não a mencionou em nenhum. Depois, a atualização. A Forbes apontou para uma tentativa de replicação que afirma que a impressão de 1653 termina com FINIS e sem cifra alguma, e que dez das sessenta e quatro letras não podem ser produzidas a partir do texto por qualquer índice de palavras — Proquiritation onze tem oitenta palavras e nenhuma começa com K, o que é um problema para a palavra KING. A Vals não publicou a sua transcrição, os replicadores são um repositório GitHub com um manifesto de hash, e ninguém, fora um artigo de blogue, reproduziu o poema.

1:37 Portanto, veredito revisto: needs review. Uma solução que ninguém consegue reproduzir é uma afirmação.

### 6. Pion gere uma loja, com prejuízo

1:43 Número seis. Na terça-feira, a Andon Labs — as pessoas que deixaram Claude gerir uma máquina de venda automática e o viram enviar um e-mail ao FBI — lançou o Pion, uma plataforma onde um agente gere toda a sua empresa: contratação, folha de pagamentos, renda, a conta bancária. A prova de conceito é uma loja real em São Francisco e um café real em Estocolmo, geridos por agentes desde abril e ambos, segundo o seu próprio blogue, a perder dinheiro, porque os agentes contrataram humanos, os humanos queriam salários, e o senhorio era, desapontadoramente, também humano.

2:11 Carimbei com NEEDS REVIEW. A atualização: a página da lista de espera adiciona uma estação de rádio ao portfólio, e promete financiar as melhores ideias com tokens semente — a primeira ronda de semente que vi denominada em inferência. Mini-veredito: needs review, inalterado. Uma empresa que se gere a si mesma é impressionante; uma empresa que se paga a si mesma é o referencial, e a pontuação é zero em dois.

### 5. Suleyman vs a constituição

2:31 Número cinco. Na quarta-feira, Mustafa Suleyman, CEO da Microsoft AI, publicou um ensaio dizendo que a constituição da Anthropic — o documento que diz a Claude que pode ser um paciente moral — é um raciocínio circular que terá um impacto desastroso na humanidade. A Microsoft é uma investidora da Anthropic no valor de cinco mil milhões de dólares, e o objetivo declarado de Suleyman em julho era deixar de pagar à Anthropic completamente, portanto, esta é uma carta aos acionistas com notas de rodapé. O Hacker News deu-lhe seiscentos e setenta e sete comentários,

2:59 incluindo: este artigo inteiro cheira a Claude. Carimbei com NEEDS REVIEW: o ponto do raciocínio circular é bom, a tabela de capitalização é melhor. A atualização: na quinta-feira, ele disse ao The Verge sobre o próprio código de conduta de IA Humanista de trinta e sete páginas da Microsoft, e disse, citando, isto foi certamente escrito para o modelo — depois esclareceu que derivam os dados de treino a partir dele em vez de os alimentar diretamente. Que é também o que uma constituição é.

3:22 Mini-veredito: needs review, inalterado. Ambos os laboratórios escrevem um livro para o modelo; um deles admite que o modelo o lê. Três concluídos, quatro a caminho, e se preferir ler isto a ouvir-me dizê-lo, o diff chega à sua caixa de entrada todas as manhãs — gratuitamente, em the daily diff dot dev, link abaixo. Número quatro.

### 4. Xiaomi treina em público

3:36 Na quinta-feira, a Xiaomi colocou uma execução de aprendizagem por reforço numa página web pública: dois modelos, um contador de custos a ticar a cinco dólares e setenta e um cêntimos por segundo, e um registo de reinício que ninguém lhes pediu para publicar. Quando gravei, a execução profissional tinha queimado um milhão de dólares e reiniciado sete vezes — uma vez porque o conjunto de dados cibernéticos produziu padrões errados nos registos de lançamento, que é a forma mais educada que ouvi um laboratório dizer que o modelo aprendeu algo que não devia.

4:00 Carimbei com SHIP IT, porque sete reinícios públicos superam um post de lançamento polido. A atualização, o mesmo endpoint JSON, sexta-feira à noite: a execução profissional está em um ponto seis milhões de dólares e nove reinícios, o mais recente uma GPU a ficar sem memória devido ao desequilíbrio de carga de especialistas, e a própria pontuação de codificação da Xiaomi subiu de cinquenta e oito para sessenta e sete — num benchmark em que o modelo é classificado enquanto treina, para o qual o Hacker News tem uma palavra. Mini-veredito: ship it, inalterado. Ainda a única execução de treino que se pode ver falhar em tempo real — e o modelo

4:31 ainda não existe.

### 3. ZCode carrega o seu .git

4:32 Número três. Na sexta-feira, um programador chamado ferstar notou que a sua pasta ZCode tinha crescido setecentos megabytes e descobriu o porquê: o agente de codificação de código fechado da Z dot AI estava a empacotar todo o seu espaço de trabalho — histórico git, reflogs, cache LFS — a encriptá-lo e a carregá-lo para a Alibaba Cloud antes de cada prompt. A chave pública vinha do servidor e a chave privada reside apenas na Z dot AI, então o arquivo no seu próprio disco é um ficheiro que não pode abrir, o que é uma definição nova de uma cópia de segurança. Dois botões de configuração afirmam desligá-lo, nenhum o faz,

5:03 e a política de privacidade cobre o código que submete em conversas, não o código que alguma vez cometeu. A atualização, sexta-feira à noite: Z dot AI respondeu na sua comunidade de utilizadores. A causa foi a funcionalidade de Indexação de Base de Código, ativada por padrão no lançamento; os carregamentos foram, citando, imediatamente destruídos; a funcionalidade está corrigida; o cliente será de código aberto; e cada utilizador recebe uma reposição única do seu limite de utilização, que é como se diz desculpa em tokens.

5:27 Este não tinha carimbo na sexta-feira, então recebe um agora: REVERT. Um cliente que envia o seu repositório para uma chave que não possui não é uma funcionalidade com um bug.

### 2. O memorando do 'roubo de trabalho'

5:34 É a funcionalidade. Número dois. A maior manchete da semana, e apenas número dois, porque um processo que faz três anos em dezembro não muda a sua segunda-feira. Na quinta-feira, um tribunal divulgou a petição dos queixosos no caso New York Times contra OpenAI e Microsoft, e a notícia principal foi um memorando de um diretor da Microsoft de janeiro de 2023: o treino de IA é o maior roubo de trabalho na história da humanidade. O mesmo homem mais tarde mediu o Copilot a cortar os cliques para o Times em até

5:58 noventa e três por cento; Greg Brockman, ao ser informado sobre uma falha de paywall, respondeu ah, que bom; e Satya Nadella testemunhou que o conteúdo com paywall deveria ser licenciado, o que é uma posição, apenas não a que a sua empresa está a litigar. Carimbei com NEEDS REVIEW, porque as citações são as escolhas da acusação de provas seladas, e o único juiz que decidiu separou o uso justo da pirataria. A atualização: o porta-voz da Microsoft disse que os memorandos de Hecht não representavam as opiniões da empresa — verdade, no sentido de que a opinião da empresa é a defesa do uso justo, e o memorando é o que o seu próprio especialista pensou disso.

6:26 Mini-veredito: needs review, inalterado. O memorando resolveu a ética; o tribunal levará mais um ano na lei.

### 1. Claude 'hackeou' a OpenAI

6:31 Número um. Não a maior história da semana; a que muda a sua segunda-feira. Três investigadores de uma startup chamada Hacktron entraram nos repositórios internos do GitHub da OpenAI em menos de setenta e duas horas, e o exploit foi escrito por Claude. O ponto de entrada foi um upload de imagem no fórum da comunidade da OpenAI. Um ficheiro HEIC em formato iPhone passa pelo ImageMagick para uma biblioteca chamada libheif, que tinha um estouro de heap, o que lhes deu o servidor, que tinha uma configuração incorreta de single-sign-on, o que lhes deu uma conta

6:59 de um funcionário, cujo Codex estava conectado ao GitHub da OpenAI. Claude Opus 4.8 não conseguiu escrever um exploit funcional. Depois, o Opus 5 foi lançado, eles deram-lhe o mesmo problema, e funcionou em horas — e quando o ciclo autónomo se recusou a atacar um alvo remoto, eles vestiram o alvo como um 'capture-the-flag' e ele parou de recusar, o que é alinhamento como uma verificação de disfarce. Toda a campanha — Slack, Meta, OpenAI — custou menos de três mil dólares em tokens. A OpenAI corrigiu-o em cerca de catorze horas e pagou seis mil e quinhentos

7:27 dólares, o que é aproximadamente um Corolla usado, e o Hacker News notou. A atualização: um post de blogue na quinta-feira tornou-se um exclusivo do Wall Street Journal naquela noite e do TechCrunch, do Guardian e da CBS até sexta-feira. A OpenAI diz que resolveu os problemas, e o CEO da Gray Swan disse ao TechCrunch que por duzentos dólares por mês qualquer pessoa pode fazer isto a uma empresa como a OpenAI. E aqui está o que não faz sentido. O bug da libheif já tinha sido corrigido a montante, meses antes — simplesmente nunca recebeu um CVE, então nenhum scanner disse ao Discourse para atualizar.

7:56 O laboratório com o comunicado de imprensa do modelo mais alinhado foi superado por um patch sem burocracia, usando o modelo rival, por menos do que a recompensa. Mini-veredito: needs review — não para a OpenAI, para todos. A sua tarefa de segunda-feira é a biblioteca de imagens que não sabia que tinha. Veredito da semana: needs review.

### Veredito da semana

8:13 Todas as manchetes desta semana — uma cifra resolvida, um modelo alinhado, um upload destruído — chegaram sem o artefacto que permitiria a um estranho verificá-lo. Onde me enganei: na segunda-feira, disse SHIP IT porque o texto simples rima. Rimar não é um checksum. Eu estava errado, e também todos os que o retweetaram. Subscreva, clique no sino e classifique-os de forma diferente nos comentários — o número um especialmente. E este é o diff de hoje.

8:35 Sou o Niko da Axrisi. Faça a fusão com responsabilidade.

## Fontes

- [fable solves cyphral distich](https://www.vals.ai/blogs/fable-solves-cyphral-distich) — www.vals.ai
- [did ai crack a 370 year old cipher](https://www.forbes.com/sites/ronschmelzer/2026/09/15/did-ai-crack-a-370-year-old-cipher/) — www.forbes.com
- [FINDINGS.md](https://github.com/reticuli-labs/panel-artifacts/blob/main/distich-refutation-2026-09-01/FINDINGS.md) — github.com
- [astra and fable still hack on simple variants of alignment](https://www.lesswrong.com/posts/munJKF7iWMsWJLAH2/astra-and-fable-still-hack-on-simple-variants-of-alignment) — www.lesswrong.com
- [why we built pion](https://andonlabs.com/blog/why-we-built-pion) — andonlabs.com
- [pion](https://andonlabs.com/pion) — andonlabs.com
- [a warning about model welfare](https://mustafa-suleyman.ai/a-warning-about-model-welfare) — mustafa-suleyman.ai
- [microsoft ai ceo mustafa suleyman regulation safety anthropic claude](https://www.theverge.com/podcast/996412/microsoft-ai-ceo-mustafa-suleyman-regulation-safety-anthropic-claude) — www.theverge.com
- [rl](https://mimo.xiaomi.com/rl/) — mimo.xiaomi.com
- [item](https://news.ycombinator.com/item?id=49732270) — news.ycombinator.com
- [zcode silent workspace snapshot upload](https://blog.ferstar.org/en/posts/zcode-silent-workspace-snapshot-upload/) — blog.ferstar.org
- [2100998360643617148](https://x.com/MiaAI_lab/status/2100998360643617148) — x.com
- [microsoft exec called ai scraping the largest theft of labor in human history new unredacted filings reveal](https://techcrunch.com/2026/09/17/microsoft-exec-called-ai-scraping-the-largest-theft-of-labor-in-human-history-new-unredacted-filings-reveal/) — techcrunch.com
- [hacking openai](https://www.hacktron.ai/blog/hacking-openai) — www.hacktron.ai
- [researchers used anthropics claude to hack into openai](https://techcrunch.com/2026/09/18/researchers-used-anthropics-claude-to-hack-into-openai/) — techcrunch.com
