Des agents d'IA ont créé un compilateur TypeScript plus rapide
Theo Browne a annoncé tsc-rs, un port expérimental en Rust du compilateur Go TypeScript de Microsoft, écrit par un agent.
Theo Browne a annoncé tsc-rs, un port expérimental en Rust du compilateur Go TypeScript de Microsoft, écrit par un agent. Ce "Daily Diff" du 8 octobre examine les allégations de vitesse spécifiques à la charge de travail du projet, les équivalents de jetons au prix de l'API, le décalage de révision en amont et les mises en garde connues concernant l'adoption. Des articles connexes couvrent le niveau de tarification des invites longues de Haiku 5.5 et un recensement des contributeurs à l'infrastructure. Le verdict de Niko est "NEEDS REVIEW" (NÉCESSITE UN EXAMEN) avant de remplacer une porte de publication.
Lire l'édition écrite (anglais) ↗
Ce que couvre cette vidéo
- Theo a annoncé tsc-rs le 7 octobre 2026 à 11h07 UTC. Le projet porte la conception et les tests du compilateur Go existant de Microsoft ; la tentative réussie en Rust n'a pas inventé toutes les sémantiques TypeScript de zéro.
- L'utilisation infructueuse d'OpenAI de Theo, d'environ 400 000 dollars, et son utilisation d'Opus, de 24 047 dollars, sont évaluées aux prix des API. Il signale utiliser des abonnements Claude pour Opus. Ces chiffres n'établissent pas des paiements en espèces de ces montants.
- Le résultat de 12,5x du projet compare T3 Code avec Effect au TypeScript 6 plus son ancien plugin Effect. Sa comparaison Go-plus-Effect est de 1,89x, et Bun gagne le tableau sans Effect. L'ancien plugin a un ensemble de règles de diagnostic différent.
- Le harnais de référence a été inspecté, avec cinq exécutions chronométrées après un échauffement et des binaires ARM natifs macOS. Les performances et la compatibilité n'ont pas été reproduites indépendamment pour cet épisode. Les versions préliminaires manquent d'optimisations utilisées par la version mesurée.
- Le README nomme une révision amont du 29 septembre, tandis que UPSTREAM.json étiquette une épingle de juin comme actuelle. Ces métadonnées d'outillage ne prouvent pas quelle révision le binaire livré utilise. Vérifiez le binaire installé et comparez des révisions égales.
- La publication répertorie le support Linux x64 et macOS arm64, ainsi que des mises en garde concernant l'émission de monorepo, la référence de construction et la mémoire de l'éditeur. La construction WASM documentée est monocœur et manque de mode serveur de langage natif ; les économies d'infrastructure restent non mesurées.
- Le prix de lancement de Haiku 5.5 est multiplié par cinq au-dessus de 100 000 jetons d'invite. Artificial Analysis rapporte une utilisation intensive de jetons de sortie à effort maximal et un résultat de 33 % sur Terminal-Bench contre 39,2 % pour Anthropic sous différentes configurations d'évaluation. Ses chiffres de coût provisoires excluent le niveau d'invite longue.
- Le recensement de sheets.works a trouvé un ou deux contributeurs réguliers dans 11 des 23 projets d'infrastructure échantillonnés, en utilisant un seuil de dix commits par an. Ce proxy peut omettre le travail de révision, de triage et de support. L'adoption dépend également de la visibilité de la propriété de la maintenance future.
Transcription traduite
Traduit de la narration originale en anglais. L'audio et les sous-titres disponibles sont gérés par YouTube.
Les agents peuvent-ils porter un compilateur que les gens utilisent réellement ?
0:00 Vous vous attendez à ce qu'une réécriture de compilateur par IA s'effondre. Le port Rust de Theo bat Go sur son benchmark T3 Code, et il dit n'avoir jamais lu son code. Dans cette vidéo, qu'ont réellement construit les agents ? Et devriez-vous remplacer votre vérificateur ? Nous sommes le jeudi 8 octobre, et c'est le Daily Diff. Gardez une question ouverte. Qui maintient cela en état de marche lorsque Microsoft modifie TypeScript ?
0:19 T S C R S est un compilateur TypeScript expérimental et open source, un vérificateur de type et un serveur de langage écrits en Rust. Le projet de Theo Browne porte l'implémentation Go de Microsoft, il hérite donc d'une conception et de tests existants. Il vérifie les types dans votre application et alimente les diagnostics de l'éditeur. Mercredi a apporté le port de Theo et un Haiku moins cher. Le conseil d'Hacker News d'aujourd'hui a mis en lumière un recensement des mainteneurs. Le thème est le code abondant, la propriété rare.
0:43 Theo dit que des mois de tentatives avec OpenAI ont stagné autour de quatre-vingt-quatre pour cent
Que signifie réellement la facture des jetons ?
0:47 de compatibilité. Son graphique évalue leurs jetons à plus de quatre cent mille dollars aux prix des API. C'est une utilisation évaluée aux prix catalogue. La facture imaginaire écrit pratiquement son propre titre. Il dit qu'Opus cinq virgule cinq a remplacé cette précédente tentative Rust et a produit une première version fonctionnelle en dix heures. L'exécution finale a duré deux semaines, avec environ vingt-quatre mille dollars d'utilisation équivalente à l'API via ses abonnements Claude.
1:11 Recommencer signifie remplacer le port infructueux. Les algorithmes de compilation et le corpus de tests de Microsoft étaient déjà là. C'est un terrain inhabituellement favorable pour un agent, car l'implémentation originale peut continuer à lui dire exactement où il se trompe. Ensuite, le "readme" trace une ligne de pente. Tout ce qui est en dessous a été écrit par des agents. Le projet rapporte plus de cent quatre-vingt mille tests portés passants, avec sa propre étiquette d'attribution.
1:34 Première question répondue. Les agents ont produit un port avec un oracle en amont. La question de la maintenance commence là où la conversion se termine, et une suite de tests verte a une date.
Quand l'accélération par douze est-elle vraie ?
1:43 L'accélération spectaculaire est de douze fois et demie plus rapide sur T3 Code avec les diagnostics Effect, par rapport à l'ancien compilateur JavaScript plus son plugin. La comparaison avec le compilateur Go plus Effect est près de deux fois plus rapide. Supprimez Effect, et Bun remporte le tableau du même projet. Le cheval gagnant change avec la course. L'ancien plugin Effect signale également des erreurs différentes, donc le chronomètre s'accompagne d'une note de bas de page sémantique.
2:05 Ce sont les mesures du projet sur un M4 Pro, utilisant cinq exécutions chronométrées après un échauffement. Ses binaires de prévisualisation manquent également d'optimisations utilisées pour la construction mesurée. Placez les paramètres de la machine et de la construction à côté du multiplicateur avant de l'emprunter pour votre présentation commerciale. Le README nomme une révision de développement de septembre.
Qu'est-ce qui pourrait casser un remplacement direct ?
2:20 Le manifeste d'outillage étiquette toujours une épingle de juin comme actuelle, alors vérifiez le binaire que vous comparez. La dérive de version peut transformer une erreur supplémentaire en un exercice de migration. La version prend en charge Linux sur les machines compatibles Intel et les Mac avec puce Apple silicon. Les utilisateurs de Windows peuvent regarder le lancement à travers une fenêtre. La liste des problèmes connus inclut également des différences d'émission de monorepo et des constructions lisant des sorties de dépendances obsolètes lorsque des références sont manquantes. Je comparerais les diagnostics et exercerais les références de projet avant de changer une porte de publication. Gardez une longue session d'édition dans le plan de test.
2:49 Le README reconnaît une mémoire croissante pendant les modifications, ce que votre benchmark de dix secondes manquera poliment. L'angle de déploiement intéressant est WebAssembly. Le dépôt inclut un exemple de navigateur et un petit module avec vérification de type en mémoire. Cela pourrait rapprocher la vérification des utilisateurs, mais la construction de navigateur documentée est monocœur et manque du mode serveur de langage natif. Les économies de machine virtuelle dépendent de ce qu'une application déplace dans le navigateur. Une facture d'infrastructure nécessite une étude de charge de travail, même lorsque le compilateur a
3:15 un excellent goût en matière de langages de programmation.
Un Haiku moins cher signifie-t-il un travail moins cher ?
3:17 Pendant ce temps, Haiku cinq virgule cinq offre des jetons très bon marché, avec un seuil à retenir. Les invites allant jusqu'à cent mille jetons bénéficient du niveau le moins cher. Au-delà, les prix d'entrée et de sortie sont multipliés par cinq. La grande fenêtre de contexte contient une trappe de prix. Artificial Analysis trouve de fortes performances des petits modèles, mais à effort maximal, Haiku utilise environ trois fois plus de jetons de sortie que Luna par tâche de test d'intelligence.
3:40 Les jetons bon marché peuvent toujours arriver en grandes quantités. Leurs chiffres de coût provisoires excluent également cette étape de prix des invites longues. Sur Terminal Bench, Artificial Analysis rapporte trente-trois pour cent, en dessous des environ trente-neuf pour cent d'Anthropic. Différentes configurations d'évaluation donnent des mesures différentes. Choisissez un réglage d'effort en tenant compte de la réussite de votre tâche et de la latence, puis calculez la facture à partir de l'utilisation réelle.
Qui maintient déjà nos dépendances en vie ?
4:01 Et le recensement des mainteneurs sur Hacker News a compté les contributeurs réguliers sur vingt-trois projets d'infrastructure. Près de la moitié n'en avait qu'un ou deux. Sa définition exige dix commits par an, elle capture donc la concentration des contributions tout en manquant une partie du travail de révision et de support. Le rapport attribue la plupart des récents changements de la base de données des fuseaux horaires à Paul Eggert. Les notes de version officielles expliquent pourquoi cela continue de bouger. Les gouvernements changent les horloges, et quelqu'un traduit cela en logiciel avant que
4:25 le calendrier de tout le monde n'ait une opinion. Cela répond à notre question ouverte.
Qui est responsable de la prochaine mise à jour en amont ?
4:28 Quelqu'un doit encore suivre les changements en amont, reproduire les échecs et maintenir la promesse de compatibilité du port. Les agents ont hérité d'années de décisions humaines. J'apprécierais encore plus l'expérience avec un plan visible pour savoir qui est responsable de la prochaine mise à jour. Si vous préférez lire ceci plutôt que de m'entendre le dire, le "diff" arrive dans votre boîte de réception chaque matin, gratuitement sur "the daily diff dot dev", lien ci-dessous. Donc, le verdict d'aujourd'hui est "NEEDS REVIEW" (NÉCESSITE UN EXAMEN).
Pourquoi mon verdict est-il "NEEDS REVIEW" ?
4:50 Je le testerais en parallèle du vérificateur existant. Cela répond à la question deux. Les gains de charge de travail sont prometteurs, et la correction de version et la maintenance décident de sa place dans le pipeline de publication. Et c'est le "diff" pour aujourd'hui. Je suis Niko d'Axrisi. Fusionnez de manière responsable.
Sources
- tsc-rs announcement and attached token-price chartTheo Browne on X
- ts-rust README, benchmarks and known problemsPing Labs on GitHub
- T3 Code benchmark harnessPing Labs on GitHub
- Upstream development pin manifestPing Labs on GitHub
- WebAssembly build documentation and limitationsPing Labs on GitHub
- Introducing Claude Haiku 5.5Anthropic
- Haiku 5.5 announcement videoClaude on X
- Claude Haiku 5.5 independent evaluationArtificial Analysis
- The people holding up the internetsheets.works
- Time zone database release notesIANA



