Architecture Podcast Summaries
Architecture on Yedapo: 4 summarized podcast and YouTube episodes. Each includes key takeaways, core concepts and notable quotes with timestamps.

Chrome veut désorganiser l'HTML !
Grafikart.fr
Jun 12, 2026
Chrome expérimente une nouvelle approche pour charger l'HTML dans le désordre, permettant d'afficher une page progressivement même si certains contenus sont lents à générer. Grâce à des balises marqueurs et des templates, le navigateur peut injecter des éléments dynamiques de manière asynchrone, optimisant ainsi l'expérience utilisateur sans alourdir la logique côté client.
Key insight: Le système permet de simuler une navigation de type SPA nativement en injectant uniquement des morceaux de templates HTML via le flux de réponse du serveur, sans JavaScript complexe.

Comment ChatGPT tourne sur UN SEUL serveur de base de données ??
cocadmin
Apr 17, 2026
Face à une croissance fulgurante, OpenAI a dû optimiser drastiquement son architecture PostgreSQL au lieu de tenter un sharding complexe. En minimisant les écritures, en cascadeant la réplication et en isolant les tâches, ils parviennent à servir des centaines de millions d'utilisateurs sans sacrifier la stabilité du système.
Key insight: OpenAI interdit tout changement de schéma de base de données dépassant 5 secondes et privilégie des migrations en plusieurs étapes sur plusieurs jours pour éviter de corrompre les données via le mécanisme MVCC de Postgres.

Byte Latent Transformer: Patches Scale Better Than Tokens (Paper Explained)
Yannic Kilcher
Dec 24, 2024
The Bite Latent Transformer (BLT) replaces static, vocabulary-based tokenization with dynamic, entropy-based 'patches.' By grouping bytes into variable-length segments, the model achieves superior scaling efficiency and handles out-of-vocabulary data more effectively than traditional LLMs like Llama, while maintaining competitive performance on standard benchmarks.
Key insight: BLT models achieve similar training scaling trends to Llama 3 using average patch sizes of 6 to 8 bytes, compared to the 4.4-byte average token size of traditional BPE-based models.

Архитектура CQRS
Программирование - это просто
Mar 23, 2020
Ярослав объясняет применение паттернов CQS и CQRS для разделения логики чтения и записи. Основная идея заключается в оптимизации производительности системы через разные подходы к обработке команд и запросов, включая использование пайплайнов и событий для поддержания целостности данных.
Key insight: Большинство систем читают данные значительно чаще, чем записывают, что делает разделение этих двух операций ключевым фактором для оптимизации производительности.