«Graph engineering» per a agents d’IA: què és i què exagera el vídeo
Els grafs poden coordinar agents en paral·lel, però 100 agents no garanteixen qualitat ni baix cost. Verifiquem Claude Code, LangGraph i els càlculs.
Arxiu del canal
Els grafs poden coordinar agents en paral·lel, però 100 agents no garanteixen qualitat ni baix cost. Verifiquem Claude Code, LangGraph i els càlculs.
Els EUA lideren en xips i models, però la Xina construeix energia i transmissió més de pressa. Comparem xarxa, centres de dades i límits d'aquesta tesi.
Huawei proposa la llei Tau i LogicFolding per guanyar densitat i rendiment sense fabricar encara en un node real d'1,4 nm. Això és el que significa.
Anthropic ha contractat tota la capacitat de Colossus 1, més de 300 MW i 220.000 GPU. Caleb Writes Code analitza què canvia per a Claude i què revela sobre la cursa d’infraestructura de la IA.
Caleb Writes Code explica l’evolució de la prompt engineering a la harness engineering: bucles, eines, context i controls que converteixen un LLM en agent.
Nemotron 3 combina Mamba-2, atenció, LatentMoE i predicció de diversos tokens per adaptar Nano, Super i Ultra a diferents GPU.
Una explicació visual de GPT: tokenització, embeddings, autoatenció, múltiples caps, normalització, connexions residuals i entrenament.
Fable 5 torna després de la suspensió: analitzem el nou filtre de seguretat, els falsos positius i una prova pràctica amb subagents.
Grok 4.5 promet codi, agents i documents amb una API de 2/6 dòlars. Contrastem la prova del vídeo amb les especificacions oficials.
Caleb Writes Code analitza per què OpenAI ofereix GPT‑5.6 Sol amb una via de baixa latència sobre Cerebras. La velocitat és real, però el vídeo barreja dades oficials amb estimacions no publicades i calcula el retorn sobre un acord que les declaracions de Cerebras valoren en més de 20.000 milions de dòlars, no en 10.000 milions.
Kimi K3 redueix la distància amb els models propietaris. Analitzem què implica per als preus, la infraestructura, la transparència i la cursa global de la IA.
Kimi K3 activa només 16 de 896 experts per token. Expliquem Stable LatentMoE, Kimi Delta Attention, Attention Residuals i els colls d’ampolla reals.