Kimi K3 per programar en 3D: gran model, comparació poc controlada
Kimi K3 crea prototips 3D convincents, però el vídeo compara tasques i configuracions diferents. Verifiquem rendiment, preus i riscos dels modes Auto i YOLO.
Tema
Resums de vídeos per entendre millor aquest tema.
Kimi K3 crea prototips 3D convincents, però el vídeo compara tasques i configuracions diferents. Verifiquem rendiment, preus i riscos dels modes Auto i YOLO.
Hy3 Preview afronta proves de codi, jocs 3D, simuladors, C++, roleplay i webs interactives dins d’un flux agentiu.
Bijan Bowen sotmet Claude Opus 4.8 a jocs, webs, animacions i simulacions 3D. Dos resultats són extraordinaris, però la resta mostren molta irregularitat.
Una explicació visual de GPT: tokenització, embeddings, autoatenció, múltiples caps, normalització, connexions residuals i entrenament.
Bijan Bowen prova Ornith 1.0 en versions de 9B i 35B amb webs, escenes 3D i correccions agentives. El 35B MoE crea els resultats més atractius, però tots dos deixen errors funcionals i la comparació utilitza maquinari i precisions diferents.
Brit Cruise construeix GrowBot, un petit bípede amb Raspberry Pi, càmera i dos servos. El projecte mostra tant el potencial dels models de llenguatge per planificar accions com el seu límit principal: pensar massa lentament per controlar el cos en temps real.
Bijan Bowen prova Bonsai 8B, un model basat en Qwen3 amb pesos d’un bit. És extraordinàriament petit i ràpid, però els tests de codi mostren una degradació clara: genera interfícies bàsiques i conversa, mentre falla en jocs amb lògica més complexa.
Bijan Bowen prova Tencent Hy3 amb un sistema operatiu al navegador, videojocs en C++ i 3D, una web de rellotges, un model de motor V8 i un problema real de Linux. El model sorprèn pel preu i la velocitat, però una confusió entre la llum del teclat i la pantalla exposa els riscos dels agents amb accés al sistema.
Kimi K3 queda tercer al benchmark d’AICodeKing, però destaca en una tasca agentiva de llarga durada. Analitzem els vuit exercicis, el patrocini i els límits de la prova.
DS4 comprimeix i executa DeepSeek V4 Flash en un MacBook de 128 GB. L’arquitectura MoE i la quantització selectiva ho fan possible, però el titular necessita matisos.
Un gateway pot connectar una eina de programació a models gratuïts, canviar de proveïdor quan s’esgota una quota i simplificar la configuració. Això no converteix Claude Code ni la inferència en gratuïts per sempre, i introdueix límits de qualitat, privacitat i confiança.
La versió 0.19 de Hermes Agent accelera l’execució, millora les tasques en segon pla, incorpora transcripcions dels subagents i reforça la gestió d’aprovacions i contrasenyes. El vídeo també explica quan convé un agent flexible i quan és millor programar un flux determinista.