Kimi K3 obté 62/80 a KingBench: és realment millor que Fable 5?
Kimi K3 queda tercer al benchmark d’AICodeKing, però destaca en una tasca agentiva de llarga durada. Analitzem els vuit exercicis, el patrocini i els límits de la prova.
Tema
Resums de vídeos per entendre millor aquest tema.
Kimi K3 queda tercer al benchmark d’AICodeKing, però destaca en una tasca agentiva de llarga durada. Analitzem els vuit exercicis, el patrocini i els límits de la prova.
Kimi K3 combina 2,8 bilions de paràmetres, visió nativa i un context d’un milió de tokens. Les proves de Bijan Bowen mostren resultats espectaculars en jocs, webs i impressió 3D, però també una latència i una tendència a sobrepensar que pesen en l’experiència.
Kimi K3 destaca per preu i prototips visuals, però no “humilia” tots els rivals: Fable 5 no s’ha cancel·lat i el retard de Gemini afecta la versió Pro.
Kimi K3 promet pesos oberts, un milió de tokens de context i 2,8 bilions de paràmetres. Resumim l’arquitectura, els benchmarks i els límits reals.
Kimi K3 s’acosta als models tancats en codi i agents. Analitzem els benchmarks, les demos de midudev, la lentitud, els límits i el valor real dels pesos oberts.
Kimi K3 activa només 16 de 896 experts per token. Expliquem Stable LatentMoE, Kimi Delta Attention, Attention Residuals i els colls d’ampolla reals.
Kimi K3 té 2,8 bilions de paràmetres i un milió de tokens de context. Analitzem els benchmarks, dues proves de codi, el preu i els límits reals.