Intel·ligència artificial Programació Codex OpenAI benchmarks GPT‑5.6 frontend

GPT‑5.6 Sol, Terra i Luna a prova: més preu no sempre guanya

Midudev compara Sol, Terra i Luna amb dues interfícies reals. Luna sorprèn en qualitat-preu, Sol afegeix detall i Terra no sempre justifica la posició intermèdia.

GPT‑5.6 arriba en tres nivells: Sol és el model insígnia, Terra busca l’equilibri i Luna prioritza velocitat i preu. Midudev els compara amb els mateixos encàrrecs de frontend per veure una cosa que els benchmarks no expliquen del tot: quant triga cada resposta, quant costa i si el resultat realment funciona.

La prova no troba un guanyador universal. Sol tendeix a afegir més detall, Luna resol tasques senzilles amb una diferència de cost enorme i Terra ofereix en alguns casos la composició visual preferida pel creador. La configuració d’esforç i l’entorn d’agent resulten tan importants com el nom del model.

1. Tres models i tres preus

A 00:00, Midudev presenta la família i consulta l’anunci oficial. Els preus de l’API per milió de tokens són:

  • Luna: 1 dòlar d’entrada i 6 de sortida;
  • Terra: 2,50 dòlars d’entrada i 15 de sortida;
  • Sol: 5 dòlars d’entrada i 30 de sortida.

OpenAI descriu Luna com el més ràpid i econòmic, Terra com l’opció equilibrada i Sol com el més capaç. Els tres permeten ajustar l’esforç de raonament. Un nivell superior pot millorar el resultat, però consumeix més tokens i augmenta la latència.

El vídeo també detecta una distinció entre mode de raonament estàndard o Pro i nivell d’esforç. Com que les taules no sempre indiquen totes dues configuracions, Midudev manté els valors per defecte en la primera ronda. És una precaució important: comparar models amb configuracions diferents pot convertir una taula aparentment exacta en una comparació injusta.

2. IsBetter.ai: la mateixa tasca, costat per costat

A 05:16, el creador utilitza una eina pròpia anomenada IsBetter.ai. Executa diversos models en paral·lel, mostra el text mentre es genera i calcula temps, tokens per segon i cost estimat.

L’aplicació funciona localment, encara que les peticions vagin a les API configurades per l’usuari. També pot amagar el nom de cada model per fer una prova cega. En el vídeo aquesta opció es desactiva perquè l’objectiu és seguir el comportament de Luna, Terra i Sol en temps real.

El mètode és millor que mirar només una captura final: mesura velocitat i preu i permet clicar la interfície. Tot i això, cada prompt s’executa una sola vegada. Els models són probabilístics, de manera que una segona execució podria canviar el disseny, els errors i fins i tot l’ordre dels guanyadors.

3. Primera prova: una pàgina de preus

La batalla de la landing page comença a 05:58. Luna acaba en uns 32 segons i Terra en uns 38; Sol necessita molt més temps. La diferència de cost també és gran: Sol s’acosta a deu vegades el cost de Luna i gairebé triplica Terra en aquella execució.

Visualment, els tres resultats s’assemblen. Luna comet petits errors d’alineació; Terra produeix un logotip menys coherent; Sol incorpora transparències, jerarquia i detalls que fan la pàgina una mica més professional. La millora existeix, però és menor que la diferència de temps i preu.

Aquesta prova resumeix bé el dilema. Si la interfície només és una primera maqueta, Luna pot ser suficient. Si es necessita un resultat presentable amb menys iteracions manuals, el sobrecost de Sol pot compensar. També es podria executar Luna diverses vegades i triar la millor mostra per menys diners que una única resposta de Sol.

4. Segona prova: un reproductor de música

A 11:20, els models han de crear un reproductor. Luna torna a ser el més ràpid i barat. El seu disseny és el més simple, però els controls canvien de cançó, permeten favorits i reprodueixen un so.

Terra genera la composició visual que més agrada a Midudev, amb colors i espai més equilibrats. En canvi, el botó principal no reprodueix música, un error funcional important. Sol crea àudio, navegació, favorits, reordenació i més comportaments no demanats, però el creador prefereix l’aspecte de Terra.

La prova mostra per què “millor codi” no és una sola mètrica:

  • una web pot ser bonica però no funcionar;
  • més funcions poden afegir valor o complexitat innecessària;
  • una preferència estètica no equival a qualitat de codi;
  • cal revisar accessibilitat, responsive, errors i mantenibilitat, aspectes que el vídeo no audita.

En un projecte real convindria separar criteris i puntuar-los abans: funcionament, fidelitat al briefing, disseny, rendiment, accessibilitat, cost i temps.

5. Què diuen els benchmarks independents

El bloc de dades comença a 15:49. Artificial Analysis situa GPT‑5.6 Sol amb esforç màxim al voltant dels 59 punts del seu Intelligence Index, gairebé empatat amb Claude Fable 5. Terra queda prop dels 55 i Luna dels 51.

La dada més rellevant és el cost per tasca. Artificial Analysis calcula que Sol ofereix un nivell pròxim a Fable per aproximadament un terç del cost; Terra i Luna redueixen encara més la factura. OpenAI publica conclusions semblants i, alhora, detalla que els resultats depenen de l’arnès: Codex per als models GPT i altres entorns per als rivals en algunes proves.

Midudev observa una zona estranya en la corba qualitat-preu. Luna amb esforç màxim pot assolir una puntuació similar a diversos nivells de Terra per menys diners; quan cal més capacitat, alguns nivells de Sol poden donar més intel·ligència que Terra per un cost comparable.

No significa que Terra sigui inútil. Les mitjanes d’un benchmark no capturen latència, límits de servei ni el rendiment en una base de codi concreta. Sí que suggereixen provar Luna Max i Sol High abans d’adoptar Terra per defecte.

6. Sol Ultra dins de Codex

A 22:10, el creador repeteix l’encàrrec del reproductor amb Sol en esforç Ultra dins de Codex. Ja no és una simple crida que retorna HTML: l’agent pot crear fitxers, executar el projecte, obrir el navegador, inspeccionar el resultat i iterar.

El procés dura gairebé 50 minuts i genera més de 2.000 línies, imatges de discs i pistes d’àudio. La web és més completa i funcional, però encara conté decisions visuals discutibles. Midudev admet que l’execució consumeix una part important de la seva quota.

No és correcte comparar directament aquests 50 minuts amb els segons de l’API. Són dos productes diferents: una resposta única davant d’un agent que usa eines i es revisa. La lliçó és decidir abans si la tasca necessita una maqueta, una implementació curta o un agent autònom.

Conclusions

La recomanació del vídeo és clara: Luna amb esforç alt o màxim ofereix una relació qualitat-preu excel·lent per a feina quotidiana; Sol en nivell alt és preferible quan el detall i la dificultat justifiquen més cost. Ultra queda per a encàrrecs excepcionals on el temps i la quota no siguin el factor principal.

Terra queda en terra de ningú en aquestes proves, però la mostra és massa petita per descartar-lo. La millor decisió és executar unes quantes tasques representatives del propi projecte i mesurar-les. GPT‑5.6 no elimina el compromís entre qualitat, velocitat i cost; el converteix en una elecció més ajustable.

Contrast i context

Fonts consultades

3 fonts
  1. 01
  2. 02
  3. 03

Font de treball

Transcripció amb marques de temps

10 fragments
Consulta la transcripció
  1. 0:00 , obre el vídeo en una pestanya nova

    O Penellay acaba de lanzar 3 modelos nuevos, GPS5.6, Sol, Terra y Luna, Sol es el modelo más potente, Terra, el que está y en medio, Y Luna, el más rápido y barato. Pero cuál debería suzar, ¿Cuál es el que temerése la pena? ¿Qué diferencias hay entre cada uno? Y cómo se comparan? Con opus, 4.8 y fey bol 5. No vamos a fiarnos de benchmarks. Vamos a ponerlos, A prueba, Utilizando una herramienta nueva que he creado, Que se llama IsBetter.ai. Y vamos a ver, cuál programa mejor, cuál de mejores resultados, cuál va más rápido y cuánto cuesta. Así que vamos a ello. Este es el bloco oficial de la anunció de GPS 5.6 inteligencia de Vanguardia que crece con tu ambición. Muy bonita la página con estos planetas, hechos de 5.6 por todos los sitios. Tenemos el sol, la tierra y la luna. Y bueno, ¿qué es lo que comentan este artículo? No te lo voy a leer entero, no te preocupes, obviamente cuando vemos los benchmarks ya no sorprenden dos cosas lo primero que en una comparación con GPT 5.5 el modelo anterior que es este que tenemos aquí de color rósita claramente los tres modelos tanto GPT 5.6 sol, luna como terra, los tres están por encima dependiendo de el esfuerzo de inteligencia que le estamos poniendo pero por ejemplo fíjate que el de terra, que sería el más normalito, el equilibrado, ya fácilmente cuando se encuentra aquí, este sería el nivel de esfuerzo alto, ya estaría al nivel de el super alto de GPT 5.5 y el coste de la apiera 600 dólares, cuando ahora el de terra serían 264 dólares para la misma punto a ciano, la misma, exactamente, pero muy similar, así que ya que hemos que ha mejorado mucho en temas de costes para conseguir la misma inteligencia pero es que a partir de aquí incluso aquí tenemos el de Luna que

  2. 1:57 , obre el vídeo en una pestanya nova

    ahora os contaré una cosa muy interesante de lo que está viviendo pero el de Luna cuando ya le ponés el esfuerzo muy alto o incluso si lo ponés al máximo sigue siendo más barato que jebete 5.5 y es que además consigues hasta en esta punto hacia en concreto este benchmark hasta un 3% más luego veremos porque el el tema de los benchmarks, hay que estar un poco pillado por los pelos, pero al menos ya visualmente se ve eso, es solo primero, lo segundo que si lo comparamos con el que sería ahora mismo, pues la referencia que sería tanto faybol 5 como opus 4.8, fijade que aquí tendríamos opus 4.8, que sí, que es que se dispara o saco opus 4.8 en esta puntación en concreto, fijade que queda muy por debajo del res de la nueva familia de GPT 5.6 y aquí tendríamos fey bol 5 que en el nivel desforzo adaptativo que es el nivel del forzo que tiene en el que el define más o menos cómo se tiene que comportar o cómo se tiene que forzar, fíjate lo bajo que queda en esta puntación que ha dado la gente de opinión, luego ya os enseñaré otros veintimas más fiable, vale? Así que nada aquí podemos ver pues un montón de situaciones en las que te quiere dejar bastante claro que esto modelos son más eficientes y son igual de inteligentes según sus venchemas más inteligentes en las pruebas yo creo que queda por detrás de fey bol 5 a son menos capaces de fey bol 5 pero tampoco muy por detrás a un precio mucho menor ¿vale? Entonces para compararlo para poner los a prueba yo tengo una nueva herramienta que se llama isbetter.ai es una herramienta que funciona 100% en el local donde tú le puedes configurar tus ápics de OpenRouter, OpenAI, Anthropic, Google Gemini, XEI, DeepSig, Mistral, Incluso, también una ápica en local, si tienes o llama el Mestudio, UB, LLM, lo que sea, los puedes utilizar también. Esto no se envían ningún servidor, funciona solo en tu máquina, de hecho puedes ver como se hace las peticiones y aquí lo que voy a hacer es comparar los modelos de OpenAI. Gpt 5.6 tenemos el delula que aquí podemos ver los precios un dólar por millón de tokens de entrada y seis dólares por millón de tokens de salida. Este es el delula que sería el más pequeño y rápido. Luego tendríamos Gpt 5.6 terrar, que es el más equilibrado y tendríamos un precio de 2,5 dólares por millón de tokens de entrada, 15 dólares por millón de tokens de salida. Y finalmente tendríamos su modelo más capaz, el más inteligente que es sol, donde vemos que se duplica el precio de terra, cinco dólares por millón de toques de entrada, 30 dólares por millón de toques de salida. Como ves, no le voy a cambiar el esfuerzo de pensamiento y ojo porque hay una cosa que hay que tener en cuenta, y esto modelo tiene una cosita rara. es que tienen el modo de razonamiento que puede ser estandar y pro. A mí no me quiera muy claro cuando han hecho los venchimas si han utilizado el estandar o el pro.

  3. 5:01 , obre el vídeo en una pestanya nova

    Pero por defecto el que está utilizando es el estandar y se que el modo de razonamiento lo tienes que poner en pro para tareas difíciles que necesitan más trabajo del modelo y que pueden tolerar una latencia más alta y más uso de tokens. Esto es el modo, pero luego tienes el esfuerzo que ya ves que GPT 5.6 por defecto en todo lo modelo va a ser medium y en todo los modos ya tienes por un lado el esfuerzo de razonamiento que esto es lo típico de pequeño, medio, alto, muy alto y luego tendiamos el modo de razonamiento. Vale, os ha nivel de esfuerzo y modo que esto del modo, pues a mí no me suena, creo que es algo totalmente nuevo pero ya te digo que ningún sitio han explicado si los veintos van a lo está haciendo con estandar o compro, así que nosotros utilizamos el que está por defecto y ya está. En esta herramienta le podemos pasar el prompt que queramos, de hecho, aquí tienes, para probar con un pricing page, un analytics dashboard, cambambor, music player, yo voy a utilizar el pricing page para ver cómo se comporta y lo más interesante es que podríamos hacer una comparación a ciegas, podríamos compararlos tenemos de los, sin saber cuál es cada uno. En este caso como si que nos interesa saber exacta en te cuál es cuál, no lo voy a activar, pero lo digo por sientas a Ismetal.ai que sepas que puedes activar esto, más que nada para no tener prejuicios de ver los resultados y así decidir que modelos haciendo mejor su trabajo, ¿vale? Entonces, ahora que ya tenemos todo preparado, le voy a dar a RAN, VATEL y aquí ya empieza la batalla, tenemos el de Luna a la izquierda del todo, el de terras el primero que ha empezado a responder y el de sol a la derecha. Podemos ver aquí tanto el tiempo la velocidad, el precio estimado en tiempo real, los toques ens por segundo es normal que el de Luna, pues sea el más rápido, aunque ya ves que el de Terrava también muy rápido, en cambio sol, que es el modo de lo más avanzado, pues es el que va más lento, el que tiene menos toques por segundo, pero interesante es que estamos viendo en tiempo real, que es lo que está devolviendo cada uno de ellos. De hecho, Miraje P5-6 Luna ya ha terminado en 32 segundos con 91, Terra ha terminado en 38 segundos con 12 y ya podemos ver la diferencia de los precios, mientras que Luna ha costado la tarea 0,038,1 dólares en el caso de Terra ha sido 0,10 dólares y todavía sol, sigue funcionando, sigue escupiendo, ahora veremos el resultado para compararlo, mientras está terminando, pues te viene señando aquí, lo que va ocurriendo, fíjate que aquí tenemos el análisis de la batalla donde tenemos unos gráficos de cada uno, el verde es Luna, que es el primero que ha terminado y Luna podemos ver que aquí tendiamos el coste, que ha terminado el coste y luego ha seguido en el caso de terra que se la azul ha seguido un poquito más para la derecha y ha superado el precio que teniamos de Luna y como solto hayan terminado pues aquí sigue acumulando dinero de hecho fíjate que

  4. 7:55 , obre el vídeo en una pestanya nova

    sigue por aquí, sigue por aquí, tendríamos tanto cuántos tokens a hecho y aquí tenemos el precio mira, ahora el se ha dado caña y por eso ha pegado un poquito de su idón, fija de la diferencia, o sea, la diferencia en cuanto a terminado, Luna y Terra y Sol, que sigue funcionando que ya lleva casi 100 segundos, de la más de un minuto y medio, cuando en medio minuto han terminado los otros dos. Ahora veremos la diferencia, veremos lo que nos ha hecho cada uno de ellos, a veces realmente lo ha mirita y quiero que tú me dejes en los comentarios cuál es el que más te ha gustado así que nada voy a darle para adelante para que termine esto y lo vemos. Pues ya han terminado los tres y ya tenemos aquí la preview. Tengo el scroll el lanzado en los tres y oye, ¿qué quieres que te diga? Es que se parecen mucho. Así que algunos detalles que parecen ser que el de sol pues tienen un detalle un poquito mejor en alguna cosa pero es muy difícil de arste cuenta, por ejemplo, fíjate que seguramente ahora lo virá sigas, te los estás inventando, fíjate que aquí en el de Luna, en el caso del gros en este pricing, fíjate que aquí este dólar no está bien alineado con el precio, aquí tendríamos el billet mózgle que está alineado al centro cuando un realidad no queda aquí muy bien, en cambio aquí, pues sí que lo ha hecho perfecto, pero bueno, si te fijas en el deterra, pues yo creo que la hecho bastante bien, no sé, son detalles muy pequeños que no me parece que que a mi dirite la diferencia, pero vamos a verlo en grande, vale, este sería el de Luna que lo ha hecho en 30 segundos, mira que tienen incluso esto, Monceli, Gille, vale, aquí tendríamos la tabla, muy parecido los tres, salos tres, un muy parecido, este sería el deterra que podemos ver, bueno que más o menos también muy parecido me parece que tiene algún detalle mejor pero bueno es que este de luna por ejemplo me gusta el detalle que la posto aquí la posto un poquito más de contraste y aquí tendríamos el de sol que bueno sí que creo que se nota que está como mejor traidos a tener detalles que lo hacen como más profesional por ejemplo aquí pues me ha gustado mucho el detalle esto está transparente son detallitos son detallitos que están bastante bien por ejemplo ahora el logo. Este no está mal, el de North Star, que era justamente el de Luna, no está mal el logo, el peor logo, yo creo que es este de Flubes que ha hecho en terra se inventaba algo muy raro, en cambio este pues el logo encaja con lo de orbit, tiene bastante sentido, que yo que me dejes en los comentarios, yo creo que podemos estar adacuerdo que no ha me dita cada edad o mi nuto más, pero que si no te importa esperar pues obviamente si que

  5. 10:36 , obre el vídeo en una pestanya nova

    de todos los detalles que hace que hay mucho mejor. Luego claro, tema de precios. Fíjate que aquí ya tenemos los ganadores. Si miramos los ganadores, voy a hacer lo bastante más grande para que lo veamos bien. Fíjate los ganadores. Tenemos que luna sido el más rápido, ganado de la generación, ganado de la velocidad y ha sido el más barato, porque el coste que he tenido este ha sido una de 0,13. Luego te rá de 0 con 10 y sol ha sido hasta tres veces más caro, casi tres veces más caro, que terra, o sea, si ya hablamos de Luna ha sido 10 veces más caro, una diferencia importante, ya que puedo ver, como de rápido ha sido en este caso Luna y Terra, a la hora de terminar y la diferencia con sol que ha tardado bastante bastante más. Esto es un ejemplo, podríamos ponerle un ejemplo más, este le voy a tirar para adelante, pero voy a poner un music player, vale, y a ver como queda. Bueno, pues ya tenemos los resultados y fijate que el Luna ha sido de nuevo el mar rápido por un estrecho margen pero nos ha devuelto 183 esto que en por segundo y a un precio de 0,04 dólares. Este sería el resultado, bueno podemos ver los tres y yo creo ojo, ojo ojo, ojo porque me sorprende un poco, mira que si que cuando le das alplície que funciona, este no funciona, bueno vamos a vamos a ver, vamos a probar, vamos a verlo en grande, este sería de Luna que aquí se nota que es bastante flogete. O sea lo que es el diseño no está mal, pero sí que se ve un poquito flogete. Si le damos al play, fija que le ha puesto como hasta un sonido para que lo puedas probar, funciona, lo añadirá favoritos, podemos cambiar entre las diferentes canciones, le ha puesto un unhaimaje de álbum, bueno, no está mal, siempre ha inventado algún y bonito, este icono es muy raro, se lo ha inventado totalmente, Pero bueno, este sería el resultado que nos ha dado Luna. Lo teníamos el de Terra. Creo que está bastante mejor compuesto, creo que los colores y todo. Creo que está bastante mejor. Vamos a ver si funciona play. Vale, en este caso no, no absolutamente nada de música. También se ha inventado este icon aunque ya se parece un poco más al real, pero creo que en general lo que son los colores, es tan mejor. mejor, cambia también lo que serían las canciones, no ha hecho el resto de páginas normal, sí que funciona también lo del favorito, aunque no tenemos ningún tipo de feedback, simplemente funciona ya está, pero bueno, no está mal, mira, el de ir anterior, siguiente y ahora vamos con el de sol, pues, que raro, ¿eh? O sea, de verdad no sé, es que, Yo creo que me quedo con la eterna, este es el de la eterna y este es el de sol.

  6. 13:17 , obre el vídeo en una pestanya nova

    Vamos a verla. Bueno, como podéis ver, se ha inventado una canción para que al veo funcioné. Si que la posto esto, pero no tiene absolutamente nada que ver con la música, le podemos, nos podemos ir a siguiente. A cada uno, la posto en la canción diferente, bueno, no está mal en el detalle. Le podemos dar a favorito y lo guarda aquí. Se puede reordenar esto, que esto es una cosa pues que yo no le he pedido, pero bueno, se le ha inventado, también lo podemos quitar, o sea, tiene como más funcionalidad. También con el mix, me da la relación que se ha inventado el icono, o sea el icono no está bien del todo es como que esticono a este modelo le cuesta, pero bueno, general, si que parece que se le que tiene como más funcionalidades, pero me quedo visualmente más con el derra. A ver, esto es totalmente sujetivo, es un gran tal que me irá, pues a mí me gustaba hacerle una o el de sol. pero bueno es mi opinión creo que me ha gustado un poquito más este en este caso si que es verdad que al menos cambia los albumes la imagen esta que aquí no ocurre que me parece un error aunque entiendo que esto sería más bien el album y estas imágenes metas a ver lo que son claro es lo que digo me da la sensación que este tiene menos funcionalidades y a este le ha puesto toda la funcionalidad es que a podido mira no me gusta mucho este salto que da cuando aquí por ejemplo no ocurre que cambia sin cada uno, también verdad que ocupa exacto entre lo mismo. Bueno, no sé, crez que lo amerita porque en este caso podemos ver aquí lo que nos ha costado cada uno. El de Luna, solo ha costado 0,0,4, el de terra ha costado 0, 11 y el de sol ha costado 0,37. Ojo porque es una diferencia bastante importante, estamos hablando de casi 3,5 veces más que el de terra casi 10 veces más menos que zar 9 veces más que el de Luna 9 veces más pero es 9 veces mejor y ya tenemos luego el tiempo es verdad que ha tardado al principio en contestar, fijate que la apia ha empezado a contestar aquí o sea cuando anterme a los todos es que han empezado a contestar la api esto puede ser más una especie del límite de la tasa de la ápidio P&EI que no que sea algo que realmente ocurra, no, pero bueno, fijaros lo que ha tardado aquí y cuanto ha costado y aquí es que ha tardado en total el de sol 228 segundos. Si le quitamos los cuarenta segundos más o menos ha tardado en darme el primer token, pues sería aún así 3 minutos. Ha tardado 3 minutos en crear este. su suave mis sensación sobre todo con el de Sol y aquí es donde vienen ya mi recomendación es que te voy a dar de cuando utilizar cada uno de los modelos.

  7. 15:57 , obre el vídeo en una pestanya nova

    Es cierto que GPT5.6 Sol se acerca a fey vol 5. Fijate que en el índice de análisis de inteligencia artificial de esta página que para mí es la mejor en su trabajo. y que al final lo que hace es diferentes benchmarks para determinar donde se encuentra cada modelo, fíjate que el pensamiento de GPT5.6 sol es en max, no en el medio que sería por defecto el medio. Es en max. Luego tendríamos el lettera en max, entonces el de sol mi sensación que si lo pone ese medio pierde mucho, ya no vale tanto la pena, ¿vale? Y ahora lo probaremos en max para que veas bastante la diferencia, ¿vale? Entonces, tendríamos el feo y volcón 60, 59, GPS 5.6, sol, en max, luego, opos 4.8, max y luego 5.6, terra, max, también. Y donde esta Luna, pues Luna se queda por detrás de Sonet 5, también en max, ambos en max con un 51. ¿Qué hay de interesante en todo esto? Como te digo, muchas veces nos etretas simplemente de utilizar modelos, sino que también te salga a cuenta. Y eso lo podemos ver aquí con el coste por cada una de las tareas, es que los de anthropic todos son mucho más caros que los modelos de GPT 5.6. O sea, es verdad que son un poquito más inteligentes. Según este benchmark, pero en cambio, puedes salir hasta 3 veces más, o sea, GPT 5.6 sol max, que solo tiene un punto menos que feybol, es casi una tercera parte, porque te ha costado un dólar la tarea cuando en FV5 ha costado 275. Para que veamos mejor la diferencia, lo tenemos aquí, ¿vale? Esto es el coste de ejecutar todo el benchmark de artificial análisis intelligence index. Y fíjate que ha costado FV5, todo los benchmark 5.600 dólares en cambio. GP5.6 sold Max ha costado la mitad 2.824, que es muy parecido a lo que hubiera costado con GPT 5.5x-hy, y fíjate que la diferencia aquí de estos dos, el precio es el mismo, pero en cambio podemos ver que la diferencia de inteligencia entre GPT 5.6 y GPT 5.5x-hy es de 4. o sea, habido una su vida inteligencia, pero el coste es casi que el mismo. Luego otra cosa interesante la podamos ver aquí. Ya no hay tanto comparando con anthropic sino cuál es el mejor modelo que puede ejecutar de GPS5.6. Pues fíjate, aquí tenemos un cuadrante muy interesante

  8. 18:37 , obre el vídeo en una pestanya nova

    donde tendíamos en verde el cuadrante más atractivo. ¿Sabe eso son los modelos más atractivos? ¿Por qué? Porque son los que te dan el coste portaria más bajo al mejor índice de inteligencia según este benchmark y que te encuentras aquí, pues te encuentras que GPT 5.6, Luna Max tiene un coste portaria de 0.21 pero te ha dado una inteligencia de 51.2, en cambio ya si vamos a GPT 5.6 terramax, ya te ha dado el doble de coste, por solo 4.2 más de inteligencia, o sea más del doble de coste. ¿Qué significa esto? Pues que el modelo de Luna Max se encuentra en la mejor calidad precio de los nuevos modelos, puedes conseguir con el Luna Max una calidad inteligencia muy parecida al de Terra Max por la mitad del precio. Lo cual lo hace muy pero que muy interesante. En cambio, ¿qué pasa aquí? ¿Qué tenemos? El de GPT 5.6 Terra Max que aquí si queremos un salto brutal porque para conseguir otros cuatro puntos más tienes que volver a doblar el precio. Fueja de el de Terra Max todavía sin interesante, pero ya si te vas al le sol, como que si te empiegas de ser bastante más claro, claro el de fey bol 5 para una inteligencia muy parecida a la le sol, pues fio jt es 1, como 75 dólares más y solo está conseguiendo 1.20 inteligencia. En esta imagen se puede ver mejor la comparativa entre los propios modelos de jpt para que te des cuenta que fija de que para una inteligencia de terra x-high utilizando luna max ya lo tienes, no se ha no vale la pena, no vale la pena en ningún momento utilizar, terra log, terra medium, terra high, terra x high, no vale la pena, son modelos que siempre te va a leer la pena utilizar luna max, por qué? Porque te da un coste por tarea más barato y encima consigues el mismo índice de inteligencia y lo mismo podría pasar si nos ponemos aquí a mirar en el tema de sol y terra y es que no vale la pena, en ningún caso utilizar terra x high, porque por un poquito menos de ese precio ya tienes la inteligente de solos, no sé cómo lo ve, pero me da la sensación que el modelo de terra no vale la pena, sea que da un poco en tierra de nadie, nunca mejor dicho, en terra de nadie, porque fijados que el de sol está un poquito a la izquierda pero estaba bastante más arriba de terra x high O sea, en mar barato, pero más inteligente. Lo mismo te pasa con sol high, siempre vas a preferir el sol high que no el terramaxca, una vez que ya llegas aquí, si que es verdad que se te va aquí un poco el precio, se te va bastante aderecha, pero terrar ya no llega en ningún momento con su inteligencia. O sea, ¿Cuál es mi sensación? Mi sensación es utiliza, pues, como para las tareas macotidianas, que no necesitas tanto, pues utiliza en luna, en razonamiento Max y luego cuando ya quieres ese extra empieza en sol, medium, sol, high, sol, x, high porque siempre van a ser más baratos que el derra y eso es lo que me sorprende es

  9. 21:50 , obre el vídeo en una pestanya nova

    que creo que el modelo de derra no está bien calibrado, también es verdad que eso es cosa de este benchmark, o sea esto es un benchmark al final, pues son un montón de pruebas que le hacen y dicen esto pero en mis propias pruebas y un poco por lo que habéis visto Así que me da esa sensación que el de Terra se quedan poco ahí en medio cuando el de luna, sobre todo cuando le sube mucho el razonamiento, ya es bastante capaz. Y si quieres ese extra con ese detalle ya normalmente el de sol te va a venir perfectamente. Vale, como se he dicho, vamos a poner a prueba sol 5.6 en muy alto fija de que se le das aquí. En esfuerzo tiene mínimo medio alto, muy alto y ultra, vale. Pues le vamos a poner en ultra que es el máximo, no hay más. Y le vamos a decir exactamente lo mismo, le voy a decir eso sí. Develop, it, guiz, hdml, css, anjadas, para asegurarme porque es una vez a saber lo que crea. Lidamos al enter, esto es lo máximo que podemos hacer. Con GPT-5.6 sol, y vamos a ver la diferencia. Obviamente, con Codex, va a funcionar mucho mejor que llamando directamente a la AP. Porque va a poder llamar herramientas, va a estar controlado, el Arnés, del propio Codex, que seguramente está preparado para sacar lo mejor del modelo, así que tendría que tener un resultado mucho, pero que mucho mejor. Vamos a ver cuánto tarda ahora te lo comentaré cuando termine, no podemos ver cuántos toques, sol con su molcozte, pero al menos si que veremos un poco cómo funciona cuánto tarda y el resultado. Bueno pues ya terminado y atardado 49 minutos con 56 segundos, si no en ninguna envenciones que ha creado las si magenes de cada uno de los álbumes luego si que has escrito pues unas dos mil líneas dos mil trescientas juventud ocho líneas de código vamos a ver el resultado a ver qué tal para eso vamos a ejecutar este pison en el puerto 41 73 así que lo carjos 41 73 este es el resultado de estos 50 minutos no quiero decir que siempre tardes 50 minutos pero pero puede ser que solo por el hecho de generar imágenes está revisando con el navegador y tal, ya sabes que esto se pone en un bucle y quizás le ha costado bastante, pero eso lo que pone igual a a mi se ha congelado en un tiempo, estas cosas pasan, este es el resultado, podemos hacer like por lo que veo le podemos dar play y fijate que ha generado los audios, las canciones, bueno, el cada uno, ya ya puesto no diferente, vale? le ha puesto cosas interesantes, por ejemplo, esto de mover, pues lo ha puesto no queda tan bien como antes, la verdad es que no queda tan bien lo mueve, pero lo mueve un poco regular

  10. 24:29 , obre el vídeo en una pestanya nova

    si lo da, le damos aquí si que se mueve, también podemos borrar, pero luego no sé como lo se puede recuperar vale, le ha puesto también te clas, le podemos dar la espacio, y se para, o le podemos dar a izquierda derecha, podemos darle al m, a la m Y se mutera, bueno, tiene detallitos, tiene detallitos. A ver si hacemos esto pequeño, pues bueno, también tiene el responsif que está bastante bien. No sé si a Merita los 50 minutos, es verdad que han quedado muy bien las portadas de los álbumes. Está muy bonitas, se verdad que ha generado las muziquitas, pero bueno, 50 minutos, yo me he fundido ahí que a si toda mi suscripción lo sabe Dios, ¿eh? pero bueno, este es GPD 5.6 un modelo que sinceramente especialmente el modelo de Luna y el de Sol me parece muy interesante, yo creo que el de Sol, como máximo utilizando el Jai, yo creo que hace falta utilizar tanto el X-Hai, como el Max, yo creo que son no hacen falta, yo creo que en el nivel de Jai tiene ahí una calidad precio bastante buena, se nota bastante la calidad y en la inmensa mayoría de tus procesos, tus tareas, tus herramientas, va a ser más que suficiente y luego también tienes el de Luna, más que es, pues muy interesante porque da bastante inteligencia a un coste muy contenido. Así que espero que te ha gustado está comparación y que me dejes en los comentarios que te ha parecido a ti. Que yo sé que muchas veces os ponen nervios o dando vuestra opinión como el paso de otro día que hice un chiste de Mimmo de los deía favoritos. Primero, jepe 5.6, segundo feibos 5, tercero cuarto, francia porque perdió con traspanya y francia va a quedar tercera o cuarta, lo siento que le han envapi. Y alguien, pues fija de Brad Sachs, dice, da pena ver como alguien tan ilustrado, piensa que jepe 5.6 es mejor que feibos ni se le acerca. Bueno, será frances. El tema es que yo sé que os ponéis muy nervioso dando vuestra opinión, porque los modelos parece que os definen como personas. a mí no me importa porque a veces me gusta mucho más opus ahora creo que GPT 5.6 en tema de coste calidad está siendo muy interesante. Así que si no está adacuerdo te puedes ir a tomar por comentar de forma sosa y gada y tranquila con tu opinión de cuál es tu modelo favorito si realmente te han gustado los de GPT 5.6 o sigues colos de Antropi. Muchas gracias por ver el vídeo deja tu like y suscríbete. Hasta luego, chao por cierto Antonio, no esto no es un vídeo patrocinado de Yo tenía hija la Samalman, me diése dinero, me ocupé ese con dinero, ojalá. Pero no, así que esta es mi voz de hacer videos, si no te gusta, tejo.