Intel·ligència artificial Programació Claude Anthropic API

Claude Opus 5 costa la meitat que Fable 5: què millora i on encara perd

Claude Opus 5 manté el preu d’Opus 4.8 i s’acosta a Fable 5 en programació, automatització i ús d’ordinador. Repassem resultats, límits i canvis de l’API.

Anthropic ha llançat Claude Opus 5 amb una proposta diferent de la cursa habitual pel model absolutament més potent: acostar-se al rendiment de Claude Fable 5, però reduint el preu a la meitat i millorant molt l’eficiència respecte d’Opus 4.8.

El vídeo de Benjamín Cordero repassa les gràfiques del llançament, explica què mesura cada prova i evita una conclusió massa fàcil: Opus 5 guanya moltes comparacions de cost i rendiment, però no supera Fable 5 en totes les tasques ni converteix els benchmarks del fabricant en una garantia per a qualsevol empresa.

1. Preu d’Opus, rendiment pròxim a Fable

Claude Opus 5 costa 5 dòlars per milió de tokens d’entrada i 25 dòlars per milió de tokens de sortida. Són les mateixes tarifes base que Opus 4.8 i la meitat del preu anunciat per a Fable 5.

Anthropic el presenta com el nou model predeterminat per als subscriptors de Claude Max i el model més potent disponible a Claude Pro. També es pot utilitzar a Claude, Claude Code, Claude Cowork i l’API amb l’identificador claude-opus-5.

Hi ha un mode Fast que funciona aproximadament 2,5 vegades més de pressa, però costa el doble de la tarifa base. Per tant, “meitat de preu” només és cert quan es compara la modalitat estàndard amb Fable i no implica que tota tasca costi exactament la meitat: la longitud de la resposta, l’esforç i el nombre d’intents continuen determinant la factura.

2. El salt respecte d’Opus 4.8 és la notícia principal

En Frontier-Bench v0.1, una prova de programació agentiva amb problemes llargs, Anthropic afirma que Opus 5 supera tots els altres models i més que duplica el resultat d’Opus 4.8 amb un cost inferior per tasca.

El vídeo destaca una puntuació del 43,3% a la configuració comparada. Aquesta xifra no significa que resolgui el 43,3% de qualsevol projecte de programació. Correspon a un benchmark, un entorn d’agents i unes condicions concretes.

Anthropic explica a la nota metodològica que el seu Frontier-Bench es va executar amb mini-SWE-agent, infraestructura GKE i una mitjana de cinc intents per tasca. A més, les negatives del classificador de seguretat podien derivar-se a Opus 4.8. Són detalls importants quan es comparen percentatges.

3. CursorBench: gairebé Fable 5, però no sempre per davant

En CursorBench 3.2, Opus 5 amb esforç màxim queda a menys de mig punt percentual del màxim de Fable 5. Anthropic assegura que ho fa amb aproximadament la meitat de cost per tasca i que, als nivells high, xhigh i max, ofereix una relació entre resultat i cost superior.

Això és més útil que proclamar un guany absolut. Si un equip necessita l’últim mig punt en una tasca especialment difícil, Fable pot continuar sent justificable. Si executa centenars de correccions i revisions cada dia, una diferència petita de qualitat amb la meitat de cost pot afavorir Opus.

La comparació també mostra per què cal mirar les corbes senceres. Un model configurat amb poc esforç pot ser més ràpid i barat; el mateix model amb esforç màxim pot consumir molts més tokens per guanyar uns punts.

4. Automatització, ús d’ordinador i problemes nous

Anthropic atribueix a Opus 5 diversos resultats destacats:

  • a ARC-AGI 3, triplica la puntuació del següent model en problemes nous;
  • a Zapier AutomationBench, aconsegueix aproximadament 1,5 vegades la taxa d’èxit del següent model al mateix cost;
  • a OSWorld 2.0, supera el millor resultat de Fable 5 amb poc més d’un terç del cost;
  • en les avaluacions de ciències de la vida d’Anthropic, millora Opus 4.8 en tots els conjunts publicats;
  • produeix resultats visuals i interfícies més elaborats que les generacions anteriors.

Són senyals d’un model pensat per acabar fluxos llargs, utilitzar eines i verificar el que ha fet. No demostren que guanyi en una base de codi, una llengua o un procés empresarial concrets.

5. Els nivells d’esforç decideixen bona part del cost

Opus 5 permet ajustar l’esforç. La guia oficial recomana començar amb high, provar low o medium quan la qualitat es manté i reservar xhigh per a programació o treball agentiu exigent.

El vídeo insisteix encertadament que el preu per milió de tokens no és suficient per estimar el cost. Cal mesurar:

  • tokens d’entrada i de sortida;
  • nombre de crides i iteracions;
  • ús d’eines;
  • temps fins a un resultat acceptable;
  • percentatge de tasques que necessiten revisió humana;
  • repeticions causades per errors.

Un model més car per token pot ser més barat si resol el problema al primer intent. A l’inrevés, un model eficient en un benchmark pot sortir car si una aplicació el força a raonar sempre al màxim.

6. Un milió de tokens de context per defecte

La documentació d’Anthropic situa la finestra de context d’Opus 5 en un milió de tokens, tant com a valor predeterminat com a màxim. La guia afirma que manté millor les instruccions, les crides d’eines i el fil de raonament en contextos llargs.

Una finestra gran no obliga a omplir-la. Enviar centenars de milers de tokens augmenta cost, latència i soroll. Per a repositoris grans, convé combinar cerca, selecció de fitxers, memòria estructurada i avaluacions pròpies.

Anthropic també recomana donar-li l’especificació completa d’una feina complexa i deixar que avanci, perquè Opus 5 tendeix a completar implementacions llargues, revisar el seu treball i corregir errors. En edicions senzilles, la diferència respecte de models més petits és menor.

7. Les quatre derrotes importen més que un titular

Cordero assenyala que la taula no és una victòria total: hi ha cel·les en què Fable 5 o altres models continuen per davant. El detall exacte depèn del nivell d’esforç i de la prova, de manera que sumar “victòries” sense ponderar-les pot enganyar.

Les mancances més clares del mateix anunci oficial són:

  • Fable conserva un màxim lleugerament superior en algunes proves de programació;
  • Mythos 5 continua sent més fort en ciberseguretat ofensiva i en determinades tasques de biologia de risc;
  • el guany d’Opus disminueix en edicions de codi simples;
  • les dades publicades provenen principalment d’Anthropic o de socis d’accés anticipat.

La conclusió no és que Opus 5 sigui pitjor, sinó que “millor relació qualitat-preu” i “millor model en tot” són afirmacions diferents.

8. Salvaguardes i derivacions automàtiques

Anthropic diu que Opus 5 no avança la frontera en capacitats de doble ús arriscades. Encara així, pot trobar vulnerabilitats millor que Opus 4.8, i per això incorpora classificadors específics.

El model pot ajudar a localitzar errors en codi font, però bloqueja part de l’escaneig de binaris, proves de penetració i generació d’exploits. Anthropic estima que aquests classificadors intervenen un 85% menys que els de Fable 5. Quan una sol·licitud és marcada a Claude, Claude Code o Cowork, el sistema pot derivar-la a Opus 4.8.

Per a l’API, Anthropic estrena en beta els fallbacks automàtics. El desenvolupador pot autoritzar que una petició bloquejada a Opus 5 o Fable 5 s’enviï a un altre model en lloc de fallar. Això millora la continuïtat, però obliga a registrar quin model ha produït cada resposta.

9. Canviar eines a mitja conversa

La segona novetat de l’API permet modificar les eines disponibles durant una conversa sense invalidar la memòria cau del prompt. Un agent pot començar amb eines de lectura, rebre una autorització i incorporar després una eina d’escriptura, o retirar capacitats quan ja no són necessàries.

La funció continua en beta. Canviar eines no equival a canviar silenciosament permisos: l’aplicació ha de definir polítiques, aprovacions i registres d’auditoria.

10. Fable 5 no ha quedat obsolet

El titular del vídeo pregunta implícitament si Fable 5 “ha mort”. Les dades no sostenen una resposta absoluta. Fable continua sent el model de frontera d’Anthropic per als casos que valoren el màxim rendiment per sobre del preu.

Opus 5 ocupa una posició probablement més útil per al treball diari: revisió de codi, funcions de diversos fitxers, recerca, documents, ús d’ordinador i automatitzacions que s’executen moltes vegades.

L’elecció correcta requereix una prova amb tasques representatives. Un equip hauria de mesurar qualitat, latència, tokens, intervenció humana i cost total, no copiar la configuració que guanya una gràfica.

Conclusions principals

Claude Opus 5 és un salt important respecte d’Opus 4.8: manté el preu de 5 dòlars d’entrada i 25 de sortida per milió de tokens, amplia el context a un milió i millora programació agentiva, automatització, ús d’ordinador i verificació.

La seva gran força és acostar-se a Fable 5 amb aproximadament la meitat de preu base. Les limitacions també són reals: no guanya totes les proves, el cost depèn de l’esforç i bona part de l’evidència prové del fabricant.

Per a moltes empreses, la pregunta ja no serà “quin és el model més intel·ligent?”, sinó quin model completa cada flux amb prou qualitat, menys repeticions i el cost total més baix.

Contrast i context

Fonts consultades

6 fonts
  1. 01
  2. 02
  3. 03
  4. 04
  5. 05
  6. 06

Font de treball

Transcripció amb marques de temps

10 fragments
Consulta la transcripció
  1. 0:00 , obre el vídeo en una pestanya nova

    Ok, me equivoque. Yo dije que cuando saliera Cloud o Pucinco, iba a ser más o menos tan bueno como Fever, sin algo así como el hermano menor de Sente o el de todos los días, y acaba de salir o Pucinco y no es tan bueno como Fever, sinco es muchísimo mejor. Mejor de lo que esperábamos y le ganan en casi todos los benchmarks y lo más impactantes es que cuesta solamente la mitad. es realmente una brutalidad, estamos todos impactados y hay tres cosas de este lanzamiento que te van a cambiar el día a día. La primera y que nos sorpreendió a todos es que en codificación agéntica en terminal o pucinco saca 43% donde febros 5 saca 34 y o puc 4.8 sacada 21. O sea más del doble que su antecesor y le vea a lo mejor que hay ahora. Y también o sea acá en problemas nuevos, es exactamente que rinde si un modelo razonalgo, que nunca vio, saca también 3 veces, lo del segundo lugar, 3 veces. La segunda es la apladosa, 5 de hora es por millón de toques de entrada y 25 de salida. El JTK, 5 versos, 25 versos, 10 y 50 que era febo, literalmente, la mitad de lo que cuesta febo, se aman tuvieron los precios del cuadro.8. y además va a ser el modelo perfecto en CloudMax y el más potente disponible en Cloud. Pero, y la tercera y la que casi nadie va a comentar y para mí, una de las importantes es la esticiencia por Tarea. En el uso de computador o buss 5 supera al mejor resultado de Pable 5, gastando un poco más de un tercio. O incluso en la Tarea de negocio a K, o buss 5 en su nivel de esfuerzo más bajo que es este Daka, Un pletamás tareas que cualquier otro modelo en su nivel más alto. Y lo vamos a mostrar este gráfico en pantalla porque hay también la noticia R real. Y vamos ahora a revisar un poco más de la nusio oficial juntos ahora mismo lo que está haciendo la gente. Y para el final de estrellido vas a saber, primero, tratar de lo Pench Rocks, Tila por Fila, incluyendo las 4 casillas donde opos 5 pierdes, porque también pierdes de la Fuea mostrar tal cual, sin maquialos, segundo que podemos hacer con fey bol 5 a partir de hoy porque tengo una respuesta que es poco y como ha y te la voy a dar completa también, y tercero como podemos leer las curvas de nivel de esfuerzo que es donde de verdad se decide cuánto vas a estar pagando este mes y cuarto los cantados. cuánto menos te va a frenar que es fey bol, qué pasa cuando de frenar. Y también para los builders que es lo que pasa con las cosas nuevas de la app que si construyes agentes es algo que que es seguro te va a importar. Hoy, antes de comenzar, te agradeceríamos un montón si me dejas un like en este video tuve que correr de un evento por eso estoy con esta pinta formal como podrán ver

  2. 2:46 , obre el vídeo en una pestanya nova

    acá en el momento que recibió la notificación de que salió cloud o gusts. Si un colegido de lado, fina aquí a grabar y creo que eso se merece por lo veros un mil de like. Así que te agradeceríamos un montón si me lo dejas. Y además te empiezas a aparecer un poco más de contenido para si yo a este estilo. Vamos, Díon. Ok, ahora sí, antes de comenzar, bueno, esta es la página oficial, todos los links que voy a ver acá contigo, te lo voy a dejar también en la descripción del video. Y como podemos ver acá, esta es lanzando Obus 5, voy a por fin es práctico, voy a simplemente traducir esto que está acá, a veces me ha risa como la palabras y las traducciones que hace, pero por fin es el video, vamos a dejarlo en español. presentamos o buss cinco. Está súper, súper bueno. Fija de la frase también con la que abren acá porque una declaración completa de estrategia. Dicen esto es un modelo inteligente y proactivo que se acerca a la inteligencia artificial de Vanguard de Afebel 5 pero a la mitad de precio. Ese es completamente como una declaración de estrategia en este sentido y es como una aproximación que tienen para poder hacer que opus cinco, complete la familia completa de Cloud. Si, cosas como lo que se está buscando acá. Son el cinco, tendrasing como el caballo de batalla, por así decirlo, fei bolsincón, va a ser el techo, claro, o fue el techo, claro. Y opus cinco se sienta justo en el medio, no sé sentir. Eso es lo que el medio, ahora que va mucho más arriba, como vamos a ver en los benchmarks, mucho más arriba de lo que cualquier persona es prada. y esta es la línea que te toca también directo a ti. Es opus cinco está diseñado para usar sabíaario, funciona con mayor eficiencia que otros modelos y es el nuevo modelo pre determinado de CloudMax y el modelo más potente en CloudPro. O sea que si estás pagando pro, hoy día acabas de subir de techo. Sin pagar necesariamente un peso más, lo que está bastante bueno. Si es que hemos estatado, ¿la? Esto es lo que creo que realmente me sorprendió, que es acá, lo un pantallazo para poder jugar acá un poco más. Tengo el avicito de de de de de de en el avicito, sí, tengo el avicito. Y acá vas a encontrar cuatro con unas distintas. Tenemos a opus, tenemos a pebo, tenemos a opus, cuatro un tocho y tenemos el Jebet de 5.6. Sol, vamos a un a uno. Tenemos este primer benchmark, acá, que está super bueno, que es el ayantic terminal coding, que en español significa un benchmark que mide,

  3. 5:20 , obre el vídeo en una pestanya nova

    lo es capaz de terminar tareas reales de programación solo se ha desde el terminal sin que nadie lo vaya guiando paso a paso y fija de esta con 43 por ciento ahí sí está con 43 por ciento acá como podemos ver superando a fei bol 5 que quedó con 34 por ciento por así decirlo porque está tan ancho esto que lo cura y volvamos a ponerlo un poco más chico ahí, ahí sí, algún poco más normal. Entonces 43 versus 34, lo que es una... una great gigante gigante, o sea, está buenísimo, está buenísimo y dobló el opus anterior, porque el anterior estaba con 20, o sea, de 20, va a ser a 40, es realmente una brutalidad. Después pasamos a otra cifra que es la cifra del... no le chuelque que es este para metro acá, y aquí lo voy a hacer como trabajo un poco más de oficina, es como informe, entregables, profesionales, no sé, se compara como con lo que entrega, contra lo que, como lo que entrega este benchmark, contra lo que entregaría como un profesional del ruro. Y ya están los 100%ajes, sino que es con un score que sube a 1800 en este caso, versos 1.700, en la casa casi 100 puntos al feio del anterior, lo que está buenísimo, marcando un nuevo benchmark también aquí en la industria. superando también por bastante a sol lo que nos muestra que el final está buenísimo y cumplió un poco en la estrategia y la tesis que está teniendo. Después tenemos otro que está muy bueno que es un bench bar que no se había visto mucho antes que es el Nobel Problem Solving y este tuvo que buscarlo porque no es algo que conocía y me encantó y me encantó y de lo que habería y fue en español me dirá haciendo como una especie de hacer tijos que no existe en el internet o sea como hacer tijos como difíciles que no requieren como una lógica o que no se puede como replicar de por sí y no existe en ningún lugar para ver si te verás razón algo que nunca vio o solamente está memorizando lo que repite y lo que se me morizó en el entramento entonces es como muchas veces van encontrar que los modelos van a hacer como esta especie de trampa por así decirlo porque en su base de entrenamiento tienen como un razonamiento lógico ya entrenado. Esto permite como mitigar un poco ese sesgo de el entrenamiento y hacer lógica con entrenamiento que no existen vas a hacer tijos que no existen lo que está muy bueno. Ya aquí ya se empenió con un 30% versus otros modelos que está acá con un 1,5 o el GPT, es en como entonces sol que está con un 8% no es una mejora digamos como en contra fibril si contra opos y jb156 pero está bueno se nota que en las filas impresionantes de toda esta dada después tenemos el agent search que es como mi de qué tan capaz es de encontrar solo como ciertas cosas difíciles de encontrar en la web tiene un 90% ver su su 84 en el modelo anterior 90% también en fibril

  4. 8:26 , obre el vídeo en una pestanya nova

    en GbD516 sol y una mejora con fable, aquí está bastante presido al GbD. Después tenemos el multidisciplinari reasoning que vendría haciendo como el... Este uno que me encanta porque me dio como que tanto las personas o que también un modelo como que razona a nivel y comparándolo con un maestro de doctorado. Entonces, como alguien que tiene un doctorado en muchas áreas, les dicen el humanitislast exam y se mide con dos maneras. Se mide con el uso de herramientas que tendría siendo como el wist tools, o sea, que también puede usar las herramientas para resolver cosas y sin tools para que no se, para ver que también como es el modelo. Entonces, aquí al final con el uso de tools como que también mide un poco las capacidades agenticas que tienen. por eso se separan dos de acá y aquí, bueno, sin herramientas sigue ganando fey vol pero con herramientas que es mucho más real de lo que se hace realmente en un mundo real porque queremos resolver como podamos resolver las cosas, no interesa como el hiciste, solo quiero saber de resultado, si ganan opus ver sus los otros, que creo que es lo que realmente importa en este caso, verdad? Después en el uso del computador, acá, o el oswaltos.0 también gana con un 70%, y aquí como que se mide como que a el tenemos lo modelo en general y los computadores como que tienen dos maneras de ejecutar cosas, sin fuera por los computadores ejecutarían toda en el terminal, pero como diseñamos las interfaces también humanos pensando en humanos, no siempre vas a poder ejecutar todas las cosas a la terminal, por ende es importante también tener el computer use para poder manipular cosas que no necesariamente tienen un app o un mcp o un cla o lo que sea y para eso si necesitamos tener un computer use. Entonces es importante y mi mide para me troco como dice su nombre que también sabe manejar un computador como te ha usado mover en mouse. Aru y programas hacer clic, etcétera. Aquí tiene un 70, como a 6 versus 66 en stable que está antes y un 62GPT. Esta fila también buena, buena, bueno, ya vamos a ver un poco más de eso. Y antes de pasar a lo que está desempeñando mejor terminamos con este último que es el Business Workflow que vendría haciendo como mi de como que también completo una tarea de negocio de principio. es como el... como desde el principio, como se conecta con varias herramientas, sin que tengas que meter tu como una mano, es como este para metro, de hecho este uno de saber de lo que me acuerdo, este un para metro que hace y realiza el mismo saber, entonces, como que también es muy parecido, como a como... cuál es el mejor modelo que yo estoy usando para mi business. Y en este tenemos un 26% versus los otros modelos que están en un DCC de Fable, DCC de August y DC8 GBDC, como entonces. Y si te fijas creo que lo interesante acá es que le gana

  5. 11:40 , obre el vídeo en una pestanya nova

    prácticamente todo a los otros modelos. A mi falta un par de cosas acá que tendría haciendo como el legal y geod que de hecho Fable sin co termina funcionando mejor para a esos casos y en biología termina funcionando mejor en o-x. Pero creo que lo interesante acá y como lo que quiero destacar es que le ganen prácticamente todo lo que estaba enísimo, sea la mayoría de los workflows automatizados o los workflows en general de trabajo o un 5 desempeñamos bien, entonces se nota como la estrategia de atrás de este lanzamiento y lo que hicieron potencial. Ahora también ojo hay algunas don de pierdes, porque no lo no vamos a que anosolamente con el lado bonito. Y existen cuatro categorías en las que pierde y entre ellas pierde contra sus predecesores que vendría siendo fable en este caso y en una contra GbT-516. Ahora estos son los benchmarks que están acá, probablemente más benchmarks, estos no son siempre todos todos, pero en fin, a uno que pierde es en la codificación agentica acá donde GPS 516 le gana en este caso, o sea, aquí como que le dan problemas de lo que tengo entendido en este benchmark, le dan problemas reales de proyecto de software como más de verdad, de los que están como reportados así en distintos repositorios públicos y guijar, si cosas así, aquí tenemos 72,7, verse unos de 68,8, aquí gana, GPS, y en el razonamiento multidisciplinario que vimos un poco más arriba en este ganado stable, que era lo que vimos antes de este el doctorado, como este grupo de expertos, como que evaluan estos parámetros y como que los comparan y lo miren, pero al final claro en este pierde igual como por dos décimas, pero igual es interesante tenerlo en cuenta y bueno también aquí el legal, o sea en el legal, estaría legales, reales del tipo que está haciendo un abogado como en su día a día, también pierde, pero fíjate, o sea, jeve de 5.6 a 2% versus o 5 que saca casi un 12, aquí entonces que está haciendo tareas legales, todavía puedes seguir haciendo feybol, o seguir usando feybol para ese tipo de cosas. Yo, con la escala, porque al final estos números igual son bajísimo para todos y bueno como vimos acá también salud también pierde y aquí se comparó como con el mitos porque el feybol no tiene acceso como esta parte de salud porque recordemos que redirigía todos los ricos es directamente a opos lo cual es interesante saber también ya el mensaje o en esto al final y como todo lo que está de fondo acá es que para temas médicos, serios quizás como que podría mantener me usando como este nuevo modelo porque funciona mejor en el negocio del río pero como el resumen o en esto en verdad que quiero hacer como de todas estas tablas que ganan a casi en todos, ya o sea pierde en cuatro casillas donde ellas son por tesimas y contra los mismos modelos de stable, pero lo interesante es que grana y lo hace costando la mitad que la columna de al lado, o sea, es mejor en la mayoría de las cosas y cuesta en la mitad de la columna al lado.

  6. 14:58 , obre el vídeo en una pestanya nova

    Lo que es una genialidad, o sea, es que empezamos a bajar acá, vamos a empezar a ver y darnos cuenta que tenemos ciertos gráficos que nos pueden dar y mostrar aquí en la misma publicación también los publican aquí en su post oficial donde como que vemos todas las cosas que hicieron y fíjate, o sea como que aquí no van mostrando distintos gráficos, podemos ir viendo este en nos mídé, por ejemplo el costo por la tarea en el eje de abajo y arriba como en el eje y el desempeño que va teniendo o el puntaje y fijar esto sea el esfuerzo o el costo necesario según cada una de las tareas y el output que va teniendo se mantiene en esta tendencia lineal lo que es súper súper bueno indica que estamos como en un momento donde se está equilibrando como el output o el nivel de esfuerzo la plata que yo quiero gastar va siempre a desempeñar un mejor output que esto es una barrera que logramos cruzar hace solamente unos meses, hecho logramos cruzar en Payable 5. Y Antrobic, te deja subir o bajar como cuánto es el nivel de razónamiento. Entonces acá te subo, te baja cuánto, bien se muero y no es que no es como que me damos que el línea llega más arriba, sino que esta línea que está arriba y a la izquierda arriba, mejor y a la izquierda es más parado, es como lo que nos tenemos que ya me trabaja arriba a la izquierda este es mejor y aquí se demuestra, o sea este que estamos viendo acá que es el de el uso del computador también o este que es como de los business workflows que habíamos visto antes también fíjate lo arriba a la izquierda que está o sea tenemos un altísimo password e incluso en el modo más bajo le gana a todo todo, o sea en el modo más bajo le gana al literalmente todos los otros modelos que existen ya, donde arranca este primer punto en los business workflows que son las tareas que hace la gente regularmente, como en un flujo de trabajo normal, es una brutalidad ya, lo mismo aquí en el humanitislas de exam, el ayante cómodo de acá, que compide fuerte con jb5.6 sol que, de hecho, este ángulo de habían sacado muchísimo, el plane explotado, lo tengo que obtener y ahora lanzaron un modelo un poco mejor acá y lo dice, o sea, no lo digo solamente yo, lo dicen como los posts acá textuales, el mejor resultado de opus 5, supera el mejor resultado o en general opus 5, supera el mejor resultado de table 5, un poco más de un tercio del costo, lo podemos encontrar donde estaba acá en o suelo, una prueba de rendimiento para el uso ordenadores o bussinkos, superados de más modelos de cualquier precio suberando el mejor resultado de fiegel cinco por un poco más de un tercio del coste. Ya, entonces hay que tener en cuenta eso, creo que está super, super bueno, es como de las cosas que más me volaron las caesas, entonces, entonces, entonces, entonces, entonces,

  7. 18:10 , obre el vídeo en una pestanya nova

    toda esta línea también de el business, o sea, esa métrica del business, como seguir bien español, será alguna de estas, el banco de automatización por así decirlo. es una brutalidad, es una brutalidad, o sea, estamos en el punto donde realmente este disparo en función de las otras cosas o en función de los otros modelos. Entonces, opusen en su esfuerzo más bajo gastando menos de un dolar portaria como podemos ver acá, el resuelve más que cualquier otro modelo que está dando lo todo, o sea, incluido stable sin cooperacías y lo. En deificación pasa lo mismo, pero es más violento, o sea, en todo lo que tendría siendo coding acá un poco más arriba, también pasa lo mismo, ya o sea como que la línea amarilla de fey, bueno, necesita acá casi 30 dólares, o por ahí, por un intento para llegar donde opos llega con 15, como vamos para acá, o menos, incluso, mucho menos, o sea, para llegar acá o cuya llega con 8, 8 horas, 8, 9 horas de donde paye volga hasta casi 30 y esto al final, porque está construyendo y ya pensando lo como acá es lo noticia, ya no es que sea como tanto más listo y que sí lo es igual, sino que cada dólar tuyo rinde entre 2 y 3 veces más que la semana basada y esa es como la real diferencia y lo bueno, y por honestidad también al de la piel está este benchmark aquí no dicen que es un test interno que corrieron acá con un promedio también de cinco intentos como estamos viendo acá por tarea y yo por cuatro o ocho sirvió como un fallback para las cosas que stable cinco y opus cinco no podrían hacer pero se siente distinto sea como que yo igual es tu es jugando un rato con esto y se siente un poco distinto los números son números, sí, obviamente, pero el fil de lo que lo greprobar, por lo menos, de lo que lo griembre estigar y son parte de prueba super ravi, yo creo que voy a subir igual más prueba adelante cuando tengo un poco más de tiempo. El fil y va a estar bueno, está bueno como que los números son números, sí, y yo jujúi igualar todos los números, pero el fil también es una cosa. Ponen al que aquí algunos ejemplos de cosas que construyeron que los encontre buenísimos, por ejemplo acá está armando un túnel y viendo como la aerotinámica de este túnel, de aire que está haciendo y como responde como la no sé cómo se vería, cómo esto sería el flujo de verno y no sé cómo era, fue ser tanto el tiempo y va a ser física en el colegio, pero se ve como un poco como se comportan los flujos y todo esto fue armado aquí nos dicen con o bussico o lo mismo acá, este también lo constre muy bueno, están armando una célula animal interactiva, como podemos ver acá, que también lo armaron todo con o bussico. Lo encontré bastante bueno, me gustó, me gustó y aquí abajo vamos viendo en más esticadas, ahora de verificar su trabajo voy a ir bajando por acá, tenemos ciertas opiniones como de luchan fil de distintas personas aquí, bueno, voy a antes de dar una buena en la reseña buena, pero como que a la gente que

  8. 21:27 , obre el vídeo en una pestanya nova

    los provó, les piden un poco su opinión para poder ponerlo y justamente poder atacar este fil no por los penchos, para que si no como por autoridad o autoridad aquí o cosas así. El MISSA LA Indigabio es como que tanto está desalignándose, según otros modelos, me imagino después de toda la situación con el Congreso y el departamento de Seguridad y el departamento de Estados Unidos, como que ya se preocupa bastante obviamente de todo esto, está bastante bajo. Como sal acá, no es una ansa significativa que va a ser desde el doble de uso respecto acá a la vulnerabilidad es y explodaciones de Open Source, mi dos está todavía a otro nivel que opus acá y está desempeando bastante bien encontrar las vulnerabilidades aquí a la izquierda, pero no desempeña bien en explotarlas, o sea como que al final creo que eso una era de los grandes como concern sobre ocupaciones que tenía el gobierno de Estados Unidos, aquí tenemos mirar un identificación de vulnerabilidades en la izquierda está el nivel de mí dos, pero mucho menos éxito al desarrollo de exploits, es decir, como cosas para poder explotarlas, lo que está bastante bueno, aquí tenemos distintas medidas de seguridad que se tomaron y por fin le quedaron esta medida de seguridad que era la diseñado para como este forma que tenía el modelo de feybol a obo, 4.8 y ahora lo hicieron como mucho más posible de usar en cierre seguridad como tecnología y mucho menos folpaks. Básicamente te van a plagiar muchos menos request, lo que estaba bastante bueno. Así que para a la gente que investiga, no se posee encia, o que día tienen como el mejor modelo de exponería que han soltado. Pero vamos a dar también lo interesante acá. Ya está disponible, pero vamos al precio, ya que esto es lo que creo que lo más impactante de todo esto. O pues está disponible con un precio de 5 dólares por millón de tokens y 25 por millón de salía. Si lo vamos acá es la mitad de paybol 5, o sea, está disponible hoy porapi y en la aplicación en todas las plataformas y también tienes, obviamente, el modo rápido, que lo que hace es en el modo rápido es como, o que necesito que me es una respuesta más rápida, entonces vamos a usar más recursos de computación, pero me va a costar más plata. Funciona aproximadamente 2,5 de ese más rápido, al igual que o 4.8, está al doble de el preso. Esto completamente opcional, es un toque el que puedes decir, prender a pagar. por ejemplo si es que en TxH, te puedes ir aquí y lo vas a aprender o apagar usando el modelo de opus y lo voy a hacer en también todos los mos. También se voy a usar por la API. Entonces, si construyes agentes, esto te puede importar bastante porque si necesitas como mantener una calidad alta y una respuesta muy rápida, puedes, por ejemplo en un Rack, es muy importante que lo hagas, puedes activar en modo

  9. 24:26 , obre el vídeo en una pestanya nova

    rápido. Hay un part de cosas que actualizaron que también me gustó bastante cuando lo le he dicho. Lo primero es que puedes cambiar ahora las herramientas que Cloud tiene disponible a la mitad de una conversación. Ya los desarrolladores pueden cambiar las herramientas sin invalidad la caché de mensajes, o sea, que si tienes una gente largo corriendo, que digamos que se gasta como directamente de plata de tu bolsillo, puedes hacerle este cambio, si tener que romper todo el ciclo y lo segundo es que tienen los fullbacks automáticos como alternativa en la ápile. O sea, si un plasificador en este caso está marcando tu medición en vez de devolver tu en error, pues es rupiar solamente de vuelta como el fullback disponible, como un fullback en específico, según lo que entendió. Se ha resumen, se me acabó el, se me murió el pipeline o se me cayó el pipeline a las tres de la mañana porque vamos a tener esta opción como del solpa. Pues en el legislador es marcas como se reirijan automáticamente con las alternativas automáticas no sé qué. Al igual que otros modelos anteriores o bussín con los requerimientos de retención o que hay perfecto. Y como siempre, en los opus al final como que estoy ya no cambió nada como lo voy a ver acá o que hay perfecto. Vamos al grano que creo que todos están preguntando en este momento, está muerto, feybol, cinco. Yo creo, yo creo hoy día a la fecha que estamos grabando este video para el día a día, yo creo que Facebook se dio sin caso de uso, o sea, con todo lo que hemos visto acá, ya le gana en casi todo, a un modelo que cuesta la mitad, que hasta mucho menos portaria y que además viene por defecto en tu plan No sé, no sé, creo que sí, creo que Es que hayan muerto necesariamente Facebook, quizás Facebook, necesitó todavía el fil de ovus, necesitó ver cómo razón, quizás voy a seguir usando Facebook para planear o poner a planear a opus o a feio y no tengo idea como funciona, feio por planear o para ejecutar o planear directamente con opus, no sé, no sé, feio por 5 fue la primera versión de consumo de un modelo de clase mitos, y creo que tenía que salir como cara o ineficientes para que, si lo pensáis también es maravilloso como a nivel de marketing, porque es como que, Ok, vamos a lanzar un nuevo modelo, una nueva familia de modelos que está altísimo está carísimo y preso que lo saló es altísimo pero es brutalmente bueno y después llegas y sacamos un modelo mucho más barato, mucho más barato a la mitad de este precio que desempeña igual es como wow, esto es realmente brutal, eso es una estrategia venta que se conoce como el anclaje donde tu fija un precio muy alto y después cuando sacas algo más barato es como wow es muy barato, puede ser que esté y ocao, puede ser que ya ha sido una coincidencia, no lo sé, no sé cómo funciona dentro el equipo de marketing, pero si es que fue una movía es realmente genial. Fable, yo creo que es un excelente producto todavía, es un excelente modelo todavía, todavía. Pero hoy día este mismo producto, según lo que nos dice,

  10. 27:29 , obre el vídeo en una pestanya nova

    Lo Penschmark es más rápido y es más económico. Y creo que a Fable le va a pasar igual que Fable sin como un tú, uno hay que llegar, quizás, va a ser más eficiente, va a tener, quizás lo mismo expresios, yo creo que hacen los precio según familia y va a ser más inteligente que obusico y así vamos a ir continuando desde el ciclo que va a ir mejorando, no creo que sea un fracaso ni cerca, creo que, fables excelente, vamos a ver qué tal es opus, y lo que voy a hacer hoy día y lo que te recomiendo es que uses opusicos, como el opo de efecto para todo, ya, la negación de la negecución ve como los sentí, si todavía creéis que está en una área donde está aplicando ciertas áreas donde fables cinco sigue siendo mejor que opos, obviamente siga ahí, pero si estás haciendo esto las cosas, usado bus, ya, así que no sé, cuando está ahí, quizá, planeificando algo, haciendo lluvede, no sé, puede ir cambiando de modelo, va a probar tu feeling pero, nuevamente, lo que importa es como tu lo sentes, no tanto que nos dicen los números, porque el lugar en filiual es algo importante, así que, vamos creo que está muy interesante, me encantaría saber qué opinas de Ubus, que te pareceo todo esto. Está súper súper bueno, estoy a punto también de lanzar algo muy bueno en mi canal, así que agradecería mucho si te suscribes al canal, es algo que yo preparando por muchas semanas que creo que te va a encantar, así que estoy a punto de subirlo ya en los próximos días. si te interesa también entrar y aprender todo esto en un lugar donde estamos puras personas construyendo te invidó darte una vuelta a imperoagéntico aquí vimos Juan fue el primer un pulgar o bussico lo que está venísimos estamos todo el día entendencia de lo que está pasando y hay gente que lo está usando y es un lugar donde estamos todo construyendo constantemente se abrazamos con los juegos imperiales estamos como no se va haciendo distintos reto gente que vendió sus primeras páginas. Está súper bueno, dato una vuelta si es que te interesa, hemos tenido mucho logro en el último tiempo, ya pasamos a hacer una comunidad súper grande, que rodeaba a gente, maravillosa, no sé cómo tenemos a la gente de mayor inteligencia, mayor capacidad acá. Yo estoy realmente sorprendido, tenemos cinco sesiones de manera semanal, cinco o seis spoiler, spoiler, soy en el asexo. Así que el link está abajo también en la descripción, pues si quieres estar tu naviel te quieres automatizar tu negocio o implementar la IA para venderla también puede ser o para aplicar la Antonio negocio. Ticho de hecho eso espero verte en Imperio o espero que te haya suscrido a mi canal y tu te recomienda que ya es alguno de estos videos de acá, que no podemos.