Kimi K3 la está ROMPIENDO: El modelo chino que compite con GPT-5.6 y Claude Fable 5 — Transcript
Full transcript
- 0:00Hace unas horas ha salido Kimi 3, que es
- 0:02la versión más actualizada del modelo de
- 0:03Kimi, este modelo multimodal que permite
- 0:05generar desde texto, imágenes, videos y
- 0:08también código. Y bueno, el día de hoy
- 0:09mucho se ha estado hablando acerca de lo
- 0:11que puede generar, que para sorpresa
- 0:12está saltando bastante en los benchmark
- 0:14a tal punto que está alcanzando a Cloud
- 0:16Fable 5 o incluso GPT 5.6 Sol. Y bueno,
- 0:19para hacer una demo el día de hoy voy a
- 0:20mostrarles alguno que otro ejemplo,
- 0:22además de también poder resumirles de
- 0:23qué se trata este nuevo modelo. Vamos a
- 0:25empezar.
- 0:26Coders, cuando una aplicación ya está en
- 0:28producción, uno de los retos más
- 0:29importantes es detectar problemas antes
- 0:31de que los usuarios los encuentren. Por
- 0:33ejemplo, una página que deja de cargar,
- 0:35una API que empieza a responder
- 0:36lentamente o un flujo dentro de la
- 0:38aplicación que simplemente deja de
- 0:40funcionar. Y esperar a que los usuarios
- 0:42reporten estos problemas no siempre es
- 0:43la mejor estrategia. Aquí es donde entra
- 0:45el synthetic monitoring. Esta técnica
- 0:48consiste en simular interacciones con tu
- 0:49aplicación de forma automática, como si
- 0:51fueran usuarios reales. Por ejemplo,
- 0:53puedes configurar pruebas que verifiquen
- 0:54periódicamente si una página carga
- 0:56correctamente, si un formulario funciona
- 0:58o si una API está respondiendo como
- 1:00debería. Y esas pruebas se ejecutan
- 1:02desde distintas ubicaciones y de forma
- 1:03constante, lo que permite detectar
- 1:05problemas de disponibilidad o
- 1:07rendimiento antes de que afecten a los
- 1:08usuarios reales. Y para resolver esto,
- 1:10puedes utilizar Open Manager Nexus, en
- 1:13donde puedes configurar este tipo de
- 1:14monitoreo para páginas web, API y
- 1:16aplicaciones completas. Además, cuando
- 1:18ocurre un problema, puedes recibir
- 1:19alertas en tiempo real, lo que ayuda a
- 1:21reaccionar rápidamente. Y lo genial es
- 1:23que puedes implementar Open Manager
- 1:25Nexus tanto en la nube como en tu propia
- 1:27infraestructura. Además, ahora mismo
- 1:28tienes disponible una prueba gratuita de
- 1:3030 días desde su página oficial. Así que
- 1:32aprovechen esta oportunidad y prueben
- 1:34todas las funciones utilizando el enlace
- 1:36que les dejo en la descripción. Muy
- 1:37bien, empecemos primero leyendo un poco
- 1:38acerca de lo que sería el anuncio de
- 1:40este nuevo modelo de Kimi llamado K3,
- 1:42que es básicamente el sucesor de K2.7.
- 1:44Ahora, lo que más ha llamado la atención
- 1:45entre todas las cosas o por qué se está
- 1:47nombrando tanto este modelo en internet
- 1:48es principalmente porque ahora está
- 1:50compitiendo con los modelos más grandes.
- 1:52Es decir, en Kimica 2.7 nosotros
- 1:54comparáamos ese modelo con GPT 5.3 u
- 1:57Opus 4.7. Entonces, al salir Química 3
- 1:59se esperaría que compita con Opus 4.8 o
- 2:02GPT 5.5, pero de hecho no. Y es que ha
- 2:04dado un salto enorme y ahora se la está
- 2:06comparando con GPT 5.6 Sol y Fable 5,
- 2:10que son los modelos más grandes y más
- 2:12producidos que hay a este momento. Lo
- 2:13que quiere decir que esa distancia de 6
- 2:15meses en el que iban los modelos chinos
- 2:17detrás de los modelos más populares,
- 2:19pues en realidad no lo es tanto. Y a
- 2:20este punto sorprende bastante que un
- 2:22modelo que estaba casi en las últimas
- 2:24listas fuera del ranking 10 de muchos
- 2:26benchmark, ahora está compitiendo con
- 2:28estos dos modelos de aquí, casi similar
- 2:30a lo que pasó con GLM 5.2 dos hace
- 2:33algunas semanas atrás, pero bueno, de
- 2:34forma resumida, este es un modelo nuevo
- 2:35que llega a los 3 trillones de
- 2:37parámetros y para lograr, digamos,
- 2:39aumentar un poco su velocidad, sobre
- 2:40todo porque es un modelo grande, tienen
- 2:41una nueva forma de implementar lo que
- 2:43sería la decodificación de tokens al
- 2:44momento de la entrada y es justamente
- 2:46con estas nuevas formas que se llama
- 2:47Delta attention y attention residuals.
- 2:49Lo que significa en la práctica es que
- 2:50también tenemos un millón de tokens en
- 2:52una ventana de contexto y que esto nos
- 2:54permite poder aplicarlo en tareas de
- 2:56larga duración como pueden ser ejecución
- 2:58de asistentes o ejecución de código o
- 3:00razonamiento y básicamente tareas de
- 3:02agentes. Aunque bueno, una forma de
- 3:04medir todo esto es utilizando algún
- 3:05benchmark que no viene por parte de la
- 3:07misma empresa. Entonces, también tenemos
- 3:08Artificial Analysis, que es un benchmark
- 3:10que mide múltiples modelos en distintos
- 3:12tipos de áreas. Y por ejemplo, cuando
- 3:13hablamos de inteligence o inteligencia,
- 3:15sobre todo al momento de escribir código
- 3:17o hacer tareas agénticas, lo que ha
- 3:19pasado con este modelo, simplemente si
- 3:20lo comparamos con uno de sus precesores,
- 3:22que es 2.6, por ejemplo, ha hecho un
- 3:24salto casi a la par de estar ahora con
- 3:26GPT 5.6 y Fable. Y bueno, esto no tan
- 3:29solamente al momento de generar códigos,
- 3:30seno que de nuevo también al momento de
- 3:32utilizarse en tareas para poder hacer
- 3:34ejecución de programas o de nuevo tareas
- 3:36relacionadas con agentes en general.
- 3:38Aunque bueno, algo muy importante con
- 3:39todo esto es justamente saber qué tan
- 3:41caro es y de hecho no es un modelo tan
- 3:43costoso para ser un modelo que está
- 3:45compitiendo con esos modelos grandes.
- 3:47Obviamente la respuesta puede variar,
- 3:48pero solamente para darnos una idea y
- 3:50midiendo el costo. Pueden ver aquí que
- 3:51este es un poco más caro que lo que
- 3:53sería GLM 5.2, pero sigue siendo más
- 3:56barato que Opus 4.8, por ejemplo. Y
- 3:58bueno, igual también mucho más barato
- 3:59que GPT. Aunque bueno, otra métrica
- 4:01también muy importante en cuanto al
- 4:02modelo es la velocidad de respuesta. Y
- 4:04bueno, este modelo ya se conocía que no
- 4:05era muy rápido. De hecho, si ustedes han
- 4:07llegado a utilizar K2.7 saben que sí es
- 4:09un modelo que puede ser bastante
- 4:10decente, pero en cuanto a velocidad pues
- 4:12hay modelos mucho más baratos. Incluso
- 4:14un descendiente de este que puede ser
- 4:15composer 2.5 es más veloz en mi opinión
- 4:18y se nota. Y en este caso no ha mejorado
- 4:20tanto en este aspecto, así que al menos
- 4:21por velocidad no esperen un cambio
- 4:23enorme. Pero bueno, al final lo que
- 4:24importa es la generación de código y qué
- 4:26tan bueno es. Así que vamos a ver
- 4:28algunos ejemplos. Y bueno, para poder
- 4:29probarlo, ya lo tienen disponible en lo
- 4:30que sería su suscripción de Kimi.com o
- 4:33pueden utilizarlo en aplicaciones como
- 4:34Kimy Word, Kimi Code o Kimi API. Y
- 4:36bueno, solamente para darles un número
- 4:38exacto, en este caso según su propia
- 4:39documentación, el millón de tokens de
- 4:41entrada cuesta alrededor de $3 y la
- 4:43salida cuesta alrededor de 15. De nuevo,
- 4:45colocándolo muy por detrás lo que sería
- 4:465.5 y 4.8 y obviamente muy por detrás lo
- 4:49que sería Fable 5. En cuanto a precios
- 4:51estamos hablando. Y bueno, para empezar
- 4:53a utilizarlo, en mi caso voy a estar
- 4:54probándolo desde Kimi, desde Kimi Code,
- 4:56su herramienta o harness. Y bueno, desde
- 4:58aquí ya pueden empezar a cambiar el
- 4:59modelo, simplemente escriben slash model
- 5:01y con esto van a empezar a ver estas
- 5:02opciones. Tenemos ahora la opción de K3.
- 5:04Y por cierto, si quieren saber cómo
- 5:05utilizar Kimi Code o quieren crear
- 5:07algunos ejemplos, ya he creado videos
- 5:08anteriormente utilizando este harness,
- 5:10así que también lo voy a dejar en la
- 5:11descripción. Pero bueno, vamos a pedir
- 5:12una aplicación un poco extensa y voy a
- 5:14pegar aquí un texto grande y básicamente
- 5:16le voy a pedir un dashboard de finanzas
- 5:18personales que nos permita manejar
- 5:20distintas cuentas, marcar objetivos
- 5:22financieros y básicamente tener un
- 5:23registro de los ingresos, retiros y
- 5:26demás operaciones que se pueden hacer
- 5:27desde una cuenta. Entonces, vamos a ver
- 5:29qué tanto se puede demorar para un pr de
- 5:31este estilo. No es una planificación,
- 5:32pero tampoco es un prqueño. Y bueno, por
- 5:34cierto, aquí si también quieren hacer
- 5:36que simplemente lo implemente, pueden
- 5:37escribir aquí un yolo y con eso
- 5:39simplemente va a empezar a responderse
- 5:40las preguntas por él mismo. Muy bien,
- 5:42después de aproximadamente unos 40
- 5:43minutos más o menos, aquí ha pasado la
- 5:46generación del proyecto y en teoría la
- 5:48razón de por qué se ha demorado tanto es
- 5:49que he implementado cada uno de los
- 5:50módulos y también lo que sería backend y
- 5:52frontend. Y bueno, lo que ha generado es
- 5:54esto de aquí, que de hecho no se ve nada
- 5:56mal. Ya ha colocado datos demo, ya
- 5:58tenemos aquí secciones para poder tener
- 6:00incluso gráficas y bueno, en cuanto a UI
- 6:03se ve bastante bien. Ahora, en este
- 6:05caso, este es un modelo sin ningún tipo
- 6:07de skill adicional, es decir, este es el
- 6:08modelo tal cual responde. Y bueno, esta
- 6:10es una de las cosas que también se está
- 6:11remarcando bastante en redes sociales y
- 6:13es que en el benchmark de Front Code
- 6:14Arena, incluso lo que ha pasado es que
- 6:16Kimica 3 está mucho mejor que Fable 5 y
- 6:195.6 sol. Eso quiere decir que para
- 6:21tareas de frontend pues realmente supera
- 6:23esos modelos y se nota realmente en el
- 6:25primer pronto, aunque de nuevo esto le
- 6:27ha tomado mucho tiempo generarlo. Y otra
- 6:28cosa que no veo por aquí es justamente
- 6:30la forma de poder añadir datos. Al
- 6:32parecer hecho como simplemente frontend
- 6:34para poder visualizar cosas y no hay
- 6:36ninguna forma aparente de poder añadir
- 6:39datos adicionales. Y bueno, en cuanto al
- 6:40código lo que quiera generar es una
- 6:41aplicación de Next en donde está la API,
- 6:44están las aplicaciones de frontend y en
- 6:45cuanto a la base de datos, como no ha
- 6:47sido muy explícito de qué base de datos
- 6:48debería utilizar, al parecer aquí ha
- 6:49elegido SQLite y bueno, en realidad no
- 6:51ha añadido muchos paquetes, es
- 6:53básicamente Nex en sus últimas
- 6:55versiones, lo cual está bastante bien,
- 6:56es decir, este modelo ya considera
- 6:58versiones modernas, al menos de estos
- 6:59frameworks. Lo siguiente que también
- 7:00incluido son los paquetes para hacer
- 7:01linting y para poder obviamente utilizar
- 7:03TypeScript y bueno, no son versiones
- 7:05viejas ni nada de eso, entonces está
- 7:06bastante decente como para producir
- 7:08código realmente al menos de
- 7:09aplicaciones frontend. Y bueno, para
- 7:11hacer un segundo ejemplo, vamos a
- 7:12pedirle ahora crea un juego en 3D al
- 7:13estilo de Mario Kart, por ejemplo,
- 7:15solamente que vamos a decirle debe haber
- 7:16métricas de velocidad y un escenario
- 7:18realista. Vamos a ver qué es lo que
- 7:19crea. Y bueno, si esperamos alrededor de
- 7:21unos 30 minutos más y un poco más
- 7:23incluso, vamos a ver que aquí ha
- 7:24generado otra vez otro proyecto y vamos
- 7:26a comprobarlo. De hecho, aquí me ha dado
- 7:28una URL y esto es lo que ha generado.
- 7:30Básicamente es un proyecto bastante
- 7:31básico utilizando 3GS obviamente, pero
- 7:33este es un modelo que obviamente es
- 7:35mucho más barato que lo que es GPT 5.6
- 7:37Se y bueno, por allí también podríamos
- 7:38hacer una comparación en uno de estos
- 7:40días justamente con los otros modelos,
- 7:41pero incluso ha cumplido con la idea del
- 7:44pron inicial, que es justamente ver en
- 7:45la parte superior izquierda lo que sería
- 7:48el tiempo, la velocidad y a la parte
- 7:50derecha hay como justamente un mapa y
- 7:52está bastante bien. De hecho es un
- 7:54primer pron, simplemente no he hecho más
- 7:56modificaciones. Sí se ha demorado, eso
- 7:58sí, aunque incluso algo que también
- 7:59pueden notar es que estoy utilizando el
- 8:01esfuerzo máximo. De hecho, si venimos
- 8:03aquí y coloco slash effort y doy un
- 8:04enter, van a ver que solamente tengo
- 8:06disponible el modo max. Entonces, esto
- 8:07quiere decir que a medida que vayan
- 8:08saliendo las variaciones de este modelo,
- 8:10pues podríamos obtener modelos que
- 8:11responden más rápido o quizás nos den
- 8:13una que otra variación adicional. Pero
- 8:15bueno, de momento es lo que tenemos y de
- 8:17nuevo no está nada mal. incluso para
- 8:18tareas de frontend este modelo está
- 8:20bastante bien y en mi opinión no lo he
- 8:22probado tanto con lógica, es decir, no
- 8:24he visto lo que ha generado, no se ve
- 8:26nada mal de hecho, pero voy a esperar
- 8:27aún así algunos días para ver algunos
- 8:29ejemplos y sobre todo también traerles
- 8:31una actualización de lo que sería
- 8:32Química 3. Y bueno, básicamente este ha
- 8:34sido el video del día de hoy. Está
- 8:35bastante impresionante el modelo, sobre
- 8:36todo para tareas de fronte me ha gustado
- 8:37bastante y aún no lo he podido probar
- 8:39incluso con lo que sería tareas en
- 8:41paralelo o con sus subagentes, pero ya
- 8:43lo voy a ir probando en el transcurso
- 8:44esta semana. Y bueno, esto acaba de
- 8:45salir, así que también pueden probarlo
- 8:47utilizando tanto Kimy Code o
- 8:48suscripciones de otros harness que
- 8:49pueden estar por allí. Y bueno, si
- 8:50tienen una duda o cualquier sugerencia
- 8:52también pueden dejar en los comentarios.
- 8:53Nos vemos en un siguiente video. Y eso
- 8:55ha sido todo por el video del día de
- 8:56hoy. Si quieres conocer más, te dejo en
- 8:58pantalla mis enlaces sociales y mi web
- 9:00fast.def donde puedes reservar asesorías
- 9:02personalizadas de cualquier tema. Y no
- 9:04te olvides de dejarme un comentario, ya
- 9:05sea de una duda o una sugerencia para el
- 9:07siguiente video. Nos vemos en un próximo
About this transcript
This page contains the full transcript of Kimi K3 la está ROMPIENDO: El modelo chino que compite con GPT-5.6 y Claude Fable 5 by Fazt, generated from the public captions YouTube serves with the video. The transcript has 2,151 words across 317 segments, with the original timestamps preserved so you can click any line to jump to that moment in the embedded player.
What you can do with it
Use the transcript to take notes, quote the speaker, build a study guide, generate a summary with ChatGPT or Claude via the YouTube Summary tool, or export it as a timed subtitle file with YouTube to SRT. You can also re-open it in the transcriber to translate the transcript into 100+ languages.
Free YouTube transcript tool
YouTube2Text is a free YouTube transcript generator — no signup, no daily limit. Paste any YouTube link and get the full transcript instantly, with timestamps, click-to-jump, translation to 100+ languages, AI prompts for ChatGPT, Claude, and Gemini, and exports to TXT, SRT, VTT, or Markdown.