Den nya kinesiska modellen Kimi K3 är redan nummer ett i Frontend Code Arena. Och det släpper lös galenskap på Internet
Det verkar som igår när DeepSeek R1 ifrågasatte en idé som många tog för given: att kapplöpningen för avancerad artificiell intelligens fortfarande hade en tydlig ägare i Silicon Valley. Framväxten av den kinesiska modellen hjälpte till att utlösa en massiv försäljning av teknik och ledde till att NVIDIA drabbades av en daglig kapitaliseringsförlust utan motstycke fram till dess. Allt eftersom månaderna gick tappade bilden i intensitet, men budskapet kvarstod: det kinesiska tekniska ekosystemet var inte villigt att begränsa sig till att hålla jämna steg med USA.
Nästa notis har nu ett annat namn: Kimi K3. Moonshot AI har precis presenterat en modell med totalt 2,8 biljoner parametrar som, knappt där, har placerat sig i toppen av Frontend Code Arena, före några av de mest kraftfulla förslagen från Anthropic och OpenAI. Men historien är inte begränsad till en klassificering: utvecklare och fans använder den redan för att skapa gränssnitt, spel och rekreationer som alla kan se och i vissa fall prova.
Det är där denna artikel verkligen börjar. En kinesisk modell leder redan ett av de mest synliga programmeringstesterna. Det är värt att uppehålla sig vid detaljerna i den klassificeringen.
I skrivande stund når Kimi K3 1 679 poäng i Frontend Code Arena, före Claude Fable 5, med 1 631, och GPT-5.6 Sol xHigh, med 1 618. Förbättringen jämfört med föregående generation är också slående: Kimi K2.6 rankades 18:e, medan dess efterträdare leder sex av de sju utvärderade domänerna. För närvarande behåller Arena etiketten för preliminära resultat, så det är bekvämt att läsa denna position som ett mycket betydelsefullt fotografi, men fortfarande mottagligt för förändringar.
Vi står inte inför ett universellt programmeringsprov, utan snarare ett mycket specifikt test. Frontend Code Arena jämför webbapplikationer skapade av olika modeller och låter användare utvärdera vilken som löser uppgiften bättre, vilken som fungerar mer tillförlitligt och vilken som ger en bättre upplevelse. Det tillvägagångssättet är särskilt användbart för att mäta synliga och praktiska förmågor, men det har också uppenbara begränsningar.
Att Kimi K3 leder här säger oss mycket om dess frontend-prestanda, även om det inte automatiskt tillåter oss att utöka den fördelen till komplexa arkiv, backend, matematik eller allmänna resonemang. Utanför denna specifika terräng förblir fotograferingen gynnsam, även om den är mer balanserad. Vals AI placerar Kimi K3 på andra plats bland 38 modeller, med 74,70 %, strax efter Claude Fable 5, som når 75,14 %, och över GPT-5,6 Sol, med 73,12 %.
Artificiell analys placerar det också bland de mest avancerade systemen i sin klassificering, med 57 poäng och tredje plats totalt.
Där Kimi K3 verkar känna sig mest bekväm är i uppgifter som kombinerar programmering, visuell kontext och flera kedjade steg. Arena stödjer dess förmåga att bygga webbgränssnitt, medan Vals AI också spelar in hög prestanda i agentprogrammeringstester. Moonshot tillägger att modellen kan gå igenom stora förråd, använda terminalverktyg och granska skärmdumpar av sitt eget arbete för att korrigera resultatet i farten.
Den sista förmågan, som företaget kallar "vision in the loop", hjälper till att förklara varför den utmärker sig på att omvandla visuella referenser till interaktiva produkter. Det finns också flera varningar innan man tolkar Kimi K3 som en definitiv seger. Moonshot presenterar den som en öppen viktmodell, men de filerna har ännu inte publicerats och företaget lovar att släppa dem senast den 27 juli.
Vi ska inte heller blanda ihop denna öppenhet med fullständig öppen källkod, eftersom detaljer om licensen och resten av systemet fortfarande saknas. Dess 2,8 miljarder totala parametrar tillhör en sparsam arkitektur som aktiverar 16 av dess 896 experter. Företaget rekommenderar själva konfigurationer med 64 acceleratorer eller fler, väldigt långt ifrån vad en konventionell dator kan erbjuda.
Reaktionen från samhället hjälper till att förstå varför Kimi K3 väcker så mycket uppmärksamhet. Ett av de mest slående exemplen är en återskapande av macOS 27 som fungerar i webbläsaren och som dess skapare tillskriver en svärm av modellagenter som arbetar i cirka tre timmar. Till den kommer Ballista, en interaktiv panel med en 3D-glob och flera jämförelser mot Claude och GPT.
De är inte oberoende riktmärken, utan demos som delas av deras egna skapare, men de låter dig se vilken typ av resultat modellen producerar utanför tabellerna. För att skapa något som macOS-simuleringen eller ballista-spelet behöver vi inte modellera varje element för hand från grunden. Vi kan beskriva resultatet, bifoga en referens och ge Kimi i uppdrag att bygga en funktionell applikation, till exempel med HTML, JavaScript och olika grafikbibliotek.
Projektet testas sedan, modifieras och publiceras eller spelas in för delning. Kimi K3 kan användas från Kimi.com, Kimi Work, Kimi Code eller verktyg kopplade till dess API, även om det inte är bekräftat vilken specifik miljö som användes i flera av de exempel vi har sett. I Xataka "Ingen vet med säkerhet vad som kommer att hända": Demis Hassabis, nobelpristagare, varnar för risken att tappa kontrollen över AI Det är fortfarande tidigt att förvandla denna lansering till ett definitivt ledarskapsbyte.
Fable 5 och GPT-5.6 Sol ligger före i flera utvärderingar, Kimi K3:s vikter är ännu inte tillgängliga och många av dess kapacitet kommer att behöva verifieras med mer tid. Trots det är det vi har sett redan svårt att ignorera: ett kinesiskt företag kan konkurrera om ledande positioner, erbjuda konkurrenskraftiga resultat och få samhället att omvandla den kapaciteten till verkliga tillämpningar nästan omedelbart. Kapplöpet fortsätter, men marginalen mellan dess huvudpersoner verkar allt snävare.
Bilder | Kimi | Skärmdump i Xataka | Kina har en plan för att vinna AI-kriget mot USA. Och DeepSeek är dess mästare (instagramScript) Den nya kinesiska modellen Kimi K3 är redan nummer ett i Frontend Code Arena.
Originalkälla
Publicerad av Xataka
17 july 2026, 20:58
Denna artikel har översatts automatiskt från spanska. Klicka på länken ovan för att läsa originaltexten.
Visa originaltext (spanska)
Rubrik
El nuevo modelo chino Kimi K3 ya es número uno en Frontend Code Arena. Y está desatando una locura en Internet
Beskrivning
Parece que fue ayer cuando DeepSeek R1 puso en cuestión una idea que muchos daban por sentada: que la carrera por la inteligencia artificial avanzada seguía teniendo un dueño claro en Silicon Valley. La irrupción del modelo chino contribuyó a desencadenar una venta masiva de tecnológicas y llevó a NVIDIA a sufrir una pérdida diaria de capitalización sin precedentes hasta entonces. Con el paso de los meses, aquella imagen perdió intensidad, pero el mensaje permaneció: el ecosistema tecnológico chino no estaba dispuesto a limitarse a seguir el ritmo de Estados Unidos. El siguiente aviso tiene ahora otro nombre: Kimi K3. Moonshot AI acaba de presentar un modelo de 2,8 billones de parámetros totales que, apenas llegar, se ha colocado en lo más alto de Frontend Code Arena, por delante de algunas de las propuestas más potentes de Anthropic y OpenAI. Pero la historia no se limita a una clasificación: desarrolladores y aficionados ya lo están utilizando para levantar interfaces, juegos y recreaciones que cualquiera puede ver y, en algunos casos, probar. Ahí es donde empieza realmente este artículo. Un modelo chino ya lidera una de las pruebas más visibles de programación Merece la pena detenerse en el detalle de esa clasificación. Al momento de escribir este artículo, Kimi K3 alcanza 1.679 puntos en Frontend Code Arena, por delante de Claude Fable 5, con 1.631, y GPT-5.6 Sol xHigh, con 1.618. La mejora frente a la generación anterior también resulta llamativa: Kimi K2.6 ocupaba el puesto 18, mientras que su sucesor lidera seis de los siete dominios evaluados. Arena mantiene por ahora la etiqueta de resultado preliminar, por lo que conviene leer esta posición como una fotografía muy significativa, pero todavía susceptible de cambios. No estamos ante un examen universal de programación, sino ante una prueba muy concreta. Frontend Code Arena compara aplicaciones web creadas por distintos modelos y deja que los usuarios valoren cuál resuelve mejor la tarea, cuál funciona con más solvencia y cuál presenta una experiencia más cuidada. Ese enfoque resulta especialmente útil para medir capacidades visibles y prácticas, pero también tiene límites evidentes. Que Kimi K3 lidere aquí nos dice mucho sobre su rendimiento en frontend, aunque no permite extender automáticamente esa ventaja a repositorios complejos, backend, matemáticas o razonamiento general. Fuera de este terreno concreto, la fotografía sigue siendo favorable, aunque más equilibrada. Vals AI sitúa a Kimi K3 segundo entre 38 modelos, con un 74,70%, apenas por detrás de Claude Fable 5, que alcanza el 75,14%, y por encima de GPT-5.6 Sol, con un 73,12%. Artificial Analysis también lo coloca entre los sistemas más avanzados de su clasificación, con 57 puntos y el tercer puesto general. {"videoId":"xaq0vmm","autoplay":false,"title":"El modelo chino Kimi K3 ya está aquí", "tag":"Tecnología", "duration":"57"} Donde Kimi K3 parece sentirse más cómodo es en tareas que combinan programación, contexto visual y varios pasos encadenados. Arena respalda su capacidad para construir interfaces web, mientras que Vals AI también registra un rendimiento elevado en pruebas de programación con agentes. Moonshot añade que el modelo puede recorrer repositorios extensos, utilizar herramientas de terminal y revisar capturas de su propio trabajo para corregir el resultado sobre la marcha. Esa última capacidad, que la compañía denomina "vision in the loop" (visión dentro del bucle), ayuda a explicar por qué destaca al transformar referencias visuales en productos interactivos. También hay varias cautelas antes de interpretar Kimi K3 como una victoria definitiva. Moonshot lo presenta como un modelo de pesos abiertos, pero esos archivos todavía no se han publicado y la compañía promete liberarlos a más tardar el 27 de julio. Tampoco debemos confundir esa apertura con código abierto completo, porque aún faltan detalles sobre la licencia y el resto del sistema. Sus 2,8 billones de parámetros totales pertenecen a una arquitectura dispersa que activa 16 de sus 896 expertos. La propia empresa recomienda configuraciones con 64 aceleradores o más, muy lejos de lo que puede ofrecer un ordenador convencional. La reacción de la comunidad ayuda a entender por qué Kimi K3 está llamando tanto la atención. Uno de los ejemplos más llamativos es una recreación de macOS 27 que funciona dentro del navegador y que su creador atribuye a un enjambre de agentes del modelo trabajando durante unas tres horas. A ella se suman Ballista, un panel interactivo con un globo 3D y varias comparaciones frente a Claude y GPT. No son benchmarks independientes, sino demostraciones compartidas por sus propios creadores, pero permiten ver qué clase de resultados está produciendo el modelo fuera de las tablas. Para crear algo como la simulación de macOS o el juego de la balista, no necesitamos modelar cada elemento a mano desde cero. Podemos describir el resultado, adjuntar una referencia y encargar a Kimi que construya una aplicación funcional, por ejemplo con HTML, JavaScript y distintas bibliotecas gráficas. Después, el proyecto se prueba, se modifica y finalmente se publica o se graba para compartirlo. Kimi K3 puede utilizarse desde Kimi.com, Kimi Work, Kimi Code o herramientas conectadas a su API, aunque no está confirmado qué entorno concreto se empleó en varios de los ejemplos que hemos visto. En Xataka “Nadie sabe con certeza qué va a ocurrir”: Demis Hassabis, premio Nobel, advierte del riesgo de perder el control de la IA Todavía es pronto para convertir este lanzamiento en un cambio definitivo de liderazgo. Fable 5 y GPT-5.6 Sol siguen por delante en varias evaluaciones, los pesos de Kimi K3 aún no están disponibles y muchas de sus capacidades tendrán que verificarse con más tiempo. Aun así, lo que hemos visto ya resulta difícil de ignorar: una empresa china puede disputar posiciones de cabeza, ofrecer resultados competitivos y conseguir que la comunidad transforme esa capacidad en aplicaciones reales casi de inmediato. La carrera continúa, pero el margen entre sus principales protagonistas parece cada vez más estrecho. Imágenes | Kimi | Captura de pantalla En Xataka | China tiene un plan para ganar a EEUU la guerra de la IA. Y DeepSeek es su campeón (function() { window._JS_MODULES = window._JS_MODULES || {}; var headElement = document.getElementsByTagName('head')[0]; if (_JS_MODULES.instagram) { var instagramScript = document.createElement('script'); instagramScript.src = 'https://platform.instagram.com/en_US/embeds.js'; instagramScript.async = true; instagramScript.defer = true; headElement.appendChild(instagramScript); } })(); - La noticia El nuevo modelo chino Kimi K3 ya es número uno en Frontend Code Arena. Y está desatando una locura en Internet fue publicada originalmente en Xataka por Javier Marquez .