Teknik • 3 tim sedan

Det stora löftet med Microsofts lokala AI är "gratis tokens", det enda problemet är att de inte är gratis

I juli 1991 deltog en 23-årig indisk pojke med håret intakt på en Microsofts utvecklarkonferens som förändrade hans liv. Ett år senare arbetade Nadella på Microsoft och resten är, som de säger, historia. Igår berättade Nadella den historien vid det gemensamma Microsoft- och Nvidia-evenemanget också i San Francisco.

Och för honom kan den här händelsen markera ytterligare en vändpunkt eftersom, sa han, "Vårt mål är att ge obegränsad intelligens till varje hem och varje Windows-skrivbord." Och deras plan för att uppnå något sånt här var enkel: Väck datorn till liv tack vare "hybrid intelligens". Och gör det med en mycket rimlig strategi: för honom i denna nya och fascinerande era av AI kan vi naturligtvis använda AI-modellerna i molnet som vi har använt de senaste tre åren, men utöver dessa modeller kan vi använda lokala AI-modeller. "Hybrid intelligens" är vettigt Det var där den så kallade "hybrid intelligensen" kom in, ett nytt marknadsföringskoncept som Microsoft Pavan Davuluri, en Microsoft-chef, enkelt förklarade: "Vi är på väg mot en framtid där hybrid intelligens alltid är tillgänglig. Kör lokalt när det är vettigt, få tillgång till molnet om du behöver det och ta med det bästa av båda världarna." Talet var övertygande.

Det var vettigt, eftersom vi tittar på hur det kan vara en bra idé att kombinera båda alternativen, men här formade Microsoft den idén till sin fördel. Han gjorde det genom att antyda att denna hybridintelligens skulle stärka PC-världen igen – som alltid har varit Microsofts värld – eftersom dess nya datorer tillåter oss att njuta av något underbart: "Gratis tokens." Det var så de pratade om dem. När du har en maskin som kan arbeta med lokala AI-modeller är det du genererar med dessa maskiner tydligen gratis.

Du behöver inte betala för ChatGPT- eller Claude-prenumerationer, och kvaliteten på de tillgängliga modellerna är verkligen anmärkningsvärd idag. Gratis tokens? I demon gjord av Kayla Cinnamon, en annan av Microsofts chefer, var det tydligt: ​​när man använde GitHub Copilot med sin nya intelligenta modellrouter kunde man se hur en viss uppgift hade använt vissa "betalda" tokens, men man kunde också se hur många tokens den hade genererat "gratis" tack vare användningen av lokala modeller.

Idén är väldigt kraftfull och gör, som vi sa, mycket vettig. Cinnamon förklarade att du kunde lämna din dator på med GitHub Copilot igång på ditt projekt och "Jag skulle få alla dessa obetalda tokens medan jag sover." Det är sant: de tokens som den lokala modellen genererar har en försumbar kostnad i det ögonblicket: den för energin som utrustningen förbrukar för att kunna generera dem. Det finns också integritetsfaktorn, eftersom samtalen du har med lokala modeller stannar kvar på din maskin, så det är en klar fördel när du till exempel arbetar med känslig data.

Men det finns en annan dold och mycket viktig kostnad som Microsoft inte pratade om. Men gratis, ingenting. Problemet med Microsofts tal är att gratis tokens inte alls är gratis, för för att kunna använda lokala AI-modeller behöver du en PC som kan hantera dem med lätthet, och de där datorerna, speciellt idag, är inte speciellt billiga.

Den nya Microsoft Surface Laptop Ultra Vi har det perfekta exemplet i den nya Microsoft Surface Laptop Ultra, en fantastisk ultraportabel baserad på de nya Nvidia RTX Spark-chippen. Dessa datorer är ett utmärkt alternativ för att kunna använda de lokala AI-modellerna, men för att kunna göra det måste vi betala ut minst $2 599. Det priset är också för basmodellen, som bara har 24 GB LPDDR5x "unified memory" (Microsoft har kopierat namnet från Apple).

Och just dessa 24 GB faller kort för lokala modeller som den populära Qwen3.8-27B, förmodligen den bästa "lilla" modellen i sitt förhållande mellan storlek och prestanda. I själva verket, för att kunna använda den modellen med viss lätthet, är det lämpligt att hoppa till versionen av Surface Laptop Ultra med 32 GB enhetligt minne, vilket går upp till $3 299. Vi har för tillfället inga data om bandbredden på detta minne (Microsoft anger det inte i utrustningens tekniska specifikationer), men det kommer att vara en mer än intressant detalj.

Den M5 Pro-baserade MacBook Pro med 48 GB enhetligt minne är samma pris som 32 GB Surface Laptop Ultra. Vi måste se vilken som presterar bäst med lokala AI-modeller. För för $3 299 kan vi köpa en MacBook Pro med en M5 Pro med 48 GB enhetligt minne och en bandbredd på 307 GB/s.

Det är en lika attraktiv maskin att kunna använda lokala AI-modeller, även om visst i Microsofts förslag det inhemska CUDA-stödet som erbjuds av de slående RTX Spark-chippen fortsätter att väga. Det ska bli intressant att jämföra hur båda maskinerna presterar när man använder lokala AI-modeller, men i vilket fall som helst är en sak klar: de där "gratis tokens" som Microsoft pratar om är inte alls gratis, eftersom du måste investera $2 599 (eller förmodligen mer) i en maskin som ger dig tillgång till den möjligheten. Och $2 599 är många månaders prenumeration på de nuvarande planerna för ChatGPT Plus ($20) eller Claude Pro ($20 också), eller andra jämförbara plattformar.

Dessa planer ger naturligtvis tillgång till de mest avancerade frontier-modellerna på marknaden, men det är också sant att de inte ger dig "oändliga tokens". Det tillkommer användningsavgifter (i dessa två fall, en Och ändå vinner och övertygar hybridintelligens. Den här kritiken av hur idén om hybridintelligens säljs till oss är endast baserad på den felaktighet med gratis tokens som Microsoft använde.

Naturligtvis är de inte gratis, för även om du har ett obegränsat antal tokens, så är den lokala molnintelligensen inte lika bra som den stora initiala investeringen och den av en inledande investering.

Men sanningen är att idén om hybrid intelligens (oavsett om vi vill kalla det det eller inte) fortfarande är mycket kraftfull för framtiden, och det är troligt att det kommer att bli mer än standardsättet på PC, men inte bara på PC. Vi ser det i mobiltelefoner, som innehåller små lokala modeller för att lösa vissa uppgifter, men som också gör det möjligt för oss att komma åt gränsmodeller i molnet. Både Siri AI och Gemini fungerar på det här sättet, och de gör det på ett allt mer transparent sätt för användaren. mycket - du kommer att kunna använda anmärkningsvärda lokala AI-modeller i en mer än anständig hastighet.

Att kombinera dessa modeller med konsultationer till frontier-modeller, oavsett om du betalar ett abonnemang på OpenAI, Anthropic eller någon annan rival, är något självklart för framtiden Xataka Att ha en AI på min mobiltelefon som fungerar utan en internetanslutning är mer användbar än jag trodde: så här kan du starta den. Med tanke på den frenetiska utvecklingen av AI är denna blandade framtid ännu mer meningsfull: öppna modeller blir allt kraftfullare och effektivare, och utvecklingen av hårdvara går parallellt och gör att våra datorer och mobiltelefoner ger oss mer och mer "intelligens som vi redan upplever" för mindre pengar Internets första år där allt dominerades av modem, pip, råa och underbara webbplatser och fruktansvärda anslutningshastigheter, användare betalade per minuts anslutning. Vi gjorde vad vi behövde och kom snabbt ur samtalet så det kostade oss inte mycket.

Sedan kom bredband och schablonpriser och vi kunde njuta av obegränsad internetåtkomst: du betalade (och betalade) hela din månadsavgift framtiden som hägrar är att installera ditt eget "datacenter" hemma för att upprätthålla din AI-konsumtion. Med AI kan exakt samma sak hända. Idag betalar vi för tokens, så vi använder dem när vi behöver dem och lägger snabbt på luren när vi slutar göra det.

Nuvarande prenumerationsplaner är ett första steg mot det "AI-fastpriset" som en dag kan komma, men det är just där lokala AI- och PC-modeller dyker upp igen. Plötsligt har du AI flat rate, lokalt, privat och "ganska smart". Och det är underbart...om du antar att den initiala kostnaden kommer att bli tung.

Men som idé är det förstås väldigt kraftfullt.

Nadella har förmodligen rätt. Det kommer inte att vara den enda som drar fördel av den idén – Apple sålde oss nyligen samma koncept med sina nya Mac-datorer – men hybridintelligens är här för att stanna. Bild | Microsoft i Engadget | Meta vill stå upp mot OpenAI och Google med ett mycket speciellt vapen: en kraftfull AI som fungerar offline på din dator Nyheten Det stora löftet om Microsofts lokala AI är "gratis tokens", det enda problemet är att de inte är gratis publicerades ursprungligen i Xataka av Javier Pastor.

Det stora löftet med Microsofts lokala AI är "gratis tokens", det enda problemet är att de inte är gratis

Originalkälla

Publicerad av Xataka

8 oktober 2026, 16:15

Läs original

Denna artikel har översatts automatiskt från spanska. Klicka på länken ovan för att läsa originaltexten.

Visa originaltext (spanska)

Rubrik

La gran promesa de la IA local de Microsoft son los "tokens gratis", el único problema es que no son gratis

Beskrivning

En julio de 1991 un chaval de 23 años, indio y con su pelo intacto, asistió a una conferencia de desarrolladores de Microsoft que le cambió la vida. Un año después Nadella estaba trabajando en Microsoft y el resto, como suele decirse, es historia.  Ayer Nadella contaba esa historia en el evento conjunto de Microsoft y Nvidia también en San Francisco. Y para él dicho evento podía marcar otro punto de inflexión porque, dijo, "Nuestro objetivo es llevar inteligencia sin límites a cada hogar y a cada escritorio con Windows". Y su plan para lograr algo así era simple:  Hacer resurgir al PC gracias a la "inteligencia híbrida". Y hacerlo con una estrategia muy razonable: para él en esta nueva y fascinante era de la IA podremos usar por supuesto los modelos de IA en la nube que venimos usando en los últimos tres años, pero es que además de esos modelos podremos usar modelos de IA locales.  La "inteligencia híbrida" tiene sentidoAhí es donde entraba la llamada "inteligencia híbrida", un nuevo concepto marketiniano que Microsoft Pavan Davuluri, directivo de Microsoft, explicaba de forma sencilla:   "Nos dirigimos a un futuro en el que la inteligencia híbrida siempre está disponible. Ejecutándose en local cuando tiene sentido, accediendo a la nube si lo necesita y trayendo lo mejor de ambos mundos". El discurso fue convincente. Tenía sentido, porque estamos viendo cómo combinar ambas opciones puede ser una excelente idea, pero aquí Microsoft moldeó esa idea a su favor. Lo hizo insinuando que esa inteligencia híbrida impulsaría de nuevo el mundo del PC —que siempre ha sido el mundo de Microsoft— porque sus nuevos equipos nos permiten disfrutar de algo maravilloso:  "Tokens gratis". Así hablaron de ellos. Cuando tienes una máquina que es capaz de trabajar con modelos locales de IA, lo que generas con esas máquinas es aparentemente gratis. No tienes que pagar suscripciones de ChatGPT o de Claude, y la calidad de los modelos disponibles es realmente notable hoy en día.  ¿Tokens gratis? En la demo que realizó Kayla Cinnamon, otra de las directivas de Microsoft, se vio claro: al usar GitHub Copilot con su nuevo enrutador inteligente de modelos, se pudo ver cómo cierta tarea había usado ciertos tokens "de pago", pero también se podía ver cuántos tokens había generado "gratis" gracias al uso de modelos locales.   La idea es potentísima y tiene, como decíamos muchísimo sentido. Cinnamon explicaba que podía dejar el ordenador encendido con GitHub Copilot funcionando en su proyecto y "estaría consiguiendo todos esos tokens sin pagar mientras duermo".  Eso es cierto: los tokens que está generando el modelo local tienen en ese momento un coste ínfimo: el de la energía que consume el equipo para poder generarlos. Está también el factor privacidad, porque las conversaciones que tienes con modelos locales se quedan en tu máquina, así que es una ventaja clara para trabajar por ejemplo con datos sensibles. Pero es que hay otro coste oculto y muy importante del que Microsoft no habló.  Pero de gratis, nadaEl problema con el discurso de Microsoft es que los tokens gratis no lo son en absoluto, porque para poder usar modelos locales de IA necesitas un PC que pueda manejarlos con soltura, y esos PCs, sobre todo a día de hoy, no son especialmente baratos.  El nuevo Microsoft Surface Laptop Ultra Tenemos el ejemplo perfecto en el nuevo Microsoft Surface Laptop Ultra, un ultraportátil fantástico basado en los nuevos chips Nvidia RTX Spark. Estos equipos son una gran opción para poder usar esos modelos de IA locales, pero para poder hacerlo tendremos que desembolsar al menos 2.599 dólares. Ese precio es además para el modelo base, que solo tiene 24 GB de "memoria unificada" LPDDR5x (Microsoft le ha copiado el nombre de Apple). Y esos 24 GB precisamente se quedan cortos para modelos locales como el popular Qwen3.8-27B, probablemente el mejor "pequeño" modelo en su relación de tamaño/prestaciones.  De hecho, para poder usar ese modelo con cierta soltura conviene dar el salto a la versión del Surface Laptop Ultra con 32 GB de memoria unificada, que sube a 3.299 dólares. No tenemos datos de momento sobre el ancho de banda de esta memoria (Microsoft no los indica en las especificaciones técnicas del equipo), pero ese será un detalle más que interesante.  El MacBook Pro basado en un M5 Pro con 48 GB de memoria unificada tiene el mismo precio que el Surface Laptop Ultra de 32 GB. Habrá que ver cuál se comporta mejor con modelos locales de IA. Porque por 3.299 dólares podemos comprar un MacBook Pro con un M5 Pro con 48 GB de memoria unificada y con un ancho de banda de 307 GB/s. Es una máquina igualmente atrayente para poder usar modelos de IA locales, aunque ciertamente en la propuesta de Microsoft sigue pesando ese soporte nativo de CUDA que ofrecen los llamativos chips RTX Spark.  Será interesante comparar cómo se comportan ambas máquinas al usar modelos de IA locales, pero sea como fuere, una cosa está clara: esos "tokens gratis" de los que habla Microsoft no son en absoluto gratis, porque tienes que invertir 2.599 dólares (o probablemente más) en una máquina que te dé acceso a esa posibilidad.  Y 2.599 dólares son muchos meses de suscripción a los planes actuales de ChatGPT Plus (20 dólares) o Claude Pro (20 dólares también), o bien de otras plataformas comparables. Dichos planes dan por supuesto acceso a los modelos frontera más avanzados del mercado, pero también es cierto que no te dan "tokens infinitos".  Hay cuotas de uso (en estos dos casos, un número X de tokens cada cinco horas y un número Y de tokens cada semana), pero aun así son una excelente opción para un gran número de usuarios, y si necesitas más siempre puedes acceder a planes más caros con más cuota... o a la API, que sí ofrece tokens infinitos pero que también puede suponer un coste infinito porque es la opción "pago por uso" ilimitada.  Y aun así, la inteligencia híbrida vence y convenceEsta crítica a la forma de vendernos la idea de la inteligencia híbrida se basa solo en esa falacia de los tokens gratis que utilizó Microsoft. Por supuesto que no son gratis, porque aunque tienes tokens ilimitados, esa inteligencia local no es tan buena como la de la nube y además impone una fuerte inversión inicial.  {"videoId":"xackz8k","autoplay":false,"title":"Introducing Surface Laptop Ultra", "tag":"portátil", "duration":"51"} Pero lo cierto es que la idea de la inteligencia híbrida (queramos llamarla así o no) sigue siendo muy potente de cara al futuro, y es más que probable que se imponga como la forma estándar de trabajar con IA, no solo en el PC, sino en el resto de dispositivos.  Lo estamos viendo en los móviles, que incorporan pequeños modelos locales para resolver algunas tareas, pero que también permiten darnos acceso a modelos frontera en la nube. Tanto Siri AI como Gemini funcionan de esa forma, y lo hacen cada vez de forma más transparente para el usuario. Con el PC y otros dispositivos está ocurriendo lo mismo: si tienes un equipo relativamente potente en el que ya realizaste una inversión importante —una GPU con al menos 16 GB de memoria gráfica ayuda mucho— podrás usar modelos locales de IA notables a una velocidad más que decente.  Combinar esos modelos con consultas a modelos frontera, pagues o no una suscripción a OpenAI, Anthropic o cualquier otro rival es algo obvio de cara al futuro. La idea es sencilla: modelos más o menos caros en la nube para las tareas más o menos complejas, y modelos "gratuitos" (con muchas comillas) en local para otras tareas más rutinarias y simples.  En Xataka Tener una IA en mi móvil que funciona sin conexión a Internet es más útil de lo que pensaba: así la puedes poner en marcha Teniendo en cuenta la frenética evolución de la IA, ese futuro mixto tiene aún más sentido: los modelos abiertos son cada vez más potentes y eficientes, y la evolución del hardware va en paralelo y hace que nuestros PCs y móviles nos den cada vez más "inteligencia" por menos dinero.  Esa idea me recuerda a otra que ya vivimos: en los primeros años de internet en la que todo estaba dominado por módems, pitidos, webs toscas y maravillosas y velocidades de conexión terribles, los usuarios pagábamos por minuto de conexión.  Hacíamos lo que necesitábamos y salíamos rápido de la llamada para que no nos costara mucho. Luego llegaron la banda ancha y las tarifas planas y pudimos disfrutar de un acceso ilimitado a internet: pagabas (y pagas) una cuota mensual, y toda internet estaba a tu alcance en cualquier momento y lugar. El NAS es el pasado: el futuro que asoma es instalar tu propio "centro de datos" en casa para sostener tu consumo de IA Con la IA puede que ocurra exactamente lo mismo. Hoy pagamos por los tokens, así que los usamos cuando los necesitamos y "colgamos" rápidamente esa llamada cuando dejamos de hacerlo. Los planes actuales de suscripción son un primer paso para esa "tarifa plana de IA" que puede llegar algún día, pero precisamente ahí es donde los modelos locales de IA y el PC resurgen.  De repente tienes tarifa plana de la IA, local, privada y "bastante inteligente".  Y eso es maravilloso... si asumes que el coste inicial será fuerte. Pero como idea, desde luego, es potentísima. Nadella probablemente tenga razón. No será ni mucho menos el único en aprovechar esa idea —Apple nos vendió el mismo concepto hace poco con sus nuevos Mac—, pero la inteligencia híbrida está aquí para quedarse. Imagen | Microsoft En Xataka | Meta quiere plantar cara a OpenAI y Google con un arma muy particular: una IA potente que funciona offline en tu ordenador - La noticia La gran promesa de la IA local de Microsoft son los "tokens gratis", el único problema es que no son gratis fue publicada originalmente en Xataka por Javier Pastor .

0 visningar
Dela:

Svep för att byta artikel

Vi använder cookies

Vi använder cookies för att förbättra din upplevelse på vår webbplats. Genom att klicka "Acceptera alla" samtycker du till användningen av alla cookies. Läs mer i vår cookiepolicy och integritetspolicy.