AMD i Cerebras s'uneixen contra les LPUs Groq de Nvidia

AMD i Cerebras combinen GPUs Instinct amb acceleradors SRAM per aconseguir 5x més tokens per watt en inferència de baixa latència. Disponible aquest any.

viernes, 24 de julio de 2026 • 3 min de lectura • Equip Q2BSTUDIO

Plataforma desagregada para inferencia ultrarrápida

La col·laboració entre AMD i Cerebras Systems, anunciada durant la conferència Advancing AI de Lisa Su, marca una fita en la computació desagregada per a inferència d'IA. Mentre que les GPUs d'AMD són excel·lents per entrenar models, el coll d'ampolla en la generació de tokens rau en la memòria. Cerebras, amb els seus Wafer Scale Engines (WSE) basats en SRAM al xip —ordres de magnitud més ràpida que la HBM—, ofereix una latència ultrabaja que supera els 2.000 tokens per segon. La proposta combina la capacitat de còmput de les Instinct amb la velocitat de memòria de Cerebras, aconseguint fins a 5 vegades més tokens per watt. Aquest moviment desafia directament Nvidia, que va invertir 20.000 milions de dòlars en l'adquisició de Groq i les seves LPUs per servir models de gran escala com Kimi K2.5. Mentre Nvidia necessita dos mil LPUs per gestionar un model d'un bilió de paràmetres, AMD i Cerebras afirmen que n'hi haurà prou amb unes poques dotzenes dels seus acceleradors. La solució estarà disponible a Cerebras Cloud a finals d'any. En l'ecosistema obert d'AMD, aquesta aliança obre la porta a més acords de desagregació de càrregues de treball. Per a les empreses que busquen implementar agents d'IA amb alta interactivitat, aquesta arquitectura suposa un salt qualitatiu. No obstant, la integració de maquinari heterogeni requereix un programari d'orquestració sofisticat. Aquí és on empreses com Q2BSTUDIO aporten valor: desenvolupen aplicacions a mida que optimitzen l'ús d'infraestructures híbrides, combinant GPUs, acceleradors SRAM i serveis cloud AWS/Azure. Per exemple, en dissenyar agents intel·ligents per a processos empresarials, és crucial triar la plataforma d'inferència adequada i gestionar la latència de forma eficient. La ciberseguretat també hi juga un paper clau; una arquitectura desagregada exposa noves superfícies d'atac que requereixen solucions de pentesting i monitoratge continu, serveis que Q2BSTUDIO integra als seus projectes. A més, l'anàltica de dades en temps real, potenciada per eines com Power BI, permet visualitzar el rendiment d'aquests sistemes i prendre decisions basades en mètriques de tokens per segon i consum energètic. L'aliança AMD-Cerebras no només competeix amb Nvidia, sinó que impulsa un enfocament modular que beneficia tota la indústria. A mesura que els agents IA es tornen autònoms —des d'assistents conversacionals fins a sistemes de trading algorítmic—, la necessitat d'inferència ultrarràpida es dispara. Q2BSTUDIO, especialista en IA i automatització, ajuda les empreses a adoptar aquestes innovacions sense perdre el control de costos ni la seguretat. En un mercat on la velocitat de resposta defineix l'experiència d'usuari, la combinació de GPUs Instinct i WSE de Cerebras promet revolucionar el desplegament de models de llenguatge. A més, l'estratègia d'AMD de col·laborar amb startups com Cerebras en lloc de comprar-les directament fomenta un ecosistema més dinàmic. Lisa Su va insinuar que hi haurà més acords de desagregació en el futur, cosa que suggereix que l'arquitectura de maquinari especialitzat es convertirà en la norma. Per a les empreses tecnològiques, això significa que s'han de preparar per integrar múltiples acceleradors als seus fluxos de treball, un repte que Q2BSTUDIO resol mitjançant programari a mida que abstrau la complexitat del maquinari. La inferència d'IA ja no serà un monòlit; serà un conjunt de components orquestrats amb precisió. En definitiva, l'aliança AMD-Cerebras no és només una batalla comercial contra Nvidia, sinó una invitació a repensar com dissenyem sistemes d'IA. Amb el suport d'empreses com Q2BSTUDIO, qualsevol organització pot aprofitar aquestes tecnologies per crear aplicacions més ràpides, segures i escalables.

UNA PAUSA?

Juga una estona abans de marxar

ELS NOSTRES SERVEIS

Com et podem ajudar

Tens un projecte en ment?

Explica'ns la teva visió i la convertim en una solució de programari. Sigui quin sigui l'abast, fem realitat la teva idea.