AMD adquirió Taalas, startup canadiense especializada en grabar modelos de inteligencia artificial directamente en silicio, logrando velocidades de inferencia de hasta 17.000 tokens por segundo, 48 veces más rápido que las GPU de Nvidia.
¿Cómo funciona la tecnología de Taalas?
A diferencia de las GPU convencionales que almacenan los pesos de los modelos en memoria HBM, la tecnología de Taalas graba esos pesos directamente en el silicio del chip, convirtiéndolo en un circuito integrado específico de modelo (MSIC). Este enfoque radical elimina los cuellos de botella de acceso a memoria y permite alcanzar velocidades extraordinarias de procesamiento.
El chip de prueba HC1, fabricado con proceso de 6 nanómetros en TSMC, demostró servir el modelo Llama 3.1 8B a 16.960 tokens por segundo durante las pruebas en febrero de 2026. Esa velocidad representa una mejora de 48 veces respecto a GPU de Nvidia y 8,5 veces más rápido que los aceleradores de Cerebras, según los datos divulgados en ese período.
Roadmap y capacidades futuras del hardware
AMD planea lanzar el chip HC2 de segunda generación durante el verano de 2026, con capacidad para procesar modelos de 20 mil millones de parámetros. Con esa escala, solo serían necesarios 50 aceleradores Taalas para servir un modelo de un billón de parámetros usando paralelismo de tubería.
En comparación, los sistemas LPX de Nvidia requerirían varias docenas de GPU, mientras que la solución Groq necesitaría al menos 2.000 LPU para la misma tarea. Esta ventaja de densidad posiciona a AMD en una línea competitiva directa con el acuerdo de licencia de US$ 20.000 millones que Nvidia cerró con Groq en diciembre de 2025 para servicios de inferencia premium.
Arquitectura desagregada: cómo se integra con AMD Instinct
AMD planea combinar los racks Helios basados en Instinct con los chips Taalas en una arquitectura desagregada. El procesamiento inicial de prompts, que requiere alta carga computacional, se ejecutaría en GPU Instinct, mientras que la generación de tokens se descargaría a los aceleradores Taalas para optimizar velocidad y eficiencia.
Vamsi Boppana, vicepresidente sénior de IA de AMD, señaló que la compañía está construyendo una plataforma de inteligencia artificial de pila completa para dar flexibilidad a los clientes. También es probable que AMD implemente un modelo tick-tock donde los clientes validen inicialmente los modelos en aceleradores Instinct y luego migren a los aceleradores Taalas para producción.
Limitaciones y costos de cambio de modelo
La principal limitación de esta tecnología es que una vez desplegado el chip, el modelo queda fijo en el silicio. Cualquier cambio más grande que un adaptador LoRA requeriría fabricar nuevos chips, un proceso costoso y que consume tiempo. Sin embargo, Taalas asegura que no es necesario empezar de cero: solo se necesita cambiar dos capas de metal, lo que es significativamente más barato y rápido que fabricar el chip desde cero.
Grabar los pesos de un modelo en silicio es 100 veces menos costoso que entrenar un modelo de frontera, según declaraciones de Taalas en febrero de 2026. Este diferencial de costo podría atraer a grandes desarrolladores como OpenAI, Anthropic y Meta, que ya son clientes de AMD Instinct.
Implicaciones para empresas y administradores de negocios en Argentina
Para las empresas argentinas que utilizan o planean implementar soluciones de inteligencia artificial, esta adquisición marca un cambio relevante en el panorama de hardware disponible. La competencia entre AMD-Taalas y Nvidia-Groq por dominar los servicios de inferencia premium tendrá impacto directo en los costos de acceso a modelos de IA de alto rendimiento.
Las pymes y empresas medianas que requieren procesamiento de IA en tiempo real —desde análisis de datos masivos hasta chatbots empresariales— podrían beneficiarse de la reducción de costos de inferencia que esta tecnología promete. Además, la menor inversión en capex para grabar modelos en silicio podría democratizar el acceso a soluciones de IA personalizadas para negocios locales.
El acuerdo se espera que se cierre en el cuarto trimestre de 2026, sujeto a aprobación regulatoria. Los términos financieros aún no han sido divulgados, aunque se confirma que se trata de una adquisición real y no un acquihire.







