AMD compra Taalas: chips que graban el modelo directamente en el silicio

By Carlos Montiel | Especialista en IA Empresarial
Publicado: 2026-09-01 | Por: Carlos Montiel | Lectura: ~5 minutos

AMD anunció el 6 de agosto la adquisición de Taalas, una startup de Toronto que hace algo poco convencional: en lugar de correr un modelo sobre un chip de propósito general, graba los pesos de ese modelo directamente en el silicio. El resultado, según la compañía, es inferencia radicalmente más rápida y barata en energía — a costa de perder la flexibilidad de un chip genérico.

Un chip por modelo, no un chip para todos los modelos

Taalas fue fundada en 2023 por exarquitectos de Tenstorrent y AMD, y hasta ahora había levantado 219 millones de dólares. Su enfoque es "hardwiring": en vez de cargar los pesos de un modelo en memoria y ejecutarlos sobre un procesador flexible como una GPU, los codifican directamente en el diseño del chip. Eso elimina buena parte del movimiento de datos entre memoria y cómputo que hoy es el cuello de botella dominante en inferencia a gran escala.

Los números que está mostrando Taalas

El chip actual de la compañía está diseñado específicamente para Llama 3.1 8B de Meta. Según reportes de la adquisición, alcanza cerca de 17,000 tokens por segundo por usuario, con un rack completo consumiendo entre 12 y 15 kW — frente a los 120-600 kW que requiere un rack de GPUs comparable para una carga similar. Es una diferencia de un orden de magnitud en consumo energético.

El costo de esa velocidad: un chip grabado para un modelo específico deja de servir en cuanto ese modelo se actualiza o se reemplaza. Es el opuesto exacto de la flexibilidad que ofrece una GPU de propósito general — una apuesta que solo tiene sentido quirúrgicamente, para cargas de inferencia masivas y estables sobre un modelo que no va a cambiar cada trimestre.

Dónde encaja en el roadmap de AMD

El acuerdo, con términos no revelados, se espera que cierre en el cuarto trimestre de 2026 sujeto a aprobación regulatoria. AMD planea integrar la tecnología de Taalas junto a sus GPUs Instinct, procesadores EPYC, la plataforma de rack Helios y el software ROCm, apuntando a productos a nivel de sistema en lugar de un chip aislado.

Qué significa para tu empresa: si tu organización corre inferencia a volumen alto sobre un modelo abierto estable (piensa en un asistente interno o un clasificador que no cambia de versión cada mes), silicio dedicado como el de Taalas podría, en unos trimestres, ofrecer una reducción drástica en el costo de energía por token. Pero es una apuesta de infraestructura de largo plazo con un modelo "congelado" — vale la pena seguir el roadmap de AMD antes de comprometer presupuesto, y no es sustituto de GPUs de propósito general para cargas que cambian de modelo con frecuencia.
Carlos Montiel
Arquitecto de Soluciones IA Empresarial
Especialista en LLMs, Agentes y Orquestación
guatemalia.com/#contacto · info@guatemalia.com

¿Necesitas implementar IA en tu empresa?

Carlos Montiel es arquitecto de soluciones IA empresarial. Implementa LLMs, Agentes, RAG y orquestadores en empresas de Guatemala y Latinoamérica. Contáctalo para una consultoría.

Contactar a Carlos Montiel

info@guatemalia.com