AMD compra Taalas, la empresa que graba los modelos de IA dentro del propio chip
La industria de la IA lleva años con el mismo problema: la tarjeta gráfica es rapidísima, pero se pasa la vida esperando a que la memoria le mande los pesos del modelo. Taalas lo resolvió por la vía radical, grabando el modelo dentro del chip. AMD acaba de comprar la empresa.
Qué ha comprado AMD
AMD ha acordado adquirir Taalas, una empresa de Toronto fundada en 2023 que fabrica chips específicos para un solo modelo. La operación se anunció el 6 de agosto y la confirmó CNBC, aunque la compañía ha declinado revelar el importe.
La idea es sencilla de contar y difícil de ejecutar: en lugar de guardar los pesos en memoria de alto ancho de banda y moverlos en cada paso, los funde en los transistores. El modelo deja de ser un fichero que se carga y pasa a ser parte del cableado.
Los números de su demostrador, el HC1, construido alrededor de Llama 3.1 8B:
- Hasta 17.000 tokens por segundo y usuario, según mediciones de la propia Taalas.
- Un chip de 815 mm² fabricado en el nodo de 6 nm de TSMC, con 53.000 millones de transistores.
- Más de 219 millones de dólares captados, 169 de ellos en la última ronda, con Quiet Capital, Fidelity y el inversor Pierre Lamond entre los respaldos.

El precio de ir tan rápido
Detrás de Taalas está Ljubisa Bajic, fundador también de Tenstorrent, con Lejla Bajic en operaciones y Drago Ignjatovic como director técnico. Gente que lleva media vida diseñando silicio.
Y la pega es grande: un chip sirve para un modelo, y solo para uno. Cuando el modelo se actualiza —cada pocos meses, en este sector— el silicio no se reaprovecha.
La velocidad se paga con flexibilidad. Es la vieja disyuntiva de los circuitos a medida, aplicada a un sector donde lo que se fija en el silicio caduca a una velocidad récord.
El plan de AMD, según ServeTheHome, no es sustituir nada: integrarlo en su hoja de ruta y venderlo como sistema, junto a las GPU Instinct. El reparto que describe The Register es elegante: la GPU digiere tu pregunta y el chip de Taalas escupe la respuesta palabra a palabra, que es donde la memoria más estorba. La incógnita es cuánto tarda un demostrador en ser un producto comprable.
Toque Personal: esto acaba en tu factura, aunque no compres chips
Ninguno de los que leemos esto vamos a comprar un acelerador de AMD. Y aun así, esta noticia va sobre el precio que pagarás por la IA dentro de dos años.
Cuando pagas por tokens estás pagando hardware de propósito general haciendo una tarea muy repetitiva: un camión articulado repartiendo sobres. Los chips específicos son la furgoneta, y por eso salen más baratos por trayecto.
Lo que me parece razonable planificar:
- Dos velocidades de precio. Los modelos estables y muy usados se abaratarán antes: solo a ellos les compensa tener silicio propio.
- Menos prisa por la última versión. Si el modelo del año pasado corre a una décima parte del coste, ir un escalón por detrás es una decisión de márgenes.
- La eficiencia como producto. Cada vez más proveedores venderán «lo mismo, más barato» en lugar de «algo mejor, más caro».
Mi consejo sigue siendo el de siempre: no ates tu producto a un modelo concreto. Deja la elección del proveedor en una sola capa de tu código y podrás cambiarte en una tarde.
La pelea se ha mudado al silicio
Esta compra es el patrón del verano: Tesla y SpaceX levantando su fábrica en Texas, Anthropic montando un equipo interno de diseño de chips y ahora AMD comprando la vía rápida. Quien controle el coste de la inferencia controlará el margen del sector.
Es la otra cara de la retirada de ventajas fiscales a los centros de datos: si la electricidad y el suelo se encarecen, la única salida es gastar menos vatios por token. Eso ya no se arregla con software.
¿Tú tienes tu producto atado a un modelo concreto, o podrías cambiar de proveedor sin reescribirlo entero? Te leo en los comentarios.
Cifras de financiación y del procesador HC1, en Data Center Dynamics.