La IA diseña su propio acelerador de inferencia y lo ejecuta en una FPGA
AI is now capable of developing its own inference hardware

openTPU es un acelerador de IA de código abierto creado por agentes de IA: incluye RTL, ISA, simulador, compilador y profiler en un solo repositorio. Corre diez modelos modernos con pesos reales en una tarjeta Kintex-7, logrando hasta 85.8 tok/s en decodificación y coincidiendo bit a bit con el simulador. También soporta modelos MoE más grandes que la memoria de la tarjeta mediante streaming de expertos desde el host.
¿Hasta dónde pueden llegar los agentes de IA en el diseño de hardware, y pueden construir el chip que ejecuta su propia inferencia?