Las estaciones de trabajo de IA han ganado popularidad en la comunidad de desarrollo de inteligencia artificial en los últimos años. Sin embargo, los PCs modernos han demostrado ser insuficientes para satisfacer las necesidades de las aplicaciones de IA más complejas. Una laptop promedio solo tiene suficiente memoria para cargar modelos de lenguaje grande (LLM) con hasta 8 a 13 mil millones de parámetros, muy lejos de la capacidad de los modelos de vanguardia que se estiman tienen más de un trillón de parámetros.
La situación se complica aún más cuando se intenta cargar modelos de mayor tamaño en PCs de sobremesa, incluso los más capaces. Es común que estos sistemas se atasquen o se ralenticen significativamente al intentar cargar modelos con más de 70 mil millones de parámetros.
Ha llegado el momento de cambiar la ecuación con la estación de trabajo de IA QuietBox 2 de Tenstorrent. Aunque en apariencia es una PC de sobremesa convencional, esta estación de trabajo oculta cuatro aceleradores de IA personalizados Blackhole de la empresa, 128 gigabytes de memoria GDDR6 y 256 GB de memoria DDR5 (totalizando 384 GB). Esta configuración proporciona suficiente memoria para cargar el modelo GPT-OSS-120B de OpenAI y puede ejecutar modelos de tamaño medio como Llama 3.1 70B de Meta a velocidades de casi 500 tokens por segundo. Para referencia, esto es varias veces más rápido que la respuesta promedio del modelo GPT-5.2 de OpenAI o Claude 4.6 de Anthropic.