Placa PCIe da Skymizer roda LLMs de até 700B com 240 W, sem precisar de clusters de GPUs.
Romário Leite · 13 de maio de 2026
A empresa taiwanesa Skymizer apresenta a HTX301, placa PCIe projetada para inferência de modelos de linguagem de grande porte.
A HTX301 consegue executar inferência de redes com até 700 bilhões de parâmetros em uma única placa.
O chip opera com 240 W, bem abaixo dos 600 W de aceleradores mais potentes, mantendo latência previsível.
Baseada na arquitetura LPU de 28 nm, a placa traz até 384 GB de memória LPDDR4/LPDDR5, sem usar HBM ou GDDR6.
A LPU octa-core atinge 240 tokens por segundo no prefill do Llama2 7B; com vários chips chega a 1.200 tokens por segundo.
A Skymizer mostrará a HTX301 na Computex 2026, buscando atender empresas que preferem IA local ao uso de nuvem.
TecFoco