L'escena es repeteix a cada demo de NAiOS Labs: algú de l'equip, amb més energia que un científic de pel·lícula a punt de cridar "això és!", assenyala un rack ple de mòduls brillants i deixa anar una xifra: "quaranta TOPS per tres watts". I mitja sala assenteix mentre l'altra mitja pensa: i què dimonis és un TOPS? Avui responem a aquesta meitat, que té tota la raó de preguntar.
La definició en una frase
TOPS significa Tera Operations Per Second: bilions d'operacions per segon. És la unitat amb què es mesura la potència bruta dels acceleradors d'IA, especialment les NPUs. Un xip "de 40 TOPS" executa quaranta bilions de multiplicacions i sumes elementals cada segon, que és just el tipus d'aritmètica de què estan fetes les xarxes neuronals. És al hardware d'IA el que els cavalls a un cotxe: la xifra que resumeix, de manera imperfecta, quanta potència hi ha sota el capó.
La lletra petita: INT8, pics i memòria
Tres matisos separen el comprador informat del que s'endú el xip equivocat. Primer, la precisió: els TOPS s'anuncien gairebé sempre en INT8 (enters de 8 bits); el mateix silici rendeix el doble en INT4 i la meitat en FP16, així que comparar xifres sense mirar la precisió és comparar peres amb pomes. Segon, són un pic teòric: el número suposa que les unitats de càlcul mai no esperen les dades, cosa que a la pràctica passa constantment. I tercer, el que més fa mal amb els LLMs: la memòria. Un model gran ha de cabre en memòria i fluir-hi a tota velocitat; per això un xip amb menys TOPS però 80 GB ben alimentats pot moure un model que ofega un altre de nominalment més potent. En models grans, l'ample de banda mana tant com el còmput.
Referències reals de 2026
Per calibrar l'ull: la NPU d'un portàtil "AI PC" ronda els 40–50 TOPS (40 és el llindar de Copilot+), una Hailo-10H dona 40 TOPS consumint 3 watts, una Axelera Metis arriba a 214, un NVIDIA Jetson AGX Orin a 275 i el Tiiny AI Pocket Lab combina ~190 TOPS amb 80 GB de memòria. A escala de datacenter la xifra per xip perd sentit i es parla de rendiment per rack, com a les Qualcomm AI200/AI250. Tens les cinc unitats analitzades al nostre top 5 de NPUs 2026–2027.
El número que de debò separa generacions
Si només pots mirar una mètrica, mira TOPS per watt. L'eficiència és el que ha fet possible baixar la IA del datacenter a la butxaca, i és la mètrica sobre la qual estem dissenyant a NAiOS Labs la nostra unitat NPU en format rack per a datacenters propis: maximitzar inferència per watt significa més IA sobirana per cada euro de factura elèctrica. La regla pràctica per triar hardware són tres preguntes juntes: pot amb el model (TOPS)?, hi cap el model (memòria)? i a quin cost (TOPS/watt)?
Segueix a la wiki
Hem publicat l'entrada TOPS a la NAiOS Wiki amb l'explicació de referència, i la seva companya NPU amb la comparativa completa d'unitats i vint casos d'ús. I si vols saber què encaixa en el teu cas —d'un assistent ofimàtic privat a visió industrial—, parlem: a NAiOS Labs ens sobren els TOPS i l'entusiasme.






