• 16 lanes di essecuzione (processori di thread).
    • Ogni lane esegue un thread di 32 istruzioni SIMD
  • Pipeline meno profonde
  • Molti più cammini di esecuzione