Según informes de The Wall Street Journal, el 23 de julio, Nvidia presentó especificaciones técnicas detalladas para su arquitectura de CPU Vera, que incluye 88 núcleos ARM Olympus personalizados, un ancho de banda de memoria de 1,2 TB/s y un ancho de banda de interconexión en el chip de 3,4 TB/s. Nvidia sitúa Vera en torno a la latencia de un solo hilo y la eficiencia de utilización de la GPU, argumentando que los agentes de IA dependen de interacciones repetidas CPU-GPU en las que cada paso requiere que el anterior haya terminado.
AMD responde que, en sistemas de IA a escala de producción, se necesita un alto rendimiento concurrente en lugar de un rendimiento bruto de un solo hilo. Según el último informe del analista de Bank of America, Vivek Arya, en una implementación simulada en rack de 100 kilovatios, el EPYC 9965 (Turin) de AMD ofrece aproximadamente 2,4x más rendimiento a nivel de rack en comparación con Vera; se prevé que el EPYC 6 (Venice) de próxima generación alcance 3,3x. La disputa refleja visiones enfrentadas sobre el mercado de CPU de servidores, que se prevé que alcance 170 mil millones de dólares para 2030. AMD presentará formalmente su framework en su evento de tecnología de IA 2026 el jueves.