All AI GPUs — Specs, Benchmarks & Pricing

Browse every AI GPU in one filterable table. Sort by VRAM, bandwidth, LLM inference speed, power draw, and MSRP.

Benchmark column shows tokens/second for Llama-3.1-8B (Q8) and Llama-3-70B (Q4_K_M)

GPU Mfr VRAM Type BW (GB/s) TDP 8B (t/s) 70B (t/s) MSRP Year Status
GeForce RTX 5090 NVIDIA 32 GDDR7 1792 575W $1,999 2025 available
GeForce RTX 5080 NVIDIA 16 GDDR7 960 360W $999 2025 available
GeForce RTX 4080 SUPER NVIDIA 16 GDDR6X 736 320W $999 2024 available
Radeon RX 7600 XT AMD 16 GDDR6 288 190W $329 2024 available
Arc B580 Intel 12 GDDR6 456 190W $249 2024 available
GeForce RTX 4060 Ti 16GB NVIDIA 16 GDDR6 288 160W $499 2023 available
RTX 6000 Ada NVIDIA 48 GDDR6 960 300W $6,800 2023 available
GeForce RTX 4090 NVIDIA 24 GDDR6X 1008 450W $1,599 2022 available
Radeon RX 7900 XTX AMD 24 GDDR6 864 355W $999 2022 available
RTX A6000 NVIDIA 48 GDDR6 768 300W $4,500 2021 available
GeForce RTX 3090 NVIDIA 24 GDDR6X 936 350W $1,499 2020 eol

CompareAIHardware.com participates in the Amazon Associates program. Benchmark sources: MLPerf, llama.cpp repo, Tom's Hardware, Reddit r/LocalLLaMA. Estimates marked on detail pages.