{"meta": {"attribution": "GetDeploying, https://getdeploying.com/gpus", "license": "CC-BY-4.0", "models": 107, "rows": 112, "updated": "2026-09-14"}, "data": [{"gpu_slug": "amd-mi210", "name": "AMD MI210", "vendor": "AMD", "release_date": "2022-03-22", "form_factor": null, "memory": {"capacity_gb": 64, "type": "HBM2e", "bandwidth_gbps": 1638, "bus_bits": 4096, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": 300, "pcie_gen": 4, "pcie_lanes": 16}, "compute": {"fp16": {"dense_tflops": 181.0}, "int8": {"dense_tops": 181.0}, "fp32": {"dense_tflops": 45.3}, "fp64": {"dense_tflops": 22.6}}, "silicon": {"architecture": "CDNA 2", "process": "TSMC 6nm FinFET", "transistors_b": null, "shader_cores": 6656, "matrix_cores": 416, "compute_units": 104}, "power": {"tdp_w": 300, "cooling": "passive"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP16", "BF16", "FP32", "FP64", "INT4", "INT8"], "datasheet_url": "https://www.amd.com/content/dam/amd/en/documents/instinct-business-docs/product-briefs/instinct-mi210-brochure.pdf"}, {"gpu_slug": "amd-mi250", "name": "AMD MI250", "vendor": "AMD", "release_date": "2021-11-08", "form_factor": null, "memory": {"capacity_gb": 128, "type": "HBM2e", "bandwidth_gbps": 3200, "bus_bits": 8192, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": 400, "pcie_gen": 4, "pcie_lanes": 16}, "compute": {"fp16": {"dense_tflops": 362.1}, "int8": {"dense_tops": 362.1}, "fp32": {"dense_tflops": 90.5}, "fp64": {"dense_tflops": 45.3}}, "silicon": {"architecture": "CDNA 2", "process": "TSMC 6nm FinFET", "transistors_b": null, "shader_cores": 13312, "matrix_cores": 832, "compute_units": 208}, "power": {"tdp_w": 500, "cooling": "passive"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP16", "BF16", "FP32", "FP64", "INT4", "INT8"], "datasheet_url": "https://www.amd.com/content/dam/amd/en/documents/instinct-tech-docs/instinct-mi200-datasheet.pdf"}, {"gpu_slug": "amd-mi300x", "name": "AMD MI300X", "vendor": "AMD", "release_date": "2023-12-06", "form_factor": null, "memory": {"capacity_gb": 192, "type": "HBM3", "bandwidth_gbps": 5300, "bus_bits": 8192, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": 896, "pcie_gen": 5, "pcie_lanes": 16}, "compute": {"fp8": {"dense_tflops": 2614.9, "sparse_tflops": 5229.8}, "fp16": {"dense_tflops": 1307.4, "sparse_tflops": 2614.9}, "int8": {"dense_tops": 2614.9, "sparse_tops": 5229.8}, "fp32": {"dense_tflops": 163.4}, "fp64": {"dense_tflops": 81.7}}, "silicon": {"architecture": "CDNA 3", "process": "TSMC 5nm / 6nm FinFET", "transistors_b": 153, "shader_cores": 19456, "matrix_cores": 1216, "compute_units": 304}, "power": {"tdp_w": 750, "cooling": "passive"}, "platform": {"mig_instances": null, "partitions": 8}, "market_class": "DATACENTER", "supported_precisions": ["FP8", "FP16", "BF16", "TF32", "FP32", "FP64", "INT8"], "datasheet_url": "https://www.amd.com/content/dam/amd/en/documents/instinct-tech-docs/data-sheets/amd-instinct-mi300x-data-sheet.pdf"}, {"gpu_slug": "amd-mi325x", "name": "AMD MI325X", "vendor": "AMD", "release_date": "2024-10-10", "form_factor": null, "memory": {"capacity_gb": 256, "type": "HBM3e", "bandwidth_gbps": 6000, "bus_bits": 8192, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": 896, "pcie_gen": 5, "pcie_lanes": 16}, "compute": {"fp8": {"dense_tflops": 2614.9, "sparse_tflops": 5229.8}, "fp16": {"dense_tflops": 1307.4, "sparse_tflops": 2614.9}, "int8": {"dense_tops": 2614.9, "sparse_tops": 5229.8}, "fp32": {"dense_tflops": 163.4}, "fp64": {"dense_tflops": 81.7}}, "silicon": {"architecture": "CDNA 3", "process": "TSMC 5nm / 6nm FinFET", "transistors_b": 153, "shader_cores": 19456, "matrix_cores": 1216, "compute_units": 304}, "power": {"tdp_w": 1000, "cooling": "passive"}, "platform": {"mig_instances": null, "partitions": 8}, "market_class": "DATACENTER", "supported_precisions": ["FP8", "FP16", "BF16", "TF32", "FP32", "FP64", "INT8"], "datasheet_url": "https://www.amd.com/content/dam/amd/en/documents/instinct-tech-docs/product-briefs/instinct-mi325x-datasheet.pdf"}, {"gpu_slug": "amd-mi350x", "name": "AMD MI350X", "vendor": "AMD", "release_date": "2025-06-12", "form_factor": null, "memory": {"capacity_gb": 288, "type": "HBM3e", "bandwidth_gbps": 8000, "bus_bits": 8192, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": 1075, "pcie_gen": 5, "pcie_lanes": 16}, "compute": {"fp4": {"dense_tflops": 9227.5}, "fp8": {"dense_tflops": 4614.0, "sparse_tflops": 9227.4}, "fp16": {"dense_tflops": 2309.6, "sparse_tflops": 4619.2}, "int8": {"dense_tops": 4614.0, "sparse_tops": 9227.4}, "fp32": {"dense_tflops": 144.2}, "fp64": {"dense_tflops": 72.1}}, "silicon": {"architecture": "CDNA 4", "process": "TSMC 3nm / 6nm FinFET", "transistors_b": 185, "shader_cores": 16384, "matrix_cores": 1024, "compute_units": 256}, "power": {"tdp_w": 1000, "cooling": "passive"}, "platform": {"mig_instances": null, "partitions": 8}, "market_class": "DATACENTER", "supported_precisions": ["FP4", "FP6", "FP8", "FP16", "BF16", "FP32", "FP64", "INT8"], "datasheet_url": "https://www.amd.com/content/dam/amd/en/documents/instinct-tech-docs/product-briefs/amd-instinct-mi350x-gpu-brochure.pdf"}, {"gpu_slug": "amd-mi355x", "name": "AMD MI355X", "vendor": "AMD", "release_date": "2025-06-12", "form_factor": null, "memory": {"capacity_gb": 288, "type": "HBM3e", "bandwidth_gbps": 8000, "bus_bits": 8192, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": 1075, "pcie_gen": 5, "pcie_lanes": 16}, "compute": {"fp4": {"dense_tflops": 10066.3}, "fp8": {"dense_tflops": 5033.2, "sparse_tflops": 10066.4}, "fp16": {"dense_tflops": 2516.6, "sparse_tflops": 5033.2}, "int8": {"dense_tops": 5033.2, "sparse_tops": 10066.4}, "fp32": {"dense_tflops": 157.3}, "fp64": {"dense_tflops": 78.6}}, "silicon": {"architecture": "CDNA 4", "process": "TSMC 3nm / 6nm FinFET", "transistors_b": 185, "shader_cores": 16384, "matrix_cores": 1024, "compute_units": 256}, "power": {"tdp_w": 1400, "cooling": null}, "platform": {"mig_instances": null, "partitions": 8}, "market_class": "DATACENTER", "supported_precisions": ["FP4", "FP6", "FP8", "FP16", "BF16", "FP32", "FP64", "INT8"], "datasheet_url": "https://www.amd.com/content/dam/amd/en/documents/instinct-tech-docs/product-briefs/amd-instinct-mi355x-gpu-brochure.pdf"}, {"gpu_slug": "amd-mi455x", "name": "AMD MI455X", "vendor": "AMD", "release_date": "2026-07-23", "form_factor": null, "memory": {"capacity_gb": 432, "type": "HBM4", "bandwidth_gbps": 23300, "bus_bits": null, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": 3600, "pcie_gen": null, "pcie_lanes": null}, "compute": {"fp4": {"dense_tflops": 40265}, "fp8": {"dense_tflops": 20133}, "fp16": {"dense_tflops": 5033, "sparse_tflops": 10066}, "int8": {"dense_tops": 5033, "sparse_tops": 10066}, "fp32": {"dense_tflops": 315}}, "silicon": {"architecture": "CDNA 5", "process": "TSMC 2nm / 3nm", "transistors_b": 320, "shader_cores": null, "matrix_cores": null, "compute_units": 256}, "power": {"tdp_w": null, "cooling": "liquid"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP4", "FP6", "FP8", "FP16", "BF16", "FP32", "INT8"], "datasheet_url": "https://www.amd.com/content/dam/amd/en/documents/products/accelerators/instinct/amd-instinct-mi455x_brochure.pdf"}, {"gpu_slug": "amd-radeon-pro-v520", "name": "AMD Radeon Pro V520", "vendor": "AMD", "release_date": "2020-05-07", "form_factor": null, "memory": {"capacity_gb": 8, "type": "HBM2", "bandwidth_gbps": 512, "bus_bits": 2048, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": 16}, "compute": {"fp16": {"dense_tflops": 14.75}, "fp32": {"dense_tflops": 7.4}}, "silicon": {"architecture": "RDNA", "process": "TSMC 7nm FinFET", "transistors_b": null, "shader_cores": 2304, "matrix_cores": null, "compute_units": 36}, "power": {"tdp_w": 225, "cooling": "passive"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP16", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.amd.com/en/products/accelerators/radeon-pro/amd-radeon-pro-v520.html"}, {"gpu_slug": "intel-gaudi2", "name": "Intel Gaudi2", "vendor": "Intel", "release_date": "2022-05-10", "form_factor": null, "memory": {"capacity_gb": 96, "type": "HBM2e", "bandwidth_gbps": 2450, "bus_bits": null, "ecc": null}, "interconnect": {"gpu_to_gpu_gbps": 600, "pcie_gen": 4, "pcie_lanes": 16}, "compute": {"fp8": {"dense_tflops": 865}, "fp16": {"dense_tflops": 432}}, "silicon": {"architecture": "Gaudi (2nd Gen)", "process": "TSMC 7nm", "transistors_b": null, "shader_cores": null, "matrix_cores": null, "compute_units": null}, "power": {"tdp_w": 600, "cooling": null}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP8", "FP16", "BF16", "TF32", "FP32", "INT8"], "datasheet_url": "https://www.intel.com/content/www/us/en/content-details/839363/intel-gaudi-2-ai-accelerators-white-paper.html"}, {"gpu_slug": "nvidia-a10", "name": "Nvidia A10", "vendor": "Nvidia", "release_date": "2021-04-12", "form_factor": null, "memory": {"capacity_gb": 24, "type": "GDDR6", "bandwidth_gbps": 600, "bus_bits": 384, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": 16}, "compute": {"fp16": {"dense_tflops": 125, "sparse_tflops": 250}, "int8": {"dense_tops": 250, "sparse_tops": 500}, "fp32": {"dense_tflops": 31.2}}, "silicon": {"architecture": "Ampere", "process": "Samsung 8N", "transistors_b": 28.3, "shader_cores": 9216, "matrix_cores": 288, "compute_units": 72}, "power": {"tdp_w": 150, "cooling": "passive"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/Data-Center/a10/pdf/a10-datasheet.pdf"}, {"gpu_slug": "nvidia-a100", "name": "Nvidia A100", "vendor": "Nvidia", "release_date": "2020-05-14", "form_factor": "PCIe", "memory": {"capacity_gb": 80, "type": "HBM2e", "bandwidth_gbps": 1935, "bus_bits": 5120, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": 600, "pcie_gen": 4, "pcie_lanes": 16}, "compute": {"fp16": {"dense_tflops": 312, "sparse_tflops": 624}, "int8": {"dense_tops": 624, "sparse_tops": 1248}, "fp32": {"dense_tflops": 19.5}, "fp64": {"dense_tflops": 9.7}}, "silicon": {"architecture": "Ampere", "process": "TSMC N7", "transistors_b": 54.2, "shader_cores": 6912, "matrix_cores": 432, "compute_units": 108}, "power": {"tdp_w": 300, "cooling": "passive"}, "platform": {"mig_instances": 7, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP16", "BF16", "TF32", "FP32", "FP64", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/Data-Center/a100/pdf/nvidia-a100-datasheet-us-nvidia-1758950-r4-web.pdf"}, {"gpu_slug": "nvidia-a100", "name": "Nvidia A100", "vendor": "Nvidia", "release_date": "2020-05-14", "form_factor": "SXM", "memory": {"capacity_gb": 80, "type": "HBM2e", "bandwidth_gbps": 2039, "bus_bits": 5120, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": 600, "pcie_gen": 4, "pcie_lanes": 16}, "compute": {"fp16": {"dense_tflops": 312, "sparse_tflops": 624}, "int8": {"dense_tops": 624, "sparse_tops": 1248}, "fp32": {"dense_tflops": 19.5}, "fp64": {"dense_tflops": 9.7}}, "silicon": {"architecture": "Ampere", "process": "TSMC N7", "transistors_b": 54.2, "shader_cores": 6912, "matrix_cores": 432, "compute_units": 108}, "power": {"tdp_w": 300, "cooling": "passive"}, "platform": {"mig_instances": 7, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP16", "BF16", "TF32", "FP32", "FP64", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/Data-Center/a100/pdf/nvidia-a100-datasheet-us-nvidia-1758950-r4-web.pdf"}, {"gpu_slug": "nvidia-a100", "name": "Nvidia A100", "vendor": "Nvidia", "release_date": "2020-05-14", "form_factor": "SXM", "memory": {"capacity_gb": 40, "type": "HBM2e", "bandwidth_gbps": 1555, "bus_bits": 5120, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": 600, "pcie_gen": 4, "pcie_lanes": 16}, "compute": {"fp16": {"dense_tflops": 312, "sparse_tflops": 624}, "int8": {"dense_tops": 624, "sparse_tops": 1248}, "fp32": {"dense_tflops": 19.5}, "fp64": {"dense_tflops": 9.7}}, "silicon": {"architecture": "Ampere", "process": "TSMC N7", "transistors_b": 54.2, "shader_cores": 6912, "matrix_cores": 432, "compute_units": 108}, "power": {"tdp_w": 300, "cooling": "passive"}, "platform": {"mig_instances": 7, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP16", "BF16", "TF32", "FP32", "FP64", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/Data-Center/a100/pdf/nvidia-a100-datasheet-us-nvidia-1758950-r4-web.pdf"}, {"gpu_slug": "nvidia-a100", "name": "Nvidia A100", "vendor": "Nvidia", "release_date": "2020-05-14", "form_factor": "PCIe", "memory": {"capacity_gb": 40, "type": "HBM2e", "bandwidth_gbps": 1555, "bus_bits": 5120, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": 600, "pcie_gen": 4, "pcie_lanes": 16}, "compute": {"fp16": {"dense_tflops": 312, "sparse_tflops": 624}, "int8": {"dense_tops": 624, "sparse_tops": 1248}, "fp32": {"dense_tflops": 19.5}, "fp64": {"dense_tflops": 9.7}}, "silicon": {"architecture": "Ampere", "process": "TSMC N7", "transistors_b": 54.2, "shader_cores": 6912, "matrix_cores": 432, "compute_units": 108}, "power": {"tdp_w": 300, "cooling": "passive"}, "platform": {"mig_instances": 7, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP16", "BF16", "TF32", "FP32", "FP64", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/Data-Center/a100/pdf/nvidia-a100-datasheet-us-nvidia-1758950-r4-web.pdf"}, {"gpu_slug": "nvidia-a10g", "name": "Nvidia A10G", "vendor": "Nvidia", "release_date": "2021-04-12", "form_factor": null, "memory": {"capacity_gb": 24, "type": "GDDR6", "bandwidth_gbps": 600, "bus_bits": null, "ecc": null}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": 16}, "compute": {"fp16": {"dense_tflops": 70, "sparse_tflops": 140}, "int8": {"dense_tops": 140, "sparse_tops": 280}, "fp32": {"dense_tflops": 35}}, "silicon": {"architecture": "Ampere", "process": "Samsung 8N", "transistors_b": 28.3, "shader_cores": 10240, "matrix_cores": 320, "compute_units": 80}, "power": {"tdp_w": 300, "cooling": "passive"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://d1.awsstatic.com/product-marketing/ec2/NVIDIA_AWS_A10G_DataSheet_FINAL_02_17_2022.pdf"}, {"gpu_slug": "nvidia-a16", "name": "Nvidia A16", "vendor": "Nvidia", "release_date": "2021-04-12", "form_factor": null, "memory": {"capacity_gb": 16, "type": "GDDR6", "bandwidth_gbps": 200, "bus_bits": 128, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": 16}, "compute": {"fp16": {"dense_tflops": 17.9, "sparse_tflops": 35.9}, "int8": {"dense_tops": 35.9, "sparse_tops": 71.8}, "fp32": {"dense_tflops": 4.5}}, "silicon": {"architecture": "Ampere", "process": null, "transistors_b": null, "shader_cores": 1280, "matrix_cores": 40, "compute_units": 10}, "power": {"tdp_w": null, "cooling": "passive"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://images.nvidia.com/content/Solutions/data-center/vgpu-a16-datasheet.pdf"}, {"gpu_slug": "nvidia-a30", "name": "Nvidia A30", "vendor": "Nvidia", "release_date": "2021-04-12", "form_factor": null, "memory": {"capacity_gb": 24, "type": "HBM2", "bandwidth_gbps": 933, "bus_bits": null, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": 16}, "compute": {"fp16": {"dense_tflops": 165, "sparse_tflops": 330}, "int8": {"dense_tops": 330, "sparse_tops": 661}, "fp32": {"dense_tflops": 10.3}, "fp64": {"dense_tflops": 5.2}}, "silicon": {"architecture": "Ampere", "process": "TSMC N7", "transistors_b": 54.2, "shader_cores": 3584, "matrix_cores": 224, "compute_units": 56}, "power": {"tdp_w": 165, "cooling": "passive"}, "platform": {"mig_instances": 4, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP16", "BF16", "TF32", "FP32", "FP64", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/data-center/products/a30-gpu/pdf/a30-datasheet.pdf"}, {"gpu_slug": "nvidia-a40", "name": "Nvidia A40", "vendor": "Nvidia", "release_date": "2020-10-05", "form_factor": null, "memory": {"capacity_gb": 48, "type": "GDDR6", "bandwidth_gbps": 696, "bus_bits": 384, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": 16}, "compute": {"fp16": {"dense_tflops": 149.7, "sparse_tflops": 299.4}, "int8": {"dense_tops": 299.3, "sparse_tops": 598.6}, "fp32": {"dense_tflops": 37.4}}, "silicon": {"architecture": "Ampere", "process": "Samsung 8N", "transistors_b": 28.3, "shader_cores": 10752, "matrix_cores": 336, "compute_units": 84}, "power": {"tdp_w": 300, "cooling": "passive"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://images.nvidia.com/content/Solutions/data-center/a40/nvidia-a40-datasheet.pdf"}, {"gpu_slug": "nvidia-a4000", "name": "Nvidia A4000", "vendor": "Nvidia", "release_date": "2021-04-12", "form_factor": null, "memory": {"capacity_gb": 16, "type": "GDDR6", "bandwidth_gbps": 448, "bus_bits": 256, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": 16}, "compute": {"fp16": {"dense_tflops": 76.7, "sparse_tflops": 153.4}, "fp32": {"dense_tflops": 19.2}}, "silicon": {"architecture": "Ampere", "process": "Samsung 8N", "transistors_b": 17.4, "shader_cores": 6144, "matrix_cores": 192, "compute_units": 48}, "power": {"tdp_w": 140, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "WORKSTATION", "supported_precisions": ["FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/gtcs21/rtx-a4000/nvidia-rtx-a4000-datasheet.pdf"}, {"gpu_slug": "nvidia-a4500", "name": "Nvidia A4500", "vendor": "Nvidia", "release_date": "2021-11-23", "form_factor": null, "memory": {"capacity_gb": 20, "type": "GDDR6", "bandwidth_gbps": 640, "bus_bits": 320, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": 16}, "compute": {"fp16": {"dense_tflops": 94.6, "sparse_tflops": 189.2}, "fp32": {"dense_tflops": 23.7}}, "silicon": {"architecture": "Ampere", "process": "Samsung 8N", "transistors_b": 28.3, "shader_cores": 7168, "matrix_cores": 224, "compute_units": 56}, "power": {"tdp_w": 200, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "WORKSTATION", "supported_precisions": ["FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/design-visualization/rtx/nvidia-rtx-a4500-datasheet.pdf"}, {"gpu_slug": "nvidia-a5000", "name": "Nvidia A5000", "vendor": "Nvidia", "release_date": "2021-04-12", "form_factor": null, "memory": {"capacity_gb": 24, "type": "GDDR6", "bandwidth_gbps": 768, "bus_bits": 384, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": 112, "pcie_gen": 4, "pcie_lanes": 16}, "compute": {"fp16": {"dense_tflops": 111.1, "sparse_tflops": 222.2}, "fp32": {"dense_tflops": 27.8}}, "silicon": {"architecture": "Ampere", "process": "Samsung 8N", "transistors_b": 28.3, "shader_cores": 8192, "matrix_cores": 256, "compute_units": 64}, "power": {"tdp_w": 230, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "WORKSTATION", "supported_precisions": ["FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/products/workstations/nvidia-rtx-a5000-datasheet.pdf"}, {"gpu_slug": "nvidia-a800", "name": "Nvidia A800", "vendor": "Nvidia", "release_date": "2022-11-08", "form_factor": null, "memory": {"capacity_gb": 40, "type": "HBM2", "bandwidth_gbps": 1555, "bus_bits": 5120, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": 400, "pcie_gen": 4, "pcie_lanes": 16}, "compute": {"fp16": {"dense_tflops": 312, "sparse_tflops": 624}, "int8": {"dense_tops": 623.5, "sparse_tops": 1247}, "fp32": {"dense_tflops": 19.5}, "fp64": {"dense_tflops": 9.7}}, "silicon": {"architecture": "Ampere", "process": "TSMC N7", "transistors_b": 54.2, "shader_cores": 6912, "matrix_cores": 432, "compute_units": 108}, "power": {"tdp_w": 240, "cooling": "active"}, "platform": {"mig_instances": 7, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP16", "BF16", "TF32", "FP32", "FP64", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/design-visualization/quadro-product-literature/proviz-a800-40gb-datasheet-nvidia-2819988-r5-web.pdf"}, {"gpu_slug": "nvidia-b100", "name": "Nvidia B100", "vendor": "Nvidia", "release_date": "2024-11-01", "form_factor": null, "memory": {"capacity_gb": 192, "type": "HBM3e", "bandwidth_gbps": 8000, "bus_bits": null, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": 1800, "pcie_gen": 5, "pcie_lanes": 16}, "compute": {"fp4": {"dense_tflops": 7000, "sparse_tflops": 14000}, "fp8": {"dense_tflops": 3500, "sparse_tflops": 7000}, "fp16": {"dense_tflops": 1750, "sparse_tflops": 3500}, "int8": {"dense_tops": 3500, "sparse_tops": 7000}, "fp32": {"dense_tflops": 60}, "fp64": {"dense_tflops": 30}}, "silicon": {"architecture": "Blackwell", "process": "TSMC 4NP", "transistors_b": 208, "shader_cores": null, "matrix_cores": null, "compute_units": null}, "power": {"tdp_w": null, "cooling": "passive"}, "platform": {"mig_instances": 7, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP4", "FP6", "FP8", "FP16", "BF16", "TF32", "FP32", "FP64", "INT8"], "datasheet_url": "https://www.nvidia.com/en-us/data-center/hgx/"}, {"gpu_slug": "nvidia-b200", "name": "Nvidia B200", "vendor": "Nvidia", "release_date": "2024-03-18", "form_factor": null, "memory": {"capacity_gb": 180, "type": "HBM3e", "bandwidth_gbps": 7700, "bus_bits": null, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": 1800, "pcie_gen": 5, "pcie_lanes": 16}, "compute": {"fp4": {"dense_tflops": 9000, "sparse_tflops": 18000}, "fp8": {"dense_tflops": 4500, "sparse_tflops": 9000}, "fp16": {"dense_tflops": 2250, "sparse_tflops": 4500}, "int8": {"dense_tops": 4500, "sparse_tops": 9000}, "fp32": {"dense_tflops": 75}, "fp64": {"dense_tflops": 37}}, "silicon": {"architecture": "Blackwell", "process": "TSMC 4NP", "transistors_b": 208, "shader_cores": null, "matrix_cores": null, "compute_units": null}, "power": {"tdp_w": 1000, "cooling": "passive"}, "platform": {"mig_instances": 7, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP4", "FP6", "FP8", "FP16", "BF16", "TF32", "FP32", "FP64", "INT8"], "datasheet_url": "https://dam-cdn.nvd.orangelogic.com/AssetLink/y441155802qub41q118b2852i557jem5.pdf"}, {"gpu_slug": "nvidia-b300", "name": "Nvidia B300", "vendor": "Nvidia", "release_date": "2025-03-18", "form_factor": null, "memory": {"capacity_gb": 288, "type": "HBM3e", "bandwidth_gbps": 8000, "bus_bits": 8192, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": 1800, "pcie_gen": 6, "pcie_lanes": 16}, "compute": {"fp4": {"dense_tflops": 14000}, "fp8": {"dense_tflops": 4500, "sparse_tflops": 9000}, "fp16": {"dense_tflops": 2250, "sparse_tflops": 4500}, "int8": {"dense_tops": 153.5, "sparse_tops": 307}, "fp32": {"dense_tflops": 75}, "fp64": {"dense_tflops": 1.2}}, "silicon": {"architecture": "Blackwell Ultra", "process": "TSMC 4NP", "transistors_b": 208, "shader_cores": null, "matrix_cores": null, "compute_units": null}, "power": {"tdp_w": 1100, "cooling": "passive"}, "platform": {"mig_instances": 7, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP4", "FP6", "FP8", "FP16", "BF16", "TF32", "FP32", "FP64", "INT8"], "datasheet_url": "https://resources.nvidia.com/en-us-blackwell-architecture/blackwell-ultra-datasheet"}, {"gpu_slug": "nvidia-gb200", "name": "Nvidia GB200", "vendor": "Nvidia", "release_date": "2024-03-18", "form_factor": null, "memory": {"capacity_gb": 186, "type": "HBM3e", "bandwidth_gbps": 8000, "bus_bits": null, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": 1800, "pcie_gen": 5, "pcie_lanes": 16}, "compute": {"fp4": {"dense_tflops": 10000, "sparse_tflops": 20000}, "fp8": {"dense_tflops": 5000, "sparse_tflops": 10000}, "fp16": {"dense_tflops": 2500, "sparse_tflops": 5000}, "int8": {"dense_tops": 5000, "sparse_tops": 10000}, "fp32": {"dense_tflops": 80}, "fp64": {"dense_tflops": 40}}, "silicon": {"architecture": "Blackwell", "process": "TSMC 4NP", "transistors_b": 208, "shader_cores": null, "matrix_cores": null, "compute_units": null}, "power": {"tdp_w": 1200, "cooling": "liquid"}, "platform": {"mig_instances": 7, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP4", "FP6", "FP8", "FP16", "BF16", "TF32", "FP32", "FP64", "INT8"], "datasheet_url": "https://dam-cdn.nvd.orangelogic.com/AssetLink/y441155802qub41q118b2852i557jem5.pdf"}, {"gpu_slug": "nvidia-gb300", "name": "Nvidia GB300", "vendor": "Nvidia", "release_date": "2025-03-18", "form_factor": null, "memory": {"capacity_gb": 288, "type": "HBM3e", "bandwidth_gbps": 8000, "bus_bits": 8192, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": 1800, "pcie_gen": 6, "pcie_lanes": 16}, "compute": {"fp4": {"dense_tflops": 15000}, "fp8": {"dense_tflops": 5000, "sparse_tflops": 10000}, "fp16": {"dense_tflops": 2500, "sparse_tflops": 5000}, "int8": {"dense_tops": 165, "sparse_tops": 330}, "fp32": {"dense_tflops": 80}, "fp64": {"dense_tflops": 1.3}}, "silicon": {"architecture": "Blackwell Ultra", "process": "TSMC 4NP", "transistors_b": 208, "shader_cores": 20480, "matrix_cores": 640, "compute_units": 160}, "power": {"tdp_w": 1400, "cooling": "liquid"}, "platform": {"mig_instances": 7, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP4", "FP6", "FP8", "FP16", "BF16", "TF32", "FP32", "FP64", "INT8"], "datasheet_url": "https://resources.nvidia.com/en-us-blackwell-architecture/blackwell-ultra-datasheet"}, {"gpu_slug": "nvidia-gh200", "name": "Nvidia GH200", "vendor": "Nvidia", "release_date": "2023-05-29", "form_factor": null, "memory": {"capacity_gb": 96, "type": "HBM3", "bandwidth_gbps": 4000, "bus_bits": null, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": 900, "pcie_gen": null, "pcie_lanes": null}, "compute": {"fp8": {"dense_tflops": 1979, "sparse_tflops": 3958}, "fp16": {"dense_tflops": 989.5, "sparse_tflops": 1979}, "int8": {"dense_tops": 1979, "sparse_tops": 3958}, "fp32": {"dense_tflops": 67}, "fp64": {"dense_tflops": 34}}, "silicon": {"architecture": "Hopper", "process": "TSMC 4N", "transistors_b": 80, "shader_cores": 16896, "matrix_cores": 528, "compute_units": 132}, "power": {"tdp_w": null, "cooling": null}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP8", "FP16", "BF16", "TF32", "FP32", "FP64", "INT8"], "datasheet_url": "https://www.nvidia.com/en-us/data-center/grace-hopper-superchip/"}, {"gpu_slug": "nvidia-gt710", "name": "Nvidia GT 710", "vendor": "Nvidia", "release_date": "2016-01-26", "form_factor": null, "memory": {"capacity_gb": 2, "type": "DDR3", "bandwidth_gbps": 14, "bus_bits": 64, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 2, "pcie_lanes": 8}, "compute": {"fp32": {"dense_tflops": 0.37}}, "silicon": {"architecture": "Kepler", "process": "TSMC 28nm", "transistors_b": 1.02, "shader_cores": 192, "matrix_cores": null, "compute_units": 1}, "power": {"tdp_w": 19, "cooling": null}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP32"], "datasheet_url": null}, {"gpu_slug": "nvidia-gt730", "name": "Nvidia GT 730", "vendor": "Nvidia", "release_date": "2014-06-18", "form_factor": null, "memory": {"capacity_gb": 2, "type": "DDR3", "bandwidth_gbps": 14, "bus_bits": 64, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 2, "pcie_lanes": 8}, "compute": {"fp32": {"dense_tflops": 0.69}}, "silicon": {"architecture": "Kepler", "process": "TSMC 28nm", "transistors_b": 1.02, "shader_cores": 384, "matrix_cores": null, "compute_units": 2}, "power": {"tdp_w": 23, "cooling": null}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP32"], "datasheet_url": null}, {"gpu_slug": "nvidia-gtx-1050-ti", "name": "Nvidia GTX 1050 Ti", "vendor": "Nvidia", "release_date": "2016-10-25", "form_factor": null, "memory": {"capacity_gb": 4, "type": "GDDR5", "bandwidth_gbps": 112, "bus_bits": 128, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 3, "pcie_lanes": null}, "compute": {"fp32": {"dense_tflops": 2.14}}, "silicon": {"architecture": "Pascal", "process": "Samsung 14nm FinFET", "transistors_b": 3.3, "shader_cores": 768, "matrix_cores": null, "compute_units": 6}, "power": {"tdp_w": 75, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP16", "FP32"], "datasheet_url": "https://www.nvidia.com/content/apac/event/ph/overwatch-campaign/geforce-gtx-1050.html"}, {"gpu_slug": "nvidia-gtx-1060", "name": "Nvidia GTX 1060", "vendor": "Nvidia", "release_date": "2016-07-19", "form_factor": null, "memory": {"capacity_gb": 6, "type": "GDDR5", "bandwidth_gbps": 192, "bus_bits": 192, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 3, "pcie_lanes": null}, "compute": {"fp32": {"dense_tflops": 4.37}}, "silicon": {"architecture": "Pascal", "process": "TSMC 16nm FinFET", "transistors_b": 4.4, "shader_cores": 1280, "matrix_cores": null, "compute_units": 10}, "power": {"tdp_w": 120, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP16", "FP32"], "datasheet_url": "https://www.nvidia.com/content/apac/event/ph/overwatch-campaign/geforce-gtx-1060.html"}, {"gpu_slug": "nvidia-gtx-1070", "name": "Nvidia GTX 1070", "vendor": "Nvidia", "release_date": "2016-06-10", "form_factor": null, "memory": {"capacity_gb": 8, "type": "GDDR5", "bandwidth_gbps": 256, "bus_bits": 256, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 3, "pcie_lanes": null}, "compute": {"fp32": {"dense_tflops": 6.46}}, "silicon": {"architecture": "Pascal", "process": "TSMC 16nm FinFET", "transistors_b": 7.2, "shader_cores": 1920, "matrix_cores": null, "compute_units": 15}, "power": {"tdp_w": 150, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP16", "FP32"], "datasheet_url": "https://www.nvidia.com/en-us/geforce/10-series/"}, {"gpu_slug": "nvidia-gtx-1070-ti", "name": "Nvidia GTX 1070 Ti", "vendor": "Nvidia", "release_date": "2017-11-02", "form_factor": null, "memory": {"capacity_gb": 8, "type": "GDDR5", "bandwidth_gbps": 256, "bus_bits": 256, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 3, "pcie_lanes": null}, "compute": {"fp32": {"dense_tflops": 8.19}}, "silicon": {"architecture": "Pascal", "process": "TSMC 16nm FinFET", "transistors_b": 7.2, "shader_cores": 2432, "matrix_cores": null, "compute_units": 19}, "power": {"tdp_w": 180, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP16", "FP32"], "datasheet_url": "https://www.nvidia.com/en-us/geforce/10-series/"}, {"gpu_slug": "nvidia-gtx-1080", "name": "Nvidia GTX 1080", "vendor": "Nvidia", "release_date": "2016-05-27", "form_factor": null, "memory": {"capacity_gb": 8, "type": "GDDR5X", "bandwidth_gbps": 320, "bus_bits": 256, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 3, "pcie_lanes": null}, "compute": {"fp32": {"dense_tflops": 8.87}}, "silicon": {"architecture": "Pascal", "process": "TSMC 16nm FinFET", "transistors_b": 7.2, "shader_cores": 2560, "matrix_cores": null, "compute_units": 20}, "power": {"tdp_w": 180, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP16", "FP32"], "datasheet_url": "https://www.nvidia.com/en-ph/geforce/products/10series/geforce-gtx-1080/"}, {"gpu_slug": "nvidia-gtx-1080-ti", "name": "Nvidia GTX 1080 Ti", "vendor": "Nvidia", "release_date": "2017-03-10", "form_factor": null, "memory": {"capacity_gb": 11, "type": "GDDR5X", "bandwidth_gbps": 484, "bus_bits": 352, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 3, "pcie_lanes": null}, "compute": {"fp32": {"dense_tflops": 11.34}}, "silicon": {"architecture": "Pascal", "process": "TSMC 16nm FinFET", "transistors_b": 12, "shader_cores": 3584, "matrix_cores": null, "compute_units": 28}, "power": {"tdp_w": 250, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP16", "FP32"], "datasheet_url": "https://www.nvidia.com/en-us/geforce/news/gfecnt/nvidia-geforce-gtx-1080-ti/"}, {"gpu_slug": "nvidia-gtx-1650", "name": "Nvidia GTX 1650", "vendor": "Nvidia", "release_date": "2019-04-23", "form_factor": null, "memory": {"capacity_gb": 4, "type": "GDDR5", "bandwidth_gbps": 128, "bus_bits": 128, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 3, "pcie_lanes": 16}, "compute": {"fp16": {"dense_tflops": 5.97}, "fp32": {"dense_tflops": 2.98}}, "silicon": {"architecture": "Turing", "process": "TSMC 12 nm FinFET", "transistors_b": 4.7, "shader_cores": 896, "matrix_cores": null, "compute_units": 14}, "power": {"tdp_w": 75, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP16", "FP32"], "datasheet_url": "https://www.nvidia.com/en-us/geforce/graphics-cards/gtx-1650/"}, {"gpu_slug": "nvidia-gtx-1660", "name": "Nvidia GTX 1660", "vendor": "Nvidia", "release_date": "2019-03-14", "form_factor": null, "memory": {"capacity_gb": 6, "type": "GDDR5", "bandwidth_gbps": 192, "bus_bits": 192, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 3, "pcie_lanes": 16}, "compute": {"fp16": {"dense_tflops": 10.05}, "fp32": {"dense_tflops": 5.03}}, "silicon": {"architecture": "Turing", "process": "TSMC 12 nm FinFET", "transistors_b": 6.6, "shader_cores": 1408, "matrix_cores": null, "compute_units": 22}, "power": {"tdp_w": 120, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP16", "FP32"], "datasheet_url": "https://www.nvidia.com/en-us/geforce/graphics-cards/16-series/"}, {"gpu_slug": "nvidia-gtx-1660-super", "name": "Nvidia GTX 1660 Super", "vendor": "Nvidia", "release_date": "2019-10-29", "form_factor": null, "memory": {"capacity_gb": 6, "type": "GDDR6", "bandwidth_gbps": 336, "bus_bits": 192, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 3, "pcie_lanes": 16}, "compute": {"fp16": {"dense_tflops": 10.05}, "fp32": {"dense_tflops": 5.03}}, "silicon": {"architecture": "Turing", "process": "TSMC 12 nm FinFET", "transistors_b": 6.6, "shader_cores": 1408, "matrix_cores": null, "compute_units": 22}, "power": {"tdp_w": 125, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP16", "FP32"], "datasheet_url": "https://www.nvidia.com/en-my/geforce/graphics-cards/16-series/"}, {"gpu_slug": "nvidia-h100", "name": "Nvidia H100", "vendor": "Nvidia", "release_date": "2022-09-20", "form_factor": "SXM", "memory": {"capacity_gb": 80, "type": "HBM3", "bandwidth_gbps": 3350, "bus_bits": 5120, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": 900, "pcie_gen": 5, "pcie_lanes": 16}, "compute": {"fp8": {"dense_tflops": 1979, "sparse_tflops": 3958}, "fp16": {"dense_tflops": 989.5, "sparse_tflops": 1979}, "int8": {"dense_tops": 1979, "sparse_tops": 3958}, "fp32": {"dense_tflops": 67}, "fp64": {"dense_tflops": 34}}, "silicon": {"architecture": "Hopper", "process": "TSMC 4N", "transistors_b": 80, "shader_cores": 16896, "matrix_cores": 528, "compute_units": 132}, "power": {"tdp_w": 700, "cooling": null}, "platform": {"mig_instances": 7, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP8", "FP16", "BF16", "TF32", "FP32", "FP64", "INT8"], "datasheet_url": "https://resources.nvidia.com/en-us-gpu-resources/h100-datasheet-24306"}, {"gpu_slug": "nvidia-h100", "name": "Nvidia H100", "vendor": "Nvidia", "release_date": "2022-09-20", "form_factor": "PCIe", "memory": {"capacity_gb": 80, "type": "HBM3", "bandwidth_gbps": 2000, "bus_bits": 5120, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": 600, "pcie_gen": 5, "pcie_lanes": 16}, "compute": {"fp8": {"dense_tflops": 1979, "sparse_tflops": 3958}, "fp16": {"dense_tflops": 989.5, "sparse_tflops": 1979}, "int8": {"dense_tops": 1979, "sparse_tops": 3958}, "fp32": {"dense_tflops": 67}, "fp64": {"dense_tflops": 34}}, "silicon": {"architecture": "Hopper", "process": "TSMC 4N", "transistors_b": 80, "shader_cores": 16896, "matrix_cores": 528, "compute_units": 132}, "power": {"tdp_w": 700, "cooling": null}, "platform": {"mig_instances": 7, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP8", "FP16", "BF16", "TF32", "FP32", "FP64", "INT8"], "datasheet_url": "https://resources.nvidia.com/en-us-gpu-resources/h100-datasheet-24306"}, {"gpu_slug": "nvidia-h100", "name": "Nvidia H100", "vendor": "Nvidia", "release_date": "2022-09-20", "form_factor": "NVL", "memory": {"capacity_gb": 94, "type": "HBM3", "bandwidth_gbps": 3938, "bus_bits": 5120, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": 600, "pcie_gen": 5, "pcie_lanes": 16}, "compute": {"fp8": {"dense_tflops": 1979, "sparse_tflops": 3958}, "fp16": {"dense_tflops": 989.5, "sparse_tflops": 1979}, "int8": {"dense_tops": 1979, "sparse_tops": 3958}, "fp32": {"dense_tflops": 67}, "fp64": {"dense_tflops": 34}}, "silicon": {"architecture": "Hopper", "process": "TSMC 4N", "transistors_b": 80, "shader_cores": 16896, "matrix_cores": 528, "compute_units": 132}, "power": {"tdp_w": 700, "cooling": null}, "platform": {"mig_instances": 7, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP8", "FP16", "BF16", "TF32", "FP32", "FP64", "INT8"], "datasheet_url": "https://resources.nvidia.com/en-us-gpu-resources/h100-datasheet-24306"}, {"gpu_slug": "nvidia-h20", "name": "Nvidia H20", "vendor": "Nvidia", "release_date": "2024-01-01", "form_factor": null, "memory": {"capacity_gb": 96, "type": "HBM3", "bandwidth_gbps": 4000, "bus_bits": null, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 5, "pcie_lanes": 16}, "compute": {}, "silicon": {"architecture": "Hopper", "process": null, "transistors_b": null, "shader_cores": null, "matrix_cores": null, "compute_units": null}, "power": {"tdp_w": 400, "cooling": null}, "platform": {"mig_instances": 7, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP8", "FP16", "BF16", "TF32", "FP32", "FP64", "INT8"], "datasheet_url": null}, {"gpu_slug": "nvidia-h200", "name": "Nvidia H200", "vendor": "Nvidia", "release_date": "2023-11-13", "form_factor": null, "memory": {"capacity_gb": 141, "type": "HBM3e", "bandwidth_gbps": 4800, "bus_bits": null, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": 900, "pcie_gen": 5, "pcie_lanes": 16}, "compute": {"fp8": {"dense_tflops": 1979, "sparse_tflops": 3958}, "fp16": {"dense_tflops": 989.5, "sparse_tflops": 1979}, "int8": {"dense_tops": 1979, "sparse_tops": 3958}, "fp32": {"dense_tflops": 67}, "fp64": {"dense_tflops": 34}}, "silicon": {"architecture": "Hopper", "process": "TSMC 4N", "transistors_b": 80, "shader_cores": 16896, "matrix_cores": 528, "compute_units": 132}, "power": {"tdp_w": 700, "cooling": null}, "platform": {"mig_instances": 7, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP8", "FP16", "BF16", "TF32", "FP32", "FP64", "INT8"], "datasheet_url": "https://resources.nvidia.com/en-us-hopper-architecture/hpc-datasheet-sc23"}, {"gpu_slug": "nvidia-h800", "name": "Nvidia H800", "vendor": "Nvidia", "release_date": "2023-03-01", "form_factor": null, "memory": {"capacity_gb": 80, "type": "HBM2e", "bandwidth_gbps": 2000, "bus_bits": 5120, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": 400, "pcie_gen": 5, "pcie_lanes": 16}, "compute": {"fp8": {"dense_tflops": 1513, "sparse_tflops": 3026}, "fp16": {"dense_tflops": 756.5, "sparse_tflops": 1513}, "int8": {"dense_tops": 1513, "sparse_tops": 3026}, "fp32": {"dense_tflops": 51}}, "silicon": {"architecture": "Hopper", "process": "TSMC 4N", "transistors_b": 80, "shader_cores": 14592, "matrix_cores": 456, "compute_units": 114}, "power": {"tdp_w": 350, "cooling": null}, "platform": {"mig_instances": 7, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP8", "FP16", "BF16", "TF32", "FP32", "FP64", "INT8"], "datasheet_url": null}, {"gpu_slug": "nvidia-k620", "name": "Nvidia K620", "vendor": "Nvidia", "release_date": "2014-07-22", "form_factor": null, "memory": {"capacity_gb": 2, "type": "DDR3", "bandwidth_gbps": 29, "bus_bits": 128, "ecc": null}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 2, "pcie_lanes": 16}, "compute": {"fp32": {"dense_tflops": 0.86}}, "silicon": {"architecture": "Maxwell", "process": "TSMC 28nm", "transistors_b": 1.87, "shader_cores": 384, "matrix_cores": null, "compute_units": 3}, "power": {"tdp_w": 45, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "WORKSTATION", "supported_precisions": ["FP32"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/design-visualization/documents/75509_DS_NV_Quadro_K620_US_NV_HR.pdf"}, {"gpu_slug": "nvidia-k80", "name": "Nvidia K80", "vendor": "Nvidia", "release_date": "2014-11-17", "form_factor": null, "memory": {"capacity_gb": 12, "type": "GDDR5", "bandwidth_gbps": 240, "bus_bits": 384, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 3, "pcie_lanes": 16}, "compute": {"fp32": {"dense_tflops": 4.37}, "fp64": {"dense_tflops": 1.46}}, "silicon": {"architecture": "Kepler", "process": "TSMC 28nm", "transistors_b": 7.1, "shader_cores": 2496, "matrix_cores": null, "compute_units": 13}, "power": {"tdp_w": 150, "cooling": "passive"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP32", "FP64"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/Data-Center/tesla-product-literature/TeslaK80-datasheet.pdf"}, {"gpu_slug": "nvidia-l4", "name": "Nvidia L4", "vendor": "Nvidia", "release_date": "2023-03-21", "form_factor": null, "memory": {"capacity_gb": 24, "type": "GDDR6", "bandwidth_gbps": 300, "bus_bits": 192, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": 16}, "compute": {"fp8": {"dense_tflops": 242, "sparse_tflops": 485}, "fp16": {"dense_tflops": 121, "sparse_tflops": 242}, "int8": {"dense_tops": 242, "sparse_tops": 485}, "fp32": {"dense_tflops": 30.3}}, "silicon": {"architecture": "Ada Lovelace", "process": "TSMC 4N", "transistors_b": null, "shader_cores": 7424, "matrix_cores": 232, "compute_units": 58}, "power": {"tdp_w": 72, "cooling": "passive"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP8", "FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://dam-cdn.nvd.orangelogic.com/AssetLink/8f4cjsr458mk07kxxt608b1ct0t570x7.pdf"}, {"gpu_slug": "nvidia-l40", "name": "Nvidia L40", "vendor": "Nvidia", "release_date": "2022-10-13", "form_factor": null, "memory": {"capacity_gb": 48, "type": "GDDR6", "bandwidth_gbps": 864, "bus_bits": 384, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": 16}, "compute": {"fp8": {"dense_tflops": 362, "sparse_tflops": 724}, "fp16": {"dense_tflops": 181.05, "sparse_tflops": 362.1}, "int8": {"dense_tops": 362, "sparse_tops": 724}, "fp32": {"dense_tflops": 90.5}}, "silicon": {"architecture": "Ada Lovelace", "process": "TSMC 4N", "transistors_b": 76.3, "shader_cores": 18176, "matrix_cores": 568, "compute_units": 142}, "power": {"tdp_w": 300, "cooling": "passive"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP8", "FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/design-visualization/support-guide/NVIDIA-L40-Datasheet-January-2023.pdf"}, {"gpu_slug": "nvidia-l40s", "name": "Nvidia L40S", "vendor": "Nvidia", "release_date": "2023-08-08", "form_factor": null, "memory": {"capacity_gb": 48, "type": "GDDR6", "bandwidth_gbps": 864, "bus_bits": 384, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": 16}, "compute": {"fp8": {"dense_tflops": 733, "sparse_tflops": 1466}, "fp16": {"dense_tflops": 362.05, "sparse_tflops": 733}, "int8": {"dense_tops": 733, "sparse_tops": 1466}, "fp32": {"dense_tflops": 91.6}}, "silicon": {"architecture": "Ada Lovelace", "process": "TSMC 4N", "transistors_b": 76.3, "shader_cores": 18176, "matrix_cores": 568, "compute_units": 142}, "power": {"tdp_w": 350, "cooling": "passive"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP8", "FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/en-us/data-center/l40s/"}, {"gpu_slug": "nvidia-m4000", "name": "Nvidia M4000", "vendor": "Nvidia", "release_date": "2015-06-29", "form_factor": null, "memory": {"capacity_gb": 8, "type": "GDDR5", "bandwidth_gbps": 192, "bus_bits": 256, "ecc": null}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 3, "pcie_lanes": 16}, "compute": {"fp32": {"dense_tflops": 2.57}}, "silicon": {"architecture": "Maxwell", "process": "TSMC 28nm", "transistors_b": 5.2, "shader_cores": 1664, "matrix_cores": null, "compute_units": 13}, "power": {"tdp_w": 120, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "WORKSTATION", "supported_precisions": ["FP32"], "datasheet_url": "https://images.nvidia.com/content/quadro/product-literature/data-sheets/12489_NV_DS_Quadro_M4000_US_NV_FNL_HR.pdf"}, {"gpu_slug": "nvidia-m60", "name": "Nvidia M60", "vendor": "Nvidia", "release_date": "2015-08-30", "form_factor": null, "memory": {"capacity_gb": 8, "type": "GDDR5", "bandwidth_gbps": 160, "bus_bits": 256, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 3, "pcie_lanes": 16}, "compute": {"fp32": {"dense_tflops": 4.83}}, "silicon": {"architecture": "Maxwell", "process": "TSMC 28nm", "transistors_b": 5.2, "shader_cores": 2048, "matrix_cores": null, "compute_units": 16}, "power": {"tdp_w": 150, "cooling": null}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP32"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/design-visualization/solutions/resources/documents1/nvidia-m60-datasheet.pdf"}, {"gpu_slug": "nvidia-p100", "name": "Nvidia P100", "vendor": "Nvidia", "release_date": "2016-06-20", "form_factor": null, "memory": {"capacity_gb": 16, "type": "HBM2", "bandwidth_gbps": 732, "bus_bits": 4096, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": 160, "pcie_gen": 3, "pcie_lanes": null}, "compute": {"fp16": {"dense_tflops": 18.7}, "fp32": {"dense_tflops": 9.3}, "fp64": {"dense_tflops": 4.7}}, "silicon": {"architecture": "Pascal", "process": "TSMC 16nm FinFET", "transistors_b": 15.3, "shader_cores": 3584, "matrix_cores": null, "compute_units": 56}, "power": {"tdp_w": 250, "cooling": "passive"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP16", "FP32", "FP64"], "datasheet_url": "https://images.nvidia.com/content/tesla/pdf/nvidia-tesla-p100-PCIe-datasheet.pdf"}, {"gpu_slug": "nvidia-p1000", "name": "Nvidia P1000", "vendor": "Nvidia", "release_date": "2017-02-07", "form_factor": null, "memory": {"capacity_gb": 4, "type": "GDDR5", "bandwidth_gbps": 82, "bus_bits": 128, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 3, "pcie_lanes": 16}, "compute": {"fp32": {"dense_tflops": 1.8}}, "silicon": {"architecture": "Pascal", "process": "Samsung 14nm LPP", "transistors_b": 3.3, "shader_cores": 640, "matrix_cores": null, "compute_units": 5}, "power": {"tdp_w": 47, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "WORKSTATION", "supported_precisions": ["FP16", "FP32"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/design-visualization/productspage/quadro/quadro-desktop/quadro-pascal-p1000-data-sheet-us-nv-704475-r1.pdf"}, {"gpu_slug": "nvidia-p2000", "name": "Nvidia P2000", "vendor": "Nvidia", "release_date": "2017-02-06", "form_factor": null, "memory": {"capacity_gb": 5, "type": "GDDR5", "bandwidth_gbps": 140, "bus_bits": 160, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 3, "pcie_lanes": 16}, "compute": {"fp32": {"dense_tflops": 3.0}}, "silicon": {"architecture": "Pascal", "process": "TSMC 16nm FinFET", "transistors_b": 4.4, "shader_cores": 1024, "matrix_cores": null, "compute_units": 8}, "power": {"tdp_w": 75, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "WORKSTATION", "supported_precisions": ["FP16", "FP32"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/design-visualization/productspage/quadro/quadro-desktop/quadro-pascal-p2000-data-sheet-us-nvidia-704443-r2-web.pdf"}, {"gpu_slug": "nvidia-p4", "name": "Nvidia P4", "vendor": "Nvidia", "release_date": "2016-09-13", "form_factor": null, "memory": {"capacity_gb": 8, "type": "GDDR5", "bandwidth_gbps": 192, "bus_bits": 256, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 3, "pcie_lanes": 16}, "compute": {"int8": {"dense_tops": 22}, "fp32": {"dense_tflops": 5.5}}, "silicon": {"architecture": "Pascal", "process": "TSMC 16nm FinFET", "transistors_b": 7.2, "shader_cores": 2560, "matrix_cores": null, "compute_units": 20}, "power": {"tdp_w": 75, "cooling": "passive"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP16", "FP32", "INT8"], "datasheet_url": "https://images.nvidia.com/content/pdf/tesla/184457-Tesla-P4-Datasheet-NV-Final-Letter-Web.pdf"}, {"gpu_slug": "nvidia-p40", "name": "Nvidia P40", "vendor": "Nvidia", "release_date": "2016-09-13", "form_factor": null, "memory": {"capacity_gb": 24, "type": "GDDR5", "bandwidth_gbps": 346, "bus_bits": 384, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 3, "pcie_lanes": 16}, "compute": {"int8": {"dense_tops": 47}, "fp32": {"dense_tflops": 12}}, "silicon": {"architecture": "Pascal", "process": "TSMC 16nm FinFET", "transistors_b": 11.8, "shader_cores": 3840, "matrix_cores": null, "compute_units": 30}, "power": {"tdp_w": 250, "cooling": "passive"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP16", "FP32", "INT8"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/design-visualization/documents/nvidia-p40-datasheet.pdf"}, {"gpu_slug": "nvidia-p4000", "name": "Nvidia P4000", "vendor": "Nvidia", "release_date": "2017-02-06", "form_factor": null, "memory": {"capacity_gb": 8, "type": "GDDR5", "bandwidth_gbps": 243, "bus_bits": 256, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 3, "pcie_lanes": 16}, "compute": {"fp32": {"dense_tflops": 5.3}}, "silicon": {"architecture": "Pascal", "process": "TSMC 16nm FinFET", "transistors_b": 7.2, "shader_cores": 1792, "matrix_cores": null, "compute_units": 14}, "power": {"tdp_w": 105, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "WORKSTATION", "supported_precisions": ["FP16", "FP32"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/design-visualization/productspage/quadro/quadro-desktop/quadro-pascal-p4000-data-sheet-a4-nvidia-704358-r2-web.pdf"}, {"gpu_slug": "nvidia-p5000", "name": "Nvidia P5000", "vendor": "Nvidia", "release_date": "2016-10-01", "form_factor": null, "memory": {"capacity_gb": 16, "type": "GDDR5X", "bandwidth_gbps": 288, "bus_bits": 256, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 3, "pcie_lanes": 16}, "compute": {"fp32": {"dense_tflops": 8.9}}, "silicon": {"architecture": "Pascal", "process": "TSMC 16nm FinFET", "transistors_b": 7.2, "shader_cores": 2560, "matrix_cores": null, "compute_units": 20}, "power": {"tdp_w": 180, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "WORKSTATION", "supported_precisions": ["FP16", "FP32"], "datasheet_url": "https://images.nvidia.com/content/pdf/quadro/data-sheets/192195-DS-NV-Quadro-P5000-US-12Sept-NV-FNL-WEB.pdf"}, {"gpu_slug": "nvidia-p600", "name": "Nvidia P600", "vendor": "Nvidia", "release_date": "2017-02-07", "form_factor": null, "memory": {"capacity_gb": 2, "type": "GDDR5", "bandwidth_gbps": 64, "bus_bits": 128, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 3, "pcie_lanes": 16}, "compute": {"fp32": {"dense_tflops": 1.1}}, "silicon": {"architecture": "Pascal", "process": "Samsung 14nm LPP", "transistors_b": 3.3, "shader_cores": 384, "matrix_cores": null, "compute_units": 3}, "power": {"tdp_w": 40, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "WORKSTATION", "supported_precisions": ["FP16", "FP32"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/design-visualization/productspage/quadro/quadro-desktop/quadro-pascal-p600-data-sheet-us-nv-704532-r1.pdf"}, {"gpu_slug": "nvidia-p6000", "name": "Nvidia P6000", "vendor": "Nvidia", "release_date": "2016-10-01", "form_factor": null, "memory": {"capacity_gb": 24, "type": "GDDR5X", "bandwidth_gbps": 432, "bus_bits": 384, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 3, "pcie_lanes": 16}, "compute": {"fp32": {"dense_tflops": 12.6}}, "silicon": {"architecture": "Pascal", "process": "TSMC 16nm", "transistors_b": 11.8, "shader_cores": 3840, "matrix_cores": null, "compute_units": 30}, "power": {"tdp_w": 250, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "WORKSTATION", "supported_precisions": ["FP16", "FP32"], "datasheet_url": "https://images.nvidia.com/content/pdf/quadro/data-sheets/192152-NV-DS-Quadro-P6000-US-12Sept-NV-FNL-WEB.pdf"}, {"gpu_slug": "nvidia-p620", "name": "Nvidia P620", "vendor": "Nvidia", "release_date": "2018-02-01", "form_factor": null, "memory": {"capacity_gb": 2, "type": "GDDR5", "bandwidth_gbps": 80, "bus_bits": 128, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 3, "pcie_lanes": 16}, "compute": {"fp32": {"dense_tflops": 1.3}}, "silicon": {"architecture": "Pascal", "process": "Samsung 14nm LPP", "transistors_b": 3.3, "shader_cores": 512, "matrix_cores": null, "compute_units": 4}, "power": {"tdp_w": 40, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "WORKSTATION", "supported_precisions": ["FP16", "FP32"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/design-visualization/quadro-product-literature/quadro-pascal-p620-data-sheet-593981-us-nv-r3-web.pdf"}, {"gpu_slug": "nvidia-rtx-6000", "name": "Nvidia Quadro RTX 6000", "vendor": "Nvidia", "release_date": "2018-08-13", "form_factor": null, "memory": {"capacity_gb": 24, "type": "GDDR6", "bandwidth_gbps": 672, "bus_bits": 384, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": 100, "pcie_gen": 3, "pcie_lanes": 16}, "compute": {"fp16": {"dense_tflops": 130.5}, "int8": {"dense_tops": 261}, "fp32": {"dense_tflops": 16.3}}, "silicon": {"architecture": "Turing", "process": "TSMC 12nm FFN", "transistors_b": 18.6, "shader_cores": 4608, "matrix_cores": 576, "compute_units": 72}, "power": {"tdp_w": 295, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "WORKSTATION", "supported_precisions": ["FP16", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/design-visualization/quadro-product-literature/quadro-rtx-6000-us-nvidia-704093-r4-web.pdf"}, {"gpu_slug": "nvidia-rtx-2000-ada", "name": "Nvidia RTX 2000 Ada", "vendor": "Nvidia", "release_date": "2024-04-01", "form_factor": null, "memory": {"capacity_gb": 16, "type": "GDDR6", "bandwidth_gbps": 224, "bus_bits": 128, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": 8}, "compute": {"fp8": {"dense_tflops": 95.95, "sparse_tflops": 191.9}, "fp16": {"dense_tflops": 47.98, "sparse_tflops": 95.95}, "fp32": {"dense_tflops": 12.0}}, "silicon": {"architecture": "Ada Lovelace", "process": "TSMC 4N", "transistors_b": 18.9, "shader_cores": 2816, "matrix_cores": 88, "compute_units": 22}, "power": {"tdp_w": 70, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "WORKSTATION", "supported_precisions": ["FP8", "FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/en-us/products/workstations/rtx-2000/"}, {"gpu_slug": "nvidia-rtx-2060", "name": "Nvidia RTX 2060", "vendor": "Nvidia", "release_date": "2019-01-15", "form_factor": null, "memory": {"capacity_gb": 6, "type": "GDDR6", "bandwidth_gbps": 336, "bus_bits": 192, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 3, "pcie_lanes": 16}, "compute": {"fp16": {"dense_tflops": 25.8}, "int8": {"dense_tops": 103.2}, "fp32": {"dense_tflops": 6.45}}, "silicon": {"architecture": "Turing", "process": "TSMC 12 nm FFN", "transistors_b": 10.8, "shader_cores": 1920, "matrix_cores": 240, "compute_units": 30}, "power": {"tdp_w": 160, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP16", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/en-us/geforce/graphics-cards/rtx-2060/"}, {"gpu_slug": "nvidia-rtx-2060-super", "name": "Nvidia RTX 2060 Super", "vendor": "Nvidia", "release_date": "2019-07-09", "form_factor": null, "memory": {"capacity_gb": 8, "type": "GDDR6", "bandwidth_gbps": 448, "bus_bits": 256, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 3, "pcie_lanes": 16}, "compute": {"fp16": {"dense_tflops": 28.7}, "int8": {"dense_tops": 114.8}, "fp32": {"dense_tflops": 7.18}}, "silicon": {"architecture": "Turing", "process": "TSMC 12 nm FFN", "transistors_b": 10.8, "shader_cores": 2176, "matrix_cores": 272, "compute_units": 34}, "power": {"tdp_w": 175, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP16", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/en-us/geforce/20-series/"}, {"gpu_slug": "nvidia-rtx-2070", "name": "Nvidia RTX 2070", "vendor": "Nvidia", "release_date": "2018-10-17", "form_factor": null, "memory": {"capacity_gb": 8, "type": "GDDR6", "bandwidth_gbps": 448, "bus_bits": 256, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 3, "pcie_lanes": 16}, "compute": {"fp16": {"dense_tflops": 29.9}, "int8": {"dense_tops": 119.4}, "fp32": {"dense_tflops": 7.5}}, "silicon": {"architecture": "Turing", "process": "TSMC 12 nm FFN", "transistors_b": 10.8, "shader_cores": 2304, "matrix_cores": 288, "compute_units": 36}, "power": {"tdp_w": 175, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP16", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/en-us/geforce/20-series/"}, {"gpu_slug": "nvidia-rtx-2080", "name": "Nvidia RTX 2080", "vendor": "Nvidia", "release_date": "2018-09-20", "form_factor": null, "memory": {"capacity_gb": 8, "type": "GDDR6", "bandwidth_gbps": 448, "bus_bits": 256, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": 50, "pcie_gen": 3, "pcie_lanes": 16}, "compute": {"fp16": {"dense_tflops": 40.3}, "int8": {"dense_tops": 161.1}, "fp32": {"dense_tflops": 10.0}}, "silicon": {"architecture": "Turing", "process": "TSMC 12 nm FFN", "transistors_b": 13.6, "shader_cores": 2944, "matrix_cores": 368, "compute_units": 46}, "power": {"tdp_w": 215, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP16", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/en-us/geforce/20-series/"}, {"gpu_slug": "nvidia-rtx-2080-ti", "name": "Nvidia RTX 2080 Ti", "vendor": "Nvidia", "release_date": "2018-09-27", "form_factor": null, "memory": {"capacity_gb": 11, "type": "GDDR6", "bandwidth_gbps": 616, "bus_bits": 352, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": 100, "pcie_gen": 3, "pcie_lanes": 16}, "compute": {"fp16": {"dense_tflops": 53.8}, "int8": {"dense_tops": 215.2}, "fp32": {"dense_tflops": 13.4}}, "silicon": {"architecture": "Turing", "process": "TSMC 12 nm FFN", "transistors_b": 18.6, "shader_cores": 4352, "matrix_cores": 544, "compute_units": 68}, "power": {"tdp_w": 250, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP16", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/en-us/geforce/20-series/"}, {"gpu_slug": "nvidia-rtx-3050", "name": "Nvidia RTX 3050", "vendor": "Nvidia", "release_date": "2022-01-27", "form_factor": null, "memory": {"capacity_gb": 8, "type": "GDDR6", "bandwidth_gbps": 224, "bus_bits": 128, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": null}, "compute": {"fp16": {"dense_tflops": 18.2, "sparse_tflops": 36.4}, "int8": {"dense_tops": 72.8, "sparse_tops": 145.6}, "fp32": {"dense_tflops": 9.1}}, "silicon": {"architecture": "Ampere", "process": "Samsung 8N", "transistors_b": null, "shader_cores": 2560, "matrix_cores": 80, "compute_units": 20}, "power": {"tdp_w": 130, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/en-us/geforce/graphics-cards/30-series/rtx-3050/"}, {"gpu_slug": "nvidia-rtx-3060", "name": "Nvidia RTX 3060", "vendor": "Nvidia", "release_date": "2021-02-25", "form_factor": null, "memory": {"capacity_gb": 12, "type": "GDDR6", "bandwidth_gbps": 360, "bus_bits": 192, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": null}, "compute": {"fp16": {"dense_tflops": 25.5, "sparse_tflops": 50.9}, "int8": {"dense_tops": 101.9, "sparse_tops": 203.8}, "fp32": {"dense_tflops": 12.7}}, "silicon": {"architecture": "Ampere", "process": "Samsung 8N", "transistors_b": null, "shader_cores": 3584, "matrix_cores": 112, "compute_units": 28}, "power": {"tdp_w": 170, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/en-us/geforce/graphics-cards/30-series/rtx-3060-3060ti/"}, {"gpu_slug": "nvidia-rtx-3060-ti", "name": "Nvidia RTX 3060 Ti", "vendor": "Nvidia", "release_date": "2020-12-02", "form_factor": null, "memory": {"capacity_gb": 8, "type": "GDDR6", "bandwidth_gbps": 448, "bus_bits": 256, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": null}, "compute": {"fp16": {"dense_tflops": 32.4, "sparse_tflops": 64.8}, "int8": {"dense_tops": 129.6, "sparse_tops": 259.2}, "fp32": {"dense_tflops": 16.2}}, "silicon": {"architecture": "Ampere", "process": "Samsung 8N", "transistors_b": 17.4, "shader_cores": 4864, "matrix_cores": 152, "compute_units": 38}, "power": {"tdp_w": 200, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/en-us/geforce/graphics-cards/30-series/rtx-3060-3060ti/"}, {"gpu_slug": "nvidia-rtx-3070", "name": "Nvidia RTX 3070", "vendor": "Nvidia", "release_date": "2020-10-29", "form_factor": null, "memory": {"capacity_gb": 8, "type": "GDDR6", "bandwidth_gbps": 448, "bus_bits": 256, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": null}, "compute": {"fp16": {"dense_tflops": 40.6, "sparse_tflops": 81.3}, "int8": {"dense_tops": 162.6, "sparse_tops": 325.2}, "fp32": {"dense_tflops": 20.3}}, "silicon": {"architecture": "Ampere", "process": "Samsung 8N", "transistors_b": 17.4, "shader_cores": 5888, "matrix_cores": 184, "compute_units": 46}, "power": {"tdp_w": 220, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/en-us/geforce/graphics-cards/30-series/rtx-3070-3070ti/"}, {"gpu_slug": "nvidia-rtx-3070-ti", "name": "Nvidia RTX 3070 Ti", "vendor": "Nvidia", "release_date": "2021-06-10", "form_factor": null, "memory": {"capacity_gb": 8, "type": "GDDR6X", "bandwidth_gbps": 608, "bus_bits": 256, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": null}, "compute": {"fp16": {"dense_tflops": 43.5, "sparse_tflops": 87.0}, "int8": {"dense_tops": 174.0, "sparse_tops": 348.0}, "fp32": {"dense_tflops": 21.8}}, "silicon": {"architecture": "Ampere", "process": "Samsung 8N", "transistors_b": 17.4, "shader_cores": 6144, "matrix_cores": 192, "compute_units": 48}, "power": {"tdp_w": 290, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/en-us/geforce/graphics-cards/30-series/rtx-3070-3070ti/"}, {"gpu_slug": "nvidia-rtx-3080", "name": "Nvidia RTX 3080", "vendor": "Nvidia", "release_date": "2020-09-17", "form_factor": null, "memory": {"capacity_gb": 10, "type": "GDDR6X", "bandwidth_gbps": 760, "bus_bits": 320, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": null}, "compute": {"fp16": {"dense_tflops": 59.5, "sparse_tflops": 119.0}, "int8": {"dense_tops": 238.0, "sparse_tops": 476.0}, "fp32": {"dense_tflops": 29.8}}, "silicon": {"architecture": "Ampere", "process": "Samsung 8N", "transistors_b": 28.3, "shader_cores": 8704, "matrix_cores": 272, "compute_units": 68}, "power": {"tdp_w": 320, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/en-us/geforce/graphics-cards/30-series/rtx-3080-3080ti/"}, {"gpu_slug": "nvidia-rtx-3080-ti", "name": "Nvidia RTX 3080 Ti", "vendor": "Nvidia", "release_date": "2021-06-03", "form_factor": null, "memory": {"capacity_gb": 12, "type": "GDDR6X", "bandwidth_gbps": 912, "bus_bits": 384, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": null}, "compute": {"fp16": {"dense_tflops": 68.2, "sparse_tflops": 136.4}, "int8": {"dense_tops": 272.8, "sparse_tops": 545.6}, "fp32": {"dense_tflops": 34.1}}, "silicon": {"architecture": "Ampere", "process": "Samsung 8N", "transistors_b": 28.3, "shader_cores": 10240, "matrix_cores": 320, "compute_units": 80}, "power": {"tdp_w": 350, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/en-us/geforce/graphics-cards/30-series/rtx-3080-3080ti/"}, {"gpu_slug": "nvidia-rtx-3090", "name": "Nvidia RTX 3090", "vendor": "Nvidia", "release_date": "2020-09-24", "form_factor": null, "memory": {"capacity_gb": 24, "type": "GDDR6X", "bandwidth_gbps": 936, "bus_bits": 384, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": 112, "pcie_gen": 4, "pcie_lanes": null}, "compute": {"fp16": {"dense_tflops": 71.2, "sparse_tflops": 142.4}, "int8": {"dense_tops": 284.7, "sparse_tops": 569.4}, "fp32": {"dense_tflops": 35.6}}, "silicon": {"architecture": "Ampere", "process": "Samsung 8N", "transistors_b": 28.3, "shader_cores": 10496, "matrix_cores": 328, "compute_units": 82}, "power": {"tdp_w": 350, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/en-us/geforce/graphics-cards/30-series/rtx-3090-3090ti/"}, {"gpu_slug": "nvidia-rtx-3090-ti", "name": "Nvidia RTX 3090 Ti", "vendor": "Nvidia", "release_date": "2022-03-29", "form_factor": null, "memory": {"capacity_gb": 24, "type": "GDDR6X", "bandwidth_gbps": 1008, "bus_bits": 384, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": null}, "compute": {"fp16": {"dense_tflops": 80.0, "sparse_tflops": 160.0}, "int8": {"dense_tops": 320.0, "sparse_tops": 640.0}, "fp32": {"dense_tflops": 40.0}}, "silicon": {"architecture": "Ampere", "process": "Samsung 8N", "transistors_b": 28.3, "shader_cores": 10752, "matrix_cores": 336, "compute_units": 84}, "power": {"tdp_w": 450, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/en-us/geforce/graphics-cards/30-series/rtx-3090-3090ti/"}, {"gpu_slug": "nvidia-rtx-4000", "name": "Nvidia RTX 4000", "vendor": "Nvidia", "release_date": "2018-11-13", "form_factor": null, "memory": {"capacity_gb": 8, "type": "GDDR6", "bandwidth_gbps": 416, "bus_bits": 256, "ecc": null}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 3, "pcie_lanes": 16}, "compute": {"fp16": {"dense_tflops": 57}, "fp32": {"dense_tflops": 7.1}}, "silicon": {"architecture": "Turing", "process": "TSMC 12nm FFN", "transistors_b": null, "shader_cores": 2304, "matrix_cores": 288, "compute_units": 36}, "power": {"tdp_w": 160, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "WORKSTATION", "supported_precisions": ["FP16", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/design-visualization/quadro-product-literature/quadro-rtx-4000-data-sheet-us-nvidia-830682-r6-web.pdf"}, {"gpu_slug": "nvidia-rtx-4000-ada", "name": "Nvidia RTX 4000 Ada", "vendor": "Nvidia", "release_date": "2023-08-01", "form_factor": null, "memory": {"capacity_gb": 20, "type": "GDDR6", "bandwidth_gbps": 360, "bus_bits": 160, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": 16}, "compute": {"fp8": {"dense_tflops": 213.8, "sparse_tflops": 427.6}, "fp16": {"dense_tflops": 106.9, "sparse_tflops": 213.8}, "fp32": {"dense_tflops": 26.7}}, "silicon": {"architecture": "Ada Lovelace", "process": "TSMC 4N", "transistors_b": 35.8, "shader_cores": 6144, "matrix_cores": 192, "compute_units": 48}, "power": {"tdp_w": 130, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "WORKSTATION", "supported_precisions": ["FP8", "FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/products/workstations/nvidia-rtx-4000-datasheet.pdf"}, {"gpu_slug": "nvidia-rtx-4000-sff-ada", "name": "Nvidia RTX 4000 SFF Ada", "vendor": "Nvidia", "release_date": "2023-04-01", "form_factor": null, "memory": {"capacity_gb": 20, "type": "GDDR6", "bandwidth_gbps": 280, "bus_bits": 160, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": 16}, "compute": {"fp8": {"dense_tflops": 153.4, "sparse_tflops": 306.8}, "fp16": {"dense_tflops": 76.7, "sparse_tflops": 153.4}, "fp32": {"dense_tflops": 19.2}}, "silicon": {"architecture": "Ada Lovelace", "process": "TSMC 4N", "transistors_b": 35.8, "shader_cores": 6144, "matrix_cores": 192, "compute_units": 48}, "power": {"tdp_w": 70, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "WORKSTATION", "supported_precisions": ["FP8", "FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/rtx-4000-sff/proviz-rtx-4000-sff-ada-datasheet-2616456-web.pdf"}, {"gpu_slug": "nvidia-rtx-4060", "name": "Nvidia RTX 4060", "vendor": "Nvidia", "release_date": "2023-06-29", "form_factor": null, "memory": {"capacity_gb": 8, "type": "GDDR6", "bandwidth_gbps": 272, "bus_bits": 128, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": 8}, "compute": {"fp8": {"dense_tflops": 60.5, "sparse_tflops": 120.9}, "fp16": {"dense_tflops": 30.2, "sparse_tflops": 60.5}, "int8": {"dense_tops": 120.9, "sparse_tops": 241.8}, "fp32": {"dense_tflops": 15.1}}, "silicon": {"architecture": "Ada Lovelace", "process": "TSMC 4N", "transistors_b": 18.9, "shader_cores": 3072, "matrix_cores": 96, "compute_units": 24}, "power": {"tdp_w": 115, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP8", "FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/en-us/geforce/graphics-cards/40-series/rtx-4060-4060ti/"}, {"gpu_slug": "nvidia-rtx-4060-ti", "name": "Nvidia RTX 4060 Ti", "vendor": "Nvidia", "release_date": "2023-05-24", "form_factor": null, "memory": {"capacity_gb": 16, "type": "GDDR6", "bandwidth_gbps": 288, "bus_bits": 128, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": 8}, "compute": {"fp8": {"dense_tflops": 88.3, "sparse_tflops": 176.5}, "fp16": {"dense_tflops": 44.1, "sparse_tflops": 88.3}, "int8": {"dense_tops": 176.5, "sparse_tops": 353.0}, "fp32": {"dense_tflops": 22.1}}, "silicon": {"architecture": "Ada Lovelace", "process": "TSMC 4N", "transistors_b": 22.9, "shader_cores": 4352, "matrix_cores": 136, "compute_units": 34}, "power": {"tdp_w": 165, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP8", "FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/en-us/geforce/graphics-cards/40-series/rtx-4060-4060ti/"}, {"gpu_slug": "nvidia-rtx-4070", "name": "Nvidia RTX 4070", "vendor": "Nvidia", "release_date": "2023-04-13", "form_factor": null, "memory": {"capacity_gb": 12, "type": "GDDR6X", "bandwidth_gbps": 504, "bus_bits": 192, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": null}, "compute": {"fp8": {"dense_tflops": 116.6, "sparse_tflops": 233.2}, "fp16": {"dense_tflops": 58.3, "sparse_tflops": 116.6}, "int8": {"dense_tops": 233.2, "sparse_tops": 466.3}, "fp32": {"dense_tflops": 29.1}}, "silicon": {"architecture": "Ada Lovelace", "process": "TSMC 4N", "transistors_b": 35.8, "shader_cores": 5888, "matrix_cores": 184, "compute_units": 46}, "power": {"tdp_w": 200, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP8", "FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/en-us/geforce/graphics-cards/40-series/rtx-4070-family/"}, {"gpu_slug": "nvidia-rtx-4070-ti", "name": "Nvidia RTX 4070 Ti", "vendor": "Nvidia", "release_date": "2023-01-05", "form_factor": null, "memory": {"capacity_gb": 12, "type": "GDDR6X", "bandwidth_gbps": 504, "bus_bits": 192, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": null}, "compute": {"fp8": {"dense_tflops": 160.4, "sparse_tflops": 320.7}, "fp16": {"dense_tflops": 80.2, "sparse_tflops": 160.4}, "int8": {"dense_tops": 320.7, "sparse_tops": 641.4}, "fp32": {"dense_tflops": 40.1}}, "silicon": {"architecture": "Ada Lovelace", "process": "TSMC 4N", "transistors_b": 35.8, "shader_cores": 7680, "matrix_cores": 240, "compute_units": 60}, "power": {"tdp_w": 285, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP8", "FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/en-us/geforce/graphics-cards/40-series/rtx-4070-family/"}, {"gpu_slug": "nvidia-rtx-4070-ti-super", "name": "Nvidia RTX 4070 Ti Super", "vendor": "Nvidia", "release_date": "2024-01-24", "form_factor": null, "memory": {"capacity_gb": 16, "type": "GDDR6X", "bandwidth_gbps": 672, "bus_bits": 256, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": null}, "compute": {"fp8": {"dense_tflops": 176.4, "sparse_tflops": 352.8}, "fp16": {"dense_tflops": 88.2, "sparse_tflops": 176.4}, "int8": {"dense_tops": 352.8, "sparse_tops": 705.6}, "fp32": {"dense_tflops": 44.1}}, "silicon": {"architecture": "Ada Lovelace", "process": "TSMC 4N", "transistors_b": 45.9, "shader_cores": 8448, "matrix_cores": 264, "compute_units": 66}, "power": {"tdp_w": 285, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP8", "FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/en-us/geforce/graphics-cards/40-series/rtx-4070-family/"}, {"gpu_slug": "nvidia-rtx-4080", "name": "Nvidia RTX 4080", "vendor": "Nvidia", "release_date": "2022-11-16", "form_factor": null, "memory": {"capacity_gb": 16, "type": "GDDR6X", "bandwidth_gbps": 717, "bus_bits": 256, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": null}, "compute": {"fp8": {"dense_tflops": 194.9, "sparse_tflops": 389.8}, "fp16": {"dense_tflops": 97.5, "sparse_tflops": 195.0}, "int8": {"dense_tops": 389.9, "sparse_tops": 779.8}, "fp32": {"dense_tflops": 48.7}}, "silicon": {"architecture": "Ada Lovelace", "process": "TSMC 4N", "transistors_b": 45.9, "shader_cores": 9728, "matrix_cores": 304, "compute_units": 76}, "power": {"tdp_w": 320, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP8", "FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/en-us/geforce/graphics-cards/40-series/rtx-4080-family/"}, {"gpu_slug": "nvidia-rtx-4090", "name": "Nvidia RTX 4090", "vendor": "Nvidia", "release_date": "2022-10-12", "form_factor": null, "memory": {"capacity_gb": 24, "type": "GDDR6X", "bandwidth_gbps": 1010, "bus_bits": 384, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": null}, "compute": {"fp8": {"dense_tflops": 330.3, "sparse_tflops": 660.6}, "fp16": {"dense_tflops": 165.2, "sparse_tflops": 330.4}, "int8": {"dense_tops": 660.6, "sparse_tops": 1321.2}, "fp32": {"dense_tflops": 82.6}}, "silicon": {"architecture": "Ada Lovelace", "process": "TSMC 4N", "transistors_b": 76.3, "shader_cores": 16384, "matrix_cores": 512, "compute_units": 128}, "power": {"tdp_w": 450, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP8", "FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://storage-asset.msi.com/datasheet/vga/global/GeForce-RTX-4090-GAMING-X-TRIO-24G.pdf"}, {"gpu_slug": "nvidia-rtx-4500-ada", "name": "Nvidia RTX 4500 Ada", "vendor": "Nvidia", "release_date": "2023-08-01", "form_factor": null, "memory": {"capacity_gb": 24, "type": "GDDR6", "bandwidth_gbps": 432, "bus_bits": 192, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": 16}, "compute": {"fp8": {"dense_tflops": 317.0, "sparse_tflops": 634.0}, "fp16": {"dense_tflops": 158.5, "sparse_tflops": 317.0}, "fp32": {"dense_tflops": 39.6}}, "silicon": {"architecture": "Ada Lovelace", "process": "TSMC 4N", "transistors_b": 35.8, "shader_cores": 7680, "matrix_cores": 240, "compute_units": 60}, "power": {"tdp_w": 210, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "WORKSTATION", "supported_precisions": ["FP8", "FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/products/workstations/nvidia-rtx-4500-datasheet.pdf"}, {"gpu_slug": "nvidia-rtx-5000", "name": "Nvidia RTX 5000", "vendor": "Nvidia", "release_date": "2018-08-13", "form_factor": null, "memory": {"capacity_gb": 16, "type": "GDDR6", "bandwidth_gbps": 448, "bus_bits": 256, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": 50, "pcie_gen": 3, "pcie_lanes": 16}, "compute": {"fp16": {"dense_tflops": 89.2}, "int8": {"dense_tops": 178.4}, "fp32": {"dense_tflops": 11.2}}, "silicon": {"architecture": "Turing", "process": "TSMC 12nm FFN", "transistors_b": 13.6, "shader_cores": 3072, "matrix_cores": 384, "compute_units": 48}, "power": {"tdp_w": 265, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "WORKSTATION", "supported_precisions": ["FP16", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/design-visualization/quadro-product-literature/quadro-rtx-5000-data-sheet-us-nvidia-704120-r4-web.pdf"}, {"gpu_slug": "nvidia-rtx-5000-ada", "name": "Nvidia RTX 5000 Ada", "vendor": "Nvidia", "release_date": "2023-08-01", "form_factor": null, "memory": {"capacity_gb": 32, "type": "GDDR6", "bandwidth_gbps": 576, "bus_bits": 256, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": 16}, "compute": {"fp8": {"dense_tflops": 522.2, "sparse_tflops": 1044.4}, "fp16": {"dense_tflops": 261.1, "sparse_tflops": 522.2}, "fp32": {"dense_tflops": 65.3}}, "silicon": {"architecture": "Ada Lovelace", "process": "TSMC 4N", "transistors_b": 76.3, "shader_cores": 12800, "matrix_cores": 400, "compute_units": 100}, "power": {"tdp_w": 250, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "WORKSTATION", "supported_precisions": ["FP8", "FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://resources.nvidia.com/_pfcdn/assets/10412/contents/1095460/b57d512c-c1b8-4fea-b9e5-cb95bcb33c44.pdf"}, {"gpu_slug": "nvidia-rtx-5060", "name": "Nvidia RTX 5060", "vendor": "Nvidia", "release_date": "2025-06-25", "form_factor": null, "memory": {"capacity_gb": 8, "type": "GDDR7", "bandwidth_gbps": 448, "bus_bits": 128, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 5, "pcie_lanes": null}, "compute": {"fp4": {"dense_tflops": 307, "sparse_tflops": 614}, "fp8": {"dense_tflops": 76.8, "sparse_tflops": 153.6}, "fp16": {"dense_tflops": 38.4, "sparse_tflops": 76.8}, "int8": {"dense_tops": 153.6, "sparse_tops": 307.2}, "fp32": {"dense_tflops": 19.2}}, "silicon": {"architecture": "Blackwell", "process": "TSMC 4N", "transistors_b": 21.9, "shader_cores": 3840, "matrix_cores": 120, "compute_units": 30}, "power": {"tdp_w": 145, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP4", "FP8", "FP16", "BF16", "TF32", "FP32", "INT8"], "datasheet_url": "https://www.nvidia.com/en-us/geforce/graphics-cards/50-series/rtx-5060-family/"}, {"gpu_slug": "nvidia-rtx-5060-ti", "name": "Nvidia RTX 5060 Ti", "vendor": "Nvidia", "release_date": "2025-04-16", "form_factor": null, "memory": {"capacity_gb": 16, "type": "GDDR7", "bandwidth_gbps": 512, "bus_bits": 128, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 5, "pcie_lanes": null}, "compute": {"fp4": {"dense_tflops": 379.5, "sparse_tflops": 759}, "fp8": {"dense_tflops": 94.8, "sparse_tflops": 189.6}, "fp16": {"dense_tflops": 47.4, "sparse_tflops": 94.8}, "int8": {"dense_tops": 189.6, "sparse_tops": 379.2}, "fp32": {"dense_tflops": 23.7}}, "silicon": {"architecture": "Blackwell", "process": "TSMC 4N", "transistors_b": 21.9, "shader_cores": 4608, "matrix_cores": 144, "compute_units": 36}, "power": {"tdp_w": 180, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP4", "FP8", "FP16", "BF16", "TF32", "FP32", "INT8"], "datasheet_url": "https://www.nvidia.com/en-us/geforce/graphics-cards/50-series/rtx-5060-family/"}, {"gpu_slug": "nvidia-rtx-5070", "name": "Nvidia RTX 5070", "vendor": "Nvidia", "release_date": "2025-03-05", "form_factor": null, "memory": {"capacity_gb": 12, "type": "GDDR7", "bandwidth_gbps": 672, "bus_bits": 192, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 5, "pcie_lanes": null}, "compute": {"fp4": {"dense_tflops": 493.9, "sparse_tflops": 987.8}, "fp8": {"dense_tflops": 123.5, "sparse_tflops": 246.9}, "fp16": {"dense_tflops": 61.7, "sparse_tflops": 123.5}, "int8": {"dense_tops": 246.9, "sparse_tops": 493.9}, "fp32": {"dense_tflops": 30.9}}, "silicon": {"architecture": "Blackwell", "process": "TSMC 4N", "transistors_b": 31.1, "shader_cores": 6144, "matrix_cores": 192, "compute_units": 48}, "power": {"tdp_w": 250, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP4", "FP8", "FP16", "BF16", "TF32", "FP32", "INT8"], "datasheet_url": "https://www.nvidia.com/en-us/geforce/graphics-cards/50-series/rtx-5070-family/"}, {"gpu_slug": "nvidia-rtx-5070-ti", "name": "Nvidia RTX 5070 Ti", "vendor": "Nvidia", "release_date": "2025-02-20", "form_factor": null, "memory": {"capacity_gb": 16, "type": "GDDR7", "bandwidth_gbps": 896, "bus_bits": 256, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 5, "pcie_lanes": null}, "compute": {"fp4": {"dense_tflops": 703, "sparse_tflops": 1406}, "fp8": {"dense_tflops": 175.8, "sparse_tflops": 351.5}, "fp16": {"dense_tflops": 87.9, "sparse_tflops": 175.8}, "int8": {"dense_tops": 351.5, "sparse_tops": 703}, "fp32": {"dense_tflops": 43.9}}, "silicon": {"architecture": "Blackwell", "process": "TSMC 4N", "transistors_b": 45.6, "shader_cores": 8960, "matrix_cores": 280, "compute_units": 70}, "power": {"tdp_w": 300, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP4", "FP8", "FP16", "BF16", "TF32", "FP32", "INT8"], "datasheet_url": "https://www.nvidia.com/en-us/geforce/graphics-cards/50-series/rtx-5070-family/"}, {"gpu_slug": "nvidia-rtx-5080", "name": "Nvidia RTX 5080", "vendor": "Nvidia", "release_date": "2025-01-30", "form_factor": null, "memory": {"capacity_gb": 16, "type": "GDDR7", "bandwidth_gbps": 960, "bus_bits": 256, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 5, "pcie_lanes": null}, "compute": {"fp4": {"dense_tflops": 900.4, "sparse_tflops": 1801}, "fp8": {"dense_tflops": 225.1, "sparse_tflops": 450.2}, "fp16": {"dense_tflops": 112.6, "sparse_tflops": 225.1}, "int8": {"dense_tops": 450.2, "sparse_tops": 900.4}, "fp32": {"dense_tflops": 56.3}}, "silicon": {"architecture": "Blackwell", "process": "TSMC 4N", "transistors_b": 45.6, "shader_cores": 10752, "matrix_cores": 336, "compute_units": 84}, "power": {"tdp_w": 360, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP4", "FP8", "FP16", "BF16", "TF32", "FP32", "INT8"], "datasheet_url": "https://www.nvidia.com/en-us/geforce/graphics-cards/50-series/rtx-5080/"}, {"gpu_slug": "nvidia-rtx-5090", "name": "Nvidia RTX 5090", "vendor": "Nvidia", "release_date": "2025-01-30", "form_factor": null, "memory": {"capacity_gb": 32, "type": "GDDR7", "bandwidth_gbps": 1792, "bus_bits": 512, "ecc": false}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 5, "pcie_lanes": null}, "compute": {"fp4": {"dense_tflops": 1676, "sparse_tflops": 3352}, "fp8": {"dense_tflops": 419, "sparse_tflops": 838}, "fp16": {"dense_tflops": 209.5, "sparse_tflops": 419}, "int8": {"dense_tops": 838, "sparse_tops": 1676}, "fp32": {"dense_tflops": 104.8}}, "silicon": {"architecture": "Blackwell", "process": "TSMC 4N", "transistors_b": 92.2, "shader_cores": 21760, "matrix_cores": 680, "compute_units": 170}, "power": {"tdp_w": 575, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "CONSUMER", "supported_precisions": ["FP4", "FP8", "FP16", "BF16", "TF32", "FP32", "INT8"], "datasheet_url": "https://www.nvidia.com/en-us/geforce/graphics-cards/50-series/rtx-5090/"}, {"gpu_slug": "nvidia-rtx-5880-ada", "name": "Nvidia RTX 5880 Ada", "vendor": "Nvidia", "release_date": "2024-01-01", "form_factor": null, "memory": {"capacity_gb": 48, "type": "GDDR6", "bandwidth_gbps": 960, "bus_bits": 384, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": 16}, "compute": {"fp8": {"dense_tflops": 554.2, "sparse_tflops": 1108.4}, "fp16": {"dense_tflops": 277.1, "sparse_tflops": 554.2}, "fp32": {"dense_tflops": 69.3}}, "silicon": {"architecture": "Ada Lovelace", "process": "TSMC 4N", "transistors_b": 76.3, "shader_cores": 14080, "matrix_cores": 440, "compute_units": 110}, "power": {"tdp_w": 285, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "WORKSTATION", "supported_precisions": ["FP8", "FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/en-us/products/workstations/rtx-5880/"}, {"gpu_slug": "nvidia-rtx-6000-ada", "name": "Nvidia RTX 6000 Ada", "vendor": "Nvidia", "release_date": "2022-12-03", "form_factor": null, "memory": {"capacity_gb": 48, "type": "GDDR6", "bandwidth_gbps": 960, "bus_bits": 384, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": 16}, "compute": {"fp8": {"dense_tflops": 728.5, "sparse_tflops": 1457}, "fp16": {"dense_tflops": 364.2, "sparse_tflops": 728.5}, "fp32": {"dense_tflops": 91.1}}, "silicon": {"architecture": "Ada Lovelace", "process": "TSMC 4N", "transistors_b": 76.3, "shader_cores": 18176, "matrix_cores": 568, "compute_units": 142}, "power": {"tdp_w": 300, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "WORKSTATION", "supported_precisions": ["FP8", "FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/design-visualization/rtx-6000/proviz-print-rtx6000-datasheet-web-2504660.pdf"}, {"gpu_slug": "nvidia-a2000", "name": "Nvidia RTX A2000", "vendor": "Nvidia", "release_date": "2021-08-10", "form_factor": null, "memory": {"capacity_gb": 12, "type": "GDDR6", "bandwidth_gbps": 288, "bus_bits": 192, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 4, "pcie_lanes": 16}, "compute": {"fp16": {"dense_tflops": 31.9, "sparse_tflops": 63.9}, "fp32": {"dense_tflops": 8.0}}, "silicon": {"architecture": "Ampere", "process": null, "transistors_b": null, "shader_cores": 3328, "matrix_cores": 104, "compute_units": 26}, "power": {"tdp_w": 70, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "WORKSTATION", "supported_precisions": ["FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/design-visualization/rtx-a2000/nvidia-rtx-a2000-datasheet-1987439-r5.pdf"}, {"gpu_slug": "nvidia-a6000", "name": "Nvidia RTX A6000", "vendor": "Nvidia", "release_date": "2020-10-05", "form_factor": null, "memory": {"capacity_gb": 48, "type": "GDDR6", "bandwidth_gbps": 768, "bus_bits": 384, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": 112, "pcie_gen": 4, "pcie_lanes": 16}, "compute": {"fp16": {"dense_tflops": 154.8, "sparse_tflops": 309.6}, "int8": {"dense_tops": 309.7, "sparse_tops": 619.4}, "fp32": {"dense_tflops": 38.7}}, "silicon": {"architecture": "Ampere", "process": "Samsung 8N", "transistors_b": 28.3, "shader_cores": 10752, "matrix_cores": 336, "compute_units": 84}, "power": {"tdp_w": 300, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "WORKSTATION", "supported_precisions": ["FP16", "BF16", "TF32", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/design-visualization/quadro-product-literature/proviz-print-nvidia-rtx-a6000-datasheet-us-nvidia-1454980-r9-web%20(1).pdf"}, {"gpu_slug": "nvidia-rtx-pro-2000", "name": "Nvidia RTX PRO 2000", "vendor": "Nvidia", "release_date": "2025-08-11", "form_factor": null, "memory": {"capacity_gb": 16, "type": "GDDR7", "bandwidth_gbps": 288, "bus_bits": 128, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 5, "pcie_lanes": 8}, "compute": {"fp4": {"dense_tflops": 272.5, "sparse_tflops": 545}, "fp8": {"dense_tflops": 136.3, "sparse_tflops": 272.5}, "fp16": {"dense_tflops": 68.1, "sparse_tflops": 136.3}, "int8": {"dense_tops": 136.3, "sparse_tops": 272.5}, "fp32": {"dense_tflops": 17}}, "silicon": {"architecture": "Blackwell", "process": "TSMC 4N", "transistors_b": 21.9, "shader_cores": 4352, "matrix_cores": 136, "compute_units": 34}, "power": {"tdp_w": 70, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "WORKSTATION", "supported_precisions": ["FP4", "FP8", "FP16", "BF16", "TF32", "FP32", "INT8"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/products/workstations/professional-desktop-gpus/rtx-pro-2000/workstation-datasheet-blackwell-rtx-pro-2000-nvidia-us-4016661.pdf"}, {"gpu_slug": "nvidia-rtx-pro-4000", "name": "Nvidia RTX PRO 4000", "vendor": "Nvidia", "release_date": "2025-03-18", "form_factor": null, "memory": {"capacity_gb": 24, "type": "GDDR7", "bandwidth_gbps": 672, "bus_bits": 192, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 5, "pcie_lanes": 16}, "compute": {"fp4": {"dense_tflops": 589, "sparse_tflops": 1178}, "fp8": {"dense_tflops": 294.5, "sparse_tflops": 589}, "fp16": {"dense_tflops": 147.3, "sparse_tflops": 294.5}, "int8": {"dense_tops": 294.5, "sparse_tops": 589}, "fp32": {"dense_tflops": 37}}, "silicon": {"architecture": "Blackwell", "process": "TSMC 4N", "transistors_b": 45.6, "shader_cores": 8960, "matrix_cores": 280, "compute_units": 70}, "power": {"tdp_w": 145, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "WORKSTATION", "supported_precisions": ["FP4", "FP8", "FP16", "BF16", "TF32", "FP32", "INT8"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/products/workstations/professional-desktop-gpus/rtx-pro-4000/workstation-datasheet-rtx-pro-4000-nvidia-us-web.pdf"}, {"gpu_slug": "nvidia-rtx-pro-4500", "name": "Nvidia RTX PRO 4500", "vendor": "Nvidia", "release_date": "2025-03-18", "form_factor": null, "memory": {"capacity_gb": 32, "type": "GDDR7", "bandwidth_gbps": 896, "bus_bits": 256, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 5, "pcie_lanes": 16}, "compute": {"fp4": {"dense_tflops": 808.5, "sparse_tflops": 1617}, "fp8": {"dense_tflops": 404.3, "sparse_tflops": 808.5}, "fp16": {"dense_tflops": 202.1, "sparse_tflops": 404.3}, "int8": {"dense_tops": 404.3, "sparse_tops": 808.5}, "fp32": {"dense_tflops": 51}}, "silicon": {"architecture": "Blackwell", "process": "TSMC 4N", "transistors_b": 45.6, "shader_cores": 10496, "matrix_cores": 328, "compute_units": 82}, "power": {"tdp_w": 200, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "WORKSTATION", "supported_precisions": ["FP4", "FP8", "FP16", "BF16", "TF32", "FP32", "INT8"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/data-center/rtx-pro-4500-blackwell/workstation-datasheet-blackwell-rtx-pro-4500-gtc25-spring-nvidia-3662540.pdf"}, {"gpu_slug": "nvidia-rtx-pro-5000", "name": "Nvidia RTX PRO 5000", "vendor": "Nvidia", "release_date": "2025-03-18", "form_factor": null, "memory": {"capacity_gb": 48, "type": "GDDR7", "bandwidth_gbps": 1344, "bus_bits": 512, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 5, "pcie_lanes": 16}, "compute": {"fp4": {"dense_tflops": 1032, "sparse_tflops": 2064}, "fp8": {"dense_tflops": 516, "sparse_tflops": 1032}, "fp16": {"dense_tflops": 258, "sparse_tflops": 516}, "int8": {"dense_tops": 516, "sparse_tops": 1032}, "fp32": {"dense_tflops": 65}}, "silicon": {"architecture": "Blackwell", "process": "TSMC 4N", "transistors_b": 92.2, "shader_cores": 14080, "matrix_cores": 440, "compute_units": 110}, "power": {"tdp_w": 300, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "WORKSTATION", "supported_precisions": ["FP4", "FP8", "FP16", "BF16", "TF32", "FP32", "INT8"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/products/workstations/professional-desktop-gpus/rtx-pro-5000-blackwell/workstation-datasheet-blackwell-rtx-pro-5000-gtc25-spring-nvidia-3658700.pdf"}, {"gpu_slug": "nvidia-rtx-pro-6000", "name": "Nvidia RTX PRO 6000", "vendor": "Nvidia", "release_date": "2025-03-18", "form_factor": "PCIe", "memory": {"capacity_gb": 96, "type": "GDDR7", "bandwidth_gbps": 1597, "bus_bits": 512, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 5, "pcie_lanes": 16}, "compute": {"fp4": {"dense_tflops": 2000, "sparse_tflops": 4000}, "fp8": {"dense_tflops": 1000, "sparse_tflops": 2000}, "fp16": {"dense_tflops": 500, "sparse_tflops": 1000}, "int8": {"dense_tops": 1000, "sparse_tops": 2000}, "fp32": {"dense_tflops": 120}}, "silicon": {"architecture": "Blackwell", "process": "TSMC 4N", "transistors_b": 92.2, "shader_cores": 24064, "matrix_cores": 752, "compute_units": 188}, "power": {"tdp_w": 600, "cooling": "passive"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "WORKSTATION", "supported_precisions": ["FP4", "FP8", "FP16", "BF16", "TF32", "FP32", "INT8"], "datasheet_url": "https://resources.nvidia.com/en-us-rtx-pro-6000"}, {"gpu_slug": "nvidia-rtx-pro-6000d", "name": "Nvidia RTX PRO 6000D", "vendor": "Nvidia", "release_date": "2025-07-01", "form_factor": null, "memory": {"capacity_gb": 84, "type": "GDDR7", "bandwidth_gbps": 1568, "bus_bits": 448, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 5, "pcie_lanes": null}, "compute": {"fp4": {"dense_tflops": 1553, "sparse_tflops": 3105}, "fp8": {"dense_tflops": 776, "sparse_tflops": 1553}, "fp16": {"dense_tflops": 388, "sparse_tflops": 776}, "int8": {"dense_tops": 776, "sparse_tops": 1553}, "fp32": {"dense_tflops": 97}}, "silicon": {"architecture": "Blackwell", "process": "TSMC 4N", "transistors_b": 92.2, "shader_cores": 19968, "matrix_cores": 624, "compute_units": 156}, "power": {"tdp_w": 400, "cooling": null}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "WORKSTATION", "supported_precisions": ["FP4", "FP8", "FP16", "BF16", "TF32", "FP32", "INT8"], "datasheet_url": null}, {"gpu_slug": "nvidia-t1000", "name": "Nvidia T1000", "vendor": "Nvidia", "release_date": "2021-05-06", "form_factor": null, "memory": {"capacity_gb": 4, "type": "GDDR6", "bandwidth_gbps": 160, "bus_bits": 128, "ecc": null}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 3, "pcie_lanes": 16}, "compute": {"fp32": {"dense_tflops": 2.5}}, "silicon": {"architecture": "Turing", "process": null, "transistors_b": null, "shader_cores": 896, "matrix_cores": null, "compute_units": 14}, "power": {"tdp_w": 50, "cooling": "active"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "WORKSTATION", "supported_precisions": ["FP16", "FP32", "INT8"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/design-visualization/productspage/quadro/quadro-desktop/proviz-print-nvidia-T1000-datasheet-us-nvidia-1670054-r4-web.pdf"}, {"gpu_slug": "nvidia-t4", "name": "Nvidia T4", "vendor": "Nvidia", "release_date": "2018-09-13", "form_factor": null, "memory": {"capacity_gb": 16, "type": "GDDR6", "bandwidth_gbps": 300, "bus_bits": 256, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 3, "pcie_lanes": 16}, "compute": {"fp16": {"dense_tflops": 65}, "int8": {"dense_tops": 130}, "fp32": {"dense_tflops": 8.1}}, "silicon": {"architecture": "Turing", "process": "TSMC 12nm FFN", "transistors_b": 13.6, "shader_cores": 2560, "matrix_cores": 320, "compute_units": 40}, "power": {"tdp_w": 70, "cooling": "passive"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP16", "FP32", "INT4", "INT8"], "datasheet_url": "https://www.nvidia.com/content/dam/en-zz/Solutions/Data-Center/tesla-t4/t4-tensor-core-datasheet-951643.pdf"}, {"gpu_slug": "nvidia-t4g", "name": "Nvidia T4G", "vendor": "Nvidia", "release_date": "2020-09-01", "form_factor": null, "memory": {"capacity_gb": 16, "type": "GDDR6", "bandwidth_gbps": 320, "bus_bits": 256, "ecc": null}, "interconnect": {"gpu_to_gpu_gbps": null, "pcie_gen": 3, "pcie_lanes": 16}, "compute": {"fp16": {"dense_tflops": 65}, "int8": {"dense_tops": 130}, "fp32": {"dense_tflops": 8.1}}, "silicon": {"architecture": "Turing", "process": "TSMC 12nm FFN", "transistors_b": 13.6, "shader_cores": 2560, "matrix_cores": 320, "compute_units": 40}, "power": {"tdp_w": 70, "cooling": null}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP16", "FP32", "INT4", "INT8"], "datasheet_url": "https://d1.awsstatic.com/product-marketing/ec2/NVIDIA_AWS_T4G_DataSheet_FINAL_02_17_2022.pdf"}, {"gpu_slug": "nvidia-v100", "name": "Nvidia V100", "vendor": "Nvidia", "release_date": "2017-06-21", "form_factor": null, "memory": {"capacity_gb": 32, "type": "HBM2", "bandwidth_gbps": 900, "bus_bits": 4096, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": 300, "pcie_gen": 3, "pcie_lanes": null}, "compute": {"fp16": {"dense_tflops": 125}, "fp32": {"dense_tflops": 15.7}, "fp64": {"dense_tflops": 7.8}}, "silicon": {"architecture": "Volta", "process": "TSMC 12nm FFN", "transistors_b": 21.1, "shader_cores": 5120, "matrix_cores": 640, "compute_units": 80}, "power": {"tdp_w": 300, "cooling": "passive"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP16", "FP32", "FP64", "INT8"], "datasheet_url": "https://images.nvidia.com/content/technologies/volta/pdf/volta-v100-datasheet-update-us-1165301-r5.pdf"}, {"gpu_slug": "nvidia-v100s", "name": "Nvidia V100S", "vendor": "Nvidia", "release_date": "2019-11-26", "form_factor": null, "memory": {"capacity_gb": 32, "type": "HBM2", "bandwidth_gbps": 1134, "bus_bits": 4096, "ecc": true}, "interconnect": {"gpu_to_gpu_gbps": 300, "pcie_gen": 3, "pcie_lanes": null}, "compute": {"fp16": {"dense_tflops": 130}, "fp32": {"dense_tflops": 16.4}, "fp64": {"dense_tflops": 8.2}}, "silicon": {"architecture": "Volta", "process": "TSMC 12nm FFN", "transistors_b": 21.1, "shader_cores": 5120, "matrix_cores": 640, "compute_units": 80}, "power": {"tdp_w": 250, "cooling": "passive"}, "platform": {"mig_instances": null, "partitions": null}, "market_class": "DATACENTER", "supported_precisions": ["FP16", "FP32", "FP64", "INT8"], "datasheet_url": "https://images.nvidia.com/content/technologies/volta/pdf/volta-v100-datasheet-update-us-1165301-r5.pdf"}]}