12GB单卡显存在AI入门推理圈流通量最大的消费卡: Stable Diffusion出图与小模型(7B级量化LLM)推理的门槛卡, 二手保有量巨大价格最透明, 是万安二手大盘走量的基本盘SKU; 12GB@192bit 360GB/s对比同价位8GB卡的显存优势就是它能成为SD/推理门槛卡的原因; 170W低功耗对家用与租赁机房供电都友好; 验货注意两点: 一认准12GB版(192-bit), 别与2022-10的8GB缩水版(128-bit/224GB/s)混淆; 二知悉2021-09起部分卡为GA104-150异芯版(规格完全一致, die名不影响口径); MSRP $329
GeForce RTX 3060 12GB是NVIDIA基于Ampere架构(GA106核心)打造的消费级显卡,配备12 GB GDDR6显存,位宽192-bit,带宽360 GB/s,CUDA核心3584个,加速频率1.78 GHz,FP32算力约12.74 TFLOPS,TGP为170 W。凭借同档位少见的12GB单卡显存,它是Stable Diffusion出图和7B级量化LLM本地推理的常见门槛选择;同时其二手保有量大、价格透明,在消费级AI入门市场流通广泛。
| 架构 | Ampere (GA106-300, 28 SM, 3MB L2) |
| 显存 | 12GB GDDR6 |
| 显存带宽 | 360GB/s (15Gbps x 192bit) |
| 显存位宽 | 192bit |
| 算力 | FP32 12.74 TFLOPS (Wikipedia按Boost 1777MHz核算, 常引作12.7; Base 9.46) / Tensor FP16 51.2 TFLOPS [102.4稀疏] |
| CUDA核心 | 3584 (28 SM) / Tensor Core 112 (三代) / RT Core 28 (二代) |
| 功耗 | 170W TGP (建议系统电源550W, 1x PCIe 8-pin附1x 12-pin转接, 最高93°C) |
| 互联 | PCIe Gen4 x16, 无NVLink (官方页NVLink(SLI-Ready)标注'-') |
| 发布年 | 2021 (CES 2021发布, 2021-02-25开售, MSRP $329) |
| 频率 | Base 1.32GHz / Boost 1.78GHz |
| 工艺 | Samsung 8N, 132.5亿晶体管, 276mm² (GA106满血30 SM:3840CUDA, 3060启用28) |
| 媒体引擎 | 第7代NVENC / 第5代NVDEC (官方页标注NVDEC为Decoder) |
| 显示输出 | HDMI 2.1 + DP 1.4a x3, 4屏, HDCP 2.3, 7680x4320 |
| 形态 | FE双槽 242x112mm, 供电 1x8pin(附1x 12-pin转接), 需550W电源 |
| CUDA算力等级 | Compute Capability 8.6 |
| 型号 | 显存 | 功耗 |
|---|
| NVIDIA T4 对比 | 16GB GDDR6 with ECC (默认开启) | 70W (Total board power, 默认) |
| NVIDIA A100 对比 | 40GB HBM2 / 80GB HBM2e 双版本(80GB 版 2020-11-16 SC20 增发),带 ECC | SXM4 400W(40GB/80GB 同);PCIe 版 40GB 250W / 80GB 300W |
| NVIDIA H20 对比 | 96GB HBM3(Flopper/VipraTech/腾讯新闻三源一致) | 400W TDP(Flopper/VipraTech规格表/腾讯新闻'热设计功耗400W'三源;VipraTech正文另有350W矛盾口径已弃) |
| NVIDIA GB300 对比 | 288GB HBM3e(单GPU封装;超级芯片576GB;HGX板级2.1TB/机柜20TB并存) | TGP 最高 1400W(单GPU,官方博客直证) |
| NVIDIA A30 对比 | 24 GB HBM2 | 165 W |
| NVIDIA GeForce RTX 4090 对比 | 24GB GDDR6X | 450W TGP (平均游戏315W, 建议系统电源850W) |