文章时间:2026年8月9日
覆盖范围:卡的类型、算力规格、国内外采购限制、费用情况、国内选型建议
数据时效:重点覆盖 2026年2月—8月 的最新动态
数据来源:NVIDIA 官网、公开媒体报道(路透社、环球时报、第一财经等)、渠道报价(京东/算力租赁平台)、行业分析机构
一、核心结论速览
二、卡的类型:英伟达算力卡全景
英伟达算力产品线按代际架构和市场定位两条线划分。截至 2026 年年中,主流在售/在研架构为:
代际路线图:Ampere(2020)→ Hopper(2022)→ Blackwell(2024)→ Blackwell Ultra(2025)→ Rubin(2026)→ Rubin Ultra(2027)→ Feynman(2028)
2.1 按市场定位分类
2.2 各代际代表型号速览
H100(Hopper,2022):上一代 AI 训练主力,"大模型时代的发动机"。2023—2025 年几乎所有主流大模型(GPT-4、Llama、DeepSeek 等)训练都用它。
H200(Hopper 升级,2024):H100 同款算力核心,显存从 80GB 升级到 141GB HBM3e,专为长上下文、大模型推理优化。
H20(中国特供,2024):为绕开出口管制而生,算力砍到 H100 的约 1/6,但保留了 96GB 大显存和 NVLink 高带宽。
B200(Blackwell,2024):全新架构,首次原生支持 FP4 精度,算力较 Hopper 提升数倍。
B300 / Blackwell Ultra(2025):B200 的显存与算力双升级版,288GB 显存是当前单卡最高,配套 GB300 NVL72 整柜方案。
B30(中国特供,2025底出货):基于 Blackwell 架构,改用 GDDR7 显存以满足出口合规,价格远低于 H20。
Vera Rubin(2026年3月发布):下一代平台,HBM4 显存、FP4 推理算力 50 PFLOPS(Blackwell 的 5 倍),2026 下半年起交付。
RTX PRO Blackwell 系列(2025):专业工作站卡,96GB 超大显存(RTX PRO 6000)跑本地大模型推理/微调,不受出口管制,国内京东可直接购买。
RTX 50 系列(2025):消费级,RTX 5090 为旗舰(32GB GDDR7),个人开发者/小团队 AI 首选。
三、算力情况:各卡详细规格
说明:数据中心卡采用 稀疏(sparse)峰值算力 标注更常见,表中同时给出部分型号的稠密值;实际部署中算力还受显存带宽、互联、软件栈影响。
3.1 数据中心卡规格对比
关键解读:
B300 是当前单卡算力与显存之王:288GB HBM3e 可单卡容纳 200B+ 稠密模型(FP8),万亿参数 MoE 模型仅需一个 8 卡节点即可跑。推理 token 成本较 Hopper 时代降低约 35 倍(SemiAnalysis 2026 Q1 基准)。
H200 vs H100:算力完全一样(同一个核心),H200 的 141GB 显存让长上下文推理、大模型训练受益明显,是"显存即正义"的典型。
H20 算力被刻意阉割:FP16 仅约 H100 的 15%,但保留 96GB 显存——设计意图就是"能跑大模型推理、不能高效训练",主要满足国内推理市场。
B30 走"低算力高性价比"路线:性能约为 H20 的 75%~90%,但价格低 30%~40%,能效比 H20 高约 30%,专为国内推理市场设计。
3.2 整柜超算方案
3.3 专业工作站卡:RTX PRO Blackwell 全家族
RTX PRO Blackwell 系列是英伟达 2025 年发布的专业工作站卡,采用与数据中心 B200 相同的 Blackwell 架构(第五代 Tensor Core,支持 FP4),不受美国出口管制、国内可直接购买,是本地跑大模型推理/微调、数据科学、专业图形的主力选择。全家族分 Workstation(桌面工作站)、Max-Q(低功耗)、Server(服务器) 三种形态。
关键解读:
RTX PRO 6000(96GB)是"桌面版 B200":显存容量与 B200 数据中心卡同级(96GB vs 192GB),单卡即可在桌面加载 70B~100B 参数的量化大模型做推理/微调,无需服务器机架。
Max-Q 版(300W) 与标准版同显存同核心,通过降功耗换来静音、低散热要求,支持一台工作站插 4 卡(MIG 最多 4 实例),适合多卡并行的本地 AI 开发。
Server 版为被动散热、机架部署设计,带宽略降(1,597 GB/s),面向小型机架式 AI 服务器。
RTX PRO 5000(72GB) 是"显存与预算的平衡点",性能约为 6000 的一半,价格也约为一半,是性价比最高的本地大模型卡。
全部支持 ECC 显存纠错、PCIe 5.0、CUDA 12.8+,可直接复用数据中心 CUDA 生态,无迁移成本。
3.4 消费级游戏卡
四、采购限制:出口管制时间线与现状(截至 2026年8月)
4.1 管制政策时间线
4.2 当前(2026年8月)各卡对华状态
⚠️ 重要提示:政策变动极快,2026年以来几乎每月都有新规(RASA 云服务限制、《AI 监控法案》、MATCH 法案等)。采购前务必以美国 BIS 最新公告为准,并咨询专业合规顾问。云服务层面也在收紧——《远程访问安全法案》限制美企向中企提供先进算力云服务,海外云训练也面临合规风险。
五、费用情况
5.1 单卡购买价格(2026年,含渠道溢价)
5.2 整柜价格
5.3 云上/租赁价格
海外(美元/卡时,2026年中):
国内(人民币,2026年2月→7月,整体降价 8%~17%):
💡 趋势判断:①高端卡(H100/H200)因订单排期至 2027 年,现货紧缺、价格坚挺甚至上涨;②国产卡(昇腾)产能爬坡 + 新特供卡(H20/B30)入局,2026年下半年租赁价格大概率继续下行;③消费级(40系/50系)受 2026年7月 渠道涨价影响,价格有所上浮。
六、国内如何选英伟达算力卡:分场景选型指南
6.1 先看清现实约束(合规红线)
可以买:H20、B30(特供合规版)——官方渠道可正常采购;
理论上可买但几乎买不到:H200(需美国逐案许可 + 第三方测试 + 上限约束,截至2026年年中中国市场无实质成交);
买不到(禁止):H100、B200、B300、GB200/GB300、Vera Rubin;
不受限:消费级 RTX 50 系列、专业工作站 RTX PRO 4000/4500/5000/6000 全家族(含 Max-Q、Server 版)——无出口管制,京东/丽台等渠道现货充足(数据中心级大规模部署不在此列,机架级部署需走服务器渠道)。
6.2 按场景推荐
6.3 买卡 vs 租算力(关键决策)
核心判断标准:年用卡量 <50 张卡 → 建议租,别买。 算力租赁平台测算,按需租用总成本(含运维/机房/电力)比自购低 30%~45%。
6.4 采购路径建议
合规特供卡(H20/B30):通过英伟达中国认证渠道商、主流云厂商(阿里云、腾讯云、火山引擎)或整机厂商(浪潮、新华三、宁畅等)采购,务必要求完整授权链路与合规文件;
消费/工作站卡:京东自营、官方渠道即可——RTX PRO 4000(丽台自营约 ¥1.4万)、RTX PRO 5000 72GB(京东自营约 ¥5.9万)、RTX PRO 6000(¥6万~15万);这类卡无出口管制限制,现货充足;
租赁:阿里云、腾讯云、火山引擎等公有云;或极智算(jygpu)等算力聚合平台比价;
警惕:市面上"水货 H100/B200"多经灰色渠道流入,存在海关扣押、无法质保、以及违反美国出口管制法律的风险(2026年5月后绕道采购亦被堵),企业采购需谨慎评估法律风险。
七、国产替代与市场格局(参考维度)
华为昇腾 910C/910D:2026年已规模交付政企/运营商渠道,8卡服务器 ¥110万~120万,性能对标 H100 的 60%~80%,生态(MindSpore/CANN)逐步成熟,是国产化首选;
寒武纪思元、海光深算、摩尔线程:单卡 ¥3万~5万,主打中小模型推理,性价比突出;
AMD MI300X/MI325X:海外市场对英伟达的主要竞争者,国内因 ROCm 生态适配成本高,主要被头部大厂采用(整机 ¥120万~130万);
格局判断:黄仁勋 2026年 公开承认"美国出口限制正把中国市场让给中国公司"。据行业统计,英伟达数据中心业务 FY2027 Q1 收入 $752亿(同比+92%),但中国大陆贡献占比已大幅下滑;国产卡在推理侧快速渗透,训练侧仍以英伟达特供卡为主。
八、风险提示与免责声明
政策风险极高:2026年以来美国对华芯片政策"月月有变"(H200 解禁、境外子公司堵漏、全球许可制酝酿、MATCH 法案等),本报告政策部分为 2026年8月9日 时点判断,采购决策前务必核实最新法规;
价格波动大:渠道价格受供需、关税、汇率影响,上下浮动可达 20%~30%;
数据来源:本文价格/规格数据综合 NVIDIA 官网、路透社/环球时报/第一财经等媒体报道及公开渠道报价,仅供参考,不构成采购建议;
合规:涉及美国出口管制(EAR 3A090 等)的产品采购,建议咨询专业出口管制律师。