AWS Trainium 亚马逊自研 AI 训练芯片,通过 EC2 实例提供高性价比训练算力,与 Neuron SDK 配合可低成本训练和微调大模型。 060 AI显卡# AI训练芯片# AWS Trainium# Neuron SDK
Google Cloud TPU 谷歌自研张量处理单元,通过云端提供大规模 AI 训练与推理算力,与 TensorFlow、JAX 深度集成,支撑 Gemini 等模型训练。 060 AI显卡# AI训练推理# Google Cloud TPU# TPU云服务
Intel Data Center GPU Max 系列 代号 Ponte Vecchio 的数据中心 GPU,采用多芯片封装与 Xe HPC 架构,面向高性能计算与 AI 融合负载。 080 AI显卡# AI融合负载# Intel Data Center GPU Max# Ponte Vecchio
Intel Gaudi 3 AI Accelerator 英特尔面向数据中心的 AI 加速器,集成矩阵乘法引擎与高速以太网互联,主打大模型训练与推理的开放生态和成本优势。 060 AI显卡# AI加速器# 大模型训练# 推理
AMD Instinct MI325X MI300X 的升级型号,将 HBM3e 显存提升至 256GB 并提高带宽,进一步强化大模型推理与长上下文处理的性价比。 070 AI显卡# AMD Instinct MI325X# HBM3e显存# MI300X升级
AMD Instinct MI300X AMD 数据中心 AI 加速卡,配备 192GB HBM3 显存与 CDNA 3 架构,以高显存容量优势在大模型推理与训练场景快速崛起。 080 AI显卡# AI加速卡# AMD Instinct MI300X# HBM3显存
NVIDIA GeForce RTX 5090 Blackwell 架构消费级旗舰显卡,拥有 32GB GDDR7 显存与强大算力,是个人开发者本地运行大模型与微调的热门选择。 060 AI显卡# AI显卡# Blackwell# GDDR7
NVIDIA L40S GPU 面向生成式 AI 推理与图形渲染的通用数据中心 GPU,配备 48GB 显存与第四代 Tensor Core,兼顾推理、微调与虚拟化场景。 070 AI显卡# 48GB显存# 图形渲染# 数据中心GPU
NVIDIA GB200 NVL72 机架级 AI 计算单元,将 72 颗 Blackwell GPU 与 Grace CPU 通过高速互联整合为单一计算域,专为超大模型训练设计。 060 AI显卡# AI计算单元# Blackwell GPU# NVIDIA GB200 NVL72
NVIDIA Blackwell B200 Blackwell 架构新一代 AI 加速平台,采用双芯片封装与第二代 Transformer 引擎,面向万亿参数级模型训练与推理。 060 AI显卡AI服务器# AI加速平台# B200# NVIDIA Blackwell
NVIDIA H200 Tensor Core GPU H100 的显存升级版本,搭载 141GB HBM3e 显存与更高带宽,显著提升大模型推理吞吐与长上下文场景下的表现。 070 AI显卡# 141GB HBM3e# GPU# NVIDIA H200
NVIDIA A100 Tensor Core GPU Ampere 架构数据中心 GPU,支持多实例 GPU 与结构化稀疏加速,长期作为 AI 训练和科学计算的主力加速卡,生态成熟稳定。 060 AI显卡# AI训练# GPU# NVIDIA A100
NVIDIA H100 Tensor Core GPU 基于 Hopper 架构的数据中心 AI 加速卡,配备 Transformer 引擎与 HBM3 显存,是大模型训练与推理的行业标杆,被全球主流云厂商广泛部署。 060 AI显卡# AI加速卡# GPU# Hopper架构