NVIDIA H200 Tensor Core GPU H100 的显存升级版本,搭载 141GB HBM3e 显存与更高带宽,显著提升大模型推理吞吐与长上下文场景下的表现。 020 AI显卡# 141GB HBM3e# GPU# NVIDIA H200
AMD Instinct MI300X AMD 数据中心 AI 加速卡,配备 192GB HBM3 显存与 CDNA 3 架构,以高显存容量优势在大模型推理与训练场景快速崛起。 010 AI显卡# AI加速卡# AMD Instinct MI300X# HBM3显存
AWS Inferentia 亚马逊自研推理加速芯片,面向云端大模型推理优化单位成本,适合高并发、低延迟的生成式 AI 在线服务部署。 010 AI显卡# AWS Inferentia# 云端推理# 大模型推理
AMD Instinct MI325X MI300X 的升级型号,将 HBM3e 显存提升至 256GB 并提高带宽,进一步强化大模型推理与长上下文处理的性价比。 000 AI显卡# AMD Instinct MI325X# HBM3e显存# MI300X升级