← BEDROCK MODEL CATALOGAWS REGIONS →
AMAZON EC2 · ACCELERATED COMPUTING

GPU & 加速器实例速查

AWS 全部 GPU / AI 芯片 / FPGA / 视频加速实例家族:一行速记看懂是什么卡,展开看每个尺寸的显存、vCPU、网络、EFA、本地 NVMe、EBS 与可用区域。数据只来自 AWS 官方页面与 ec2:DescribeInstanceTypes,不含价格。

34实例家族
99实例尺寸
26加速器型号
2026-09-29官方数据抓取日
34 个家族
P6e-GB300P6e-GB200P6-B300P6-B200P5enP5eP5P4deP4dP3dnP3G7eG7G6eG6G6fGr6Gr6fG5gG5G4dnG4adG3Trn3Trn2uTrn2Trn1nTrn1Inf2Inf1DL2qDL1F2VT1

怎么读:每个家族顶部大字是速记;「未公开」= AWS 官方页面与 API 均未给出该值(我们不推算)。尺寸行来自 EC2 规格文档(加速计算 / 上一代)+ describe-instance-types;「可用区域」为本账号 17 个已启用 Region 中 describe-instance-type-offerings 的返回结果,「API 未返回」不代表全球无货(可能仅 Capacity Blocks 或需联系销售)。

未收录:F1、P2、G2、Elastic Inference(EI,附加型加速器,非实例家族)——以下家族在 2026-09-29 抓取的 EC2 规格文档(ac.html / pg.html)与 describe-instance-types(17 个已启用 Region)中均不存在,视为已下线/不再提供,未收录:

FAMILY GROUP

P 系列 · 训练 / 大规模推理 GPU

11
P6e-GB300UltraServer训练推理0 个尺寸

P6e-GB300 = NVIDIA GB300 NVL72 UltraServer(Blackwell Ultra)

Amazon EC2 P6e-GB300 UltraServers · NVIDIA
加速器
NVIDIA GB300 NVL72(Grace Blackwell Ultra 超级芯片:2×Blackwell Ultra GPU + 1×Grace CPU)
显存类型
未公开(官方仅称 GPU 显存为 P6e-GB200 的 1.5 倍,每 UltraServer 接近 20 TB)
显存带宽
未公开
互联
NVLink(NVL72 域);Grace↔GPU 用 NVLink-C2C
GPUDirect RDMA
未公开
EFA
EFAv4
UltraCluster / UltraServer
EC2 UltraClusters;仅以 UltraServer 形式提供
用途
万亿参数级模型、长上下文推理、推理/Agentic AI
发布时间
2025-12-02
EC2 规格文档与 describe-instance-types 暂未列出该家族的实例尺寸——单实例 vCPU / 内存 / 网络等规格未公开。
  • EC2 规格文档(ac.html)尚未列出 P6e-GB300 的实例尺寸,单实例 vCPU/内存/网络等规格未公开。
  • 官方:1.5× GPU 显存、1.5× FP4 算力(无稀疏)对比 P6e-GB200;需联系 AWS 销售获取。
P6e-GB200UltraServer训练推理1 个尺寸

P6e-GB200 = NVIDIA GB200 NVL72,UltraServer 最多 72×B200

Amazon EC2 P6e-GB200 UltraServers · NVIDIA
加速器
NVIDIA GB200 NVL72(Grace Blackwell 超级芯片:2×B200 + 1×Grace CPU)
显存类型
HBM3e(每超级芯片最高 372 GB)
显存带宽
未公开
互联
第五代 NVLink;UltraServer 内最高 130 TB/s NVLink;Grace↔GPU 用 NVLink-C2C
GPUDirect RDMA
未公开
EFA
EFAv4,每 GPU 400 Gbps,UltraServer 合计 28.8 Tbps
UltraCluster / UltraServer
EC2 UltraClusters;实例只能以 UltraServer 形式购买
用途
数万亿参数前沿模型训练与部署、MoE、推理模型
发布时间
2025-07-09
实例加速器加速器显存vCPU / CPU内存网络EFA本地存储EBS 带宽可用区域
p6e-gb200.36xlarge4 x NVIDIA B200 GPU740 GiB每卡 185 GiB144Nvidia Grace CPU960 GiB3200 Gigabit17 张网卡✓3 x 7500 GBNVMe SSD60 GbpsAPI 未返回
  • UltraServer:72 GPU 单 NVLink 域,360 PFLOPS FP8(无稀疏),13.4 TB HBM3e。
P6-B300当前代训练推理1 个尺寸

P6-B300 = 8×NVIDIA B300(Blackwell Ultra)· 2.1 TB HBM3e

Amazon EC2 P6-B300 · NVIDIA
加速器
NVIDIA B300(Blackwell Ultra)
显存类型
HBM3e
显存带宽
未公开
互联
未公开
GPUDirect RDMA
未公开
EFA
EFAv4 6.4 Tbps + 300 Gbps 专用 ENA
UltraCluster / UltraServer
EC2 UltraClusters
用途
大规模分布式训练与推理
发布时间
2025-11-18
实例加速器加速器显存vCPU / CPU内存网络EFA本地存储EBS 带宽可用区域
p6-b300.48xlarge8 x NVIDIA B300 GPU2148 GiB每卡 268 GiB192Intel Xeon Emerald Rapids · x86_644096 GiB6400 Gigabit17 张网卡✓最多 16 个接口8 x 3800 GBNVMe SSD100 Gbps4 个区域
  • 对比 P6-B200:2× 网络带宽(官方归因于 PCIe Gen6)、1.5× 显存、1.5× FP4 算力(无稀疏)。产品页未单独给出 P6-B300 的 NVLink 带宽。
P6-B200当前代训练推理1 个尺寸

P6-B200 = 8×NVIDIA B200 · 1,432 GB HBM3e

Amazon EC2 P6-B200 · NVIDIA
加速器
NVIDIA B200(Blackwell)
显存类型
HBM3e
显存带宽
官方称为 P5en 的 1.6 倍(未给绝对值)
互联
第五代 NVLink,每 GPU 1.8 TB/s,实例合计 14.4 TB/s 双向
GPUDirect RDMA
未公开
EFA
EFAv4 3.2 Tbps
UltraCluster / UltraServer
EC2 UltraClusters(数万 GPU)
用途
前沿模型训练(MoE / 推理模型)、实时推理
发布时间
2025-05-15
实例加速器加速器显存vCPU / CPU内存网络EFA本地存储EBS 带宽可用区域
p6-b200.48xlarge8 x NVIDIA B200 GPU1432 GiB每卡 179 GiB192Intel Xeon Emerald Rapids · x86_642048 GiB3200 Gigabit8 张网卡✓最多 8 个接口8 x 3800 GBNVMe SSD100 Gbps6 个区域
  • CPU:第五代 Intel Xeon(Emerald Rapids);本地 NVMe 30 TB。
P5en当前代训练推理HPC1 个尺寸

P5en = 8×NVIDIA H200 141GB + Sapphire Rapids + EFAv3

Amazon EC2 P5en · NVIDIA
加速器
NVIDIA H200 Tensor Core
显存类型
HBM3e
显存带宽
未公开
互联
NVSwitch 900 GB/s(实例内 3.6 TB/s 对分带宽);CPU↔GPU PCIe Gen5
GPUDirect RDMA
支持
EFA
第三代 EFA 3,200 Gbps(Nitro v5,延迟较 P5 最多降 35%)
UltraCluster / UltraServer
EC2 UltraClusters,最多 20,000 GPU
用途
生成式 AI 训练/推理、HPC
发布时间
2024-12-02
实例加速器加速器显存vCPU / CPU内存网络EFA本地存储EBS 带宽可用区域
p5en.48xlarge8 x NVIDIA H200 GPU1128 GiB每卡 141 GiB192Intel Xeon Sapphire Rapids · x86_642048 GiB3200 Gigabit16 张网卡✓最多 16 个接口8 x 3800 GBNVMe SSD100 Gbps8 个区域
P5e当前代训练推理HPC1 个尺寸

P5e = 8×NVIDIA H200 141GB

Amazon EC2 P5e · NVIDIA
加速器
NVIDIA H200 Tensor Core
显存类型
HBM3e
显存带宽
未公开
互联
NVSwitch 900 GB/s(实例内 3.6 TB/s 对分带宽)
GPUDirect RDMA
支持
EFA
第二代 EFA 3,200 Gbps
UltraCluster / UltraServer
EC2 UltraClusters,最多 20,000 GPU
用途
大模型训练与推理、HPC
发布时间
2024-09-09
实例加速器加速器显存vCPU / CPU内存网络EFA本地存储EBS 带宽可用区域
p5e.48xlarge8 x NVIDIA H200 GPU1128 GiB每卡 141 GiB192AMD EPYC 7R13 · x86_642048 GiB3200 Gigabit32 张网卡✓最多 32 个接口8 x 3800 GBNVMe SSD80 Gbps6 个区域
  • 首发经 EC2 Capacity Blocks 提供。
P5当前代训练推理HPC2 个尺寸

P5 = 8×NVIDIA H100 80GB(另有 p5.4xlarge 单卡)

Amazon EC2 P5 · NVIDIA
加速器
NVIDIA H100 Tensor Core
显存类型
HBM3
显存带宽
未公开
互联
NVSwitch 900 GB/s(实例内 3.6 TB/s 对分带宽);p5.4xlarge 无 GPU P2P
GPUDirect RDMA
支持(p5.4xlarge 不支持)
EFA
第二代 EFA 3,200 Gbps(p5.4xlarge 为 100 Gbps)
UltraCluster / UltraServer
EC2 UltraClusters,最多 20,000 GPU
用途
生成式 AI 训练/推理、HPC
发布时间
2023-07-26
实例加速器加速器显存vCPU / CPU内存网络EFA本地存储EBS 带宽可用区域
p5.4xlarge1 x NVIDIA H100 GPU80 GiB每卡 80 GiB16AMD EPYC 7R13 · x86_64256 GiB100 Gigabit1 张网卡✓最多 1 个接口1 x 3800 GBNVMe SSD10 Gbps9 个区域
p5.48xlarge8 x NVIDIA H100 GPU640 GiB每卡 80 GiB192AMD EPYC 7R13 · x86_642048 GiB3200 Gigabit32 张网卡✓最多 32 个接口8 x 3800 GBNVMe SSD80 Gbps12 个区域
P4de当前代训练HPC1 个尺寸

P4de = 8×NVIDIA A100 80GB HBM2e

Amazon EC2 P4de · NVIDIA
加速器
NVIDIA A100 Tensor Core
显存类型
HBM2e
显存带宽
未公开
互联
NVSwitch 600 GB/s 双向
GPUDirect RDMA
支持
EFA
400 Gbps(ENA + EFA)
UltraCluster / UltraServer
EC2 UltraClusters
用途
ML 训练、HPC
发布时间
2022-05-26
实例加速器加速器显存vCPU / CPU内存网络EFA本地存储EBS 带宽可用区域
p4de.24xlarge8 x NVIDIA A100 GPU640 GiB每卡 80 GiB96Intel Xeon Platinum 8275CL · x86_641152 GiB4x 100 Gigabit4 张网卡✓最多 4 个接口8 x 1000 GBNVMe SSD19 Gbps5 个区域
  • 2022-05-26 为预览发布日期。
P4d当前代训练HPC1 个尺寸

P4d = 8×NVIDIA A100 40GB HBM2

Amazon EC2 P4d · NVIDIA
加速器
NVIDIA A100 Tensor Core
显存类型
HBM2
显存带宽
未公开
互联
NVSwitch 600 GB/s 双向
GPUDirect RDMA
支持
EFA
400 Gbps(ENA + EFA)
UltraCluster / UltraServer
EC2 UltraClusters(数千 GPU)
用途
ML 训练、HPC
发布时间
2020-11-02
实例加速器加速器显存vCPU / CPU内存网络EFA本地存储EBS 带宽可用区域
p4d.24xlarge8 x NVIDIA A100 GPU320 GiB每卡 40 GiB96Intel Xeon Platinum 8275CL · x86_641152 GiB4x 100 Gigabit4 张网卡✓最多 4 个接口8 x 1000 GBNVMe SSD19 Gbps13 个区域
P3dn上一代训练HPC1 个尺寸

P3dn = 8×NVIDIA V100 32GB(上一代)

Amazon EC2 P3dn · NVIDIA
加速器
NVIDIA V100
显存类型
未公开
显存带宽
未公开
互联
未公开
GPUDirect RDMA
未公开
EFA
支持(规格文档 EFA ✓)
UltraCluster / UltraServer
未公开
用途
ML 训练、HPC(上一代)
发布时间
2018-12-07
实例加速器加速器显存vCPU / CPU内存网络EFA本地存储EBS 带宽可用区域
p3dn.24xlarge8 x NVIDIA V100 GPU256 GiB每卡 32 GiB96Intel Xeon Platinum 8175 · x86_64768 GiB100 Gigabit1 张网卡✓最多 1 个接口2 x 900 GBNVMe SSD19 Gbps4 个区域
  • 已归入 EC2「上一代实例」规格文档;aws.amazon.com/ec2/instance-types/p3/ 已重定向至 P4 页面,产品页无独立规格。
P3上一代训练HPC3 个尺寸

P3 = 1/4/8×NVIDIA V100(上一代)

Amazon EC2 P3 · NVIDIA
加速器
NVIDIA V100
显存类型
未公开
显存带宽
未公开
互联
未公开
GPUDirect RDMA
未公开
EFA
未公开
UltraCluster / UltraServer
未公开
用途
ML 训练、HPC(上一代)
发布时间
2017-10-25
实例加速器加速器显存vCPU / CPU内存网络EFA本地存储EBS 带宽可用区域
p3.2xlarge1 x NVIDIA V100 GPU16 GiB每卡 16 GiB8Intel Xeon E5-2686 v461 GiB2.5 / 10.01 张网卡✗无1.75 GbpsAPI 未返回
p3.8xlarge4 x NVIDIA V100 GPU64 GiB每卡 16 GiB32Intel Xeon E5-2686 v4244 GiB10 Gigabit1 张网卡✗无7 GbpsAPI 未返回
p3.16xlarge8 x NVIDIA V100 GPU128 GiB每卡 16 GiB64Intel Xeon E5-2686 v4488 GiB25 Gigabit1 张网卡✗无14 GbpsAPI 未返回
  • 已归入 EC2「上一代实例」规格文档;产品页 /p3/ 已重定向至 P4。本账号 17 个已启用区域的 describe-instance-type-offerings 未返回 P3。
FAMILY GROUP

G 系列 · 推理 / 图形 GPU

12
G7e当前代推理图形/渲染训练6 个尺寸

G7e = 1–8×NVIDIA RTX PRO 6000 Blackwell 96GB GDDR7

Amazon EC2 G7e · NVIDIA
加速器
NVIDIA RTX PRO 6000 Blackwell Server Edition
显存类型
GDDR7
显存带宽
每 GPU 1,597 GB/s
互联
GPUDirect P2P(经 PCIe);GPU 间带宽最高为 G6e 的 4 倍
GPUDirect RDMA
多 GPU 尺寸支持(EFAv4,UltraClusters 内)
EFA
最高 1,600 Gbps EFA
UltraCluster / UltraServer
EC2 UltraClusters(多 GPU 尺寸)
用途
LLM / 多模态 / 物理 AI 推理、空间计算、小规模多节点微调
发布时间
2026-01-20
实例加速器加速器显存vCPU / CPU内存网络EFA本地存储EBS 带宽可用区域
g7e.2xlarge1 x NVIDIA RTX PRO Server 6000 GPU96 GiB每卡 96 GiB8Intel Xeon Emerald Rapids · x86_6464 GiB50 Gigabit1 张网卡✗1 x 1900 GBNVMe SSD2 / 5 Gbps9 个区域
g7e.4xlarge1 x NVIDIA RTX PRO Server 6000 GPU96 GiB每卡 96 GiB16Intel Xeon Emerald Rapids · x86_64128 GiB50 Gigabit1 张网卡✗1 x 1900 GBNVMe SSD8 Gbps9 个区域
g7e.8xlarge1 x NVIDIA RTX PRO Server 6000 GPU96 GiB每卡 96 GiB32Intel Xeon Emerald Rapids · x86_64256 GiB100 Gigabit1 张网卡✓最多 1 个接口1 x 1900 GBNVMe SSD16 Gbps9 个区域
g7e.12xlarge2 x NVIDIA RTX PRO Server 6000 GPU192 GiB每卡 96 GiB48Intel Xeon Emerald Rapids · x86_64512 GiB400 Gigabit1 张网卡✓最多 1 个接口1 x 3800 GBNVMe SSD25 Gbps9 个区域
g7e.24xlarge4 x NVIDIA RTX PRO Server 6000 GPU384 GiB每卡 96 GiB96Intel Xeon Emerald Rapids · x86_641024 GiB800 Gigabit2 张网卡✓最多 2 个接口2 x 3800 GBNVMe SSD50 Gbps9 个区域
g7e.48xlarge8 x NVIDIA RTX PRO Server 6000 GPU768 GiB每卡 96 GiB192Intel Xeon Emerald Rapids · x86_642048 GiB1600 Gigabit4 张网卡✓最多 4 个接口4 x 3800 GBNVMe SSD100 Gbps9 个区域
  • 支持 GPUDirect Storage(FSx for Lustre)。
G7当前代推理图形/渲染6 个尺寸

G7 = 1–8×NVIDIA RTX PRO 4500 Blackwell 32GB

Amazon EC2 G7 · NVIDIA
加速器
NVIDIA RTX PRO 4500 Blackwell Server Edition
显存类型
未公开
显存带宽
未公开
互联
未公开
GPUDirect RDMA
未公开
EFA
最高 700 Gbps EFA(G6 的 7 倍)
UltraCluster / UltraServer
未公开
用途
AI 推理、图形、GPU 加速数据分析(向量库等)
发布时间
2026-06-18
实例加速器加速器显存vCPU / CPU内存网络EFA本地存储EBS 带宽可用区域
g7.2xlarge1 x NVIDIA RTX PRO 4500 GPU32 GiB每卡 32 GiB8Intel Xeon Granite Rapids · x86_6432 GiB40.0 / 60.01 张网卡✗1 x 440 GBNVMe SSD4 / 8 Gbps3 个区域
g7.4xlarge1 x NVIDIA RTX PRO 4500 GPU32 GiB每卡 32 GiB16Intel Xeon Granite Rapids · x86_6464 GiB80.0 / 100.01 张网卡✗1 x 875 GBNVMe SSD8 Gbps3 个区域
g7.8xlarge1 x NVIDIA RTX PRO 4500 GPU32 GiB每卡 32 GiB32Intel Xeon Granite Rapids · x86_64128 GiB100 Gigabit1 张网卡✓最多 1 个接口1 x 930 GBNVMe SSD16 Gbps3 个区域
g7.12xlarge2 x NVIDIA RTX PRO 4500 GPU64 GiB每卡 32 GiB48Intel Xeon Granite Rapids · x86_64192 GiB175 Gigabit1 张网卡✓最多 1 个接口1 x 1900 GBNVMe SSD20 Gbps3 个区域
g7.24xlarge4 x NVIDIA RTX PRO 4500 GPU128 GiB每卡 32 GiB96Intel Xeon Granite Rapids · x86_64384 GiB350 Gigabit1 张网卡✓最多 1 个接口1 x 3800 GBNVMe SSD40 Gbps3 个区域
g7.48xlarge8 x NVIDIA RTX PRO 4500 GPU256 GiB每卡 32 GiB192Intel Xeon Granite Rapids · x86_64768 GiB700 Gigabit2 张网卡✓最多 2 个接口2 x 3800 GBNVMe SSD80 Gbps3 个区域
  • CPU:定制 Intel Xeon 6(规格文档写 Granite Rapids);FP16 算力为 G6 的 1.5 倍。
G6e当前代推理图形/渲染8 个尺寸

G6e = 1–8×NVIDIA L40S 48GB

Amazon EC2 G6e · NVIDIA
加速器
NVIDIA L40S Tensor Core
显存类型
未公开
显存带宽
官方称为 G6 的 2.9 倍(未给绝对值)
互联
未公开
GPUDirect RDMA
未公开
EFA
规格文档:部分尺寸支持 EFA(见尺寸表)
UltraCluster / UltraServer
未公开
用途
生成式 AI 推理、空间计算
发布时间
2024-08-15
实例加速器加速器显存vCPU / CPU内存网络EFA本地存储EBS 带宽可用区域
g6e.xlarge1 x NVIDIA L40S GPU44 GiB每卡 44 GiB4AMD EPYC 7R13 · x86_6432 GiB2.5 / 20.01 张网卡✗1 x 250 GBNVMe SSD1 / 5 Gbps9 个区域
g6e.2xlarge1 x NVIDIA L40S GPU44 GiB每卡 44 GiB8AMD EPYC 7R13 · x86_6464 GiB5.0 / 20.01 张网卡✗1 x 450 GBNVMe SSD2 / 5 Gbps9 个区域
g6e.4xlarge1 x NVIDIA L40S GPU44 GiB每卡 44 GiB16AMD EPYC 7R13 · x86_64128 GiB20 Gigabit1 张网卡✗1 x 600 GBNVMe SSD8 Gbps9 个区域
g6e.8xlarge1 x NVIDIA L40S GPU44 GiB每卡 44 GiB32AMD EPYC 7R13 · x86_64256 GiB25 Gigabit1 张网卡✓最多 1 个接口2 x 450 GBNVMe SSD16 Gbps9 个区域
g6e.12xlarge4 x NVIDIA L40S GPU178 GiB每卡 44 GiB48AMD EPYC 7R13 · x86_64384 GiB100 Gigabit1 张网卡✓最多 1 个接口2 x 1900 GBNVMe SSD20 Gbps9 个区域
g6e.16xlarge1 x NVIDIA L40S GPU44 GiB每卡 44 GiB64AMD EPYC 7R13 · x86_64512 GiB35 Gigabit1 张网卡✓最多 1 个接口2 x 950 GBNVMe SSD20 Gbps9 个区域
g6e.24xlarge4 x NVIDIA L40S GPU178 GiB每卡 44 GiB96AMD EPYC 7R13 · x86_64768 GiB200 Gigabit2 张网卡✓最多 2 个接口2 x 1900 GBNVMe SSD30 Gbps9 个区域
g6e.48xlarge8 x NVIDIA L40S GPU357 GiB每卡 44 GiB192AMD EPYC 7R13 · x86_641536 GiB400 Gigabit4 张网卡✓最多 4 个接口4 x 1900 GBNVMe SSD60 Gbps9 个区域
G6当前代推理图形/渲染8 个尺寸

G6 = 1–8×NVIDIA L4 24GB

Amazon EC2 G6 · NVIDIA
加速器
NVIDIA L4 Tensor Core
显存类型
未公开
显存带宽
未公开
互联
未公开
GPUDirect RDMA
未公开
EFA
见尺寸表
UltraCluster / UltraServer
未公开
用途
ML 推理、图形密集型应用
发布时间
2024-04-04
实例加速器加速器显存vCPU / CPU内存网络EFA本地存储EBS 带宽可用区域
g6.xlarge1 x NVIDIA L4 GPU22 GiB每卡 22 GiB4AMD EPYC 7R13 · x86_6416 GiB2.5 / 10.01 张网卡✗1 x 250 GBNVMe SSD1 / 5 Gbps13 个区域
g6.2xlarge1 x NVIDIA L4 GPU22 GiB每卡 22 GiB8AMD EPYC 7R13 · x86_6432 GiB5.0 / 10.01 张网卡✗1 x 450 GBNVMe SSD2 / 5 Gbps13 个区域
g6.4xlarge1 x NVIDIA L4 GPU22 GiB每卡 22 GiB16AMD EPYC 7R13 · x86_6464 GiB10.0 / 25.01 张网卡✗1 x 600 GBNVMe SSD8 Gbps13 个区域
g6.8xlarge1 x NVIDIA L4 GPU22 GiB每卡 22 GiB32AMD EPYC 7R13 · x86_64128 GiB25 Gigabit1 张网卡✓最多 1 个接口2 x 450 GBNVMe SSD16 Gbps13 个区域
g6.12xlarge4 x NVIDIA L4 GPU89 GiB每卡 22 GiB48AMD EPYC 7R13 · x86_64192 GiB40 Gigabit1 张网卡✓最多 1 个接口4 x 940 GBNVMe SSD20 Gbps13 个区域
g6.16xlarge1 x NVIDIA L4 GPU22 GiB每卡 22 GiB64AMD EPYC 7R13 · x86_64256 GiB25 Gigabit1 张网卡✓最多 1 个接口2 x 940 GBNVMe SSD20 Gbps13 个区域
g6.24xlarge4 x NVIDIA L4 GPU89 GiB每卡 22 GiB96AMD EPYC 7R13 · x86_64384 GiB50 Gigabit1 张网卡✓最多 1 个接口4 x 940 GBNVMe SSD30 Gbps13 个区域
g6.48xlarge8 x NVIDIA L4 GPU178 GiB每卡 22 GiB192AMD EPYC 7R13 · x86_64768 GiB100 Gigabit1 张网卡✓最多 1 个接口8 x 940 GBNVMe SSD60 Gbps13 个区域
G6f当前代图形/渲染推理4 个尺寸

G6f = 1/8–1/2 块 NVIDIA L4(分数 GPU)

Amazon EC2 G6f · NVIDIA
加速器
NVIDIA L4(分片 vGPU)
显存类型
未公开
显存带宽
未公开
互联
未公开
GPUDirect RDMA
未公开
EFA
不支持(规格文档)
UltraCluster / UltraServer
未公开
用途
远程工作站 / 轻量图形 / 小模型推理
发布时间
2025-07-29
实例加速器加速器显存vCPU / CPU内存网络EFA本地存储EBS 带宽可用区域
g6f.large0.125 x NVIDIA L4 GPU2.79 GiB2AMD EPYC 7R13 · x86_648 GiB1.5 / 10.01 张网卡✗1 x 100 GBNVMe SSD0.936 / 5 Gbps12 个区域
g6f.xlarge0.125 x NVIDIA L4 GPU2.79 GiB4AMD EPYC 7R13 · x86_6416 GiB2.5 / 10.01 张网卡✗1 x 100 GBNVMe SSD1 / 5 Gbps12 个区域
g6f.2xlarge0.25 x NVIDIA L4 GPU5.59 GiB8AMD EPYC 7R13 · x86_6432 GiB5.0 / 10.01 张网卡✗1 x 200 GBNVMe SSD2 / 5 Gbps12 个区域
g6f.4xlarge0.5 x NVIDIA L4 GPU11.18 GiB16AMD EPYC 7R13 · x86_6464 GiB10.0 / 25.01 张网卡✗1 x 450 GBNVMe SSD6 Gbps12 个区域
Gr6当前代图形/渲染推理2 个尺寸

Gr6 = 1×NVIDIA L4,1:8 vCPU:内存

Amazon EC2 Gr6 · NVIDIA
加速器
NVIDIA L4 Tensor Core
显存类型
未公开
显存带宽
未公开
互联
未公开
GPUDirect RDMA
未公开
EFA
未公开
UltraCluster / UltraServer
未公开
用途
需要大内存的图形 / 仿真 / 推理
发布时间
未公开
实例加速器加速器显存vCPU / CPU内存网络EFA本地存储EBS 带宽可用区域
gr6.4xlarge1 x NVIDIA L4 GPU22 GiB每卡 22 GiB16AMD EPYC 7R13 · x86_64128 GiB10.0 / 25.01 张网卡✗1 x 600 GBNVMe SSD8 Gbps13 个区域
gr6.8xlarge1 x NVIDIA L4 GPU22 GiB每卡 22 GiB32AMD EPYC 7R13 · x86_64256 GiB25 Gigabit1 张网卡✓最多 1 个接口2 x 450 GBNVMe SSD16 Gbps13 个区域
Gr6f当前代图形/渲染1 个尺寸

Gr6f = 1/2 块 NVIDIA L4,1:8 vCPU:内存

Amazon EC2 Gr6f · NVIDIA
加速器
NVIDIA L4(分片 vGPU)
显存类型
未公开
显存带宽
未公开
互联
未公开
GPUDirect RDMA
未公开
EFA
未公开
UltraCluster / UltraServer
未公开
用途
大内存轻量图形工作站
发布时间
未公开
实例加速器加速器显存vCPU / CPU内存网络EFA本地存储EBS 带宽可用区域
gr6f.4xlarge0.5 x NVIDIA L4 GPU11.18 GiB16AMD EPYC 7R13 · x86_64128 GiB10.0 / 25.01 张网卡✗1 x 450 GBNVMe SSD8 Gbps12 个区域
G5g当前代图形/渲染推理6 个尺寸

G5g = 1–2×NVIDIA T4G 16GB + Graviton2(Arm)

Amazon EC2 G5g · NVIDIA
加速器
NVIDIA T4G Tensor Core
显存类型
未公开
显存带宽
未公开
互联
未公开
GPUDirect RDMA
未公开
EFA
未公开
UltraCluster / UltraServer
未公开
用途
Android 游戏串流、低成本 ML 推理
发布时间
2021-11-29
实例加速器加速器显存vCPU / CPU内存网络EFA本地存储EBS 带宽可用区域
g5g.xlarge1 x NVIDIA T4g GPU16 GiB每卡 16 GiB4AWS Graviton2 Processor · arm648 GiB1.25 / 10.01 张网卡✗无1.188 / 4.75 Gbps6 个区域
g5g.2xlarge1 x NVIDIA T4g GPU16 GiB每卡 16 GiB8AWS Graviton2 Processor · arm6416 GiB2.5 / 10.01 张网卡✗无2.375 / 4.75 Gbps6 个区域
g5g.4xlarge1 x NVIDIA T4g GPU16 GiB每卡 16 GiB16AWS Graviton2 Processor · arm6432 GiB5.0 / 10.01 张网卡✗无4.75 Gbps6 个区域
g5g.8xlarge1 x NVIDIA T4g GPU16 GiB每卡 16 GiB32AWS Graviton2 Processor · arm6464 GiB12 Gigabit1 张网卡✗无9.5 Gbps6 个区域
g5g.16xlarge2 x NVIDIA T4g GPU32 GiB每卡 16 GiB64AWS Graviton2 Processor · arm64128 GiB25 Gigabit1 张网卡✗无19 Gbps6 个区域
g5g.metal2 x NVIDIA T4g GPU32 GiB每卡 16 GiB64AWS Graviton2 Processor · arm64128 GiB25 Gigabit1 张网卡✗无19 Gbps6 个区域
G5当前代推理图形/渲染8 个尺寸

G5 = 1–8×NVIDIA A10G 24GB

Amazon EC2 G5 · NVIDIA
加速器
NVIDIA A10G Tensor Core
显存类型
未公开
显存带宽
未公开
互联
未公开
GPUDirect RDMA
未公开
EFA
见尺寸表
UltraCluster / UltraServer
未公开
用途
图形工作站、ML 推理与轻量训练
发布时间
2021-11-12
实例加速器加速器显存vCPU / CPU内存网络EFA本地存储EBS 带宽可用区域
g5.xlarge1 x NVIDIA A10G GPU22 GiB每卡 22 GiB42nd Gen AMD EPYC 7R32 · x86_6416 GiB2.5 / 10.01 张网卡✗1 x 250 GBNVMe SSD0.7 / 3.5 Gbps14 个区域
g5.2xlarge1 x NVIDIA A10G GPU22 GiB每卡 22 GiB82nd Gen AMD EPYC 7R32 · x86_6432 GiB5.0 / 10.01 张网卡✗1 x 450 GBNVMe SSD0.85 / 3.5 Gbps14 个区域
g5.4xlarge1 x NVIDIA A10G GPU22 GiB每卡 22 GiB162nd Gen AMD EPYC 7R32 · x86_6464 GiB10.0 / 25.01 张网卡✗1 x 600 GBNVMe SSD4.75 Gbps14 个区域
g5.8xlarge1 x NVIDIA A10G GPU22 GiB每卡 22 GiB322nd Gen AMD EPYC 7R32 · x86_64128 GiB25 Gigabit1 张网卡✓最多 1 个接口1 x 900 GBNVMe SSD16 Gbps14 个区域
g5.12xlarge4 x NVIDIA A10G GPU89 GiB每卡 22 GiB482nd Gen AMD EPYC 7R32 · x86_64192 GiB40 Gigabit1 张网卡✓最多 1 个接口1 x 3800 GBNVMe SSD16 Gbps14 个区域
g5.16xlarge1 x NVIDIA A10G GPU22 GiB每卡 22 GiB642nd Gen AMD EPYC 7R32 · x86_64256 GiB25 Gigabit1 张网卡✓最多 1 个接口1 x 1900 GBNVMe SSD16 Gbps14 个区域
g5.24xlarge4 x NVIDIA A10G GPU89 GiB每卡 22 GiB962nd Gen AMD EPYC 7R32 · x86_64384 GiB50 Gigabit1 张网卡✓最多 1 个接口1 x 3800 GBNVMe SSD19 Gbps14 个区域
g5.48xlarge8 x NVIDIA A10G GPU178 GiB每卡 22 GiB1922nd Gen AMD EPYC 7R32 · x86_64768 GiB100 Gigabit1 张网卡✓最多 1 个接口2 x 3800 GBNVMe SSD19 Gbps14 个区域
  • 产品页写每 GPU 24 GB;规格文档写 22 GiB(单位/可用量口径不同)。
G4dn当前代推理图形/渲染7 个尺寸

G4dn = 1–8×NVIDIA T4 16GB

Amazon EC2 G4dn · NVIDIA
加速器
NVIDIA T4 Tensor Core
显存类型
未公开
显存带宽
未公开
互联
未公开
GPUDirect RDMA
未公开
EFA
支持 EFA(见尺寸表)
UltraCluster / UltraServer
未公开
用途
低成本 ML 推理、图形、视频转码
发布时间
2019-09-20
实例加速器加速器显存vCPU / CPU内存网络EFA本地存储EBS 带宽可用区域
g4dn.xlarge1 x NVIDIA T4 GPU16 GiB每卡 16 GiB4Intel Xeon P-8259L · x86_6416 GiB5.0 / 25.01 张网卡✗1 x 125 GBNVMe SSD0.95 / 3.5 Gbps17 个区域
g4dn.2xlarge1 x NVIDIA T4 GPU16 GiB每卡 16 GiB8Intel Xeon P-8259L · x86_6432 GiB10.0 / 25.01 张网卡✗1 x 225 GBNVMe SSD1.15 / 3.5 Gbps17 个区域
g4dn.4xlarge1 x NVIDIA T4 GPU16 GiB每卡 16 GiB16Intel Xeon P-8259L · x86_6464 GiB20.0 / 25.01 张网卡✗1 x 225 GBNVMe SSD4.75 Gbps17 个区域
g4dn.8xlarge1 x NVIDIA T4 GPU16 GiB每卡 16 GiB32Intel Xeon P-8259L · x86_64128 GiB50 Gigabit1 张网卡✓最多 1 个接口1 x 900 GBNVMe SSD9.5 Gbps17 个区域
g4dn.12xlarge4 x NVIDIA T4 GPU64 GiB每卡 16 GiB48Intel Xeon P-8259L · x86_64192 GiB50 Gigabit1 张网卡✓最多 1 个接口1 x 900 GBNVMe SSD9.5 Gbps17 个区域
g4dn.16xlarge1 x NVIDIA T4 GPU16 GiB每卡 16 GiB64Intel Xeon P-8259L · x86_64256 GiB50 Gigabit1 张网卡✓最多 1 个接口1 x 900 GBNVMe SSD9.5 Gbps17 个区域
g4dn.metal8 x NVIDIA T4 GPU128 GiB每卡 16 GiB96Intel Xeon P-8259L · x86_64384 GiB100 Gigabit1 张网卡✓最多 1 个接口2 x 900 GBNVMe SSD19 Gbps17 个区域
G4ad当前代图形/渲染5 个尺寸

G4ad = 1–4×AMD Radeon Pro V520 8GB

Amazon EC2 G4ad · AMD
加速器
AMD Radeon Pro V520
显存类型
未公开
显存带宽
未公开
互联
未公开
GPUDirect RDMA
未公开
EFA
未公开
UltraCluster / UltraServer
未公开
用途
图形渲染、游戏串流、远程工作站
发布时间
2020-12-01
实例加速器加速器显存vCPU / CPU内存网络EFA本地存储EBS 带宽可用区域
g4ad.xlarge1 x AMD Radeon Pro V520 GPU8 GiB每卡 8 GiB42nd Gen AMD EPYC 7R3216 GiB2.0 / 10.01 张网卡✗1 x 150 GBNVMe SSD0.4 / 3.17 GbpsAPI 未返回
g4ad.2xlarge1 x AMD Radeon Pro V520 GPU8 GiB每卡 8 GiB82nd Gen AMD EPYC 7R3232 GiB4.167 / 10.01 张网卡✗1 x 300 GBNVMe SSD0.8 / 3.17 GbpsAPI 未返回
g4ad.4xlarge1 x AMD Radeon Pro V520 GPU8 GiB每卡 8 GiB162nd Gen AMD EPYC 7R3264 GiB8.333 / 10.01 张网卡✗1 x 600 GBNVMe SSD1.58 / 3.17 GbpsAPI 未返回
g4ad.8xlarge2 x AMD Radeon Pro V520 GPU16 GiB每卡 8 GiB322nd Gen AMD EPYC 7R32128 GiB15 Gigabit1 张网卡✗1 x 1200 GBNVMe SSD3.17 GbpsAPI 未返回
g4ad.16xlarge4 x AMD Radeon Pro V520 GPU32 GiB每卡 8 GiB642nd Gen AMD EPYC 7R32256 GiB25 Gigabit1 张网卡✗2 x 1200 GBNVMe SSD6.3 GbpsAPI 未返回
G3上一代图形/渲染3 个尺寸

G3 = 1–4×NVIDIA Tesla M60(上一代)

Amazon EC2 G3 · NVIDIA
加速器
NVIDIA M60
显存类型
未公开
显存带宽
未公开
互联
未公开
GPUDirect RDMA
未公开
EFA
不支持(规格文档)
UltraCluster / UltraServer
未公开
用途
图形工作站(上一代)
发布时间
2017-07-13
实例加速器加速器显存vCPU / CPU内存网络EFA本地存储EBS 带宽可用区域
g3.4xlarge1 x NVIDIA M60 GPU8 GiB每卡 8 GiB16Intel Xeon E5-2686 v4122 GiB5.0 / 10.01 张网卡✗无3.5 GbpsAPI 未返回
g3.8xlarge2 x NVIDIA M60 GPU16 GiB每卡 8 GiB32Intel Xeon E5-2686 v4244 GiB10 Gigabit1 张网卡✗无7 GbpsAPI 未返回
g3.16xlarge4 x NVIDIA M60 GPU32 GiB每卡 8 GiB64Intel Xeon E5-2686 v4488 GiB25 Gigabit1 张网卡✗无14 GbpsAPI 未返回
FAMILY GROUP

Trainium · AWS 自研训练芯片

05
Trn3UltraServer训练推理0 个尺寸

Trn3 = UltraServer 最多 144×Trainium3(3nm)· 每芯片 144GB HBM3e

Amazon EC2 Trn3 UltraServers · AWS
加速器
AWS Trainium3(第四代 AI 芯片,3nm)
显存类型
HBM3e(每芯片 144 GB)
显存带宽
每芯片 4.9 TB/s;UltraServer 合计 706 TB/s
互联
NeuronSwitch-v1 全互联 + NeuronLink-v4,每芯片 2 TB/s
GPUDirect RDMA
未公开
EFA
未公开
UltraCluster / UltraServer
EC2 UltraClusters 3.0(数十万芯片);UltraServer 最多 144 芯片、362 FP8 PFLOPS、20.7 TB HBM3e
用途
前沿模型训练与推理(MoE / 推理 / 长上下文 / 视频生成)
发布时间
2025-12-02
EC2 规格文档与 describe-instance-types 暂未列出该家族的实例尺寸——单实例 vCPU / 内存 / 网络等规格未公开。
  • 每芯片 2.52 PFLOPS FP8;支持 FP32 / BF16 / MXFP8 / MXFP4。
  • EC2 规格文档(ac.html)尚未列出 Trn3 实例尺寸,单实例 vCPU/内存/网络规格未公开。
Trn2uUltraServer训练推理1 个尺寸

Trn2 UltraServer = 4×trn2u.48xlarge = 64×Trainium2

Amazon EC2 Trn2 UltraServer (trn2u) · AWS
加速器
AWS Trainium2
显存类型
HBM3(UltraServer 合计 6 TB)
显存带宽
UltraServer 合计 185 TB/s
互联
NeuronLink 连接 4 台实例共 64 颗芯片
GPUDirect RDMA
未公开
EFA
EFAv3,UltraServer 合计 12.8 Tbps
UltraCluster / UltraServer
EC2 UltraClusters
用途
超大模型训练、低延迟推理
发布时间
2024-12-03
实例加速器加速器显存vCPU / CPU内存网络EFA本地存储EBS 带宽可用区域
trn2u.48xlarge16 x AWS Trainium2(产品页)1.5 TB(产品页)192Intel Xeon Sapphire Rapids2048 GiB16x 200 Gigabit16 张网卡✓4 x 1900 GBNVMe SSD80 GbpsAPI 未返回
  • 2024-12-03 为 Trn2 GA 公告日期,当时 UltraServer 为预览;产品页仍写「available in preview」。
  • UltraServer 合计 83.2 PFLOPS FP8。
  • 规格文档的加速器列对 trn2u.48xlarge 写「✗ No」;芯片数 16 取自产品页。
Trn2当前代训练推理2 个尺寸

Trn2 = 16×Trainium2 · 1.5 TB HBM3 · 20.8 FP8 PFLOPS

Amazon EC2 Trn2 · AWS
加速器
AWS Trainium2
显存类型
HBM3
显存带宽
trn2.48xlarge 合计 46 TB/s
互联
NeuronLink(芯片间)
GPUDirect RDMA
未公开
EFA
EFAv3 3.2 Tbps
UltraCluster / UltraServer
EC2 UltraClusters(数万芯片)
用途
数千亿到万亿参数模型的训练与部署
发布时间
2024-12-03
实例加速器加速器显存vCPU / CPU内存网络EFA本地存储EBS 带宽可用区域
trn2.3xlarge1 x AWS Trainium2 accelerators512 GiB每卡 512 GiB12Intel Xeon Sapphire Rapids · x86_64128 GiB200 Gigabit1 张网卡✓最多 1 个接口1 x 470 GBNVMe SSD5 Gbps1 个区域
trn2.48xlarge16 x AWS Trainium2 accelerators8192 GiB每卡 512 GiB192Intel Xeon Sapphire Rapids · x86_642048 GiB16x 200 Gigabit16 张网卡✓最多 16 个接口4 x 1900 GBNVMe SSD80 Gbps1 个区域
  • 加速器显存口径冲突:产品页写每芯片 96 GB / 实例 1.5 TB HBM3;EC2 规格文档(ac.html)与 describe-instance-types(NeuronInfo.MemoryInfo=524288 MiB/芯片,合计 8388608 MiB)均写 512 GiB/芯片、trn2.48xlarge 合计 8192 GiB。表中尺寸行照录规格文档,家族速记用产品页口径,以 AWS 后续更正为准(2026-09-29 核对)。
Trn1n当前代训练1 个尺寸

Trn1n = 16×Trainium + 1,600 Gbps EFAv2

Amazon EC2 Trn1n · AWS
加速器
AWS Trainium(第一代)
显存类型
HBM(实例合计 512 GB)
显存带宽
实例合计 9.8 TB/s
互联
NeuronLink 768 GB/s
GPUDirect RDMA
支持 EFA 与 RDMA
EFA
EFAv2 1,600 Gbps
UltraCluster / UltraServer
EC2 UltraClusters,最多 30,000 芯片
用途
网络密集型大模型训练(MoE / GPT)
发布时间
2023-04-13
实例加速器加速器显存vCPU / CPU内存网络EFA本地存储EBS 带宽可用区域
trn1n.32xlarge16 x AWS Trainium accelerators512 GiB每卡 32 GiB128Intel Xeon Ice Lake · x86_64512 GiB16x 100 Gigabit16 张网卡✓最多 16 个接口4 x 1900 GBNVMe SSD80 Gbps3 个区域
Trn1当前代训练2 个尺寸

Trn1 = 1 / 16×Trainium 32GB

Amazon EC2 Trn1 · AWS
加速器
AWS Trainium(第一代)
显存类型
HBM(trn1.32xlarge 合计 512 GB)
显存带宽
trn1.32xlarge 合计 9.8 TB/s
互联
NeuronLink 768 GB/s
GPUDirect RDMA
trn1.32xlarge 支持 EFA 与 RDMA;trn1.2xlarge 不支持
EFA
EFAv2 800 Gbps(trn1.32xlarge)
UltraCluster / UltraServer
EC2 UltraClusters,最多 30,000 芯片
用途
深度学习 / 生成式 AI 训练
发布时间
2022-10-10
实例加速器加速器显存vCPU / CPU内存网络EFA本地存储EBS 带宽可用区域
trn1.2xlarge1 x AWS Trainium accelerators32 GiB每卡 32 GiB8Intel Xeon Ice Lake 8375C · x86_6432 GiB3.125 / 12.51 张网卡✗1 x 474 GBNVMe SSD5 / 20 Gbps3 个区域
trn1.32xlarge16 x AWS Trainium accelerators512 GiB每卡 32 GiB128Intel Xeon Ice Lake 8375C · x86_64512 GiB8x 100 Gigabit8 张网卡✓最多 8 个接口4 x 1900 GBNVMe SSD80 Gbps5 个区域
FAMILY GROUP

Inferentia · AWS 自研推理芯片

02
Inf2当前代推理4 个尺寸

Inf2 = 1–12×Inferentia2 32GB HBM

Amazon EC2 Inf2 · AWS
加速器
AWS Inferentia2
显存类型
HBM(每芯片 32 GB)
显存带宽
inf2.48xlarge 合计 9.8 TB/s
互联
NeuronLink 192 GB/s(24xl / 48xl)
GPUDirect RDMA
未公开
EFA
不支持(规格文档)
UltraCluster / UltraServer
未公开
用途
生成式 AI / LLM 推理
发布时间
2023-04-13
实例加速器加速器显存vCPU / CPU内存网络EFA本地存储EBS 带宽可用区域
inf2.xlarge1 x AWS Inferentia2 inference accelerator32 GiB每卡 32 GiB4AMD EPYC 7R13 · x86_6416 GiB2.083 / 15.01 张网卡✗无1.25 / 10 Gbps14 个区域
inf2.8xlarge1 x AWS Inferentia2 inference accelerator32 GiB每卡 32 GiB32AMD EPYC 7R13 · x86_64128 GiB16.667 / 25.01 张网卡✗无10 Gbps13 个区域
inf2.24xlarge6 x AWS Inferentia2 inference accelerator192 GiB每卡 32 GiB96AMD EPYC 7R13 · x86_64384 GiB50 Gigabit1 张网卡✗无30 Gbps13 个区域
inf2.48xlarge12 x AWS Inferentia2 inference accelerator384 GiB每卡 32 GiB192AMD EPYC 7R13 · x86_64768 GiB100 Gigabit1 张网卡✗无60 Gbps13 个区域
Inf1当前代推理4 个尺寸

Inf1 = 1–16×Inferentia(第一代)

Amazon EC2 Inf1 · AWS
加速器
AWS Inferentia
显存类型
未公开
显存带宽
未公开
互联
芯片间高速互联(6xl / 24xl,NeuronCore Pipeline)
GPUDirect RDMA
未公开
EFA
未公开
UltraCluster / UltraServer
未公开
用途
低成本 ML 推理(CV / NLP / 推荐)
发布时间
2019-12-03
实例加速器加速器显存vCPU / CPU内存网络EFA本地存储EBS 带宽可用区域
inf1.xlarge1 x AWS Inferentia inference accelerator8 GiB每卡 8 GiB4Intel Xeon P-8259L · x86_648 GiB5.0 / 25.01 张网卡✗无1.19 / 4.75 Gbps16 个区域
inf1.2xlarge1 x AWS Inferentia inference accelerator8 GiB每卡 8 GiB8Intel Xeon P-8259L · x86_6416 GiB5.0 / 25.01 张网卡✗无1.19 / 4.75 Gbps16 个区域
inf1.6xlarge4 x AWS Inferentia inference accelerator32 GiB每卡 8 GiB24Intel Xeon P-8259L · x86_6448 GiB25 Gigabit1 张网卡✗无4.75 Gbps16 个区域
inf1.24xlarge16 x AWS Inferentia inference accelerator128 GiB每卡 8 GiB96Intel Xeon P-8259L · x86_64192 GiB100 Gigabit1 张网卡✓最多 1 个接口无19 Gbps16 个区域
FAMILY GROUP

DL 系列 · 第三方 AI 加速器

02
DL2q当前代推理1 个尺寸

DL2q = 8×Qualcomm Cloud AI 100

Amazon EC2 DL2q · Qualcomm
加速器
Qualcomm AI 100
显存类型
未公开
显存带宽
未公开
互联
无加速器间互联(产品页)
GPUDirect RDMA
未公开
EFA
未公开
UltraCluster / UltraServer
未公开
用途
深度学习推理、汽车 ADAS 等 Qualcomm 生态开发
发布时间
2023-11-15
实例加速器加速器显存vCPU / CPU内存网络EFA本地存储EBS 带宽可用区域
dl2q.24xlarge8 x Qualcomm Qualcomm AI100 inference accelerator125 GiB每卡 15 GiB96Intel Xeon Cascade Lake · x86_64768 GiB100 Gigabit1 张网卡✓最多 1 个接口无19 Gbps2 个区域
  • 加速器显存:产品页 128 GB,规格文档 125 GiB(8×15 GiB)。
DL1当前代训练1 个尺寸

DL1 = 8×Habana Gaudi 32GB HBM

Amazon EC2 DL1 · Intel Habana
加速器
Habana Gaudi(HL-205)
显存类型
HBM(每加速器 32 GiB)
显存带宽
未公开
互联
加速器间 100 Gbps 双向
GPUDirect RDMA
未公开
EFA
产品页称可接入 EFA;规格文档 EFA 列为 ✗
UltraCluster / UltraServer
未公开
用途
深度学习训练
发布时间
2021-10-26
实例加速器加速器显存vCPU / CPU内存网络EFA本地存储EBS 带宽可用区域
dl1.24xlarge8 x Habana Gaudi HL-205 GPU256 GiB每卡 32 GiB96Intel Xeon Platinum 8275CL768 GiB4x 100 Gigabit4 张网卡✗4 x 1000 GBNVMe SSD19 GbpsAPI 未返回
FAMILY GROUP

F 系列 · FPGA

01
F2当前代FPGA 定制加速HPC3 个尺寸

F2 = 1–8×AMD Virtex UltraScale+ VU47P FPGA(16GB HBM)

Amazon EC2 F2 · AMD
加速器
AMD(Xilinx)Virtex UltraScale+ HBM VU47P FPGA
显存类型
每 FPGA 16 GiB HBM + 64 GiB DDR4
显存带宽
未公开
互联
未公开
GPUDirect RDMA
未公开
EFA
未公开
UltraCluster / UltraServer
未公开
用途
基因组学、多媒体处理、大数据、网络加速等 FPGA 定制加速
发布时间
2024-12-12
实例加速器加速器显存vCPU / CPU内存网络EFA本地存储EBS 带宽可用区域
f2.6xlarge1 x Xilinx Virtex UltraScale+ (VU47P) FPGA80 GiB每卡 80 GiB24AMD EPYC 7R13 · x86_64256 GiB12.5 Gigabit1 张网卡✗1 x 940 GBNVMe SSD7.5 Gbps8 个区域
f2.12xlarge2 x Xilinx Virtex UltraScale+ (VU47P) FPGA160 GiB每卡 80 GiB48AMD EPYC 7R13 · x86_64512 GiB25 Gigabit1 张网卡✗2 x 940 GBNVMe SSD15 Gbps8 个区域
f2.48xlarge8 x Xilinx Virtex UltraScale+ (VU47P) FPGA640 GiB每卡 80 GiB192AMD EPYC 7R13 · x86_642048 GiB100 Gigabit1 张网卡✓最多 1 个接口8 x 940 GBNVMe SSD60 Gbps8 个区域
  • F1 已由 F2 取代:aws.amazon.com/ec2/instance-types/f1/ 重定向至 F2,规格文档不再列出 F1。
FAMILY GROUP

VT 系列 · 视频转码加速器

01
VT1当前代视频转码3 个尺寸

VT1 = 1–8×Xilinx U30 媒体加速卡

Amazon EC2 VT1 · AMD
加速器
AMD Xilinx Alveo U30 媒体加速器
显存类型
未公开
显存带宽
未公开
互联
未公开
GPUDirect RDMA
未公开
EFA
未公开
UltraCluster / UltraServer
未公开
用途
实时视频转码(1080p60 8/16/64 路;4Kp60 2/4/16 路)
发布时间
2021-09-13
实例加速器加速器显存vCPU / CPU内存网络EFA本地存储EBS 带宽可用区域
vt1.3xlarge1 x Xilinx U30 media accelerator24 GiB每卡 24 GiB12Intel Cascade Lake P-8259CL · x86_6424 GiB3.12 Gigabit1 张网卡✗无2.375 / 4.75 Gbps4 个区域
vt1.6xlarge2 x Xilinx U30 media accelerator48 GiB每卡 24 GiB24Intel Cascade Lake P-8259CL · x86_6448 GiB6.25 Gigabit1 张网卡✗无4.75 Gbps4 个区域
vt1.24xlarge8 x Xilinx U30 media accelerator192 GiB每卡 24 GiB96Intel Cascade Lake P-8259CL · x86_64192 GiB25 Gigabit1 张网卡✓最多 1 个接口无19 Gbps4 个区域
没有匹配的实例家族。