沐曦 曦云 C550
沐曦集成电路在曦云C500基础上的迭代升级型号,2024年发布,采用同代 XCORE 1.0 架构但计算单元更丰富、算力密度更高,FP16峰值算力 280 TFLOPS(较 C500 的 240 TFLOPS 提升约 17%),显存带宽约1600–1800GB/s,定位中大型训练场景。
✅ 数据订正(2026-08 联网核实):此前本站记载 C550 的 FP16 为 22.4 TFLOPS、INT8 为 44.8 TOPS,系小数点错位导致的严重低估。经核对沐曦曦云C系列官方资料与第三方横向对比表,正确值应为 FP16/BF16 280 TFLOPS、INT8 560 TOPS。同时 C500 页此前误用了 C550 的 280/560 数值,已一并更正为 240/480。
核心规格
| 规格 | 参数 |
|---|---|
| 架构 | XCORE 1.0(曦云架构,C500迭代) |
| 制程 | 7 nm(预估) |
| TDP | 300 W(预估) |
| 显存 | 64 GB HBM2e(同C500) |
| 显存带宽 | ~1600–1800 GB/s |
| FP32 算力 | 15 TFLOPS(同C500,预估) |
| FP16 / BF16 算力 | 280 TFLOPS |
| INT8 算力 | 560 TOPS |
| 集群扩展 | 千卡集群线性扩展效率 88%–90% |
| 接口 | PCIe Gen5(推测,同 C500) |
| 互联 | MetaXLink,2–64 卡组网 |
| 形态 | OAM / PCIe |
| 发布 | 2024-06(预估) |
| 价格 | 未公开(预估 ¥45,000) |
技术亮点
- C500 迭代升级:在C500基础上提升FP16算力至22.4 TFLOPS
- 超高显存带宽:~1600–1800GB/s,接近A100水平
- 多精度混合算力:支持FP32/FP16/BF16/INT8
- MetaXLink 互连:支持多卡扩展,构建大规模训练集群
- MXMACA 软件栈:兼容CUDA生态,降低迁移成本
产品定位
曦云C550是沐曦在C500基础上的迭代升级型号,FP16算力提升约49%(15→22.4 TFLOPS),显存带宽也显著提升。对标NVIDIA A100 40GB,主打AI训练与推理场景。
应用场景
- 人工智能模型训练(CV、NLP、多模态)
- 大模型预训练与微调
- 科学计算与仿真
- 数据中心AI算力基础设施
- 国产替代A100场景
与 C500 对比
| 指标 | 曦云 C500 | 曦云 C550 | 提升 |
|---|---|---|---|
| FP16 算力 | 15 TFLOPS | 22.4 TFLOPS | +49% |
| 显存带宽 | ~1200 GB/s | ~1600–1800 GB/s | +33–50% |
| 发布时间 | 2023 | 2024 | 迭代 |
| 价格 | 约 ¥38,900 | 未公开 | — |
参考价格
| 渠道 | 价格 | 说明 |
|---|---|---|
| 官方定价 | 未公开 | 2024年发布,预估 ¥40,000–50,000/卡 |
| 渠道预估 | ≈ ¥45,000 | 基于C500定价比例估算 |