曦云 C500
产品概述:曦云 C500
曦云 C500 是沐曦(MetaX)于 2022 年 发布的旗舰级通用计算 GPU。该产品基于沐曦自主研发的**“曦云”架构**设计,旨在为科学计算、人工智能训练及推理提供强大的国产算力解决方案。依托自研 MXMACA 软件栈,适配主流算法框架、运算库等工具,编程接口在 API 层面高度兼容 GPU 行业国际主流 CUDA 生态。
核心软件生态:MACA
MACA(MetaX Advanced Compute Architecture)是沐曦 GPU 的统一计算软件栈。
AI 开发库:版本管理与避坑指南
为了发挥 C500 的最佳性能,PyTorch、vLLM 等主流 AI 框架均需要使用沐曦官方适配版。
严禁随意更新核心库
在使用过程中,请极度小心 pip install 或 pip upgrade 操作。
- 风险:执行标准的
pip install torch会从 PyPI 拉取社区公版,这将覆盖掉环境内预装的沐曦适配版(带+metax后缀),直接导致无法调用 GPU,程序运行失败。
识别适配版本
沐曦适配的 Python 库版本号中通常包含 +metax 或 +maca 标识。你可以通过以下命令检查当前环境状态:
pip list | grep -e torch -e maca -e metax -e +
正常输出示例:
apex 0.1+metax... # 混合精度加速库
flash_attn 2.6.3+metax... # 注意力优化库
torch 2.6.0+metax... # 核心框架
torchvision 0.15.1+metax...
triton 3.0.0+metax...
vllm 0.8.5+maca... # 大模型推理框架
最佳实践:
- 优先使用官方镜像:如果您需要特定的 AI 库,请优先查找是否提供了包含该库的沐曦官方镜像。
- 检查是否存在:在安装新库前,先检查该库是否已存在
+metax版本。 - 获取正确源:如确需更新,请访问沐曦官方软件中心获取正确的 whl 安装包或安装源。
模型部署建议与排查
模型支持列表
根据沐曦(MetaX)官方提供的 MACA 软件栈适配数据,曦云 C500 算力集群已完成对下列主流模型的适配与验证。
部署提示
- 软件栈版本:以下模型主要基于 MACA-vLLM 推理框架进行验证。请务必使用平台提供的 MACA 3.x 及以上版本的镜像。
- 显存规划:曦云 C500 单卡显存为 64GB。对于 70B/72B 以上的大参数模型。
- 功能支持:支持 LoRA 微调、FlashAttention 加速及 PagedAttention 推理优化。
常见问题排查
- 库版本:是否不小心执行了
pip install --upgrade覆盖了官方驱动库? - 新模型适配:对于刚刚发布的全新架构模型,可能需要等待官方 MACA 软件栈的更新适配。
监控工具:mx-smi 使用简明手册
mx-smi 是沐曦 GPU 的命令行管理工具,其功能和用法在很大程度上对标 NVIDIA 的 nvidia-smi,方便用户快速上手。
常用命令速查
| 功能 | 命令 | 说明 |
|---|---|---|
| 查看概览 | mx-smi | 最常用。显示所有 GPU 的显存、功耗、温度、利用率及进程列表。 |
| 实时监控 | mx-smi -l 1000 | 每 1000 毫秒(1 秒)刷新一次状态。按 Ctrl+C 退出。 |
| 指定 GPU | mx-smi -i 0 | 仅查看 ID 为 0 的 GPU 信息。 |
组合查询参数
如果您只需要特定的监控指标,可以使用以下参数:
- 利用率:
mx-smi --show-usage(显示 GPU 和 VPU 利用率) - 显存详情:
mx-smi --show-memory - 温度监控:
mx-smi --show-temperature - 进程查看:
mx-smi --show-process
如需了解性能等级设置、拓扑关系查询、固件管理等高级功能,请参阅《曦云系列通用计算 GPU mx-smi 使用手册》。
平台与官方资源导航
国产芯片权威 AI 技能认证
国产芯片 AI 技能证书:联合国内顶尖算力厂商,打造实战型 AI 技能认证体系。从算力到底层框架,助你成为国产 AI 生态的先行者。
- 官方权威认证:由模力方舟联合行业国产芯片大厂联合签发的权威证书,加盖模力方舟和芯 片厂商的公章,支持线上核验,一举成为国产算力与信创生态的官方认可人才
- 学习即实战:开箱即用的实验环境,直接调用国产 GPU 云端算力,全链路课程覆盖“适配 - 训练 - 推理 - 部署”,获得国产 GPU 实操能力。
- 面试优先推荐:认证人才进入国产 GPU 与信创企业人才储备库,在求职、合作、项目申报中优先推荐,抢占国产 AI 与算力产业的人才红利。
- 生态特权:加入开发者社群,享受专家一对一指导,优先获得国产 GPU 算力市场免费测试时长,在信创生态中享有优先曝光与合作机会。
模力方舟实战教程
基于 曦云 C500 算力环境,平台提供了深度适配的“开箱即用”部署指南:
- 模型部署实战
- 进阶工作流
- ComfyUI 实操指南: 学习节点式工作流搭建,以及如何使用 Moark 自定义节点调用云端算力。
- n8n 自动化编排: 基于 n8n 编排的全链路 AIGC 工作流,实现了从“一个 创意”到“一篇完整图文笔记”的端到端自动化。
- RAG 知识库系列实操
- Naive RAG 知识库实操: 快速打通“加载 - 检索 - 生成”的基础闭环,构建本地私有化 RAG 系统的入门首选。
- Advanced RAG 知识库实操: 引入多路检索、精排与层级索引策略,深度解决知识割裂与召回偏差,打造高准确率的生产级助手。
- Modular RAG 知识库实操: 融合 GraphRAG 与 智能意图路由,构建“向量 + 图谱”的双流混合检索体系。通过生产级持久化与摘要级逻辑抽取,突破传统检索界限,实现跨文档的复杂推理与全景知识聚合。
- Agentic RAG 知识库实操: 引入自主决策循环与纠错机制,通过置信度门控与动态语义重写攻克垂直领域语义断层。深度适配单卡部署,构建具备深度反思能力与严谨证据链溯源的高标准智能助理。
沐曦官方技术资料
如需获取最新的 MACA 驱动、开发库白名单、SDK 下载及详细技术文档,请参考厂商官方文档:
- 开发者与文档支持: 沐曦文档中心
- 提供 MACA 驱动下载、安装指南、故障排查手册及全栈开发文档。