跳到主要内容
feedback
feedback

曦云 C500

产品概述:曦云 C500

曦云 C500 是沐曦(MetaX)于 2022 年 发布的旗舰级通用计算 GPU。该产品基于沐曦自主研发的**“曦云”架构**设计,旨在为科学计算、人工智能训练及推理提供强大的国产算力解决方案。依托自研 MXMACA 软件栈,适配主流算法框架、运算库等工具,编程接口在 API 层面高度兼容 GPU 行业国际主流 CUDA 生态。


核心软件生态:MACA

MACA(MetaX Advanced Compute Architecture)是沐曦 GPU 的统一计算软件栈。


AI 开发库:版本管理与避坑指南

为了发挥 C500 的最佳性能,PyTorch、vLLM 等主流 AI 框架均需要使用沐曦官方适配版

严禁随意更新核心库

在使用过程中,请极度小心 pip installpip upgrade 操作。

  • 风险:执行标准的 pip install torch 会从 PyPI 拉取社区公版,这将覆盖掉环境内预装的沐曦适配版(带 +metax 后缀),直接导致无法调用 GPU,程序运行失败。

识别适配版本

沐曦适配的 Python 库版本号中通常包含 +metax+maca 标识。你可以通过以下命令检查当前环境状态:

pip list | grep -e torch -e maca -e metax -e +

正常输出示例:

apex 0.1+metax... # 混合精度加速库
flash_attn 2.6.3+metax... # 注意力优化库
torch 2.6.0+metax... # 核心框架
torchvision 0.15.1+metax...
triton 3.0.0+metax...
vllm 0.8.5+maca... # 大模型推理框架

最佳实践:

  1. 优先使用官方镜像:如果您需要特定的 AI 库,请优先查找是否提供了包含该库的沐曦官方镜像。
  2. 检查是否存在:在安装新库前,先检查该库是否已存在 +metax 版本。
  3. 获取正确源:如确需更新,请访问沐曦官方软件中心获取正确的 whl 安装包或安装源。

模型部署建议与排查

模型支持列表

根据沐曦(MetaX)官方提供的 MACA 软件栈适配数据,曦云 C500 算力集群已完成对下列主流模型的适配与验证。

部署提示
  • 软件栈版本:以下模型主要基于 MACA-vLLM 推理框架进行验证。请务必使用平台提供的 MACA 3.x 及以上版本的镜像。
  • 显存规划:曦云 C500 单卡显存为 64GB。对于 70B/72B 以上的大参数模型。
  • 功能支持:支持 LoRA 微调、FlashAttention 加速及 PagedAttention 推理优化。

常见问题排查

  1. 库版本:是否不小心执行了 pip install --upgrade 覆盖了官方驱动库?
  2. 新模型适配:对于刚刚发布的全新架构模型,可能需要等待官方 MACA 软件栈的更新适配。

监控工具:mx-smi 使用简明手册

mx-smi 是沐曦 GPU 的命令行管理工具,其功能和用法在很大程度上对标 NVIDIA 的 nvidia-smi,方便用户快速上手。

常用命令速查

功能命令说明
查看概览mx-smi最常用。显示所有 GPU 的显存、功耗、温度、利用率及进程列表。
实时监控mx-smi -l 1000每 1000 毫秒(1 秒)刷新一次状态。按 Ctrl+C 退出。
指定 GPUmx-smi -i 0仅查看 ID 为 0 的 GPU 信息。

组合查询参数

如果您只需要特定的监控指标,可以使用以下参数:

  • 利用率mx-smi --show-usage (显示 GPU 和 VPU 利用率)
  • 显存详情mx-smi --show-memory
  • 温度监控mx-smi --show-temperature
  • 进程查看mx-smi --show-process

如需了解性能等级设置、拓扑关系查询、固件管理等高级功能,请参阅《曦云系列通用计算 GPU mx-smi 使用手册》


平台与官方资源导航

国产芯片权威 AI 技能认证

国产芯片 AI 技能证书:联合国内顶尖算力厂商,打造实战型 AI 技能认证体系。从算力到底层框架,助你成为国产 AI 生态的先行者。

  • 官方权威认证:由模力方舟联合行业国产芯片大厂联合签发的权威证书,加盖模力方舟和芯片厂商的公章,支持线上核验,一举成为国产算力与信创生态的官方认可人才
  • 学习即实战:开箱即用的实验环境,直接调用国产 GPU 云端算力,全链路课程覆盖“适配 - 训练 - 推理 - 部署”,获得国产 GPU 实操能力。
  • 面试优先推荐:认证人才进入国产 GPU 与信创企业人才储备库,在求职、合作、项目申报中优先推荐,抢占国产 AI 与算力产业的人才红利。
  • 生态特权:加入开发者社群,享受专家一对一指导,优先获得国产 GPU 算力市场免费测试时长,在信创生态中享有优先曝光与合作机会。

模力方舟实战教程

基于 曦云 C500 算力环境,平台提供了深度适配的“开箱即用”部署指南:

  • 模型部署实战
    • 部署文本模型:涵盖使用 Transformers、vLLM 等框架部署 Qwen 等主流大语言模型。
    • 部署生图模型:基于 Diffusers 框架部署 Qwen-Image 等前沿视觉生成模型。
  • 进阶工作流
    • ComfyUI 实操指南: 学习节点式工作流搭建,以及如何使用 Moark 自定义节点调用云端算力。
    • n8n 自动化编排: 基于 n8n 编排的全链路 AIGC 工作流,实现了从“一个创意”到“一篇完整图文笔记”的端到端自动化。
    • RAG 知识库系列实操
      • Naive RAG 知识库实操: 快速打通“加载 - 检索 - 生成”的基础闭环,构建本地私有化 RAG 系统的入门首选。
      • Advanced RAG 知识库实操: 引入多路检索、精排与层级索引策略,深度解决知识割裂与召回偏差,打造高准确率的生产级助手。
      • Modular RAG 知识库实操: 融合 GraphRAG 与 智能意图路由,构建“向量 + 图谱”的双流混合检索体系。通过生产级持久化与摘要级逻辑抽取,突破传统检索界限,实现跨文档的复杂推理与全景知识聚合。
      • Agentic RAG 知识库实操: 引入自主决策循环与纠错机制,通过置信度门控与动态语义重写攻克垂直领域语义断层。深度适配单卡部署,构建具备深度反思能力与严谨证据链溯源的高标准智能助理。

沐曦官方技术资料

如需获取最新的 MACA 驱动、开发库白名单、SDK 下载及详细技术文档,请参考厂商官方文档:

  • 开发者与文档支持: 沐曦文档中心
    • 提供 MACA 驱动下载、安装指南、故障排查手册及全栈开发文档。