算力 · 沐曦 / AMD / NVIDIA

算力与私有化部署

三条硬件路线,一套交付方式。按合规要求、模型规模和预算选型, 也可以混合部署,模型跑在企业自己的机房。

病历、图纸、客户名单、财务底稿,这类数据出域要走一遍合规评审。

解释成本往往超过技术收益,私有化部署因此不是一个可选项, 而是很多行业能不能开始的前提。算力也就成了 OwnAgent 交付的一部分。

我们不绑定单一厂商。下面三条路线各有适用场景,选型的顺序是先看约束条件,再看性能参数。

选型要先回答的四个问题

  • 要跑多大的模型,需不需要训练
  • 并发量与上下文长度的量级
  • 有没有自主可控或信创要求
  • 机房的供电、制冷、承重与网络条件

硬件路线

三条路线,按约束条件选

沐曦 GPU

国产自主路线

对供应链自主可控有明确要求的场景——政务、能源、部分制造企业——通常从这条路线开始。 板卡和整机两种交付方式都支持。

型号
待确认
单卡显存
参数待补
互联方式
参数待补
交付形态
板卡 / 整机
适合
信创与自主可控要求

AMD Instinct

大显存路线

单卡显存大,同样的模型需要的卡更少,长上下文的推理场景部署密度更高。 软件栈走 ROCm,迁移前需要做一轮算子验证。

型号
待确认
单卡显存
参数待补
软件栈
ROCm
交付形态
整机 / 机柜
适合
大模型推理、长上下文

NVIDIA 一体机

开箱即用路线

软硬件预装,上电接网就能起服务,交付周期最短。 生态最成熟,绝大多数模型和推理框架都能直接跑。

型号
待确认
单机卡数
参数待补
整机功耗
参数待补
交付形态
一体机
适合
快速上线、生态优先

规格待补:上表中标为「待确认 / 参数待补」的字段, 需要按最终选定的型号和配置填写,本页不预先写一个看起来确定的数字。 需要具体配置与报价,请在下面留下需求

为什么私有化

三个现实原因

数据不出企业

医疗、金融、政务的数据出域,本身就要走一遍合规评审。本地部署不触发这道流程。

成本可预期

按调用量付费的模式,用量上来之后总成本不易预估。自有算力是一次性投入加固定运维,长期跑批和高频调用的场景更划算。

延迟可控

产线质检、窗口办事导引这类场景的延迟要求是硬指标。本地推理不受公网状况和第三方限流影响。

交付流程

从选型到跑起来,四步

  1. 先量清楚要跑什么

    模型规模、并发量、上下文长度、是否需要训练——这四项决定了配置,不是反过来。

  2. 确认机房条件

    供电、制冷、机柜承重、网络。这一项经常是真正的瓶颈,建议在选型前就勘察。

  3. 装机与模型部署

    一体机通常上电当天可用;板卡与机柜方案需要额外的环境适配与压测。

  4. 接上智能体并交接运维

    OwnAgent 平台接到本地推理服务,同时把日常运维口径交给企业自己的人。

需求登记

说说你要跑什么

我们按需求给配置建议,而不是先报一个型号。

提交后会生成一封发往 contact@wuchuangai.com 的邮件草稿, 我们会带着配置建议回你。