cdgo.ai / 一体机
把推理放在你的本地,
讲同一套云端协议。
三档 SKU,全部以 vLLM 为底,对外暴露同一套 OpenAI 兼容 HTTP 接口。本地能答的留在本地;需要 GPT-4o 或 Claude 才能搞定的请求经 PII 脱敏后由云端网关接管,审计日志保留在机器内。
CDGO-MB-01
Mini Box
个人开发者 · 5–15 人小团队
¥39,800
不含税,含首年软件更新

机箱
- · 1U 短深机箱(380 mm)
- · 单 220 V,750 W 80+ 白金电源
可承载
- · DeepSeek-V3-Lite Q4_K_M @ ~55 tok/s
- · Qwen3-32B Q5 @ ~38 tok/s
- · bge-m3 + jina-rerank-v2 用于 RAG
- · 约 25 个并发对话用户
| GPU | 1 × NVIDIA RTX 4090 24 GB(或 RTX 5080 16 GB) |
| CPU | AMD Ryzen 9 7950X · 16 核 32 线程 |
| 内存 | 128 GB DDR5-5600 ECC |
| 存储 | 2 TB NVMe Gen4(系统)+ 4 TB NVMe(模型缓存) |
| 网络 | 2 × 10 GbE SFP+, 1 × 1 GbE OOB |
| 功耗 | 满载约 480 W · 空载约 55 W |
CDGO-GP-04
Gateway Pro
100–500 人组织 · 受监管业务
最多客户选择
¥168,000
不含税 · 含上门安装与首年 9×5 支持

机箱
- · 4U 机架(750 mm)
- · 双 1600 W 冗余电源 · 220 V
可承载
- · DeepSeek-V3 Q5 @ ~95 tok/s
- · Qwen3-235B-A22B (MoE) Q4 @ ~62 tok/s
- · Llama-3.3-70B FP8 @ ~70 tok/s
- · 约 200 个并发对话用户 · 或 30 个 RAG 重负载席位
| GPU | 2 × NVIDIA L40S 48 GB(可选 NVLink) |
| CPU | 2 × Intel Xeon Gold 6438Y+ · 64 核 128 线程 |
| 内存 | 512 GB DDR5-4800 ECC RDIMM |
| 存储 | 2 × 3.84 TB NVMe(RAID1 系统)+ 4 × 7.68 TB NVMe(RAID10 缓存) |
| 网络 | 2 × 25 GbE SFP28, 1 × IPMI |
| 功耗 | 持续约 1,650 W · 空载约 210 W |
CDGO-SR-XX
Sovereign Rack
银行 · 医疗 · 政企 · 信创
项目定制报价
起价 ¥1.2M(含安装、3 年 7×24)

机箱
- · 42U 整机柜 · 380 V 三相
- · 冷通道 + 机柜 PDU + KVM
可承载
- · DeepSeek-V3 BF16 全精度
- · Qwen3-235B + 70B reranker 双模型协同
- · 机柜内向量库(Milvus / 腾讯 VectorDB)
- · 1,000+ 并发用户 · 多租户隔离
| GPU | 8 × 昇腾 910B 64 GB · 或 8 × NVIDIA H20 96 GB |
| CPU | 鲲鹏 920 / 海光 C86 7490(信创路线) |
| 内存 | 1 TB – 2 TB DDR5 ECC |
| 存储 | 2U JBOF 内最高 240 TB NVMe |
| 网络 | 2 × 100 GbE QSFP28 + 25 GbE 管理网 |
| 功耗 | 单节点约 6 kW · 适配 8–18 kW 机柜 |
注意事项
— 这是推理一体机,不是训练集群。Gateway Pro 与 Sovereign Rack 支持 LoRA 微调,但全量预训练不在范围内。
— 表格里的 tok/s 数据基于 vLLM 0.7、batch 8、prompt 1k / generate 256 测得。你的实际数字会有偏差,POC 期间我们会用你自己的代表性 trace 在机器上跑一遍。
— Mini Box 上的 RTX 4090 / 5080 是消费级显卡。我们用自己的备件池提供 1 年 RMA,而不是 NVIDIA 原厂保修。Pro 与 Sovereign 走数据中心 SKU,享原厂质保。
— Mini Box 不含冗余电源。需要冗余请直接选 Gateway Pro。