🔴 测试管理模型(非官方·仅供技术验证)· 本系统为数字中国管理模型的技术测试版,尚未被国家采用,所有组织/机构信息仅作管理模型演示与算法验证,不代表任何官方立场,不构成任何权威信息发布。
算力超市 · GPU弹性租赁

算力超市

GPU算力租赁·AI模型训练·推理部署一站式服务。弹性扩容·按需付费·专业技术支持

热门算力产品

按需选择·弹性扩容·即开即用

基础推理型

适合轻量AI推理、模型测试、API服务部署

¥0.8/小时起
  • 16GB GPU显存
  • 8vCPU / 32GB内存
  • 100GB SSD存储
  • 共享带宽 100Mbps

专业训练型

适合模型微调、中等规模训练——性价比首选

¥3.5/小时起
  • 80GB GPU显存
  • 32vCPU / 128GB内存
  • 500GB NVMe存储
  • 独享带宽 1Gbps

旗舰集群型

适合大规模训练、分布式计算、多模态模型

¥28/小时起
  • 8×80GB GPU集群
  • 128vCPU / 512GB内存
  • 2TB NVMe存储
  • 独享带宽 10Gbps

GPU规格对比

一目了然选对算力

规格项基础推理型专业训练型旗舰集群型
GPU类型T4 / A10A100-80G8×A100-80G
单卡显存16GB80GB80GB×8
适用场景推理·测试·API微调·中等训练大模型训练·分布式
单次最大token4K32K128K
数据集上限10GB500GB5TB
交付时间分钟级5分钟30分钟
技术支持工单在线+工单专属技术顾问
合同周期按量按量/月付月付/年付

场景推荐

什么场景用什么配置——实测数据支撑

API

智能客服/问答API

轻量推理负载,7B-13B参数模型推理,建议基础推理型即可满足

基础型QPS 20+
FT

模型微调Fine-tuning

LoRA/QLoRA微调7B-70B模型,单卡A100即可覆盖大多数企业微调需求

专业型2-8小时
PT

大模型预训练

从零训练百亿参数模型,需要分布式多卡集群+高速互联+海量存储

旗舰型天/周级
IMG

文生图/视频生成

Stable Diffusion·Sora类模型推理,建议基础型+弹性扩容应对峰值

基础型弹性扩容
RAG

RAG知识库检索

Embedding+向量检索+大模型生成,建议专业型满足向量库+推理双重负载

专业型百万文档
BAT

批量离线推理

海量数据批量推理·评测·标注,按需短期租用旗舰集群跑完即释放

旗舰型短期租用

服务优势

不只是卖算力,而是完整的AI基础设施服务

弹性扩容

按需随时增减GPU资源,不浪费、不等待,分钟级交付

预装环境

主流深度学习框架预装就绪——PyTorch·TensorFlow·JAX,开箱即用

数据安全

训练数据独享存储,任务完成后数据彻底清除,满足企业合规要求

技术专家支持

AI工程化团队7×24小时技术支持,模型调优·分布式训练指导

模型市场联动

训练完成的模型可直接接入汇智工厂智能体,从训练到部署全链路

成本可控

按量计费·无预付费·随时暂停,对比自建集群节省40%以上IT成本

算力选择指南

三个维度确定算力方案

Q1: 是训练还是推理?

推理→基础型足够;微调→专业型;预训练→旗舰型

Q2: 模型参数量多大?

7B以下→基础型;7B-70B→专业型;70B+→旗舰型

Q3: 任务时间要求?

实时→基础型+独享;批处理→旗舰型短期租用最经济

不确定该选哪种?联系技术顾问,根据您的具体模型和场景免费做算力评估。

API 接入说明

算力即服务·标准化 API·三步接入

Token

获取 API Token

在算力控制台生成专属 API Token,用于鉴权和用量追踪。支持多Token·多项目隔离。

REST APIBearer鉴权
Submit

提交训练任务

通过 API 提交训练脚本+数据集,系统自动分配GPU资源、启动训练容器,完成后通知回调。

POST /api/compute/train
Infer

调用推理服务

部署模型为在线推理API,标准OpenAI兼容接口格式,零代码切换,毫秒级响应。

OpenAI兼容POST /v1/chat

接入示例(cURL)

# 提交训练任务
curl -X POST https://os.zgscrh.com/api/compute/train \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{"model":"llama-7b","dataset":"s3://my-bucket/data","gpu":"A100-80G","epochs":3}'

# 调用推理API(OpenAI兼容)
curl https://os.zgscrh.com/api/compute/infer/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{"model":"my-finetuned-model","messages":[{"role":"user","content":"你好"}]}'

用量监控

实时GPU利用率·费用明细·任务日志

监控指标基础型专业型旗舰型
GPU利用率看板✅ 实时✅ 实时+历史✅ 实时+历史+预测
费用明细✅ 按小时✅ 按任务✅ 按任务+部门分摊
任务日志✅ 最近7天✅ 最近30天✅ 永久保存
用量预警✅ 余额预警✅ 预算预警✅ 多级预警+自动暂停
导出报表CSVCSV+PDFCSV+PDF+API
专属控制台WebWeb+CLIWeb+CLI+API全量

申请算力服务

选择合适的算力方案,我们将安排技术顾问对接

诊断 存证 知产 数资 管理 国策 组织 培训 定价
+
需要什么工具?
正在匹配最适合你的工具...
诊断 存证 知产 数资 管理 国策 组织 培训 定价
+
需要什么工具?
正在匹配最适合你的工具...