全国 8 大可用区 · 已开放

把算力变成随手可用的水与电

ArithCloud 提供 H100 / A100 / L40S 裸金属与弹性实例,覆盖大模型训练、推理服务、科学计算全场景。 控制台秒级开通,按秒计费,随业务弹性伸缩——你只管把模型做好。

0
在线 GPU 卡数
0
服务可用性 SLA
0
平均成本降幅
arithcloud-cli — zsh
# 一行命令拉起一个 8 卡 H100 训练集群
$ arith create cluster --gpu h100 --count 8
⠋ 正在调度资源...
✓ 集群 cluster-train-01 已就绪(耗时 27s)
✓ 节点: 1 × 8×H100 SXM 80GB
✓ 网络: 3.2Tbps InfiniBand
 
$ arith ssh cluster-train-01
Welcome to ArithCloud. 数据集已挂载至 /mnt/data
$

已服务 3000+ 家 AI 团队与科研机构

深研智能 星轨科技 云图医疗 元启机器人 南方智算所 澄明量化
产品能力

从单卡微调到千卡集群,一套平台全搞定

无论是跑通第一个 demo,还是支撑千亿参数模型的持续训练,ArithCloud 的算力规格与网络架构都能平滑跟随你的业务增长。

GPU 裸金属 · 零虚拟化损耗

独享整机物理资源,无 Hypervisor 开销,NCCL 通信性能与本地机房完全一致。适合对吞吐与延迟极度敏感的大规模分布式训练。

GPU 型号
H100 SXM / A100 80G / L40S
单机规格
最高 8 卡 · 640GB 显存
互联带宽
3.2 Tbps InfiniBand
本地存储
NVMe SSD 7.68 TB
GPU 利用率96%
通信带宽占用88%
线性加速比94%
虚拟化损耗0%

弹性实例 · 秒级伸缩不浪费

按秒计费、按需升降配。推理流量高峰自动扩容,闲时自动缩容到零,把每一分算力预算都花在真正产生价值的地方。

开通速度
平均 12 秒
计费粒度
按秒计费 · 无最低消费
自动伸缩
基于 QPS / 显存 / 队列深度
实例类型
通用 / 计算优化 / 显存优化
扩容响应12s
资源利用率提升+63%
闲置成本-71%
冷启动命中率99.2%

托管推理 · 把模型变成 API

上传权重即可获得生产级推理端点,内置连续批处理、KV Cache 复用与量化加速。无需运维,自动扩缩容与灰度发布开箱即用。

支持框架
vLLM / TensorRT-LLM / SGLang
首 Token 延迟
低至 42 ms
吞吐提升
较原生实现 3.8×
发布策略
蓝绿 / 金丝雀 / A-B 实验
吞吐提升3.8×
GPU 显存节省45%
P99 延迟达标率99.8%
服务可用性99.99%
0
全国可用区
0
在线 GPU 卡数
0
服务企业客户
0
月度可用性
为什么选择 ArithCloud

不只卖算力,更交付可预期的结果

从选型、迁移到调优,我们提供贯穿全生命周期的工程支持,让算力投入真正转化为业务产出。

秒级交付

控制台或 API 一键开通,平均 12 秒可用,无需等待排期与采购流程。

  • 平均开通耗时 12 秒
  • 支持预留与抢占双模式

企业级安全

等保三级、ISO 27001 认证,VPC 网络隔离、数据静态加密与细粒度权限管控。

  • 等保三级 / ISO 27001
  • 数据不出境 · 私有 VPC

成本可控

按秒计费、无最低消费,配合资源画像与闲置检测,平均为客户节省 40% 算力支出。

  • 按秒计费 · 无最低消费
  • 成本看板与预算告警

高性能网络

3.2T InfiniBand 与 RDMA 加速,千卡集群线性加速比稳定保持在 90% 以上。

  • 3.2Tbps 无损互联
  • 并行文件存储 200GB/s

开箱即用生态

预置 PyTorch、DeepSpeed、Megatron 等主流镜像,兼容 K8s、Ray、Slurm 调度。

  • 50+ 预置框架镜像
  • 兼容 K8s / Ray / Slurm

专家护航

资深算法工程师提供选型建议、性能调优与故障定位,7×24 小时工单响应。

  • 7×24 工单 · 15 分钟响应
  • 专属架构师一对一支持
客户案例

他们的模型,跑在 ArithCloud 上

从初创团队到科研院所,不同规模的客户都在这里找到了算力与成本的最佳平衡点。

我们把 70B 模型的训练任务从自建机房迁移到 ArithCloud,集群交付从两周缩短到半天,千卡线性加速比还高了 6 个百分点。
14 天 → 4 小时集群交付周期
94%线性加速比
陈立衡
深研智能 · 基础设施负责人
医疗影像推理对延迟极敏感。接入托管推理服务后,P99 延迟稳定在 60ms 以内,整体推理成本反而降了三分之一。
60msP99 延迟
-33%推理成本
周敏之
云图医疗 · CTO
科研预算有限,弹性实例按秒计费帮我们把闲置成本压掉了七成。跑批实验的时间窗口也从夜里挪到了随时。
-71%闲置成本
3.8×实验吞吐
许承宇
南方智算所 · 研究员
常见问题

关于算力与计费,你可能想知道

开通一台 GPU 实例需要多久?
控制台或 API 提交后平均 12 秒内可用。裸金属集群因涉及网络拓扑编排,通常也在 3 分钟内完成交付;如遇资源紧张,可在控制台提交预留申请,我们会给出明确的可用时间承诺。
计费方式是怎样的?会收取闲置费用吗?
弹性实例按秒计费,关机即停止计费(存储费用另计,按 GiB/月)。裸金属按月或按年整机租赁,支持预留实例与抢占实例两种折扣模式。平台不收取任何开机费或最低消费,未使用的算力金可全额结转。
数据安全与合规如何保障?
平台已通过等保三级与 ISO 27001 认证,所有数据默认静态加密存储,实例间通过 VPC 网络隔离。我们提供私有子网、安全组、RAM 细粒度权限与操作审计日志。所有数据中心均位于境内,数据不出境。
能否支持千卡以上的大规模分布式训练?
可以。我们已在多个可用区部署 3.2Tbps InfiniBand 无损网络,单集群最大支持 4096 卡。同时预置 Megatron-LM、DeepSpeed、Colossal-AI 等并行框架镜像,并提供拓扑感知调度以最大化线性加速比。
是否提供免费试用?
新注册企业用户可获得 500 元算力金,用于体验任意弹性实例与托管推理服务,有效期 30 天。需要 POC 支持的大客户,可联系解决方案顾问申请更大额度的专项测试资源。
支持哪些付款方式和发票类型?
支持对公转账、支付宝、微信支付及企业月结。可开具增值税专用发票或普通发票,发票内容为「信息技术服务费」。年度框架协议客户可申请先使用后结算的信用额度。

准备好把你的算力成本降下来了吗?

注册即送 500 元算力金,30 天内可体验全部弹性实例与推理服务。需要更大规模 POC,我们的架构师会为你定制方案。

无需信用卡 · 12 秒开通 · 随时销毁不留费用