提供 GPU 算力的弹性计算服务
以超强并行算力为核心,面向深度学习训练推理、科学计算、图形图像处理等场景,提供多种 NVIDIA GPU 实例规格,开箱即用的深度学习镜像。
深度学习镜像 · 开箱即用
预置 PyTorch、TensorFlow、PaddlePaddle 等主流深度学习框架与 CUDA 环境镜像, 无需手动配置驱动与软件依赖,数分钟即可启动实例并开始模型训练与推理,大幅降低上云门槛。
典型适用场景
- 深度学习训练与推理
- 大模型分布式训练
- 科学计算 / HPC
- 图形图像处理与渲染
- 视频编解码 / 云游戏
NVIDIA GPU 并行计算
搭载 NVIDIA Tesla / A 系列 GPU,提供数千核心级并行算力,显著加速深度学习训练与推理任务。
CUDA / Tensor Core 加速
全面支持 NVIDIA CUDA、Tensor Core、RT Core 等硬件加速技术,满足 AI 训练、科学计算与图形渲染需求。
按需弹性,灵活扩缩容
支持按秒计费与包年包月等多种计费方式,实例规格可按需调整,GPU 数量灵活配置,匹配业务算力需求。
主流深度学习框架支持
预置 TensorFlow、PyTorch、MXNet、PaddlePaddle 等主流深度学习框架镜像,开箱即用快速开始模型训练。
全球多地域节点覆盖
覆盖中国大陆及海外多地域节点,就近部署低延迟访问,满足跨境 AI 业务与海外用户访问需求。
企业级 SLA 保障
基于成熟云服务器架构构建,提供快照备份、安全防护与监控告警能力,为 AI 训练任务提供稳定算力支撑。
六大典型使用场景
从深度学习训练推理到大模型分布式训练,从科学计算到图形图像处理与视频编解码,GPU 云服务器覆盖丰富的并行算力业务场景。
深度学习训练
面向大模型训练、图像识别、语音识别等深度学习场景,提供高带宽 NVLink 互联的多 GPU 并行算力。
AI 推理加速
为在线预测、实时推荐、智能客服等推理业务提供高吞吐低延迟的 GPU 推理加速能力。
科学计算
为计算流体力学、分子动力学、金融分析、气象模拟等科学计算场景提供超强浮点并行算力。
图形图像处理
支持专业图形渲染、影视特效制作、三维建模等图形处理任务,兼容 OpenGL / Vulkan 等图形 API。
视频编解码
面向视频转码、直播推流、超分辨率等视频处理场景,提供 NVENC / NVDEC 硬件编解码加速。
云游戏
提供云端游戏渲染与实时串流能力,为云游戏平台提供高性能 GPU 渲染与低延迟音视频传输方案。
多档次实例规格灵活选择
提供推理型到旗舰训练型多档实例规格,CPU、GPU、显存、网络带宽灵活配置,按需计费与包年包月可选,匹配业务算力需求。
推理型
¥8.80/小时起适合 AI 推理、图像识别、NLP 推理
标准训练型
¥25.60/小时起适合中等规模模型训练
高性能训练型
¥58.00/小时起适合多 GPU 大模型训练
旗舰训练型
¥198.00/小时起适合大模型分布式训练
主流深度学习框架 · 开箱即用
预置 PyTorch、TensorFlow、PaddlePaddle 等主流深度学习框架与 CUDA 环境,支持大模型工具链与推理部署,快速启动 AI 任务。
深度学习框架
大模型工具链
开发与容器
CUDA / 驱动
科学计算
推理部署
超强并行算力 · 弹性灵活 · 多地域部署
围绕深度学习与并行计算场景深度优化,提供 NVIDIA GPU 并行算力、预置深度学习镜像、弹性灵活计费,赋能 AI 业务快速上线。
超强并行算力
搭载 NVIDIA 最新一代 GPU,提供数千核心级并行计算能力,配合 NVLink 高速互联,显著加速深度学习训练与推理任务。
开箱即用镜像
预置主流深度学习框架与 CUDA 环境镜像,无需手动配置驱动与软件依赖,数分钟即可开始模型训练与推理。
弹性灵活计费
支持按需计费与包年包月等多种计费方式,实例规格可按需调整,GPU 数量灵活配置,匹配业务发展节奏。
多地域部署
覆盖中国大陆及海外多地域节点,就近部署实现低延迟访问,满足跨境 AI 业务与海外用户访问需求。
配套云产品组合
与对象存储、容器服务、日志监控、CDN 加速等产品协同使用,构建从训练数据存储到推理部署、从安全到运维的完整 AI 业务方案。
对象存储
为训练数据集与模型文件提供高可用、低成本的海量存储方案,支持高吞吐数据读写。
容器服务
基于 Kubernetes 的容器编排服务,支持 GPU 资源调度与隔离,快速部署分布式训练集群。
Web 应用防火墙
为 GPU 推理服务提供 SQL 注入、XSS 攻击等常见 Web 威胁防护,保障线上推理业务安全。
日志与监控
提供 GPU 利用率、显存、训练任务等全方位监控告警能力,实时掌握算力使用情况。
CDN 加速
将推理结果与模型资源分发至全球边缘节点,加速 AI 应用访问,提升用户体验。
弹性云服务器
业务规模增长后,可平滑迁移至高规格 GPU 实例或弹性云服务器集群,享受更灵活的计算能力。