深度介绍
RunPod详细介绍
🖥Pods:按需 GPU,覆盖 31 个区域
Pods 是 RunPod 的基础形态:按需开通的 GPU 实例,官方称部署在 31 个全球区域,用于直接跑训练、推理或任何需要显卡的任务。它提供社区云与安全云两类资源池,前者价格更低、后者面向对隔离与合规有要求的生产环境;切换的粒度是单个 Pod,因此可以先用便宜的池子做实验、再把关键服务迁到安全云。官方定价页的顶部起价卡片显示 H100 80GB 每小时 1.99 美元起、RTX 4090 每小时 0.34 美元起,实际单价随机型、云类型与计费周期变化。
⚡Serverless:把模型变成 API 端点
Serverless 是把模型封装成 API 端点的形态:官方描述为「用无服务器 GPU 端点运行基于 API 的 AI 负载」,适合请求量波动、不希望常备实例的场景。它的计费方式与 Pods 不同,按调用或输出量结算——官方定价页把模型按音频、图像、语言、视频分类分别标价,例如语音转写按每 1000 字符、图像生成按次或按百万像素、视频生成按秒或按次、语言模型按百万 token。官方还给出一个对比说法:仅弹性 worker 一项就能比同类 Serverless 方案省 25%。
🧮模型级价目:按次、按秒、按 token
Serverless 价目表里的几个例子可以直接用来估算成本:语音侧 Whisper V3 Large 每 1000 字符 0.05 美元,聊天合成模型 Chatterbox Turbo 为 0.00 美元;图像侧 Pruna Image T2I 每次请求 0.0050 美元、Seedream 4.0 系列 0.0270 美元、Nano Banana Edit 0.0380 美元、Nano Banana Pro Edit 0.14 美元,FLUX.1 Schnell 为每百万像素 0.0024 美元;视频侧 Seedance V1.5 Pro I2V 每秒 0.024 美元、Kling Video O1 R2V 每秒 0.112 美元、Wan 2.2 I2V 720p 每条 5 秒 0.30 美元;语言侧 IBM Granite 4.0 H Small 每百万 token 1.00 美元、Qwen3 32B AWQ 为 10.00 美元。
🗄存储档位与单价
官方把存储单独列价:容器盘 0.10 美元/GB/月;卷盘在运行状态下 0.10 美元/GB/月、空闲状态 0.20 美元/GB/月;网络存储标准档 1TB 以内 0.07 美元/GB/月、超过 1TB 为 0.05 美元/GB/月;高性能网络存储 0.14 美元/GB/月。定价页的概述写「灵活且持久的存储最低 0.05 美元/GB/月起,分标准与高性能两档」。对要长期保存模型权重、数据集或推理中间结果的项目,这部分成本容易在估算时被忽略,而卷盘的运行/空闲差价说明官方是按真实占用计费的。
🧵Clusters 与统一控制平面
面向多机多卡任务,官方提供 Clusters 这一档,用于分布式 AI 负载;配合「Deployments / Models」这层统一控制平面,官方的说法是可以把自己或平台的算力放在同一个平面上管理,也就是把自建机房与云端资源叠在一起调度。对需要临时把训练规模从单机扩到多机的团队,这一层的价值在于省去自己搭调度与编排;官方也在产品导航里把 Pods、Serverless、Clusters、Hub 并列为四条主线,避免用户在「先租实例还是先上端点」之间反复摇摆。
📚Hub:开箱即用的模型与模板
Hub 提供可直接部署的开源模型与模板,官方描述为「在 Runpod 上部署开源 AI 模型与模板」。配合 Serverless 的模型价目表,常见做法是直接在 Hub 里挑一个已经调好的模板起服务,而不是从零写推理代码与容器镜像。对不熟悉推理引擎参数的用户,这类模板省掉了显存规划、量化选择与并发配置的门槛;代价是模板的默认参数未必贴合具体业务,正式上线前仍应实测吞吐与成本。
🎯官方归纳的四类使用场景
官网把使用场景分成四类:推理(用低延迟 GPU 实时服务模型)、Agent(运行会反应与扩缩的 AI Agent)、微调(用可扩展算力训练模型)与计算密集任务(处理大规模负载而不产生瓶颈)。这份分类的实用之处在于它对应不同的产品组合:实时推理通常走 Serverless 端点或常驻 Pod;Agent 需要能快速创建与销毁的执行环境;微调与重计算任务更适合 Clusters 或高显存机型。选型时按这四类对号入座,比按机型比价更省事。
🆕新模型上架与生态跟进
官网公告条显示 Kimi K3 已可在 Runpod 上使用并链接到专题页,说明平台的模型覆盖会跟随开源社区的发布节奏更新;官方另有 Articles、Blog 与 Press 三个内容栏目,用来发布技术文章、产品更新与公司动态。对使用者来说,判断一个平台是否值得长期投入,除了价格,还要看它上新速度与文档质量:模型上架越快,越不需要自己折腾权重转换与环境适配,这一点在多模态与视频模型迭代较快的当下尤其明显。
产品特点
核心功能与独有价值
01三种形态覆盖不同负载
官方把产品分成 Pods(按需 GPU 实例)、Serverless(API 端点)与 Clusters(多节点任务),并明确「按你跑的 GPU 负载决定计费方式」。这种组合让同一账户可以在实验期租实例、上线后转端点、训练时开集群,而不必在三家供应商之间搬数据与凭证。
02社区云与安全云双池并行
定价页把资源分为 Community Cloud 与 Secure Cloud 两栏,并按小时与按秒两种口径展示。低价池适合实验与批处理,安全云面向生产与合规要求,切换粒度细到单个实例,成本与隔离等级可以逐个工作负载权衡。
03Serverless 按模型逐一标价
官方把 Serverless 侧的音频、图像、语言、视频模型逐项标价,单位分别是每 1000 字符、每次请求、每百万像素、每秒与每百万 token。这种细颗粒价目让「用哪个模型更划算」变成可以直接算的题,而不是靠试跑猜。
04存储单独计价且区分运行状态
容器盘、卷盘与网络存储分档列价,卷盘还区分运行(0.10 美元/GB/月)与空闲(0.20 美元/GB/月)状态,网络存储超过 1TB 后单价下降。这类细则说明官方按真实占用计费,也提醒使用者及时清理不用的卷。
最近动态
重要更新
Kimi K3 已可在 Runpod 上使用
官网公告条显示「Kimi K3 is now available on Runpod」并链接到专题页,说明平台已上架这款模型。结合 Serverless 的模型级价目与 Hub 模板,使用者可以直接用端点调用而不必自己准备权重与环境;具体可用形态(端点或模板)与价格以官方页面当期内容为准。
定价页以起价卡片呈现主流机型
截至 2026 年 9 月,官方定价页顶部的起价卡片显示 H100 80GB 每小时 1.99 美元起、RTX 4090 每小时 0.34 美元起,页面同时提供「按小时 / 按秒」两种口径以及 Community Cloud 与 Secure Cloud 两栏。实际单价随机型、资源池与区域浮动,采购前应以定价页当期数字为准。
Serverless 强调弹性 worker 的成本优势
官方在 Serverless 区块写明,仅在弹性 worker 一项上就能比同类 Serverless 云服务商节省 25%,并把「无需基础设施准备、即时调用预部署模型」当作卖点。对推理量波动明显的应用,这类按调用计费的形态通常比常备实例更省,但需要按模型级价目估算实际请求量与输出规模。
存储分档列价,网络存储超 1TB 降价
官方定价页把存储分为容器盘、卷盘与网络存储(标准 / 高性能):容器盘 0.10 美元/GB/月;卷盘运行 0.10、空闲 0.20 美元/GB/月;网络存储标准档 1TB 以内 0.07、超过 1TB 0.05 美元/GB/月;高性能档 0.14 美元/GB/月。长期挂机或存放大型数据集的团队应把这部分计入总成本。
产品总结
RunPod 自称「AI 开发者云」,把算力拆成四种形态:Pods 是按需 GPU 实例,官方称分布在 31 个全球区域;Serverless 把模型封装成 API 端点,按调用或输出量计费;Clusters 面向多节点分布式任务;Hub 提供可直接部署的开源模型与模板。官方另有一层统一控制平面,用同一界面管理自有算力与平台算力。资源池分为 Community Cloud 与 Secure Cloud,定价页支持按小时与按秒两种口径,官方写明的计费逻辑是「按你所跑的 GPU 负载类型决定」。 价格方面,官网上 H100 80GB 每小时 1.99 美元起、RTX 4090 每小时 0.34 美元起,实际单价随机型、资源池与区域变化。Serverless 则按模型逐一标价:语音侧 Whisper V3 Large 每 1000 字符 0.05 美元、Chatterbox Turbo 为 0.00 美元;图像侧 Pruna Image T2I 每次 0.0050 美元、Seedream 4.0 系列 0.0270 美元、Nano Banana Edit 0.0380 美元、Nano Banana Pro Edit 0.14 美元、FLUX.1 Schnell 每百万像素 0.0024 美元;视频侧 Seedance V1.5 Pro I2V 每秒 0.024 美元、Kling Video O1 R2V 每秒 0.112 美元、Wan 2.2 I2V 720p 每 5 秒 0.30 美元;语言侧 IBM Granite 4.0 H Small 每百万 token 1.00 美元、Qwen3 32B AWQ 为 10.00 美元。 存储同样分档计价:容器盘 0.10 美元/GB/月;卷盘运行 0.10、空闲 0.20 美元/GB/月;网络存储标准档 1TB 以内 0.07、超过 1TB 0.05 美元/GB/月;高性能网络存储 0.14 美元/GB/月。官方把使用场景归为推理、Agent、微调与计算密集任务四类,分别对应 Serverless、可快速创建的执行环境、Clusters 与高显存机型等不同组合;官网公告条显示 Kimi K3 已可在平台上使用。 使用前需要注意:起价只是「from」口径,实际账单取决于机型、资源池、区域与占用时长,且按秒计费意味着短任务更划算、长任务要按小时口径比价;社区云价格低但隔离与合规等级不如安全云,生产环境应分别评估;存储若不及时清理会持续计费,卷盘的空闲单价还高于运行单价;Serverless 的模型级价格随模型更新变化较快,选型时应以当期价目为准;部分模型属于第三方权重,商用前需单独核对许可。整体而言,它适合需要灵活组合实例、端点与集群,并希望把算力成本算到很小颗粒度的 AI 团队。
- 产品类型
- GPU 云与 Serverless 推理平台
- 支持平台
- Pods(按需 GPU) / Serverless 端点 / Clusters(多节点) / Hub 模型与模板 / Community Cloud / Secure Cloud / 网络存储 / 统一控制平面
- 资费模式
- 按秒或按小时计费:官网起价 H100 80GB 每小时 1.99 美元、RTX 4090 每小时 0.34 美元;Serverless 按次、按字符或按 token 计费。
核验信息
参考文章与数据来源
本页事实来自 RunPod 官方渠道:官网首页(「The AI Developer Cloud」定位、Pods / Serverless / Clusters / Hub 四条产品线、31 个区域、四类使用场景、Kimi K3 公告)、官方定价页(H100 80GB 每小时 1.99 美元与 RTX 4090 每小时 0.34 美元的起价、Community Cloud 与 Secure Cloud 两栏、按小时与按秒口径、Serverless 各模型的按字符/按次/按像素/按秒/按 token 价格、存储四类档位单价与弹性 worker 省 25% 的表述)、各产品页(按需 GPU、Serverless、Clusters、Hub)与官方博客入口。核验时间为 2026 年 9 月 22 日。起价为「from」口径,机型、资源池与模型价目变化较快,请以官网当期页面为准。
- 官网RunPod 官网
- 官网定价页(GPU / Serverless / 存储)
- 官网按需 GPU(Pods)
- 官网Serverless 推理
- 官网多节点集群 Clusters
- 官网模型 Hub
- 更新日志官方博客
用户体验调查
RunPod介绍页面对您是否有帮助?