Novita AI

Novita AI

开发者工具
Novita AI
免费增值API

关于

一站式模型 API + GPU 云,200+ 开源模型 OpenAI 兼容调用,另可按秒租 RTX 4090/5090、H100/H200,Spot 价省约 50%,新账号送入门额度

分享此工具

编辑评价

值得尝试

开源模型 API 与可租 GPU 的实惠一站式平台

Novita 占据了一个很实用的中间地带:它既是托管模型 API 供应商(200+ 开源 LLM、图像、音频、视频模型,藏在一个 OpenAI 兼容端点后),又是一个 GPU 云——从 RTX 4090 到 H200 都能按秒租,还常有最高打五折的 Spot 价。对个人开发者或小团队,这个组合是真方便:先对着 API 做原型,需要训练或跑自定义任务时再租裸 GPU,全在一个控制台、一张账单里。让它停在「值得一试」的诚实提醒:评测指出它没有永久免费算力档,所谓「免费开始」其实是充值前的入门额度,且 Spot 供给随需求波动。它也没有超大规模云那种硬 SLA,或单一用途推理云那种极致专注。但把这些取舍算进价格里,Novita 确实是个便宜又灵活的建站之处——当你的负载横跨模型 API 与偶尔的裸 GPU 时长、又不想在两个供应商间来回折腾时,它是个稳妥选择。

最适合

  • 想在一个地方同时用上模型 API 与可租 GPU 的个人开发者与小团队
  • 能利用 Spot GPU 价的成本敏感型负载
  • 把自定义模型部署为自动扩缩 Serverless 端点

以下情况建议考虑替代方案

  • 关键业务生产需要超大规模云级 SLA(→ AWS / GCP / Azure)
  • 你只需要热门模型的高速托管推理(→ Together AI / Cerebras)

平台支持

网页版API

可用平台包括网页版和API。

核心功能

200+ 开源模型的 Model API(LLM、图像、音频、视频),OpenAI 兼容端点
GPU 云覆盖 RTX 4090/5090、L40S、H100、H200,按秒计费
Serverless 端点、专属实例与裸金属,同一控制台管理
Spot 价可将 GPU 成本削减约 50%
自定义模型的自动扩缩 Serverless 部署
面向想要无长约拿到算力的开发者,全球 GPU 供给

定价方案

free
新账号获入门额度试用 Model API;没有永久免费算力档——正经跑 GPU 需充值。
paid
按量付费:Model API 按模型的 token/次计费,GPU 按秒计费——RTX 4090 级每小时几十美分起,直至 H100/H200 档,Spot 价最高省约 50%。另提供专属端点与裸金属。(对照官方定价页核实,2026-07-28。)

使用场景

通过一个 OpenAI 兼容 API 调用开源 LLM 与媒体模型
租用高性价比 GPU 做训练、微调或批量推理
把自定义模型部署为自动扩缩的 Serverless 端点
用 Spot GPU 价为可中断负载削减算力账单

优点

一个平台同时覆盖托管模型 API 与裸 GPU 租用
GPU 型号广且新,含 RTX 5090、H200,价格有竞争力
Spot 价加按秒计费,让可中断负载保持低成本
OpenAI 兼容 API,迁移摩擦小

缺点

没有永久免费算力档——正经跑 GPU 需先充值(评测常见吐槽点)
Spot GPU 的可用性与价格随地区和需求波动
关键业务 SLA 的企业级保障不如超大规模云
覆盖面广也意味着不如单一用途推理云那样专精

最新动态

2026 年:Novita 持续扩充其产品的两端——不断增长的 200+ 开源模型 API 目录,以及刷新的 GPU 机队(RTX 5090、H200)与 Spot 价——把自己定位为「模型 API 与可租算力一站式、价格实惠」的平台。

订阅 AI 资讯

获取最新 AI 工具推荐、行业动态和深度分析,每周精选直达邮箱。

我们尊重你的隐私,随时可以取消订阅。