DGX Cloud Lepton (原 Lepton AI) 免费额度 · API 注册教程(2026 年 4 月)
Lepton AI 由贾扬清(PyTorch 联合创始人)创办,后迁移到 NVIDIA DGX Cloud / Build 路线。对开发者来说,关键不是旧 lepton.ai 是否可用,而是当前 NVIDIA 控制台是否提供可测试的模型、免费额度、RPM、端点和价格。生产接入前应把它与 NVIDIA Build、Groq、Fireworks、Together 等高速推理路线一起比较。
DGX Cloud Lepton (原 Lepton AI) 是一款对话、编程、category.api工具,Lepton AI 由贾扬清(PyTorch 联合创始人)创办,后迁移到 NVIDIA DGX Cloud / Build 路线。对开发者来说,关键不是旧 lepton.ai 是否可用,而是当前 NVIDIA 控制台是否提供可测试的模型、免费额度、R
同类替代:llama.cpp、vLLM、Cline
需要中国大陆直连、统一低价调用多个模型,可轻量查看 openllmapi.com。
免费额度、价格、中国大陆访问状态或注册要求变化时,优先邮件提醒。
免费额度详情
🎁 免费额度
每日限制: 10M tokens/day
| 模型 | 上下文 | 限制 | 说明 |
|---|---|---|---|
| Llama 3.3 70B | 128k | 10 RPM | 免费使用,华人团队打造 |
| Mixtral 8x7B | 32k | 10 RPM | 免费额度内可用 |
🔑 API 免费额度
免费额度: $10 free credits
速率限制: 10 RPM
历史记录为新用户 $10 免费额度;服务已迁移到 NVIDIA DGX Cloud / Build 路线,当前额度、模型目录和端点需以 NVIDIA 控制台为准。
中国大陆用户完整注册教程
打开 NVIDIA Build / DGX Cloud Lepton 相关入口
使用 NVIDIA 账号登录并确认当前是否仍有免费额度或开发者配额
在控制台记录可用模型、端点、RPM、TPM、价格和区域
创建 API key 后用最小请求测试延迟、错误率和限速行为
代码示例
from openai import OpenAI
client = OpenAI(
api_key="your-lepton-key",
base_url="https://llama3-3-70b.lepton.run/api/v1"
)
response = client.chat.completions.create(
model="llama3-3-70b",
messages=[{"role": "user", "content": "Hello!"}],
)
print(response.choices[0].message.content)
中国大陆访问怎么样?
- 直连:✅ 可以
- 速度:fast
- 旧 Lepton 访问记录较友好,但迁移到 NVIDIA 后中国大陆访问、控制台、API 域名、付款和区域延迟需重新测试;面向大陆用户时保留本地可用 provider 或合规网关 fallback。
常见问题
Lepton AI 是什么背景?
由贾扬清创办,他是 PyTorch 联合创始人、Caffe 作者、前 Meta AI 和阿里巴巴 VP。技术实力很强。
免费额度有多少?
新用户 $10 免费额度,比大多数平台慷慨。开源模型价格也很低。
现在还应该直接用旧 Lepton endpoint 吗?
不建议只依赖旧 endpoint。应优先查看 NVIDIA Build / DGX Cloud 控制台里的当前端点、模型、额度和价格。
免费 API 专题入口
🔄 相似厂商
🐑 相关羊毛
总结:谁应该用 DGX Cloud Lepton (原 Lepton AI)?
如果你需要API 免费额度、国际一流水平的 AI 服务,DGX Cloud Lepton (原 Lepton AI) 值得一试。 想省钱?先比较免费额度、官方价格、同类替代和 API 网关方案,再决定是否接入生产。