关于模型 API、GPU 算力、计费的常见问题。如果找不到答案,可以随时联系客服。
关于 GPU 算力、模型 API、计费方式的一切疑问,这里都有答案。
按实际使用小时数计费,无需预付费用。从您开始使用算力時計时,到归还算力时结束,精确到分钟。
例如:使用 H100 4卡,计费 $12.50/小时 × 4 = $50/小时。如果用了 2 小时 30 分钟,费用为 $50 × 2.5 = $125。
月付套餐相当于一次性买断 730 小时,享受约 35% 折扣。
所有价格透明,不含隐性费用:
| 套餐 | 适用场景 | 折扣 |
|---|---|---|
| 按小时 | 短时任务、测试、弹性需求 | 无折扣 |
| 月付(730小时) | 持续训练项目 | 约 65% |
| 年付(8760小时) | 长期商用、规模化部署 | 约 50% |
所有价格以美元计价,支持微信、支付宝、信用卡付款。
未使用的余额可以在 7 天内申请全额退款,需联系客服处理。已消耗的算力费用不退还。
月付/年付套餐在服务期开始后不支持退款,但可以申请停机保号(最多30天)。
所有付费均可开具正规发票(增值税普通发票或专用发票)。
发票将在付款后 3 个工作日内开具并发送到您的邮箱。如需专票,请提供企业资质证明。
Token API 按实际消耗的 Token 数量计费,分为输入 Token 和输出 Token:
| 模型 | 输入价格 | 输出价格 |
|---|---|---|
| GPT-4o | $2.5/1M | $10/1M |
| Claude 3.5 Sonnet | $3/1M | $15/1M |
| Qwen3 72B | ¥0.9/1M | ¥0.9/1M |
| DeepSeek Coder | ¥1/1M | ¥1/1M |
Token 数量可在后台实时查看,按月结算。
当账户余额低于 $5 时,系统会发送余额提醒通知。
余额耗尽后,服务会自动暂停,所有未完成的任务会被保留 24 小时,续费后可继续使用。
建议开启用量告警功能,当月消耗超过阈值时自动通知,避免服务中断。
注册并登录后,在用户中心的 API Keys 页面一键创建。您的密钥只会显示一次,请妥善保管。
创建后立即可用,支持设置权限和有效期。
目前已接入 20+ 主流模型,包括:
全部支持 OpenAI 兼容 API 接口。
我们提供 分钟级部署:
99.95% 的情况下部署时间在 30 分钟以内。
注册后获得 API Key,调用示例(Python):
import openai
openai.api_key = "fw_xxxxxxxxxx"
openai.base_url = "https://api.flowerwolf.net/v1"
response = openai.ChatCompletion.create(
model="gpt-4o",
messages=[{"role": "user", "content": "用 Python 写一个快排"}]
)
print(response.choices[0].message.content)
兼容 OpenAI SDK,所有现有代码只需改 base_url 即可。
有,不同模型限制不同:
如果需要更高并发,可以联系客服开通企业级配额。
GPU 显存(VRAM)是大模型的关键瓶颈。常见解决方案:
如果您不确定需要多少显存,可以咨询客服帮您估算。
我们预装了主流深度学习框架:
如需特殊镜像或自定义驱动/库,联系客服单独处理。
H100 是 NVIDIA 最新一代数据中心 GPU,基于 Hopper 架构;A100 是上一代 Ampere 架构。两者的主要差距:
| 对比项 | H100 SXM | A100 80GB SXM |
|---|---|---|
| 架构 | Hopper (HBM3) | Ampere (HBM2e) |
| 显存带宽 | 3.35 TB/s | 2 TB/s |
| FP16 算力 | ~1979 TFLOPS | ~312 TFLOPS |
| NVLink 带宽 | 900 GB/s | 600 GB/s |
| 适用场景 | 大模型训练/推理 | 训练+推理 |
简单说:H100 比 A100 快 5-6 倍,价格大约是 2 倍。对于大模型推理,H100 的性价比反而更高。
这是两种不同的 GPU 物理封装形式:
选 SXM 还是 PCIe,主要看是否需要多卡互联。如果是单卡推理,PCIe 性价比更高。
NVLink 是 NVIDIA 的高速互联技术,允许 GPU 之间直接通信,绕过 PCIe 总线:
NVLink 版 H100(8卡集群)非常适合大模型训练,可以几乎线性扩展多卡效率。普通 PCIe 多卡则受限于 PCIe 带宽瓶颈。
Token 是语言模型处理的最小单位。中文大约 1 token ≈ 0.5-1 个汉字,英文约 1 token ≈ 0.75 个单词。
GPT-4o 的定价:输入 $2.5/1M tokens,输出 $10/1M tokens。输出价格通常是输入的 4 倍,因为生成计算更重。
国内外模型的主要区别:
| 维度 | 国内模型(Qwen/DeepSeek) | 海外模型(GPT/Claude) |
|---|---|---|
| 价格 | 极低(¥0.5-2/1M) | 较高($2-15/1M) |
| 中文能力 | 原生中文优化 | 也很好,但价格贵 |
| 海外数据/知识 | 相对弱 | 原生优势 |
| 合规性 | 完全国产合规 | 需境外访问 |
| 访问方式 | 直连国内节点 | 需代理/国际带宽 |
推荐策略:中文简单任务用国内模型(省钱),复杂推理/英文任务用海外模型(质量优先)。
是的。FlowerWolf Token Market 完全兼容 OpenAI API 格式:
/v1/chat/completionsbase_url 和 api_key同时支持 Anthropic、阿里云 DashScope 等多厂商统一接入。
国内模型走直连节点,延迟通常在 50-200ms,比访问海外模型(200-500ms)更快。
海外模型经过优化路由,平均延迟约 200-400ms,可以满足大多数在线应用需求。
您的数据安全是我们的核心优先级:
我们无法也不会访问您的模型权重、数据或代码。
如果 API Key 泄露,可以在后台随时重置,旧 Key 立即失效。
建议:
FlowerWolf 致力于提供合规的 AI 算力和模型服务:
如有合规相关问题,欢迎联系 compliance@flowerwolf.net。
不会。您的训练数据、模型权重和代码:
可选私有节点隔离,物理独享,进一步保障数据安全。
在用户后台可以设置 API Key 的访问限制:
建议生产环境务必开启 IP 白名单,防止 Key 被滥用。
在登录页面点击"忘记密码",输入注册邮箱或手机号,会收到重置链接。
如果没有收到邮件,请检查垃圾箱,或联系客服处理。
在用户后台可以看到:
也支持设置用量告警,当月消耗超过阈值时自动通知。
我们有多种客服渠道:
如果您的账户因违反服务条款被封禁,可以:
一般违规会在 3 个工作日内处理完成。
您可以随时注销账户:
注销前请确保没有未完成的订单或欠款。