算力市场 模型市场 快速部署 常见问题 费用计算 登录
Knowledge Base

常见问题 / FAQ

关于模型 API、GPU 算力、计费的常见问题。如果找不到答案,可以随时联系客服。

🔍
🔍
没有找到相关问题,试试其他关键词
💰 计费相关 0
GPU 算力如何计费?

按实际使用小时数计费,无需预付费用。从您开始使用算力時計时,到归还算力时结束,精确到分钟。

例如:使用 H100 4卡,计费 $12.50/小时 × 4 = $50/小时。如果用了 2 小时 30 分钟,费用为 $50 × 2.5 = $125

月付套餐相当于一次性买断 730 小时,享受约 35% 折扣。

小时价、月付价、年付价具体怎么算?

所有价格透明,不含隐性费用:

套餐适用场景折扣
按小时短时任务、测试、弹性需求无折扣
月付(730小时)持续训练项目约 65%
年付(8760小时)长期商用、规模化部署约 50%

所有价格以美元计价,支持微信、支付宝、信用卡付款。

充值后可以退款吗?

未使用的余额可以在 7 天内申请全额退款,需联系客服处理。已消耗的算力费用不退还。

月付/年付套餐在服务期开始后不支持退款,但可以申请停机保号(最多30天)。

如何获取发票?

所有付费均可开具正规发票(增值税普通发票或专用发票)。

发票将在付款后 3 个工作日内开具并发送到您的邮箱。如需专票,请提供企业资质证明。

Token API 如何计费?

Token API 按实际消耗的 Token 数量计费,分为输入 Token 和输出 Token:

模型输入价格输出价格
GPT-4o$2.5/1M$10/1M
Claude 3.5 Sonnet$3/1M$15/1M
Qwen3 72B¥0.9/1M¥0.9/1M
DeepSeek Coder¥1/1M¥1/1M

Token 数量可在后台实时查看,按月结算。

账户余额不足会怎样?

当账户余额低于 $5 时,系统会发送余额提醒通知。

余额耗尽后,服务会自动暂停,所有未完成的任务会被保留 24 小时,续费后可继续使用。

建议开启用量告警功能,当月消耗超过阈值时自动通知,避免服务中断。

如何申请企业月结?

企业用户可以申请月结服务,先使用后付款,次月统一结算。

申请条件:企业实名认证 + 月消费超过 $500。

联系 business@flowerwolf.net 申请开通。

📋 使用问题 0
如何获取 API Key?

注册并登录后,在用户中心的 API Keys 页面一键创建。您的密钥只会显示一次,请妥善保管。

创建后立即可用,支持设置权限和有效期。

Token 超市支持哪些模型?

目前已接入 20+ 主流模型,包括:

  • 海外模型:OpenAI GPT-4o/4o-mini、Claude 3.5 Sonnet/Haiku、Gemini 1.5/2.0
  • 国内模型:Qwen3 72B/32B、DeepSeek Coder、Yi Lightning
  • 开源模型:Llama 3.1、Mistral、Falcon 等

全部支持 OpenAI 兼容 API 接口。

部署 GPU 算力需要多久?

我们提供 分钟级部署

  • 基础镜像(PyTorch/TensorFlow):约 3-5 分钟
  • 自定义容器/模型加载:约 10-20 分钟
  • 大规模集群(8卡以上):约 20-30 分钟

99.95% 的情况下部署时间在 30 分钟以内。

如何调用 Token API?

注册后获得 API Key,调用示例(Python):

import openai
openai.api_key = "fw_xxxxxxxxxx"
openai.base_url = "https://api.flowerwolf.net/v1"

response = openai.ChatCompletion.create(
    model="gpt-4o",
    messages=[{"role": "user", "content": "用 Python 写一个快排"}]
)
print(response.choices[0].message.content)

兼容 OpenAI SDK,所有现有代码只需改 base_url 即可。

API 调用有并发限制吗?

有,不同模型限制不同:

  • Qwen / DeepSeek:基础套餐 100 RPM(每分钟请求数)
  • GPT-4o:500 RPM,4096 TPM(每分钟 Token 数)
  • Claude 3.5 Sonnet:根据套餐从 50-500 RPM 不等

如果需要更高并发,可以联系客服开通企业级配额。

GPU 显存在不够用时怎么办?

GPU 显存(VRAM)是大模型的关键瓶颈。常见解决方案:

  • 量化(Quantization):FP16 → INT8 → INT4,牺牲少量精度换取更大容量
  • 模型并行(Tensor Parallel):将模型切分到多卡
  • 梯度累积:用更小显存模拟大 batch size
  • 升级到更大显存 GPU:如从 A100 40GB 升级到 H100 80GB

如果您不确定需要多少显存,可以咨询客服帮您估算。

支持哪些框架和工具?

我们预装了主流深度学习框架:

  • PyTorch 2.x(CUDA 12.x)
  • TensorFlow 2.x
  • JAXDeepSpeedTransformers
  • vLLM(LLM 推理优化框架)
  • TensorRTTRITON

如需特殊镜像或自定义驱动/库,联系客服单独处理。

技术细节 0
H100 和 A100 有什么区别?

H100 是 NVIDIA 最新一代数据中心 GPU,基于 Hopper 架构;A100 是上一代 Ampere 架构。两者的主要差距:

对比项H100 SXMA100 80GB SXM
架构Hopper (HBM3)Ampere (HBM2e)
显存带宽3.35 TB/s2 TB/s
FP16 算力~1979 TFLOPS~312 TFLOPS
NVLink 带宽900 GB/s600 GB/s
适用场景大模型训练/推理训练+推理

简单说:H100 比 A100 快 5-6 倍,价格大约是 2 倍。对于大模型推理,H100 的性价比反而更高。

SXM 和 PCIe 有什么区别?

这是两种不同的 GPU 物理封装形式:

  • SXM:NVIDIA DGX/A100 Server 专用插槽,通过 NVLink 直接互联,带宽更高,多卡通信延迟更低。适合多卡训练/推理。
  • PCIe:标准消费/服务器 PCIe 卡,通过 PCIe 总线连接,带宽约为 SXM 的 60-70%。适合单卡场景或成本敏感型任务。

选 SXM 还是 PCIe,主要看是否需要多卡互联。如果是单卡推理,PCIe 性价比更高。

什么是 NVLink?和普通多卡有何区别?

NVLink 是 NVIDIA 的高速互联技术,允许 GPU 之间直接通信,绕过 PCIe 总线:

  • PCIe 4.0 x16:双向带宽约 64 GB/s
  • NVLink 4.0 (H100):每条链路 900 GB/s,8 卡集群聚合带宽更高

NVLink 版 H100(8卡集群)非常适合大模型训练,可以几乎线性扩展多卡效率。普通 PCIe 多卡则受限于 PCIe 带宽瓶颈。

Token 是什么?输入和输出有什么区别?

Token 是语言模型处理的最小单位。中文大约 1 token ≈ 0.5-1 个汉字,英文约 1 token ≈ 0.75 个单词

  • 输入 Token(Input):您发给模型的文字(如提示词、对话历史)
  • 输出 Token(Output):模型返回的文字(生成内容)

GPT-4o 的定价:输入 $2.5/1M tokens,输出 $10/1M tokens。输出价格通常是输入的 4 倍,因为生成计算更重。

国内模型和海外模型有什么区别?

国内外模型的主要区别:

维度国内模型(Qwen/DeepSeek)海外模型(GPT/Claude)
价格极低(¥0.5-2/1M)较高($2-15/1M)
中文能力原生中文优化也很好,但价格贵
海外数据/知识相对弱原生优势
合规性完全国产合规需境外访问
访问方式直连国内节点需代理/国际带宽

推荐策略:中文简单任务用国内模型(省钱),复杂推理/英文任务用海外模型(质量优先)。

有没有 OpenAI 兼容接口?

是的。FlowerWolf Token Market 完全兼容 OpenAI API 格式:

  • Endpoint: /v1/chat/completions
  • SDK: 现有 OpenAI Python/JS SDK 无需修改
  • 只需替换 base_urlapi_key

同时支持 Anthropic、阿里云 DashScope 等多厂商统一接入。

国内模型访问慢吗?

国内模型走直连节点,延迟通常在 50-200ms,比访问海外模型(200-500ms)更快。

海外模型经过优化路由,平均延迟约 200-400ms,可以满足大多数在线应用需求。

🔒 安全合规 0
数据安全和隐私如何保障?

您的数据安全是我们的核心优先级:

  • 所有计算节点之间采用加密通信(TLS 1.3)
  • 训练/推理数据在计算完成后自动清除,不做任何留存
  • 可选私有节点隔离(物理独享,不与其他用户共享)
  • 可签署数据处理协议(DPA)

我们无法也不会访问您的模型权重、数据或代码。

API Key 泄露了怎么办?

如果 API Key 泄露,可以在后台随时重置,旧 Key 立即失效。

建议:

  • 不要硬编码在代码里(用环境变量)
  • 不要提交到 GitHub(用 .gitignore)
  • 定期更换 Key
  • 启用 Key 权限限制(只允许特定 IP 访问)
服务是否合规?

FlowerWolf 致力于提供合规的 AI 算力和模型服务:

  • 所有算力服务符合当地法律法规
  • 国内模型完全合规,可企业内网部署
  • 海外模型调用通过正规渠道
  • 支持企业实名认证和数据处理协议(DPA)签署

如有合规相关问题,欢迎联系 compliance@flowerwolf.net

训练数据会被保留吗?

不会。您的训练数据、模型权重和代码:

  • 在计算完成后自动清除,不做任何留存
  • 不会被用于模型训练或任何其他目的
  • 计算节点的磁盘在任务结束后会完整擦除

可选私有节点隔离,物理独享,进一步保障数据安全。

如何设置 IP 白名单?

在用户后台可以设置 API Key 的访问限制:

  • 允许指定 IP 或 IP 段访问
  • 支持绑定域名(通过 HTTP Referrer 验证)
  • 可设置有效期限

建议生产环境务必开启 IP 白名单,防止 Key 被滥用。

👤 账户管理 0
如何注册账户?

访问 登录页面,支持:

  • 邮箱注册(推荐)
  • 手机号注册
  • 微信/支付宝一键登录

注册后完成实名认证即可开始使用服务。

如何重置密码?

在登录页面点击"忘记密码",输入注册邮箱或手机号,会收到重置链接。

如果没有收到邮件,请检查垃圾箱,或联系客服处理。

如何查看用量账单?

在用户后台可以看到:

  • 实时 API 调用量(按模型分组)
  • Token 消耗(输入/输出分开)
  • 费用明细和月度账单
  • 剩余余额和充值记录

也支持设置用量告警,当月消耗超过阈值时自动通知。

如何联系客服?

我们有多种客服渠道:

  • 邮件support@flowerwolf.net(2小时内必回)
  • 工单:用户后台提交工单
  • 微信:关注公众号 "FlowerWolf" 获取支持
  • 企业用户:专属客户经理 + 7x24 优先响应
账户被封禁怎么办?

如果您的账户因违反服务条款被封禁,可以:

  • 查看邮件通知了解封禁原因
  • 联系客服申诉,说明情况
  • 提交整改措施,等待审核

一般违规会在 3 个工作日内处理完成。

如何注销账户?

您可以随时注销账户:

  • 在用户后台 "账户设置" 中提交注销申请
  • 账户注销后,所有数据将在 30 天内永久删除
  • 如有未消耗余额,需先完成退款申请

注销前请确保没有未完成的订单或欠款。

还有其他问题?

联系客服,我们随时在线。也可以提交工单,2小时内必回。

开始使用算力 浏览模型市场
💬

需要帮助?

我们的团队随时准备回答您的问题,帮助您选择合适的方案。

✉ 发送邮件