EN / 中文 登录 开始使用
算力市场模型市场选择指南快速部署登录
🚀 3 分钟快速接入

GPU 算力 & AI 模型
快速部署指南

从注册到生产环境,最快 3 分钟完成。无论您使用 Python、curl 还是 OpenAI SDK,都能零学习成本接入。

三种方式 接入

选择您最熟悉的开发方式,3 分钟内完成配置

📝
OpenAI SDK
使用官方 OpenAI Python SDK,只需修改 base URL 和 API Key,立即切换到 FlowerWolf。
Python
💻
curl 命令行
无需安装任何 SDK,一行 curl 即可调用。适合快速测试、脚本集成、Shell 自动化。
Shell / CLI
🛠
REST API
标准 HTTPS REST API,支持所有主流编程语言(Go / Java / Node.js / PHP)。
多语言

代码 示例

复制粘贴即可运行,无需修改业务逻辑

Python / OpenAI SDK
from openai import OpenAI client = OpenAI( api_key="fw_xxxxxxxxxxxxxxxx", # 替换为你的 FlowerWolf API Key base_url="https://api.flowerwolf.net/v1" # 只需修改 base URL ) response = client.chat.completions.create( model="gpt-4o", # 也可用 claude-3.5-sonnet / deepseek-v3 / qwen-2.5-72b messages=[{"role": "user", "content": "用两句话回答,今天是周几?"}] ) print(response.choices[0].message.content)
curl / Shell
# 适合 GPT-4o / Claude / Gemini / DeepSeek 所有模型 curl https://api.flowerwolf.net/v1/chat/completions \\
-H "Authorization: Bearer fw_xxxxxxxxxxxxxxxx" \\
-H "Content-Type: application/json" \\
-d '{"model":"gpt-4o","messages":[{"role":"user","content":"今天是周几?"}]}'
JavaScript / Node.js
import OpenAI from 'openai'; const client = new OpenAI({ apiKey: "fw_xxxxxxxxxxxxxxxx", baseURL: "https://api.flowerwolf.net/v1", }); const chat = await client.chat.completions.create({ model: "gpt-4o", messages: [{role: "user", content: "用两句话回答,今天是周几?"}], }); console.log(chat.choices[0].message.content);

支持的 模型

一个 Key,调用全部模型,无需切换

GPT-4o
GPT-4o Mini
Claude 3.5 Sonnet
Claude 3 Haiku
Gemini 1.5 Pro
Gemini 1.5 Flash
DeepSeek V3
DeepSeek Chat
Qwen 2.5 72B
Qwen 2.5 7B
LLaMA 3.1 405B
Mistral Large 2
Stable Diffusion XL
Whisper Large V3

使用 场景

每种场景的推荐模型和 GPU 配置

💻
AI 应用开发
使用 OpenAI SDK 快速接入,在现有代码中替换 base URL 即可。无需修改任何业务逻辑,支持 LangChain、LlamaIndex 等主流框架。
📈
数据处理流水线
Gemini 1.5 Flash 成本极低,适合批量文档分析、内容审核、数据清洗。使用 GPU 算力并行处理,高吞吐低延迟。
🎨
AI 生图/视频
Stable Diffusion XL 图像生成,H100 / A100 80GB GPU 集群加速。FLUX.1 模型即将上线,支持精细控制。
💬
智能客服 / 对话
Claude 3.5 Sonnet 200K 上下文支持超长对话记忆,GPT-4o 多模态支持图像输入。DeepSeek 低价适合高并发场景。

常见问题 FAQ

API 兼容哪些模型?
FlowerWolf API 兼容 OpenAI Chat Completions 格式,支持 GPT-4o、Claude 3.5、Gemini 1.5、DeepSeek V3、Qwen、LLaMA、Mistral 等全部 14+ 主流模型。只需替换 base URL,model 参数填入目标模型名称即可。
调用频率有限制吗?
不同账户等级有不同的 RPM(每分钟请求数)和 TPM(每分钟 Token 数)限制。初创版基础限制 60 RPM / 100K TPM,企业版可申请更高限制。如需无限调用,请联系客服升级。
数据会被留存或用于训练吗?
绝对不会。FlowerWolf 承诺不留存、不窥探、不使用客户 API 调用数据进行任何模型训练。计算完成后数据立即清除。我们可签署数据处理协议(DPA),满足企业合规要求。
GPU 算力和 API 模型可以同时使用吗?
可以,这是 FlowerWolf 的核心优势。您可以在我们的 GPU 上部署自有模型(使用 vLLM / TensorRT-LLM),同时通过同一个账户调用 FlowerWolf 模型 API。账单统一管理,简化财务流程。
支持 WebSocket 流式输出吗?
支持。OpenAI SDK 的 stream=True 参数直接可用,FlowerWolf API 会以 Server-Sent Events(SSE)格式返回流式内容。curl 示例:加 -N 参数禁用缓冲即可实时看到输出。

准备开始?

注册账号后 1 分钟获取 API Key,立即开始调用