常见问题 (FAQ)
关于 WLON API 的常见问题与解答,帮助你快速排查问题。
WLON API 是否支持国内直连?需要 VPN 吗?
WLON API 完全支持国内直连,无需 VPN 或任何代理工具。我们的服务器针对国内网络做了专门的路由优化,确保低延迟、高速度。你只需将 base_url 设置为:
https://api2everything.xyz/v1
即可在国内网络环境下直接调用 OpenAI、Claude、Gemini 等海外模型。
WLON API 与 OpenAI 官方 API 有什么区别?
WLON API 是 AI 模型 API 的中转服务,与官方 API 的主要区别:
- 国内可用 — 官方 API 在国内无法直接访问,WLON API 可国内直连
- 多模型统一 — 一个 API Key 即可访问 OpenAI、Anthropic、Google、DeepSeek 等 300+ 模型
- 格式兼容 — 100% 兼容 OpenAI SDK 格式,迁移成本为零
- 支付便捷 — 支持微信/支付宝,无需海外信用卡
- 价格优惠 — 部分模型低至官方 3 折
本质上: 模型能力与官方完全一致,我们只是提供一个更便捷的访问通道。
WLON API 支持哪些模型?
我们目前支持 300+ 主流 AI 模型,包括但不限于:
- OpenAI — GPT-4o、GPT-4o-mini、GPT-4-turbo、o1、o3-mini 等
- Anthropic — Claude Opus 4、Claude Sonnet 4、Claude 3.5 Haiku 等
- Google — Gemini 2.5 Pro、Gemini 2.0 Flash 等
- DeepSeek — DeepSeek V3、DeepSeek R1
- 其他 — Grok、Qwen、Llama、Mistral 等
我的数据安全吗?WLON API 会存储对话内容吗?
我们非常重视数据安全:
- 不存储对话内容 — 你的请求和响应数据仅在传输过程中经过我们的服务器,不会被持久化存储
- 全程加密 — 所有通信均通过 HTTPS/TLS 加密
- 日志最小化 — 我们仅记录必要的调用元数据(模型、token 数、时间戳)用于计费,不记录内容
- Key 安全 — API Key 使用单向哈希存储,即使数据库泄露也无法还原
建议: 请妥善保管你的 API Key,不要在前端代码或公开仓库中暴露。如果怀疑 Key 泄露,请立即在 控制台 重新生成。
收到 401 Unauthorized 错误怎么办?
401 错误表示认证失败,请按以下步骤排查:
- 检查 API Key — 确认 Key 以
sk-开头,且没有多余的空格或换行 - 检查 Header 格式 — 确认使用
Authorization: Bearer sk-xxx格式 - 确认 Key 状态 — 登录 控制台 查看该 Key 是否已被禁用或删除
- 检查账户余额 — 余额为 0 时部分操作可能返回认证错误
# 正确的请求头格式
curl -H "Authorization: Bearer sk-your-api-key" \
https://api2everything.xyz/v1/chat/completions
收到 429 Too Many Requests 错误怎么办?
429 错误表示请求频率超过限制。解决方法:
- 降低请求频率 — 在请求之间添加适当的延时
- 实现指数退避 — 遇到 429 后等待 1s、2s、4s... 后重试
- 使用批量请求 — 合并多个小请求为一个批量请求
- 联系客服 — 如果业务需要更高的速率限制,可联系我们调整
import time
from openai import OpenAI
client = OpenAI(
api_key="sk-your-api-key",
base_url="https://api2everything.xyz/v1"
)
# 指数退避重试
for attempt in range(5):
try:
response = client.chat.completions.create(
model="gpt-4o-mini",
messages=[{"role": "user", "content": "你好"}]
)
print(response.choices[0].message.content)
break
except Exception as e:
if "429" in str(e):
wait = 2 ** attempt
print(f"速率限制,{wait}秒后重试...")
time.sleep(wait)
else:
raise
API 响应很慢怎么办?
响应速度受多种因素影响,以下是常见原因和优化建议:
- 模型选择 — 大模型(如 GPT-4o)比小模型(如 GPT-4o-mini)慢,按需选择
- 输出长度 — 设置合理的
max_tokens,避免生成过长的回复 - 使用流式输出 — 开启
stream: true可以显著改善用户感知的响应速度,参见 流式输出 - 网络因素 — 检查本地网络是否稳定,可尝试更换 DNS(如 223.5.5.5)
- 上游波动 — 偶尔上游模型提供商会出现延迟波动,通常会很快恢复
首字延迟 vs 总延迟: 流式输出模式下,首个 token 通常在 1-3 秒内返回,用户体验远好于等待完整响应。
如何使用流式输出(Streaming)?
在请求中添加 stream: true 参数即可开启流式输出。流式输出以 Server-Sent Events (SSE) 格式逐 token 返回结果:
from openai import OpenAI
client = OpenAI(
api_key="sk-your-api-key",
base_url="https://api2everything.xyz/v1"
)
stream = client.chat.completions.create(
model="gpt-4o",
messages=[{"role": "user", "content": "讲一个简短的故事"}],
stream=True
)
for chunk in stream:
if chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
详细说明请参考 流式输出 文档。
WLON API 可以接入哪些第三方平台?
由于 WLON API 100% 兼容 OpenAI 格式,几乎所有支持自定义 OpenAI API 地址的平台都可以接入,包括:
- AI 开发平台 — Dify、Coze、FastGPT、MaxKB
- 聊天客户端 — LobeChat、ChatBox、NextChat、Open WebUI
- IDE 插件 — Cursor、Continue、Cline、GitHub Copilot(需配置)
- 自动化工具 — n8n、Zapier、LangChain、LlamaIndex
只需在平台设置中填入:
- API Base URL:
https://api2everything.xyz/v1 - API Key:你在控制台创建的 Key
详细图文教程请查看 第三方平台接入。
如何联系客服或获取技术支持?
你可以通过以下方式联系我们:
- 邮件 — [email protected](工作日 24 小时内回复)
- 控制台工单 — 登录 控制台,在页面底部提交工单
提交问题时请附上: 你的请求参数(隐去 API Key)、完整的错误信息、请求时间,这将帮助我们更快定位问题。