快速开始
Token 工厂 是 wylon 新云面向开发者提供的生成式 AI 模型服务。当前已开放对话、图片与视频模型,并提供 OpenAI / Anthropic 对话兼容接口、OpenAI Images 兼容接口与 wylon 内容任务接口。服务运行在 wylon 自建国产 GPU 算力底座上,适合从原型验证到生产部署的完整开发流程。
概览
对话、图片与视频生成共用同一账户和 API Key。你可以在 模型广场 中查看模型名称、能力和价格,并可复制完整 API ID 用于请求。
通过 Token 工厂,你可以:- 调用文本模型完成对话、推理、代码生成、工具调用与结构化输出,并按需使用普通响应或流式响应。
- 调用图片与视频模型完成图片生成、视频生成,并按模型能力使用图片编辑。
- 在 体验中心 查看近期图片、视频生成任务及结果。
- 将模型能力接入应用、Agent 或研发工具链,并支持 OpenClaw、Hermes、OpenCode、Claude Code 等主流 Agent 工具。
立即开始构建
按照下面三个步骤,即可向 Token 工厂发起第一次请求。
-
注册账户
- 前往 控制台 免费注册 wylon 新云账户。
- 完成实名认证后即可使用已开放模型。
info已经在使用 OpenAI 或 Anthropic?wylon 兼容对应 SDK,通常只需要替换 Base URL、API Key 和模型 ID。
具体的迁移步骤请参考 迁移到 wylon。 -
创建 API 密钥
- 在 控制台 进入 账户设置 → API 密钥。
- 点击 创建新密钥,复制生成的 API Key。
密钥管理、权限和轮换说明请参考 API 密钥 - 将密钥设置为 Shell 环境变量,方便下面的示例代码完成鉴权。
# 添加到 ~/.bashrc 或 ~/.profile export WYLON_API_KEY="wl-live-••••••••••••••••••••••••••••••••" export WYLON_BASE_URL="https://api.wylon.cn/v1"# 添加到 ~/.zshrc export WYLON_API_KEY="wl-live-••••••••••••••••••••••••••••••••" export WYLON_BASE_URL="https://api.wylon.cn/v1"# PowerShell - 对当前用户持久生效 [Environment]::SetEnvironmentVariable("WYLON_API_KEY", "wl-live-••••••••••••••••••••••••••••••••", "User") [Environment]::SetEnvironmentVariable("WYLON_BASE_URL", "https://api.wylon.cn/v1", "User")key妥善保管密钥。 切勿将 API 密钥提交到代码仓库,也不要打包到客户端产物中。生产环境建议使用密钥管理服务或服务端 -
发送第一个请求
- 将任意符合 OpenAI 规范的客户端指向
https://api.wylon.cn/v1; - 从 模型目录 中选择一个受支持的模型 ID 作为
model。 - 根据所选模型的使用说明,构建相应的对话消息或 prompt
messages,并发送请求以获取模型的响应。
下方展示如何使用 OpenAI 兼容接口,通过 ZhipuAI/GLM-5.3 发起一条简单的对话请求。
from openai import OpenAI import os client = OpenAI( api_key=os.environ["WYLON_API_KEY"], base_url="https://api.wylon.cn/v1", ) response = client.chat.completions.create( model="ZhipuAI/GLM-5.3", messages=[ {"role": "system", "content": "You are a helpful assistant."}, {"role": "user", "content": "Explain KV cache in one paragraph."}, ], temperature=0.6, max_tokens=512, ) print(response.choices[0].message.content)import OpenAI from "openai"; const client = new OpenAI({ apiKey: process.env.WYLON_API_KEY, baseURL: "https://api.wylon.cn/v1", }); const response = await client.chat.completions.create({ model: "ZhipuAI/GLM-5.3", messages: [ { role: "system", content: "You are a helpful assistant." }, { role: "user", content: "Explain KV cache in one paragraph." }, ], temperature: 0.6, max_tokens: 512, }); console.log(response.choices[0].message.content);curl https://api.wylon.cn/v1/chat/completions \ -H "Content-Type: application/json" \ -H "Authorization: Bearer $WYLON_API_KEY" \ -d '{ "model": "ZhipuAI/GLM-5.3", "messages": [ {"role": "system", "content": "You are a helpful assistant."}, {"role": "user", "content": "Explain KV cache in one paragraph."} ], "temperature": 0.6, "max_tokens": 512 }'package main import ( "context" "fmt" "os" "github.com/sashabaranov/go-openai" ) func main() { cfg := openai.DefaultConfig(os.Getenv("WYLON_API_KEY")) cfg.BaseURL = "https://api.wylon.cn/v1" client := openai.NewClientWithConfig(cfg) resp, err := client.CreateChatCompletion(context.Background(), openai.ChatCompletionRequest{ Model: "ZhipuAI/GLM-5.3", Messages: []openai.ChatCompletionMessage{ {Role: "user", Content: "Explain KV cache in one paragraph."}, }, }) if err != nil { fmt.Println(err); return } fmt.Println(resp.Choices[0].Message.Content) }请求成功后,响应会返回模型输出
content、Token 使用情况usage,以及 wylon 新云系统级缓存命中率cache_hit_ratio。{ "id": "cmpl-9f1c7b2e8a41", "object": "chat.completion", "model": "ZhipuAI/GLM-5.3", "created": 1744828800, "choices": [{ "index": 0, "message": { "role": "assistant", "content": "KV cache stores the key and value tensors …" }, "finish_reason": "stop" }], "usage": { "prompt_tokens": 24, "completion_tokens": 128, "total_tokens": 152, "cache_hit_ratio": 0.71 // wylon 扩展字段:上下文缓存命中率 } }infousage中的cache_hit_ratio是 wylon 在 OpenAI 兼容协议基础上增加的扩展字段, 用于表示本次请求命中系统级上下文缓存的比例。重复前缀越多,命中率通常越高,成本也更有优势。其余字段与 OpenAI 协议保持一致。 - 将任意符合 OpenAI 规范的客户端指向
API 接入点
不同能力沿用对应的主流请求格式,并使用统一的 wylon 鉴权方式。完整字段请查看 API 手册。
| 方法与路径 | 用途 | 说明 |
|---|---|---|
| POST /chat/completions | 文本生成 | OpenAI Chat Completions 兼容,支持流式输出及模型可用的工具调用、结构化输出。 |
| POST /messages | 文本生成 | Anthropic Messages 兼容。 |
| POST /images/generations | 同步文生图 | OpenAI Images 兼容,在同一次响应中获取图片结果。 |
| POST /contents/generations/tasks | 异步图片和视频生成 | 创建内容任务后,通过任务 ID 查询状态和结果。 |
| GET /models | 列出可用模型 | 返回当前账户可用的模型 ID 列表。 |
需要帮助?
如遇问题,欢迎通过 联系我们 获取支持。