wylon

快速开始

Token 工厂 是 wylon 新云面向开发者提供的生成式 AI 模型服务。当前已开放对话、图片与视频模型,并提供 OpenAI / Anthropic 对话兼容接口、OpenAI Images 兼容接口与 wylon 内容任务接口。服务运行在 wylon 自建国产 GPU 算力底座上,适合从原型验证到生产部署的完整开发流程。

概览

对话、图片与视频生成共用同一账户和 API Key。你可以在 模型广场 中查看模型名称、能力和价格,并可复制完整 API ID 用于请求。

通过 Token 工厂,你可以:

立即开始构建

按照下面三个步骤,即可向 Token 工厂发起第一次请求。

  1. 注册账户

    • 前往 控制台 免费注册 wylon 新云账户。
    • 完成实名认证后即可使用已开放模型。
    套餐、免费额度和扣费规则请参考 计费与用量

    info
    已经在使用 OpenAI 或 Anthropic?wylon 兼容对应 SDK,通常只需要替换 Base URL、API Key 和模型 ID。
    具体的迁移步骤请参考 迁移到 wylon
  2. 创建 API 密钥

    • 控制台 进入 账户设置 → API 密钥
    • 点击 创建新密钥,复制生成的 API Key。
      密钥管理、权限和轮换说明请参考 API 密钥
    • 将密钥设置为 Shell 环境变量,方便下面的示例代码完成鉴权。
    # 添加到 ~/.bashrc 或 ~/.profile
    export WYLON_API_KEY="wl-live-••••••••••••••••••••••••••••••••"
    export WYLON_BASE_URL="https://api.wylon.cn/v1"
    # 添加到 ~/.zshrc
    export WYLON_API_KEY="wl-live-••••••••••••••••••••••••••••••••"
    export WYLON_BASE_URL="https://api.wylon.cn/v1"
    # PowerShell - 对当前用户持久生效
    [Environment]::SetEnvironmentVariable("WYLON_API_KEY", "wl-live-••••••••••••••••••••••••••••••••", "User")
    [Environment]::SetEnvironmentVariable("WYLON_BASE_URL", "https://api.wylon.cn/v1", "User")
    key
    妥善保管密钥。 切勿将 API 密钥提交到代码仓库,也不要打包到客户端产物中。生产环境建议使用密钥管理服务或服务端
  3. 发送第一个请求

      下方展示如何使用 OpenAI 兼容接口,通过 ZhipuAI/GLM-5.3 发起一条简单的对话请求。

    • 将任意符合 OpenAI 规范的客户端指向 https://api.wylon.cn/v1
    • 模型目录 中选择一个受支持的模型 ID 作为model
    • 根据所选模型的使用说明,构建相应的对话消息或 prompt messages,并发送请求以获取模型的响应。
    from openai import OpenAI
    import os
    
    client = OpenAI(
        api_key=os.environ["WYLON_API_KEY"],
        base_url="https://api.wylon.cn/v1",
    )
    
    response = client.chat.completions.create(
        model="ZhipuAI/GLM-5.3",
        messages=[
            {"role": "system", "content": "You are a helpful assistant."},
            {"role": "user", "content": "Explain KV cache in one paragraph."},
        ],
        temperature=0.6,
        max_tokens=512,
    )
    
    print(response.choices[0].message.content)
    import OpenAI from "openai";
    
    const client = new OpenAI({
      apiKey: process.env.WYLON_API_KEY,
      baseURL: "https://api.wylon.cn/v1",
    });
    
    const response = await client.chat.completions.create({
      model: "ZhipuAI/GLM-5.3",
      messages: [
        { role: "system", content: "You are a helpful assistant." },
        { role: "user",   content: "Explain KV cache in one paragraph." },
      ],
      temperature: 0.6,
      max_tokens: 512,
    });
    
    console.log(response.choices[0].message.content);
    curl https://api.wylon.cn/v1/chat/completions \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer $WYLON_API_KEY" \
      -d '{
        "model": "ZhipuAI/GLM-5.3",
        "messages": [
          {"role": "system", "content": "You are a helpful assistant."},
          {"role": "user",   "content": "Explain KV cache in one paragraph."}
        ],
        "temperature": 0.6,
        "max_tokens": 512
      }'
    package main
    
    import (
        "context"
        "fmt"
        "os"
    
        "github.com/sashabaranov/go-openai"
    )
    
    func main() {
        cfg := openai.DefaultConfig(os.Getenv("WYLON_API_KEY"))
        cfg.BaseURL = "https://api.wylon.cn/v1"
        client := openai.NewClientWithConfig(cfg)
    
        resp, err := client.CreateChatCompletion(context.Background(),
            openai.ChatCompletionRequest{
                Model: "ZhipuAI/GLM-5.3",
                Messages: []openai.ChatCompletionMessage{
                    {Role: "user", Content: "Explain KV cache in one paragraph."},
                },
            })
        if err != nil { fmt.Println(err); return }
        fmt.Println(resp.Choices[0].Message.Content)
    }

    请求成功后,响应会返回模型输出 content、Token 使用情况 usage,以及 wylon 新云系统级缓存命中率 cache_hit_ratio

    {
      "id": "cmpl-9f1c7b2e8a41",
      "object": "chat.completion",
      "model": "ZhipuAI/GLM-5.3",
      "created": 1744828800,
      "choices": [{
        "index": 0,
        "message": {
          "role": "assistant",
          "content": "KV cache stores the key and value tensors …"
        },
        "finish_reason": "stop"
      }],
      "usage": {
        "prompt_tokens": 24,
        "completion_tokens": 128,
        "total_tokens": 152,
        "cache_hit_ratio": 0.71      // wylon 扩展字段:上下文缓存命中率
      }
    }
    info

    usage 中的 cache_hit_ratio 是 wylon 在 OpenAI 兼容协议基础上增加的扩展字段, 用于表示本次请求命中系统级上下文缓存的比例。重复前缀越多,命中率通常越高,成本也更有优势。其余字段与 OpenAI 协议保持一致。

API 接入点

不同能力沿用对应的主流请求格式,并使用统一的 wylon 鉴权方式。完整字段请查看 API 手册

方法与路径 用途 说明
POST  /chat/completions 文本生成 OpenAI Chat Completions 兼容,支持流式输出及模型可用的工具调用、结构化输出。
POST  /messages 文本生成 Anthropic Messages 兼容。
POST  /images/generations 同步文生图 OpenAI Images 兼容,在同一次响应中获取图片结果。
POST  /contents/generations/tasks 异步图片和视频生成 创建内容任务后,通过任务 ID 查询状态和结果。
GET  /models 列出可用模型 返回当前账户可用的模型 ID 列表。

需要帮助?

如遇问题,欢迎通过 联系我们 获取支持。

沪ICP备2026010432号-1 沪公网安备31010402336632号