跳转到内容

模型清单与能力

可用模型完全由站长在后台配置的渠道决定,并且会随上游上下线、渠道调整而变化。 任何写死在文档里的模型清单都会过期,甚至误导你去填一个已经不存在的 ID。

所以本页给出的是实时查询方法 —— 这也是排查「模型不存在」类问题的正确起点。

打开 操练场,左侧模型下拉框列出的就是当前密钥可用的模型。 还能直接对话测试,一次确认「模型存在」与「模型可用」两件事。

  1. 逐字复制,不要手打

    大小写、短横线、点号、日期后缀都必须完全一致:

    正确 常见错误写法
    gpt-5.2 GPT-5.2gpt5.2gpt-5-2
    claude-sonnet-4-5 claude-sonnet-4.5claude-sonnet-45
    deepseek-chat deepseekDeepSeek-Chat
  2. 警惕名称相近的变体

    日期版(-20241022)、供应商前缀版(zai-org/glm-5.2)、能力后缀版(-flash-vision[1m]) 是不同的模型,价格与能力都不同。CherryStudio 会在模型名下方显示实际 API 模型 ID,添加前先核对这一行。

  3. 不要凭印象填官方名称

    ZiAI 支持模型重定向:站长可以把 gpt-4o 映射到实际上游的另一个模型,也可以自定义站内专有的模型名。 所以你在 ZiAI 上看到的 ID 可能与上游官方名称不同 —— 一律以 ZiAI 控制台展示的为准。

  4. 换客户端时重新确认

    同一个模型在不同协议通道下的可用性可能不同。例如某模型走 Chat 通道正常,走 Responses 通道却报「仅支持 v1/responses」或反之。

各客户端会给模型标能力(CherryStudio 的模型管理、ChatBox 的能力勾选、ZCode 的图片支持判定、WorkBuddy 的能力标记):

能力 含义 标记错误的后果
工具调用(tools / function calling) 模型能返回结构化的工具调用请求 未标记 → Agent 不触发工具,表现为「只会聊天不会干活」
图片输入(vision) 模型能接收图像内容 未标记 → 图片被客户端提前移除;错误标记 → 上游直接报错
推理 / 思考(thinking / reasoning) 模型支持思考档位或思考开关 档位不被上游接受时会返回 400,降档即可
上下文窗口 单次请求可容纳的 Token 上限 设得过大 → 每轮重发历史更多,费用成倍增加
流式输出 支持 SSE 逐段返回 不支持时客户端可能长时间无输出后一次性返回

具体可用性以 ZiAI 实际清单为准,这里只给选型思路:

场景 选型思路
日常问答、文案润色、格式转换 轻量 / flash 档模型,响应快、单价低
写文档、分析数据、多文件改动 中档通用模型,效果与成本平衡
跨模块重构、多步推理、复杂调试 旗舰推理模型,配合较高思考档位
长文档处理、大仓库理解 长上下文模型(如 1M 窗口),但注意费用随窗口线性上升
截图理解、UI 还原、视觉问答 必须选带 vision 能力的模型
Agent / 工具密集型任务 必须选工具调用稳定的模型,比选「最聪明」的更重要
向量检索 / RAG https://api.ziai.lol/v1/embeddings 端点与对应的嵌入模型