-
Notifications
You must be signed in to change notification settings - Fork 0
Expand file tree
/
Copy pathmodels.example.py
More file actions
50 lines (46 loc) · 2.62 KB
/
Copy pathmodels.example.py
File metadata and controls
50 lines (46 loc) · 2.62 KB
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
42
43
44
45
46
47
48
49
50
"""模型字典模板 —— 复制本文件为 models.py 并填入你的真实 token。
cp models.example.py models.py (Windows: copy models.example.py models.py)
字段说明见 models.py。models.py 已被 gitignore,不会提交。
"""
MODELS = {
# 多 token 说明:条目里配多个 api_token 时默认【成功后预旋转】轮流使用——适合 ModelScope 等
# 按号限每日额度、且不吃 prompt cache 的 provider(轮换分摊配额,换了无损失)。
# ⚠️ GLM/bigmodel 等 prompt cache 按 api_token 隔离的 provider:
# 1. 每次成功换 token = 自己交错驱逐自己的缓存 → 该类条目配 "token_rotate": false 保持 sticky
# (限流时的应急轮换不受此开关影响)。
# 2. 同一 token 交错用于【react 长上下文】和【utility 短调用】(recap/RAG检索/工作流LLM)也会
# 互相驱逐缓存 → utility 配独立条目 + 独立 api_token(见下方 glm-utility 示例),
# 再 /config utility_model glm-utility。
"deepseek": {
"base_url": "https://api.deepseek.com",
"api_token": "sk-你的-deepseek-key",
"model": "deepseek-v4-flash",
"desc": "DeepSeek(备用)",
"thinking": False,
"vision": False,
# DeepSeek【思考模型】(如 deepseek-reasoner/v4-pro thinking 模式)要求历史中带
# tool_calls 的 assistant 消息必须有 reasoning_content 字段;跨模型混用历史缺该字段时 400。
# 设 true 后发请求前自动给缺字段的消息补空串占位。非思考模型保持 False 即可。
"requires_reasoning_in_history": False,
},
"qwen": {
"base_url": "https://api-inference.modelscope.cn/v1",
"api_token": "ms-你的-modelscope-token",
"model": "Qwen/Qwen3.5-397B-A17B",
"desc": "ModelScope Qwen3.5-397B 推理模型(视觉)",
"thinking": True,
"vision": True,
},
# utility 专用条目示例:与主模型同 provider 也【必须用不同 api_token】(缓存按 token 隔离,
# 同 token 长短调用交错互相驱逐缓存)。去 provider 后台再申请一个 key 填这里,
# 然后 /config utility_model glm-utility 生效。
# "glm-utility": {
# "base_url": "https://open.bigmodel.cn/api/coding/paas/v4",
# "api_token": "另一个-key(不要与主条目共用)",
# "model": "glm-5.3",
# "desc": "utility 短调用专用(recap/RAG检索/工作流LLM),独立 token 保主链缓存命中",
# "thinking": False,
# "vision": False,
# },
}
DEFAULT_MODEL = "deepseek"