多模型使用
Wesclaw 支持同时接入多个 AI 模型,让你可以根据不同需求选择最合适的模型。无论是追求极致的推理能力、更快的响应速度,还是更低的使用成本,你都能找到最佳方案。
功能概述
Wesclaw 的多模型架构支持三种 Provider 来源:
| 来源 | 标识前缀 | 说明 |
|---|---|---|
| WES 平台 | wes: | 平台提供的模型服务,按用量计费 |
| 组织托管 | org: | 企业统一提供的模型服务 |
| 自有密钥 | byok: | 你自己的 API Key 直连模型提供商 |
模型切换
在对话中切换
在输入框下方的模型选择器中,点击当前模型名称即可切换:
- 点击模型选择器
- 浏览可用模型列表
- 选择目标模型
- 后续对话将使用新模型
提示:切换模型不影响已有对话历史,AI 仍然可以看到之前的上下文。
支持的模型提供商
| 提供商 | 代表模型 | 特点 |
|---|---|---|
| OpenAI | GPT-4o、o1、o3 | 综合能力强 |
| Anthropic | Claude 4 Opus/Sonnet | 长文本、推理 |
| DeepSeek | DeepSeek V4 | 高性价比 |
| Gemini 2.5 Pro/Flash | 多模态 | |
| 本地部署 | Ollama / vLLM | 隐私保护 |
快速切换方式
| 方式 | 操作 |
|---|---|
| 模型选择器 | 点击输入框下方的模型名称 |
| 快捷键 | Ctrl + M(macOS: ⌘ + M) |
| 对话指令 | "切换到 Claude Sonnet" |
模型特长
各模型适用场景
| 场景 | 推荐模型 | 理由 |
|---|---|---|
| 日常对话 | GPT-4o / Claude Sonnet | 响应快、质量好、成本适中 |
| 深度推理 | o3 / Claude Opus | 复杂逻辑推理能力强 |
| 代码编写 | Claude Sonnet / DeepSeek V4 | 代码理解和生成能力优秀 |
| 长文处理 | Claude Opus / Gemini 2.5 Pro | 支持超长上下文窗口 |
| 图片理解 | GPT-4o / Gemini 2.5 | 强大的视觉理解能力 |
| 成本敏感 | DeepSeek V4 / Gemini Flash | 价格实惠,性能不俗 |
| 隐私优先 | Ollama 本地部署 | 数据完全不出本机 |
模型能力对比
| 能力维度 | GPT-4o | Claude Sonnet | DeepSeek V4 | Gemini 2.5 Pro |
|---|---|---|---|---|
| 中文理解 | ⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ |
| 英文理解 | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ |
| 代码能力 | ⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ |
| 推理能力 | ⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐⭐ |
| 多模态 | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐ | ⭐⭐⭐⭐⭐ |
| 响应速度 | ⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ |
| 上下文长度 | 128K | 200K | 128K | 1M |
注意:以上评分基于通用场景,具体表现可能因任务类型而异。
成本对比
主流模型价格参考
| 模型 | 输入价格(每百万Token) | 输出价格(每百万Token) | 成本等级 |
|---|---|---|---|
| GPT-4o | ¥17.5 | ¥70 | 中等 |
| Claude Sonnet | ¥21 | ¥105 | 中高 |
| Claude Opus | ¥105 | ¥525 | 高 |
| DeepSeek V4 | ¥2 | ¥8 | 低 |
| Gemini 2.5 Flash | ¥0.5 | ¥3.5 | 极低 |
提示:价格可能随时变化,请以各提供商官网为准。使用 WES 平台时,价格可能略有不同。
省钱技巧
- 日常对话用便宜模型:简单问答用 DeepSeek 或 Gemini Flash
- 重要任务用好模型:复杂推理、正式写作用 Claude Opus
- 使用 BYOK:直接使用自己的 API Key,跳过平台加价
- 控制上下文:避免不必要的长对话,及时开新会话
- 善用记忆:利用记忆系统避免重复说明背景信息
自动选择
智能路由
Wesclaw 支持配置模型的自动选择策略:
Provider 策略:
| 策略 | 说明 | 适用场景 |
|---|---|---|
own_only | 只用自有 API Key | 成本控制、隐私优先 |
shared_only | 只用平台共享模型 | 便捷使用 |
own_first | 优先自有,不可用时回落到共享 | 推荐配置 |
shared_first | 优先共享,不可用时回落到自有 | 按需选择 |
Fallback 机制
当首选模型不可用时(如额度用尽、服务故障),系统会自动切换到备选模型:
首选模型(如 GPT-4o)
↓ 不可用
备选模型(如 Claude Sonnet)
↓ 不可用
最终回落(如 DeepSeek V4)
Thinking Level
对于支持思考模式的模型(如 Claude),你可以调节思考深度:
| 思考等级 | 说明 | 适用场景 |
|---|---|---|
| 低 | 快速响应,适度思考 | 简单任务 |
| 中 | 平衡速度和质量 | 日常使用 |
| 高 | 深度思考,更佳质量 | 复杂推理 |
模型评估
查看模型使用情况
在 设置 → 模型使用统计 中查看:
- 各模型的调用次数
- Token 消耗量
- 费用统计
- 响应时间分析
对比测试
如果你想对比不同模型在特定任务上的表现:
- 开两个对话窗口
- 分别选择不同模型
- 发送相同问题
- 比较回答质量和速度
选择建议
根据你的主要使用场景选择默认模型:
- 日常助手:GPT-4o 或 Claude Sonnet(平衡性能和成本)
- 开发者:Claude Sonnet(优秀的代码能力)
- 内容创作者:Claude Opus(深度理解和创作能力)
- 学生/研究者:DeepSeek V4(高性价比)
- 企业用户:根据合规要求选择(如需国内模型)
添加自有模型
配置 BYOK Provider
- 进入 设置 → LLM 服务
- 点击 添加 Provider
- 选择提供商类型
- 填入你的 API Key 和其他配置
- 测试连接
- 保存
配置本地模型
使用 Ollama 本地部署:
- 安装 Ollama(
brew install ollama或官网下载) - 拉取模型(
ollama pull llama3.2) - 在 Wesclaw 中添加 Provider:
- 类型:Ollama
- 地址:
http://localhost:11434
- 选择该模型即可使用
注意事项
模型兼容性
- 不同模型的上下文窗口大小不同,切换后长对话可能被截断
- 部分模型不支持图片输入(Vision),切换后图片功能可能不可用
- 工具调用(Function Calling)能力因模型而异
计费说明
- WES 平台模型按 Token 用量从钱包扣费
- BYOK 模型直接由提供商按其定价计费
- 组织托管模型的费用由组织统一管理
- 本地部署模型仅消耗本机计算资源
最佳实践
- 设置默认模型:选一个日常使用的高性价比模型作为默认
- 按需切换:只在复杂任务时切换到更强的模型
- 关注 Token 消耗:定期查看用量统计,控制成本
- 测试新模型:新模型发布后,用简单任务先测试效果
- 保留备选:至少配置两个 Provider,确保服务可用性