AI 模型选择器:Claude、Groq 与本地引擎对比
模型选择器决定由哪个引擎回答你,并写明决定这件事的三个事实:它要花多少钱、你的文字去了哪里,以及这个模型哪里弱。Claude、Groq 和任何本地已安装的模型都在同一份列表中。
Senzoukria · 文档 · 更新于 2026 年 9 月
位置
- 位置
- AI 页面 → 聊天顶栏的模型按钮;默认值也在 设置 → AI 中
- 默认引擎
- Claude,使用你自己的 API 密钥
- 默认 Groq 模型
- llama-3.3-70b-versatile
- 读取截图
- 仅 Claude;Groq 和本地引擎只收到文字
- 运行应用工具
- 三种引擎都可以
它做什么
选择器列出 Claude、Groq 以及本地引擎报告为确实已安装的每一个模型。没有任何本地模型是写死的:列表向引擎询问得来,只有引擎知道下载了什么,因此你没有的模型绝不会显示为可用。
每一行都带着通常被略去不说的三列——成本、你的文字去了哪里,以及这个模型弱在哪里。Claude 按消息用你的密钥付费,并发送至 Anthropic。Groq 用你自己的密钥免费、速度快、使用开源模型,但每分钟限速,且在长推理和代码上较弱。本地模型永远不离开本机、不花钱,那一行也直白写明:8B 模型在代码和长推理上不如 Claude。
界面上把词汇分开是有原因的:Ollama 是引擎,是监听本地端口的那个程序;qwen3:8b 是模型,是它加载的权重。引擎有自己单独的一行。
设置项
| 设置 | 默认值 | 它改变什么 |
|---|---|---|
| 默认引擎(设置 → AI) | Claude | Claude、Groq 或本地引擎——默认由哪个提供方作答 |
| Groq 模型 | llama-3.3-70b-versatile | 确切的 Groq 模型 id;列表用你的密钥从 Groq API 读取 |
| 上下文窗口 | 8k | 本地引擎加载模型时使用的 token 数:4k、8k、16k、32k 或 64k。更大需要更多显存,并会让 Ollama 重新加载模型 |
| 助手联网 | 开 | 搜索网页并阅读页面——Claude 使用 Anthropic 的搜索,Groq 和本地模型通过应用使用 DuckDuckGo |
| 工具(读取图表、运行脚本) | 开 | 允许助手读取图表、账户、日历、资讯、回测、脚本和自动驾驶——只读 |
| 回退到本地模型 | 关 | 仅在 Claude 请求失败时使用;回复会带上实际撰写它的引擎徽标 |
怎么用
- 当任务是编写指标代码或需要跟随一条很长的推理链,以及你希望截图被读取时,选 Claude。
- 想先不花钱就开始,选 Groq:在 Groq 控制台免费获取密钥,使用开源模型,支持工具调用和网页搜索——代价是每分钟限速且不读图片。
- 当任何内容都不能离开本机时,选本地模型。选择器显示确切的模型名称,绝不会写「Claude」,因此一个 8B 模型写的回复永远不会被误认为是 Claude 写的。
- 如果你选中的本地模型后来被从本机删除了,选择器会把这个选择标记为不可用,而不是让发送悄悄失败。
限制与陷阱
- 选了「本地」却没有选定模型时,不会悄悄回退到 Claude。请求会被拒绝并说明原因,因为回退等于把你本想留在本机的内容发到云端。
- 嵌入模型把文本转换成向量,无法作答;选择器会把它们标出来,而不是让其中之一被选作助手。
- Groq 的免费档每分钟限速,而上下文窗口设置只对本地引擎有效——Claude 和 Groq 自行管理各自的窗口。
- 无论你选哪个引擎,它的费用都由该提供方按你的密钥计收。行情数据仍由你的数据提供方单独计费。
相关页面
其他语言版本
常见问题
- Ollama 是一个模型吗?
- 不是。Ollama 是引擎——你机器上监听本地端口的那个程序。qwen3:8b 是它加载的模型。选择器正是为此把两者分成不同的行。
- 为什么这个引擎上我不能附加截图?
- 本地路径向引擎发送的是纯字符串,Groq 那几行也只支持文本,所以两者都收不到图片。选择器会在你附加之前就说明,而不是让发送之后才失败。
- 上下文窗口这个设置有什么作用?
- 它告诉本地引擎加载模型时使用多少 token。8k 可以容纳助手的提示词加一段短对话;更大的取值需要更多显存,并会让 Ollama 重新加载模型。