AI 模型选择器:Claude、Groq 与本地引擎对比

模型选择器决定由哪个引擎回答你,并写明决定这件事的三个事实:它要花多少钱、你的文字去了哪里,以及这个模型哪里弱。Claude、Groq 和任何本地已安装的模型都在同一份列表中。

Senzoukria · 文档 · 更新于 2026 年 9 月


位置

位置
AI 页面 → 聊天顶栏的模型按钮;默认值也在 设置 → AI 中
默认引擎
Claude,使用你自己的 API 密钥
默认 Groq 模型
llama-3.3-70b-versatile
读取截图
仅 Claude;Groq 和本地引擎只收到文字
运行应用工具
三种引擎都可以

它做什么

选择器列出 Claude、Groq 以及本地引擎报告为确实已安装的每一个模型。没有任何本地模型是写死的:列表向引擎询问得来,只有引擎知道下载了什么,因此你没有的模型绝不会显示为可用。

每一行都带着通常被略去不说的三列——成本、你的文字去了哪里,以及这个模型弱在哪里。Claude 按消息用你的密钥付费,并发送至 Anthropic。Groq 用你自己的密钥免费、速度快、使用开源模型,但每分钟限速,且在长推理和代码上较弱。本地模型永远不离开本机、不花钱,那一行也直白写明:8B 模型在代码和长推理上不如 Claude。

界面上把词汇分开是有原因的:Ollama 是引擎,是监听本地端口的那个程序;qwen3:8b 是模型,是它加载的权重。引擎有自己单独的一行。

设置项

引擎设置及其默认值
设置默认值它改变什么
默认引擎(设置 → AI)ClaudeClaude、Groq 或本地引擎——默认由哪个提供方作答
Groq 模型llama-3.3-70b-versatile确切的 Groq 模型 id;列表用你的密钥从 Groq API 读取
上下文窗口8k本地引擎加载模型时使用的 token 数:4k、8k、16k、32k 或 64k。更大需要更多显存,并会让 Ollama 重新加载模型
助手联网搜索网页并阅读页面——Claude 使用 Anthropic 的搜索,Groq 和本地模型通过应用使用 DuckDuckGo
工具(读取图表、运行脚本)允许助手读取图表、账户、日历、资讯、回测、脚本和自动驾驶——只读
回退到本地模型仅在 Claude 请求失败时使用;回复会带上实际撰写它的引擎徽标

怎么用

  • 当任务是编写指标代码或需要跟随一条很长的推理链,以及你希望截图被读取时,选 Claude。
  • 想先不花钱就开始,选 Groq:在 Groq 控制台免费获取密钥,使用开源模型,支持工具调用和网页搜索——代价是每分钟限速且不读图片。
  • 当任何内容都不能离开本机时,选本地模型。选择器显示确切的模型名称,绝不会写「Claude」,因此一个 8B 模型写的回复永远不会被误认为是 Claude 写的。
  • 如果你选中的本地模型后来被从本机删除了,选择器会把这个选择标记为不可用,而不是让发送悄悄失败。

限制与陷阱

  • 选了「本地」却没有选定模型时,不会悄悄回退到 Claude。请求会被拒绝并说明原因,因为回退等于把你本想留在本机的内容发到云端。
  • 嵌入模型把文本转换成向量,无法作答;选择器会把它们标出来,而不是让其中之一被选作助手。
  • Groq 的免费档每分钟限速,而上下文窗口设置只对本地引擎有效——Claude 和 Groq 自行管理各自的窗口。
  • 无论你选哪个引擎,它的费用都由该提供方按你的密钥计收。行情数据仍由你的数据提供方单独计费。

其他语言版本

常见问题

Ollama 是一个模型吗?
不是。Ollama 是引擎——你机器上监听本地端口的那个程序。qwen3:8b 是它加载的模型。选择器正是为此把两者分成不同的行。
为什么这个引擎上我不能附加截图?
本地路径向引擎发送的是纯字符串,Groq 那几行也只支持文本,所以两者都收不到图片。选择器会在你附加之前就说明,而不是让发送之后才失败。
上下文窗口这个设置有什么作用?
它告诉本地引擎加载模型时使用多少 token。8k 可以容纳助手的提示词加一段短对话;更大的取值需要更多显存,并会让 Ollama 重新加载模型。