发送给模型的上下文:实时快照、提示词与窗口
向 Senzoukria 助手提出的每个问题都会带上一段系统提示词(角色、讲解风格、绘图词汇、图片指南)、一份实时盘面快照、一条回复语言指令,以及该会话最近 24 轮对话,并按引擎的 token 预算裁剪。
Senzoukria · 文档 · 更新于 2026 年 9 月
位置
- 位置
- AI 助手聊天 → 「查看实时上下文」/「隐藏上下文」按钮
- 发送轮数
- MAX_CONTEXT_TURNS = 24(十二次往返)
- token 估算
- 每个 token 3.5 个字符,每个图片区块 400 tokens
- 语言
- 用界面语言回复;代码、品种代码和 id 保持不变
它做什么
系统提示词按固定顺序拼装:基础角色(嵌在一款面向美国期货和期权的专业订单流桌面应用中的副驾驶,只读访问,不给买卖信号,绝不编造快照中没有的数值)、讲解风格、senz-viz 绘图词汇、截图指南,然后是实时上下文,最后是语言指令。静态部分排在前面,使前缀在各轮之间保持完全一致且可缓存,从而降低你自己密钥上的成本。
实时上下文是一份带时间戳的 Markdown 快照。图表始终最先描述,包括「没有打开任何图表」这一事实,因为缺了这一段,模型曾把 GEX 的品种当成图表的品种。之后,只有在模块有数据时才会加入:Gamma 敞口模块(它自己的品种、现价、零 gamma、call 墙和 put 墙、GEX 总量、DEX 总量、put/call 未平仓量比、25Δ 偏斜、平值隐含波动率)、期权流向(最近 N 笔成交、call 和 put 权利金、买入和卖出权利金、≥ $500K 的巨额成交、最大单笔)、账户(余额、当日盈亏、当日交易笔数、胜率、最多 8 个持仓)、最近 6 条标题和接下来的 6 个经济事件。
聊天中的「查看实时上下文」按钮显示的正是这份快照,方便你在相信模型引用的某个数字之前先核对它到底被告知了什么。
设置项
| 设置 | 默认值 | 它改变什么 |
|---|---|---|
| MAX_CONTEXT_TURNS | 24 | 只发送最近 24 轮;窗口始终从一条用户消息开始 |
| token 预算(本地引擎) | 引擎的上下文窗口,例如模型选择器中的 8k | 从最旧的轮次开始丢弃,直到其余内容放得下;最后一个问题始终保留 |
| estimateTokens | 每个 token 3.5 个字符 | 仅用于估算大小,绝不用于计费 |
| 图片区块估算 | 400 tokens | 适配预算时每张图片的固定开销 |
| 回复语言 | 界面语言(英语、法语、西班牙语、意大利语、简体中文、俄语、阿拉伯语) | 该指令附在最后;若你用另一种语言书写,模型会跟随你 |
| 脚本知识 | 输出契约、沙箱限制、约定、指标清单 | 加入脚本助手的提示词;其体积由一项测试限定 |
怎么用
- 提问之前先打开你希望模型据以推理的模块:本次会话中从未打开过的模块 store 为空,快照中也就没有对应的段落。
- 当回答看起来不对劲时按「查看实时上下文」;如果相应段落缺失,模型被要求如实说明并反问你,而不是猜测。
- 换话题时开一段新对话。每次都会发送十二次往返,整天不换的会话每提一个问题都要为这条长尾付费。
- 使用本地模型时,如果请求被拒绝,请在模型选择器中调大上下文窗口;本地引擎对过长的提示词是拒绝,而不是截断。
限制与陷阱
- 裁剪只发生在发送时。会话在屏幕上和磁盘上都是完整的;你付费的只是末尾那一段。
- 快照是发送那一刻的照片。它不会在一段长回复的过程中更新。
- 只有在期权数据源返回了期权链之后,GEX 数值才会出现;该段落会把 GEX 的品种标注为期权数据,而不是图表的品种。
- 脚本提示词包含从注册表读取的完整指标清单(204 条约 7 300 个字符);每一个脚本相关的问题都会带上它。
相关页面
其他语言版本
常见问题
- 模型能看到我的整段对话吗?
- 它收到最近 24 轮,对本地引擎还会进一步压缩到 token 预算放得下的范围。窗口始终从你的某条消息开始,因为 API 拒绝以助手回合开头的对话。
- 我的界面是英文,助手为什么用法语回答?
- 本不该如此:每段提示词最后都会附上一条语言指令,用英文写明界面语言。如果你用另一种语言书写,模型会跟随你。
- 为什么实时上下文里没有 GEX 段落?
- GEX 模块还没有快照。请打开它并等待期权链返回;图表以外的段落只有在对应模块有数据时才会加入。