主题
本地优先 Playground
打开控制台的 Playground,即可用自己的 API Key 测试当前实际可路由的模型。
隐私与存储边界
Playground 采用本地优先设计:
- 对话消息、附件、长期上下文、工具输入输出和 Compact 分支保存在当前浏览器的 IndexedDB。
- Sub2API 服务端实时转发请求,只保留计费、Token、状态、耗时、模型/路由分类和媒体任务 ID 等固定运行元数据,不持久化正文。
- 内容仍会发送给实际选择的上游模型提供商;上游可能按其自身政策处理或保留数据。
- 清理浏览器站点数据会删除本地会话、长期上下文与生成历史。
页面顶部会显示本机存储状态。如果 IndexedDB 被禁用、阻塞或空间不足,工作台会降级为内存模式;当前页面仍能请求模型,但关闭页面后内容可能丢失。
选择 API Key 与模型
- 选择属于当前账号的 API Key。
- 选择 Chat、Build、图片、视频或对比模式。
- 从模型列表选择当前真实可调度的模型。
列表能力来自当前 API Key 的实际路由,而不是根据模型名称猜测。切换模型时,不受支持的 Reasoning、Fast、工具、Compact、图片或视频参数会自动关闭或调整。
窄屏与小窗口
工作台以对话为主体,配置项按可用宽度收纳:
- 宽屏(≥1024px):模式切换、API Key、模型与参数摘要在同一行运行栏内,点击参数摘要在其下方展开完整参数面板。
- 窄屏(<1024px):运行栏只保留模式图标和一个显示当前模型的“运行设置”按钮,点击后从底部弹出抽屉,内含 API Key、模型与全部参数;切换模式会自动收起抽屉。
- 会话列表与长期上下文在窄屏改为抽屉,通过标题栏左侧的菜单按钮和右侧的上下文按钮打开。
- 顶部本机存储说明默认折叠为一行,点击展开完整说明;存储降级告警始终展开显示。
- 输入框上方的上下文预算在窄屏收敛为单行进度条,只在接近或超出上限时追加提示文字。
Chat 与 Build
Chat 支持:
- 文本、图片和文本/代码附件;
- temperature、top_p、最大输出 Token 和路由支持的推理档位;
- 当前模型支持时的网页搜索与代码执行;
- 经过 SSRF 防护的公开 URL 抓取。
Build 只会在模型路由同时确认 Responses 和代码执行能力时显示。它用于组织编程任务和工具活动,不会直接读取或修改你电脑上的本地文件。
长期上下文与预算
右侧“长期上下文”可保存项目约束、术语或常用说明,并按会话决定是否加入下一次请求。上下文预算会估算历史消息、附件、长期上下文和预留输出占用;图片或未知附件可能无法完全精确估算。
当用量接近上限时,可以:
- 删除或关闭不需要的长期上下文;
- 降低最大输出 Token;
- 删除历史消息;
- 对支持原生 Compact 的模型执行“立即压缩”。
Compact 成功后只在本地建立压缩分支,原始消息不会被删除,并可撤销。启用自动压缩后,工作台会在预计占用达到阈值时先压缩再发送。
Fast 与工具
- Fast:只有路由明确支持
fast或priority服务层时可用,可能采用不同计费。 - 网页搜索:由上游模型托管,只有能力目录明确支持时发送。
- 代码执行:由上游模型托管,工具输入、输出和状态只保存在本地会话。
- 网页抓取:由 Sub2API 工作台抓取公开 URL,并作为“不可信上下文”加入请求;它不是上游 hosted tool。
中断、重试与导出
停止生成后,已收到的文字会保留为部分结果。流中断或可重试错误会显示明确终态,可按原输入重试。会话可导出为 Markdown 或 JSON;导出文件可能包含敏感正文,请自行安全保存。
多设备与多标签页
会话不会自动同步到其他浏览器或设备。同一浏览器、同一站点的多个标签页会同步本地 revision,且在浏览器支持时串行化写入,减少互相覆盖。
