查询证据实验室
先建立证据,再讲故事。
从空白工作区开始,只记录 AI 界面实际展示的内容,并用同一套字段完成每次复测。这是测量底稿,不是可见度分数或成果宣称。
特意保持空白 · Tenten 没有运行或发布你浏览器中的观察 · 不生成基准、提升幅度或因果结论
本地工作区
记录有限且可追溯的查询观察
最多创建 100 条人工观察。可导入同格式 CSV、导出本地数据,或下载只有表头的空白模板。
提示词、备注和网址只留在当前浏览器,不会写入分析事件,也不会提交给 Tenten。
数据保存在当前浏览器的 local storage。清除站点数据或更换浏览器后,未导出的内容无法找回。
数据行
0
覆盖引擎
0
覆盖语言区域
0
协议完整行
0
完整度区间
空白
0/0 必填单元格已完成. 这些只是文档状态摘要,不衡量可见度、表现、提升或因果。
尚无观察
添加空白行或导入固定格式 CSV。系统不预填任何样例数据。
观察词汇
四类不同主张,请保持分离。
同一回答可能提及却不引用、引用却不推荐;界面通常也不会披露系统为何检索某来源。
01
检索
系统在生成时使用材料。仅凭回答无法证明隐藏检索,因此本工作区不提供检索状态字段。
02
提及
命名实体出现在生成正文。提及并不自动意味着正面、被引或被推荐。
03
引用
界面明确附上来源卡、链接或归因。只记录可见来源,不推断隐藏来源。
04
推荐
回答明确背书、选择或排序某实体以满足用户需求。中性列入不算推荐。
证据协议
一条观察、一个可见回答、一行数据
固定能够控制的条件,只记录界面展示的事实;遇到歧义就保留歧义,不用假设补齐。
- 01
先定义提示词集合
运行前选择有限且与决策相关的集合,并保持标签和原文稳定。
- 02
固定运行条件
记录引擎/界面、语言区域、日期、序号;账户、位置或会话等重要条件写入备注。
- 03
分别观察
正文提及、可见引用、来源与推荐各自编码;必要时用无法判断或尚未检查。
- 04
重复运行,不抹平差异
在记录好的条件下重复观察,每次运行单独保留一行。
- 05
将变更连接到复测
先命名干预并保留原始观察,再连接后续运行;不要声称变更必然造成结果。
方法限制
这个工作区不能证明什么
把数据行作为审计轨迹,而不是市场基准或因果模型。
- AI 回答会随时间、模型、界面、账户、位置、会话和个性化而变化。
- 可见引用不会披露全部检索来源,也不能证明某个页面造成回答。
- 人工编码会产生判断和抄录误差;不确定状态应保留为无法判断。
- 有限提示词集合只描述自身覆盖,不能代表全部需求或用户。
- 浏览器本地存储不是备份、共享数据库、监控服务,也不是 Tenten 持有的数据集。
- 前后观察只能显示顺序,不能证明提升或因果;两次运行间可能还有其他变化。
可复现检查表
让下一次复测可解释
保留足够上下文,让另一位操作者可以复跑;不要假装所有引擎条件都能完全冻结。
- 保存完整提示词,或使用版本控制的提示词 ID。
- 写明引擎、界面,以及可见时的模型/版本。
- 记录语言区域、市场/位置、日期、序号和相关登录或会话状态。
- 截图或来源证据放在获准系统中,此处只记录参考链接。
- 使用同一套编码定义,并保留无法判断/尚未检查状态。
- 复测前先记录干预,原始行与后续行都要保留。
- 高风险或有歧义的观察由第二位审核者复核。
变更记录
协议历史
v1.0.0 · 2026-08-12 · 首次发布空白、浏览器本地协议与 CSV 工作区;未发布任何第一方结果数据集。
常见问题
这个实验室能做与不能做的事
Tenten 会收到我的提示词或网址吗?
不会。数据只在当前浏览器和你主动创建的 CSV 中。交互分析仅包含行数、引擎数、语言区域数和完整度区间。
这是 Tenten 的基准或研究数据集吗?
不是。工作区初始为空,没有虚构样例,也不声称 Tenten 已运行这些观察;它只是帮你建立自己的证据轨迹。
为什么没有可见度分数?
单一分数会把提示词选择、引擎差异、提及、引用和推荐藏在虚假的可比性之后。本实验室只报告覆盖和记录完整度。
这些数据能证明干预有效吗?
不能。连接前后观察有助调查,但时间顺序本身无法证明提升或因果。
把干净的证据轨迹转成运营决策。
相邻工作可用空白模板,节奏与责任可看运营手册;页面级技术检查则另用 URL Snapshot。
本地证据仍归你所有 · URL Snapshot 是独立流程 · 不保证表现