答案复现清单
01

请求:问题、上下文与身份

02

语义:概念、规则与版本

03

数据:快照、水位与质量

04

执行:计划、查询与模型

05

输出:结果哈希、图表与限制

结论:截图只能证明曾经显示过什么

数据更新、指标换版、权限变化、模型升级和缓存淘汰都会让同一问题得到不同结果。截图没有输入范围和计算证据,无法判断变化是否合理。生产问数应为每次回答生成 response_manifest。

复现有三种目标:原样 replay 使用当时输入与版本;rerun 使用当前数据但保持逻辑;restate 按新规则重算历史。页面和审计记录必须区分,不能把今天重跑称为复现昨天。

清单从请求和身份开始

保存 normalized_question、原问题、会话中继承条件、locale、timezone、organization、project、subject、role 和 policy_version。敏感文本按分类脱敏或加密,但不能丢掉决定范围的证据。

分享他人回答时不能沿用原作者权限。清单可证明当时范围,重新打开仍按当前授权过滤;审计可见不等于业务数据永远可见。

冻结语义和业务规则

记录 concept IDs、指标版本、维度、枚举映射、时间角色、币种、默认过滤和业务文档版本。只保存最终 SQL 无法解释为什么选择该指标,也无法在换库后迁移。

语义发布使用不可变版本或内容哈希。若旧规则因合规要求删除,清单应保留最小审计指纹和删除原因,并明确无法完整重放的边界。

描述数据快照而不是写“最新”

保存每个关键数据集的 snapshot_id、partition、水位、质量状态和 backfill_version。对象存储或时间旅行能力可支持原样读取;没有历史快照时只能说明逻辑可重跑,不能承诺数字可重现。

多源答案记录共同截止时间与缺失分区。源系统后来修正历史数据时,原快照与重述快照都应可识别,差异报告按数据修订、逻辑变化和执行误差分类。

保存结构化查询计划与执行证据

清单包含计划节点、编译器版本、生成 SQL 哈希、参数、数据库引擎、query_id、行数、粒度、超时、采样、缓存和守恒检查。凭据和敏感 SQL 常量不应进入普通清单。

SQL 文本可在受控审计库保存,但业务复现以稳定计划和语义为主。物理优化、表迁移或方言变化后,可以重新编译等价计划,而不是依赖旧 SQL 永远可执行。

模型生成也需要版本和随机性记录

若模型负责解析、摘要或图表建议,记录 provider/model identifier、提示模板版本、工具版本、解码参数和安全策略。即使 temperature 为零,托管模型也可能更新,不能把确定性当作绝对保证。

关键数字应由查询结果而非模型记忆生成。摘要复现可接受措辞差异,但事实、限制和引用必须一致;验收分别比较数值层和表达层。

输出需要哈希、血缘和显示版本

保存结果 schema、行数、排序、精度、结果哈希、图表配置、摘要版本和引用。未定义排序的结果即使集合相同,哈希也会变化;浮点、时区和舍入规则也要固定。

导出和分享链接绑定 manifest_id。页面后续样式升级可以重新渲染,但应保留原显示版本或标记“按新版样式呈现”,避免把展示变化误判为数据变化。

定义留存、隐私和删除边界

完整清单可能含敏感问题和结果,按分类设置留存、访问、加密与删除。审计目的通常只需较长保留元数据,明细结果可更短;法律删除请求要传播到快照、缓存和向量索引。

删除后可保留不可逆哈希和事件记录,但不能声称仍可完整复现。可靠系统会报告 reproducibility_level,而不是用一个“可追溯”标签掩盖缺失。

用差异分类验证复现

选取固定、迟到数据、语义换版、权限撤销、模型升级和引擎迁移样本。分别执行 replay、rerun、restate,检查预期不变项与预期变化项。

差异报告至少分 input_data、semantic_rule、authorization、execution、model_summary 和 rendering。若系统只说结果不同却不能定位类别,清单没有完成任务。

清单服务也需要故障与迁移设计

清单写入失败时,高风险答案应暂停发布或明确标为不可复现,不能先返回后假设日志一定补齐。清单与结果使用幂等事务标识,重试不会生成两个互相矛盾的 manifest;异步补写要有超时告警和责任人。

更换数据库、模型供应商或语义引擎前,抽取一批历史清单做迁移演练。验证旧 concept_id、snapshot_id 和计划节点能映射到新系统;无法迁移的记录标注 replay 不可用,而不是生成看似成功的新答案覆盖证据。

容量规划要区分元数据、查询结果与源快照。可对低风险结果只保留哈希和统计,对监管或财务证据保留受控快照;具体期限由数据分类与法规决定,不能由存储成本单方面决定。

用户看到的变化提示要能回答三个问题

当新答案与历史不同,页面先说明“变了什么”:金额、排序还是表述;再说明“为什么变”:数据回填、口径、权限或模型;最后说明“是否需要行动”:旧报告是否撤回、下游通知谁、能否切回原发布。

差异阈值按指标风险设置,不能所有小数舍入变化都告警,也不能用百分比阈值忽略大金额。通知引用旧新 manifest_id 和责任人,避免在聊天里只转发两张截图继续猜测。

验收与 AskTable.ai 边界

验收清单包括唯一 manifest_id、版本与水位完整、受控 replay、当前权限重新验证、结果哈希稳定、差异可分类、删除和留存可执行。先覆盖高风险指标,再扩展所有探索问题。

AskTable.ai 可作为自然语言分析和答案记录入口候选,但本文不证明当前版本已保存完整 manifest、历史快照或确定性模型重放。语义版本、数据时间旅行、日志留存和导出血缘需结合基础设施逐项验证。

公开参考资料

准备好让团队开始了吗?

预约一次场景交流,了解 AskTable.ai 如何接入你的业务。

预约演示