采集与登记
接收结果后先登记期次、时间、号码序列和来源类别。此时重点是保留收到的内容,不急于用统计结果反向修饰原始字段。
Source register
结果号码、玩法结构、名称解释和背景资料承担不同功能。平台不会把解释性资料当作某一期结果,也不会用单条结果记录反推长期规则。区分来源类型,可以减少“内容看起来相关,但实际不能互相证明”的混用。
| 来源类别 | 主要引用范围 | 进入平台时关注的字段 | 使用边界 |
|---|---|---|---|
| 结果类 | 用于建立每一期的期次、开奖时间、名次顺序和号码记录,是最新结果、历史列表与统计计算的基础。 | 期次标识、时间信息、完整号码序列、抓取或录入时间、来源类别及当前状态。 | 单一结果记录只能说明对应期次,不能单独定义规则,也不能证明未来分布。 |
| 规则类 | 用于解释号码结构、名次含义,以及大小单双、龙虎、冠亚和等衍生指标的分类方式。 | 规则名称、适用范围、生效区间、术语定义和可能影响历史计算的版本差异。 | 规则说明用于解释计算,不会被当作开奖结果;存在版本变化时,不用新规则强行覆盖旧期次。 |
| 身份与名称类 | 用于说明中文名称、常见简称和相近叫法之间的关系,帮助用户确认自己查询的对象。 | 名称写法、别名、语境、是否容易与其他项目混淆,以及站内采用的统一称呼。 | 名称相似不代表数据可合并;身份资料只帮助辨析对象,不用于补齐缺失结果。 |
| 背景资料类 | 用于补充项目背景、公开语境或相关制度概念,让规则与名称说明具备必要上下文。 | 资料主题、发布时间或版本、适用对象、引用目的,以及是否直接关联某一期结果。 | 背景资料不自动取得结果来源的优先级;与具体号码无直接关联时,仅作说明性引用。 |
Data lifecycle
数据处理的重点不是增加复杂步骤,而是避免在不同页面中出现不同答案。平台以期次作为主索引,以名次和号码作为结构字段,并将原始记录与衍生统计分开保存逻辑。这样即使统计窗口发生变化,基础结果仍保持同一条记录。
接收结果后先登记期次、时间、号码序列和来源类别。此时重点是保留收到的内容,不急于用统计结果反向修饰原始字段。
把展示时间与采集时间区分开,并转换为站内统一的时间表达。若原始资料缺少明确时区,不擅自用抓取时间代替开奖时间。
相同期次和相同号码序列不会被重复计入。若相同期次出现不同序列,则保留冲突信号,不以“较晚收到”作为自动覆盖理由。
根据字段完整度和记录一致性标记已收录、待核验、冲突或缺失。状态是记录当前处理阶段,不等同于对未来结果的判断。
基础字段被修正后,依赖该期次的频次、遗漏和走势图会重新计算。旧值不继续参与当前统计,但修订原因与前后版本应留有脉络。
最新结果展示最近收录的记录,历史页面按期次组织查询,走势与统计页面再从同一批基础记录生成序列。若某一期处于缺失或冲突状态,相关图表可能出现空位、断点或暂不纳入计算,而不是用相邻期次自动填补。这样做能让列表与图表保持同一数据边界。
Status legend
“已收录”不应被理解为对所有外部资料的一般性确认,“待核验”也不等于记录必然错误。状态的作用是告诉用户:当前记录包含哪些字段、是否存在差异,以及统计页面此刻如何处理它。
判断顺序
期次与号码结构满足当前展示要求,能够进入结果列表。若没有其他异常标记,该记录可参与对应窗口的统计计算。
记录已进入处理队列,但时间、期次或号码字段仍需进一步比对。页面可以保留其存在性提示,统计时则根据缺失字段决定是否暂缓纳入。
相同期次存在不同号码、不同顺序或其他关键字段差异。冲突未处理前,不把其中任意一个版本静默替换为最终记录。
在连续期次或指定查询范围内发现应有位置没有可用记录。缺失期不以零值、前一期号码或推算号码填充。
关键字段经过复核后发生变化,当前页面展示修正后的有效版本。依赖该记录的历史统计会按新值重算;状态同时提示用户,这条记录曾发生过影响展示或计算的更改。
Coverage summary
仅知道“有历史数据”并不足以判断一张走势图是否完整。有效的覆盖说明至少应回答三个问题:查询区间从哪里开始、区间中间有没有缺期、最近记录与数据接收之间是否存在延迟。平台不在没有实际记录支持时给出固定覆盖数字,也不会把连续展示误写成永久完整。
以当前数据库中可查询的最早与最晚有效期次描述,不用栏目上线时间代替实际数据起点。
记录区间内部若存在缺失期次,应保留空位或状态提示,使频次分母和走势图横轴不被悄然压缩。
区分开奖时间、接收时间与页面更新时间。尚未收到可用记录时,不用预计时间生成占位结果。
Methodology table
统计结果取决于查询窗口、位置范围和有效记录集合。为了让同一筛选条件在不同页面得到一致结果,平台先确定参与计算的期次,再逐项生成频次、遗漏和分类指标。下表说明指标代表什么,也说明它们不代表什么。
| 指标 | 计算对象 | 计算方式 | 边界与展示原则 |
|---|---|---|---|
| 出现频次 | 指定查询窗口内,某个号码在某一名次或全部选定名次中的出现次数。 | 逐期读取有效号码序列,每满足一次筛选条件计数一次。按位置统计与全位置统计分别计算,不混为同一分母。 | 频次反映已选历史范围内的实际计数。窗口大小改变,频次也会改变;它不是下一期概率承诺。 |
| 当前遗漏 | 某号码在指定位置距离最近一次出现后,连续未出现的有效期数。 | 从窗口末端向前查找最近一次命中;之后连续未命中的有效记录数即为当前遗漏。若窗口内从未出现,则仅能说明窗口内未命中。 | 缺失期是否进入期次跨度与是否进入有效记录计数应分开表达,避免把“没有数据”误算为“号码未出现”。 |
| 平均与最大遗漏 | 查询范围内某号码相邻两次出现之间的间隔序列。 | 先生成每次命中之间的连续未命中长度,再计算算术平均值或取其中最大值。样本不足时不强行生成稳定结论。 | 窗口起点之前的未知间隔不补算,窗口末端尚未结束的遗漏可作为当前遗漏单列,不与完整历史间隔混淆。 |
| 冷热号 | 选定窗口和位置范围内,各号码的频次或占比排序。 | 先按统一窗口计算每个号码的出现次数,再按相对高低分组或排序。若并列,则保留并列关系,不用号码大小人为打破统计相同。 | “热”只表示近期样本中出现较多,“冷”只表示出现较少;标签会随窗口移动,不表示应当继续出现或必然回补。 |
| 大小单双 | 单个名次号码,或按页面明确指定的和值对象。 | 单双按整数奇偶分类;大小按对应规则版本规定的分界值分类。计算前先确定对象是单号还是和值,二者不共用同一阈值。 | 页面必须显示当前使用的对象与规则口径。若规则版本发生变化,历史期次按其适用口径处理,而非全部套用最新设置。 |
| 龙虎 | 成对比较的两个名次号码,例如前后对称位置形成的一组比较。 | 读取同一期对应位置的号码,按规则页定义的比较方向和大小关系得到龙或虎。每一对位置独立累计次数。 | 比较方向必须固定,不能在不同图表中交换左右位置。缺少任一比较号码时,该组不生成分类值。 |
| 冠亚和 | 同一期第一名与第二名的号码。 | 将冠军号码与亚军号码相加得到单期和值;再根据需要统计和值频次、走势或规则定义的大小单双类别。 | 基础号码任一缺失时不生成和值。和值统计与单个名次统计分别维护,不能把和值当作一个额外名次。 |
| 占比 | 某分类或号码的命中次数与有效样本数。 | 命中次数除以实际参与该指标计算的有效记录数,再按页面显示精度进行四舍五入。底层比较使用未格式化数值。 | 显示百分比之和可能因小数舍入出现轻微视觉差异;分母不包含无法计算该指标的缺失或冲突记录。 |
“最近一段记录”“指定日期”和“自选期次区间”可能包含不同数量的有效样本。比较两个统计结果前,应确认筛选区间、位置范围、状态过滤和数据版本一致。否则,即使指标名称相同,数值也未必可直接比较。
频次、遗漏、冷热和分类占比都是对已收录历史记录的重组。它们适合帮助用户观察分布、对照不同位置和发现数据异常,但不能仅凭过去的高低、连续或间隔推导下一期必然结果。
Correction process
一处名次或号码变化,可能同时影响历史列表、和值、龙虎、频次、遗漏和走势图。因此,异常处理从定位基础记录开始,而不是直接修改某张图表上的结果。只有这样,多个页面才能在重算后重新保持一致。
异常可能来自同一期次的号码不一致、号码数量不完整、时间顺序异常、重复期次或统计值与基础记录无法对应。首先记录问题发生在哪个字段和页面,不直接用推测值填补。
以期次为中心比较现有记录,区分是展示格式问题、采集重复、字段错位,还是确实存在互相冲突的号码序列。在结论形成前,记录可以继续标记为待核验或冲突。
若需要更改期次、时间或号码,应保留原值、修正值、变更字段和修订时间的对应关系。当前查询使用修正后的有效版本,但修订脉络不能因页面刷新而消失。
修正基础记录后,重新生成受影响窗口内的和值、龙虎、频次、遗漏和趋势序列,再检查最新结果、历史记录与统计页面是否指向同一版本。只有统计链完成更新,更正才算结束。