独立研究计划框架正在接受审阅
02 / 方法与可证伪性

每项主张都必须可追溯、可检验、可修订。

文明科学区分定义、观察、模型、解释和规范性建议。任何公式或指标都不能仅因为形式优美就被视为有效。

方法论状态

稳定性方程及相关构念是开放研究框架中的工作假设,尚未被验证为普适科学定律。研究计划只能通过透明证据、批评、重复验证和修订向前发展。

01

从概念到纠错

每项研究主张都应经过一条有记录的研究链。完成这条链并不等于证明主张成立,而是使其可以审查、重复并被否定。

01

概念操作化

把抽象概念转化为可观察构念、分析单位、测量尺度和边界条件。

02

变量定义

明确符号、作用方向、分析层级、时间窗口和合理的替代解释。

03

数据来源

记录来源、采集方法、许可、覆盖范围、排除项、偏差和修订历史。

04

指标构建

公开变换、标准化、权重、聚合、缺失值规则和不确定性。

05

多智能体仿真

使智能体规则、网络拓扑、参数、随机种子和输出指标可重复。

06

历史回测

在过去时间截点冻结模型,只使用当时能够获得的信息进行检验。

07

比较案例

明确案例选择规则,并纳入困难案例、负面案例和反证案例。

08

敏感性分析

在合理范围内改变假设、参数、权重、滞后期、阈值和数据处理方式。

09

模型验证

分别检验构念、测量、内部、外部、预测和决策有效性。

10

同行评议

邀请相关学科、统计、计算、历史、区域和伦理专家审阅。

11

勘误与版本管理

公开勘误、保留旧版本,并记录重大变更及其对结论的影响。

12

可证伪声明

预先说明哪些观察会削弱、限定、否定或替代研究命题。

02

工作构念与变量定义

稳定性表达式是一种研究架构。每个变量都必须通过多个可观察指标估计,任何单一代理指标都不能被等同于构念本身。

研究协议工作假设:S = (C × Lₑ × Eₙ) / E

乘法形式、作用方向、函数形式、滞后、交互与尺度依赖都属于可检验假设,不是既定事实。

符号工作构念可能的观测指标必要限制
S文明稳定性关键功能连续性、恢复时间、制度可靠性、暴力与流离失所、适应能力必须说明系统、人口、时间范围和可接受权衡;稳定不等于道德正当性。
C合作结构网络连通性、集体行动完成度、制度协同、互惠、冲突解决表现必须区分自愿合作、强制服从和不平等攫取。
Lₑ信任场人际与制度信任、预期可靠性、验证成本、信息可信度问卷信任、行为信任和制度可靠性相关但不可互换。
Eₙ有效能量可用于适应的物质、金融、信息、组织和技术能力测量可获得并可转化的能力,而非资源存量总额;应考虑分配和转换损耗。
E文明熵协同损耗、制度摩擦、腐败、信息失序、碎片化和不可逆浪费除非给出形式化度量和守恒逻辑,否则“熵”只能作为操作性类比。
03

数据来源与可追溯性

研究结果的可审计程度取决于证据链。每项观测都应保留机器可读的来源记录和人类可读的局限说明。

01

官方与行政数据

人口普查、财政、卫生、教育、司法、基础设施、贸易、冲突和制度记录。

02

调查与追踪面板

对信任、预期、行为、福祉、合法性和合作的重复测量。

03

历史与事件数据

档案、同时代记录、年代资料、编码事件、制度史和案例重建。

04

环境与数字痕迹

在符合法律与伦理的条件下使用遥感、气候生态观测、流动、网络、通信和开放平台数据。

04

指标构建

复合指标只有在构建过程透明、且结论能够经受合理替代方案时才有价值。

01

定义

把每个指标连接到明确构念和因果理由。

02

检查

报告分布、覆盖、缺失、异常值、结构断点和测量不变性。

03

标准化

说明方向、基准、缩尾、标准化方法和有界值处理。

04

赋权

优先采用理论或证据支持的权重,同时公布等权和替代权重结果。

05

聚合

视需要检验加法、乘法、阈值和不可补偿形式。

06

不确定性

把抽样、测量、插补、参数和模型不确定性传递到结果中。

任何排名、预警分值或复合指数,都不应在缺少分项值、不确定性、敏感性结果以及数据质量差异导致的不可比性声明时发布。
05

多智能体仿真、历史回测与比较案例

01

多智能体仿真

明确智能体类型、状态、激励、信息、学习、交互规则、网络拓扑、冲击、制度约束、终止条件和结果指标。在法律与条件允许时,公开代码、配置、随机种子、校准目标和重复运行分布。

02

历史回测

采用滚动或固定历史截点,防止未来数据泄漏;检验前定义事件和预测窗口;与简单基线比较;报告误报、漏报、校准度、提前量和性能衰减。

03

比较案例

按照明确规则而非预期结论选择案例。结合最相似、最不同、典型、偏离、负面和边界案例。保留历史语境,不用编码观测替代对一手史料的解释。

06

敏感性分析与模型验证

模型验证具有多个维度。一个模型可能较好测量了构念,却不具备预测、外推或支持决策的能力。

01

构念有效性

指标是否代表预定概念,而非仅仅反映便利性、可见性或制度偏差?

02

测量有效性

观测在不同来源、语言、地区、时期和群体中是否可靠?

03

内部有效性

关联能否经受混杂、反向因果、选择偏差和替代设定检验?

04

外部有效性

发现能否推广到校准案例和条件以外?

05

预测有效性

预注册的样本外表现是否以良好校准超过透明基线?

06

决策有效性

拟议用途能否改善结果,并避免不可接受的伤害、权利侵犯与分配失败?

必要敏感性检验
参数与权重扫描替代性操作定义滞后与时间窗口变化缺失值与异常值处理网络拓扑与智能体规则变化安慰剂结果与负向对照逐一排除案例与亚组分析蒙特卡洛与不确定性传播
07

同行评议、勘误与版本管理

学术可信度来自可见的纠错机制,而不是营造从不出错的形象。

01

权威之前先审阅

预印本、研究协议、数据集、代码和重大主张应接受相关专家审阅,并披露利益冲突与审阅范围。

02

可重复记录

在许可范围内归档数据字典、代码、运行环境、随机种子、模型卡、研究协议、分析计划和输出校验值。

03

勘误分类

区分轻微勘误、分析修正、重大修订、撤回和被替代模型;不得静默替换会影响结论的结果。

04

语义版本

主版本:构念或结论改变;次版本:兼容的方法或数据增加;修订版本:不改变结论的事实、排版或实现修正。

08

可证伪声明

核心方程及相关指标均为工作假设。当透明检验失败时,应当削弱、限定、否定或替代相应主张。

F1

方向性失败

若预注册且测量充分的研究在既定条件下反复未发现 C、Lₑ、Eₙ、E 与 S 的预期关系,或稳定发现相反关系,相应方向性主张必须修订或否定。

F2

预测失败

若模型在独立样本外检验中不能超过简单透明的基线,就不应被宣传为预测或早期预警的改进。

F3

缺乏稳健性

若结论依赖单一代理指标、权重、案例、阈值、时间窗口或未公开的数据处理,并在合理替代方案下消失,则主张不具稳健性。

F4

无法推广

若效应不能在预注册的人群、时期或系统类型之间迁移,应缩小适用范围,而不是宣称普适。

F5

因果失败

当实验、准实验、纵向或过程证据支持可信的竞争解释时,不得把相关关系描述为因果。

F6

决策失败

若模型指导的干预没有收益,或产生不可接受的伤害、不平等、强制或权利侵犯,即使描述拟合仍然存在,也必须撤回决策性主张。

任何著作、网站、仿真、方程、作者或机构都不能使一个命题免于这些检验条件。证据高于框架。