概念操作化
把抽象概念转化为可观察构念、分析单位、测量尺度和边界条件。
文明科学区分定义、观察、模型、解释和规范性建议。任何公式或指标都不能仅因为形式优美就被视为有效。
稳定性方程及相关构念是开放研究框架中的工作假设,尚未被验证为普适科学定律。研究计划只能通过透明证据、批评、重复验证和修订向前发展。
每项研究主张都应经过一条有记录的研究链。完成这条链并不等于证明主张成立,而是使其可以审查、重复并被否定。
把抽象概念转化为可观察构念、分析单位、测量尺度和边界条件。
明确符号、作用方向、分析层级、时间窗口和合理的替代解释。
记录来源、采集方法、许可、覆盖范围、排除项、偏差和修订历史。
公开变换、标准化、权重、聚合、缺失值规则和不确定性。
使智能体规则、网络拓扑、参数、随机种子和输出指标可重复。
在过去时间截点冻结模型,只使用当时能够获得的信息进行检验。
明确案例选择规则,并纳入困难案例、负面案例和反证案例。
在合理范围内改变假设、参数、权重、滞后期、阈值和数据处理方式。
分别检验构念、测量、内部、外部、预测和决策有效性。
邀请相关学科、统计、计算、历史、区域和伦理专家审阅。
公开勘误、保留旧版本,并记录重大变更及其对结论的影响。
预先说明哪些观察会削弱、限定、否定或替代研究命题。
稳定性表达式是一种研究架构。每个变量都必须通过多个可观察指标估计,任何单一代理指标都不能被等同于构念本身。
乘法形式、作用方向、函数形式、滞后、交互与尺度依赖都属于可检验假设,不是既定事实。
| 符号 | 工作构念 | 可能的观测指标 | 必要限制 |
|---|---|---|---|
| S | 文明稳定性 | 关键功能连续性、恢复时间、制度可靠性、暴力与流离失所、适应能力 | 必须说明系统、人口、时间范围和可接受权衡;稳定不等于道德正当性。 |
| C | 合作结构 | 网络连通性、集体行动完成度、制度协同、互惠、冲突解决表现 | 必须区分自愿合作、强制服从和不平等攫取。 |
| Lₑ | 信任场 | 人际与制度信任、预期可靠性、验证成本、信息可信度 | 问卷信任、行为信任和制度可靠性相关但不可互换。 |
| Eₙ | 有效能量 | 可用于适应的物质、金融、信息、组织和技术能力 | 测量可获得并可转化的能力,而非资源存量总额;应考虑分配和转换损耗。 |
| E | 文明熵 | 协同损耗、制度摩擦、腐败、信息失序、碎片化和不可逆浪费 | 除非给出形式化度量和守恒逻辑,否则“熵”只能作为操作性类比。 |
研究结果的可审计程度取决于证据链。每项观测都应保留机器可读的来源记录和人类可读的局限说明。
人口普查、财政、卫生、教育、司法、基础设施、贸易、冲突和制度记录。
对信任、预期、行为、福祉、合法性和合作的重复测量。
档案、同时代记录、年代资料、编码事件、制度史和案例重建。
在符合法律与伦理的条件下使用遥感、气候生态观测、流动、网络、通信和开放平台数据。
复合指标只有在构建过程透明、且结论能够经受合理替代方案时才有价值。
把每个指标连接到明确构念和因果理由。
报告分布、覆盖、缺失、异常值、结构断点和测量不变性。
说明方向、基准、缩尾、标准化方法和有界值处理。
优先采用理论或证据支持的权重,同时公布等权和替代权重结果。
视需要检验加法、乘法、阈值和不可补偿形式。
把抽样、测量、插补、参数和模型不确定性传递到结果中。
明确智能体类型、状态、激励、信息、学习、交互规则、网络拓扑、冲击、制度约束、终止条件和结果指标。在法律与条件允许时,公开代码、配置、随机种子、校准目标和重复运行分布。
采用滚动或固定历史截点,防止未来数据泄漏;检验前定义事件和预测窗口;与简单基线比较;报告误报、漏报、校准度、提前量和性能衰减。
按照明确规则而非预期结论选择案例。结合最相似、最不同、典型、偏离、负面和边界案例。保留历史语境,不用编码观测替代对一手史料的解释。
模型验证具有多个维度。一个模型可能较好测量了构念,却不具备预测、外推或支持决策的能力。
指标是否代表预定概念,而非仅仅反映便利性、可见性或制度偏差?
观测在不同来源、语言、地区、时期和群体中是否可靠?
关联能否经受混杂、反向因果、选择偏差和替代设定检验?
发现能否推广到校准案例和条件以外?
预注册的样本外表现是否以良好校准超过透明基线?
拟议用途能否改善结果,并避免不可接受的伤害、权利侵犯与分配失败?
学术可信度来自可见的纠错机制,而不是营造从不出错的形象。
预印本、研究协议、数据集、代码和重大主张应接受相关专家审阅,并披露利益冲突与审阅范围。
在许可范围内归档数据字典、代码、运行环境、随机种子、模型卡、研究协议、分析计划和输出校验值。
区分轻微勘误、分析修正、重大修订、撤回和被替代模型;不得静默替换会影响结论的结果。
主版本:构念或结论改变;次版本:兼容的方法或数据增加;修订版本:不改变结论的事实、排版或实现修正。
核心方程及相关指标均为工作假设。当透明检验失败时,应当削弱、限定、否定或替代相应主张。
若预注册且测量充分的研究在既定条件下反复未发现 C、Lₑ、Eₙ、E 与 S 的预期关系,或稳定发现相反关系,相应方向性主张必须修订或否定。
若模型在独立样本外检验中不能超过简单透明的基线,就不应被宣传为预测或早期预警的改进。
若结论依赖单一代理指标、权重、案例、阈值、时间窗口或未公开的数据处理,并在合理替代方案下消失,则主张不具稳健性。
若效应不能在预注册的人群、时期或系统类型之间迁移,应缩小适用范围,而不是宣称普适。
当实验、准实验、纵向或过程证据支持可信的竞争解释时,不得把相关关系描述为因果。
若模型指导的干预没有收益,或产生不可接受的伤害、不平等、强制或权利侵犯,即使描述拟合仍然存在,也必须撤回决策性主张。