Last Modified: b70d671 on
2026-09-01
本文为发布在zenodo的测量学学术报告的转载和,平易近人化,的版本。也包含了一点整体分析建议。
高考改革关乎民生,而目前恰好2029级高一刚开学,想必很多家长还是很关心,为了避免很多事情被过度贩卖焦虑我们做了这个报告。
完整版本DOI:10.5281/zenodo.22226943 代码与数据仓库:rad:zYrJE5TYBeoGbNj2Ny4quMLGauMw
当然,如果有review发现问题或者测量学系统偏差的话欢迎提出(info@apich.org)我们会尽快修复并发布勘误,也在这里更正并特别致谢。
这里的版本是一个不太谈及方法学过程,主要谈及结论的版本;具体的方法学过程详见原始文章。本研究由开源组织旗下的Lab Apich R&D Lab (Apich Organization Science & Research Team)开展,原始数据引自山东招考院官方网站,数据处理由我们自行进行。注意,以下所提到的一段线、二段线、特控线等均为我们的百分比式估算,具体得看招生计划。
本研究系统实现了 16 项核心数理模型与控制机制:(1) 学龄人口队列递推与教育转化漏斗模型(测定 2029 届参考规模为 74.82 万人);(2) 现行 8 等级制向 2029 新 5 等级制并轨的非线性量表变形映射;(3) 2024 年高校专业选考“物化强绑定”政策断点的多层级分层计量识别;(4) 高分段前 50 名脱敏排位的局域对数极值 Pareto 逆回归与 𝐶^1 平滑连接;(5) 局域多项式近邻选考人次全域恒等守恒律(∑^6_𝑠=1 𝑃𝑠 ≡ 3.0);(6) Fritsch-Carlson 单调保序三次 Hermite 插值多项式(PCHIP)连续化;(7) 7 维学科潜能向量多元正态相依结构标定(𝜽 ∼ 𝒩︀7(𝟎, 𝑹));(8) 选考单科赋分期望中立性定理(𝔼[𝑇𝑠] ≡ 68.32 分);(9) 20 种选科组合信息论最小交叉熵规划(I-Divergence / SLSQP);(10) 考生自选择 Multinomial Logit 与带阻尼(𝜂 =0.70)IPF 影子价格均衡系统;(11) 统考语数外潜能全域法定支持域 [0, 450] 广义 Logistic 映射与微观破并列微扰(𝜎_jitter =0.22 分);(12) 非参数面板分位数弹性回归 𝛽̂(𝑝) 与规模对数正交修正;(13) 历年命题难度冲击的分位数等百分位单调保序包络投影(Π≤0, Π≥0);(14) 法定五级阶梯赋分公式与单科独立取整方差守恒(Var(𝑒elec) = 0.25);(15) 注入宏观考试命题与选科漂移方差(𝜎macro = 3.5 分)的保序回归(PAVA)95% 全域联立置信走廊;(16) 基于全方差定理的 ANOVA 预测总不确定性正交分解(𝜎^2_total = 20.98分2)。
(以上方法学概述防喷用,TL;DR可以不看)
*然后… 其实似乎最好把完整预测数据贴出来,但是太长了而且似乎估计不易读,所以给一些比较有参考价值的数字吧。
历史7年池化平均值,总分均分 433.29分;总分中位数 441.00分;Top 20% 522.00分;Top 44% 457.00分;Top 95% 263.00分;IQR(四分位距) 147.00分;>=600分 23000人左右;>=680 450人左右;>=700 30人左右。(这里的最后几个人数数据我们没仔细算,因为对照意义只有量级上的,再加上还有截断屏蔽之类的)
2029基准(中等难度)下,根据模型计算,总分均分 481.05分;总分中位数 484.00分;Top 20% 558.00分;Top 44% 498.00分;Top 95% 332.00分;IQR(四分位距) 122.00分;>=600分 64139人 8.57%;>=680 2538人;>=700 424人;前1000名691分;前2000名683分;前3000名677分;前4000名672分;前5000名669分;前6000名665分;前7000名662分;前8000名660分;前9000名657分;前10000名655分。(再低的不列了,我们很快会做个静态网站展示更全面的模型预测数据,不需要担心收费或广告我们是做开源的…)
2029基准(高难)下,根据模型计算,总分均分 478.92分;总分中位数 483.00分;Top 20% 553.00分;Top 44% 496.00分;Top 95% 332.00分;IQR(四分位距) 119.00分;>=600分 55070人 7.36%;>=680 1186人;>=700 115人;前1000名681分;前2000名674分;前3000名668分;前4000名664分;前5000名660分;前6000名657分;前7000名654分;前8000名652分;前9000名649分;前10000名647分。
2029基准(平易)下,根据模型计算,总分均分 489.21分;总分中位数 493.00分;Top 20% 565.00分;Top 44% 506.00分;Top 95% 340.00分;IQR(四分位距) 122.00分;>=600分 75893人 10.14%;>=680 3577人;>=700 584人;前1000名694分;前2000名687分;前3000名682分;前4000名674分;前5000名674分;前6000名671分;前7000名668分;前8000名666分;前9000名663分;前10000名661分。
*ANOVA正交分解总方差:
*其他很多数据结果不写了… 到时候他们把网站做出来了再发一下。声明是,这仅限我们自己的分析,还没有经过较多的peer review,欢迎大家对我们的方法学提出质疑并严谨讨论,但是,不欢迎人肉或辱骂等情况。完整版报告也可以看zenodo(doi在开头;https://doi.org/10.5281/zenodo.22226943)。
*以下是我个人“夹带私货”的一些分析:
整体上,考试时间压缩和赋分调整,一是为了向全国统一标准靠拢,二是继续深入反套路降题量。在时间缩短后根据一些不准确的消息和参考别的地方的情况,以及一直以来部委对山东的态度,肯定也会要求把选考科目题量大幅度降低(众所周知山东一直有不少做不完的;以及部委对山东作文模板泛滥的批评和压分要求),但是题目难度不会很降低,每个题区分度梯度只会更陡但是整体分辨率降低。
个人建议是多拓展大学课程,不管是哪一科目。尤其是数学、物理、化学很有必要。我自己是学物理的当然… 这个,不保证不存在主观因素但是整体是这样的。
看模型预测的PDF的话,整体就是原本较平缓的一段消失了,整体曲线右移,最高端升高了。所以,在平常模考时看自己分数也要更多的是以新规下的频率密度来作为参考了,或者是直接看排名。但也要注意,市里排名和省里排名换算也可能会大变,因为题型风格大变,所以… 还是只能估算。
平常模考有压分,可以统一按照难题模式估算。总之,调整好心态,同时放宽松一点顺应国家号召和要求增强对课外的广泛涉猎,少点套路化,在高分段总还是沾光的,虽然不是唯一的路径,但别的路径会越来越困难。(虽然因为社会还是把教育作为阶层跃迁而非智识探索的工具,任何选拔制度还会被异化并搞成机械化套路,但是… 毕竟这是逆上层意志的,以近几年作文的硬性评分标准为例就可以知道还是会不利的。作文的事情不多说。)
*更新: 一个介绍的网站链接:https://ncee.apich.org/ (这个网站本身是ai做的,我们只进行了初步检验;技术栈也不规范不是全栈rust,请见谅主要是为了部署速度没仔细做)
本文为发布在zenodo的测量学学术报告的转载和,平易近人化,的版本。也包含了一点整体分析建议。
高考改革关乎民生,而目前恰好2029级高一刚开学,想必很多家长还是很关心,为了避免很多事情被过度贩卖焦虑我们做了这个报告。
完整版本DOI:10.5281/zenodo.22226943 代码与数据仓库:rad:zYrJE5TYBeoGbNj2Ny4quMLGauMw
当然,如果有review发现问题或者测量学系统偏差的话欢迎提出(info@apich.org)我们会尽快修复并发布勘误,也在这里更正并特别致谢。
这里的版本是一个不太谈及方法学过程,主要谈及结论的版本;具体的方法学过程详见原始文章。本研究由开源组织旗下的Lab Apich R&D Lab (Apich Organization Science & Research Team)开展,原始数据引自山东招考院官方网站,数据处理由我们自行进行。注意,以下所提到的一段线、二段线、特控线等均为我们的百分比式估算,具体得看招生计划。
本研究系统实现了 16 项核心数理模型与控制机制:(1) 学龄人口队列递推与教育转化漏斗模型(测定 2029 届参考规模为 74.82 万人);(2) 现行 8 等级制向 2029 新 5 等级制并轨的非线性量表变形映射;(3) 2024 年高校专业选考“物化强绑定”政策断点的多层级分层计量识别;(4) 高分段前 50 名脱敏排位的局域对数极值 Pareto 逆回归与 𝐶^1 平滑连接;(5) 局域多项式近邻选考人次全域恒等守恒律(∑^6_𝑠=1 𝑃𝑠 ≡ 3.0);(6) Fritsch-Carlson 单调保序三次 Hermite 插值多项式(PCHIP)连续化;(7) 7 维学科潜能向量多元正态相依结构标定(𝜽 ∼ 𝒩︀7(𝟎, 𝑹));(8) 选考单科赋分期望中立性定理(𝔼[𝑇𝑠] ≡ 68.32 分);(9) 20 种选科组合信息论最小交叉熵规划(I-Divergence / SLSQP);(10) 考生自选择 Multinomial Logit 与带阻尼(𝜂 =0.70)IPF 影子价格均衡系统;(11) 统考语数外潜能全域法定支持域 [0, 450] 广义 Logistic 映射与微观破并列微扰(𝜎_jitter =0.22 分);(12) 非参数面板分位数弹性回归 𝛽̂(𝑝) 与规模对数正交修正;(13) 历年命题难度冲击的分位数等百分位单调保序包络投影(Π≤0, Π≥0);(14) 法定五级阶梯赋分公式与单科独立取整方差守恒(Var(𝑒elec) = 0.25);(15) 注入宏观考试命题与选科漂移方差(𝜎macro = 3.5 分)的保序回归(PAVA)95% 全域联立置信走廊;(16) 基于全方差定理的 ANOVA 预测总不确定性正交分解(𝜎^2_total = 20.98分2)。
(以上方法学概述防喷用,TL;DR可以不看)
*然后… 其实似乎最好把完整预测数据贴出来,但是太长了而且似乎估计不易读,所以给一些比较有参考价值的数字吧。
历史7年池化平均值,总分均分 433.29分;总分中位数 441.00分;Top 20% 522.00分;Top 44% 457.00分;Top 95% 263.00分;IQR(四分位距) 147.00分;>=600分 23000人左右;>=680 450人左右;>=700 30人左右。(这里的最后几个人数数据我们没仔细算,因为对照意义只有量级上的,再加上还有截断屏蔽之类的)
2029基准(中等难度)下,根据模型计算,总分均分 481.05分;总分中位数 484.00分;Top 20% 558.00分;Top 44% 498.00分;Top 95% 332.00分;IQR(四分位距) 122.00分;>=600分 64139人 8.57%;>=680 2538人;>=700 424人;前1000名691分;前2000名683分;前3000名677分;前4000名672分;前5000名669分;前6000名665分;前7000名662分;前8000名660分;前9000名657分;前10000名655分。(再低的不列了,我们很快会做个静态网站展示更全面的模型预测数据,不需要担心收费或广告我们是做开源的…)
2029基准(高难)下,根据模型计算,总分均分 478.92分;总分中位数 483.00分;Top 20% 553.00分;Top 44% 496.00分;Top 95% 332.00分;IQR(四分位距) 119.00分;>=600分 55070人 7.36%;>=680 1186人;>=700 115人;前1000名681分;前2000名674分;前3000名668分;前4000名664分;前5000名660分;前6000名657分;前7000名654分;前8000名652分;前9000名649分;前10000名647分。
2029基准(平易)下,根据模型计算,总分均分 489.21分;总分中位数 493.00分;Top 20% 565.00分;Top 44% 506.00分;Top 95% 340.00分;IQR(四分位距) 122.00分;>=600分 75893人 10.14%;>=680 3577人;>=700 584人;前1000名694分;前2000名687分;前3000名682分;前4000名674分;前5000名674分;前6000名671分;前7000名668分;前8000名666分;前9000名663分;前10000名661分。
*ANOVA正交分解总方差:
*其他很多数据结果不写了… 到时候他们把网站做出来了再发一下。声明是,这仅限我们自己的分析,还没有经过较多的peer review,欢迎大家对我们的方法学提出质疑并严谨讨论,但是,不欢迎人肉或辱骂等情况。完整版报告也可以看zenodo(doi在开头;https://doi.org/10.5281/zenodo.22226943)。
*以下是我个人“夹带私货”的一些分析:
整体上,考试时间压缩和赋分调整,一是为了向全国统一标准靠拢,二是继续深入反套路降题量。在时间缩短后根据一些不准确的消息和参考别的地方的情况,以及一直以来部委对山东的态度,肯定也会要求把选考科目题量大幅度降低(众所周知山东一直有不少做不完的;以及部委对山东作文模板泛滥的批评和压分要求),但是题目难度不会很降低,每个题区分度梯度只会更陡但是整体分辨率降低。
个人建议是多拓展大学课程,不管是哪一科目。尤其是数学、物理、化学很有必要。我自己是学物理的当然… 这个,不保证不存在主观因素但是整体是这样的。
看模型预测的PDF的话,整体就是原本较平缓的一段消失了,整体曲线右移,最高端升高了。所以,在平常模考时看自己分数也要更多的是以新规下的频率密度来作为参考了,或者是直接看排名。但也要注意,市里排名和省里排名换算也可能会大变,因为题型风格大变,所以… 还是只能估算。
平常模考有压分,可以统一按照难题模式估算。总之,调整好心态,同时放宽松一点顺应国家号召和要求增强对课外的广泛涉猎,少点套路化,在高分段总还是沾光的,虽然不是唯一的路径,但别的路径会越来越困难。(虽然因为社会还是把教育作为阶层跃迁而非智识探索的工具,任何选拔制度还会被异化并搞成机械化套路,但是… 毕竟这是逆上层意志的,以近几年作文的硬性评分标准为例就可以知道还是会不利的。作文的事情不多说。)
*更新: 一个介绍的网站链接:https://ncee.apich.org/ (这个网站本身是ai做的,我们只进行了初步检验;技术栈也不规范不是全栈rust,请见谅主要是为了部署速度没仔细做)