数见成长 · 1–6 年级数学能力评估

我们看的不只是一道题
有没有做对

更关心孩子在适龄任务中如何读懂信息、建立数学关系、维持计算,并留下可复核的作答过程数据。

测评按具体年级选择 6–9 项任务:先完成六步预检,再按“说明—示范—练习—正式”进行。完成后只提供本次任务的描述性结果,不提供常模排名或诊断结论。

6 / 9 项低年段 / 中高年段
约 20–30 分钟1–3 年级 20–25 分钟
服务器记录正式模式经同意后自动保存
理论框架 · ASSESSMENT MODEL1–6 年级分层试测

数学能力推理架构

五核二环模型

5 × 2
  1. 01数感
  2. 02几何模型化
  3. 03语义映射
  4. 04运算稳定性
  5. 05数学元认知
1 · 数学特异性执行功能2 · 数学学习可塑性

五核描述数学任务中的关键能力结构,二环解释短期执行条件与长期学习改变;现版只覆盖其中一部分任务证据。

五核 · 数学能力结构

不只看答案,还看能力结构

科研修订版把数感、几何模型化、语义映射、运算稳定性和数学元认知作为五个相互关联的核心。网站同时标注现版的直接任务、受限代理和尚待补齐之处。

01部分覆盖

数量—度量—抽象体系

数感

理解数量大小、度量关系和数的结构,并能从具体数量逐步进入符号、数轴、分数等抽象体系。

当前任务直接涉及数量识别、数字大小、数轴和分数,但尚未完整覆盖度量单位、比例迁移与代数化适应,因此不能把这些任务合成为经验证的“数感总分”。

02部分覆盖

翻转、拼补与空间建模

几何模型化

把图形、方向、位置和空间关系组织成可操作的内部或外部模型,并通过翻转、拼补等操作识别结构。

当前只有数轴的一维数量—空间映射,没有独立的翻转、拼补、心理旋转、面积、体积或几何建模任务,不能视为完整的几何模型化测量。

03部分覆盖

把题干转换成算法

语义映射

从题干和现实材料中筛选数学信息,把语言关系转换为数量关系、运算步骤或可检验的数学模型。

情境题直接涉及信息筛选、建模、运用和解释,但当前多为选择题,没有直接记录儿童列式、图示或算法形成过程,因此只覆盖语义映射的一部分。

04直接覆盖

流畅运算并持续推进

运算稳定性

在基础运算和连续步骤中保持准确、流畅与持续推进,并减少中间结果断裂和累计错误。

180 秒运算流畅性、乘法结构和链式心算是当前最直接的任务证据;结果仍只描述本次作答,不能换算为常模化能力等级。

05间接线索

复述、草稿与认知卸载

数学元认知

觉察和调节自己的数学思考,通过复述、草稿、标记、检查点或外部表征管理条件、步骤与中间量。

当前没有独立的口述、草稿、辅助线、检查或认知卸载任务;链式心算只提供间接线索,不能据此形成数学元认知结论。

二环 · 执行条件与学习改变

一次作答与长期改变,需要分开解释

数学特异性执行功能解释短期规则维持、切换和错误恢复;数学学习可塑性关注训练后的改变、迁移和复测。二环是研究解释层,不是给孩子贴标签。

01

环一:数学特异性执行功能

解释数学任务中短期规则的理解、维持与切换,以及受干扰后继续推进和从错误中恢复的条件。

当前没有完整的数学特异性规则切换、更新和错误恢复任务;Flanker 也只是领域一般组级基线,不能输出个体执行功能诊断。
02

环二:数学学习可塑性

解释经过标准化教学或训练后,表现是否发生稳定改变,能否迁移到新题或新体系,并在复测中保持。

现版没有标准化短教学、近迁移和平行复测;练习答错后的重试只用于确认理解规则,不能解释为学习潜力或可塑性。

按年级 6–9 项 · 低年段约 20–25 分钟 · 中高年段约 30 分钟

从数感到学习反应,每一项都有明确作用

下方是两套协议的联合任务地图。低年段进入 6 项适龄任务,中高年段进入 9 项任务;情境题受 PISA 数学素养框架启发,但不是 PISA 等值测验。

  1. 011–6 年级 · 约 1–2 分钟

    数学学习感受

    1–3 年级 2 题;4–6 年级 3 题(另有 1 道练习)

    了解孩子在数学任务中的主观感受,为解释当次作答提供背景;项目没有对错,也不进入数学能力得分。

    这是描述性背景变量,不是焦虑量表,也不构成情绪、能力或可塑性诊断。

  2. 021–6 年级 · 正式限时 180 秒

    运算流畅性

    180 秒适龄题池;题数随作答速度变化

    在连续的适龄运算中记录答对数与反应时。一年级使用加减法,2–6 年级按协议进入加、减、乘、除。

    运算稳定性数学特异性执行功能

    主要结果是 180 秒内的答对数与作答过程,不以完成固定题量为目标。

  3. 031–3 年级 · 约 2–3 分钟

    快速数量识别

    2 道练习 + 8 道正式题

    快速判断短暂呈现点阵中的数量,记录正确率与反应时,避免用尚未学习的分数知识代替低年段数感观察。

    数感

    低年段数量识别与中高年段分数比较使用不同任务,原始分不能直接互相比较。

  4. 044–6 年级 · 约 2 分钟

    数字大小比较

    2 道练习 + 6 道正式题

    快速判断两个符号数字中哪一个更大,观察不同数位和数值距离条件下的数量大小判断。

    数感

    条件差异需在样本层面分析,不能用少量题目的个体差异即时贴标签。

  5. 054–6 年级 · 约 3 分钟

    数轴位置估计

    2 道练习 + 6 道正式题

    把整数或分数映射到数轴位置,记录点击位置、调整次数与百分绝对误差(PAE)。

    数感几何模型化

    只覆盖一维数量—空间映射,不能代表完整的几何模型化能力。

  6. 061–6 年级 · 约 4–6 分钟

    生活情境数学任务

    2 道练习 + 6 道正式题;基础、进阶、挑战分层

    多个问题共享真实生活材料,结合价格、时间、路线或统计信息,观察信息筛选、数学建模、运用、解释与决策。

    语义映射数学特异性执行功能

    任务受 PISA 数学素养框架启发,但为面向小学生的自建题,不是 PISA 官方试题、量尺或等值测验。

  7. 074–6 年级 · 约 2 分钟

    乘法结构识别

    2 道练习 + 4 道正式题

    从四个选项中识别与目标数相等的乘法算式,观察乘法事实提取和整数结构理解。

    数感运算稳定性

    题量较少,需结合反应时与其他任务解释,不能单独形成能力诊断。

  8. 081–6 年级 · 约 3–4 分钟

    链式心算

    2 道练习;1 年级 2 道正式题,2–6 年级 4 道正式题

    逐步呈现数字和运算,要求在头脑中保持并更新中间结果,最后输入答案。

    运算稳定性数学元认知数学特异性执行功能

    任务直接观察连续运算;对数学元认知仅提供间接负荷线索,不含分级提示或学习斜率测量。

  9. 091–6 年级 · 约 1–2 分钟

    方向选择任务(Flanker)

    2 道练习 + 4 个正式试次

    快速判断中间箭头方向,在一致和不一致条件下记录正确率与反应时,提供领域一般抑制背景。

    数学特异性执行功能

    仅作为组级领域一般背景变量;4 个正式试次不足以支持稳定的个体抑制差异解释。

  10. 104–6 年级 · 约 2–3 分钟

    分数大小比较

    2 道练习 + 6 道正式题

    判断两个分数中哪一个更大,题目包含基础、进阶和挑战难度,记录正确率与反应时。

    数感

    当前仅描述本次六道题的表现,不输出分数策略类型、提示学习斜率或常模化能力等级。

测评流程 · 预检、理解、作答与确认

一次测评,四个清楚阶段

页面会显示当前任务、整体进度、模块进度和已完成任务数。计时、固定随机种子与过程数据在后台记录,不增加学生的操作负担。

  1. 01

    先完成六步预检

    欢迎说明、年级选择、匿名编号、设备浏览器、数据保存与隐私、任务总览。正式测评必须完成非商业学术研究知情同意;快速预览不写入服务器。

  2. 02

    说明、示范、练习、正式分开

    每个任务先说明操作,展示静态或动态示范,再完成 1–3 道练习并确认理解。练习记录与正式结果分开。

  3. 03

    分阶段休息,意外后真正续测

    任务阶段间会提示休息;正式作答和检查点由研究服务器自动保存。刷新或意外关闭后,可从已成功写入的未完成记录继续,已提交的正式题不会重复。

  4. 04

    完成后确认描述性结果与数据去向

    完成页只展示原始正确数、正确率、平均反应时、超时/跳过与数据完整性。正式记录已由服务器保存;JSON 和 CSV 只在使用者主动点击时下载。

开始前的 30 秒检查

桌面浏览器、实体键盘、稳定的全屏环境

  • Chrome 或 Edge 桌面版
  • F / J、方向键、数字键可用
  • 仅填写可选匿名研究编号,不填姓名
  • 正式测评经知情同意后由服务器自动保存
  • 匿名研究编号不得填写姓名、学号、邮箱或学校
  • 快速预览只在当前页面内存中运行,不写入服务器

报告样例 · 版式与信息组织参考

24 页 A3 匿名历史报告样例

这份文件是“匿名历史样例”,只展示长报告的版式、章节和图表结构。它“非当前网页自动生成”,也“不代表当前被试结果”。

该历史样例采用早期报告框架,与当前五核二环理论不等同,仅作版式、章节和图表结构参考。

  • 24 页 A3 完整结构包含封面、报告导航、质量说明、维度剖面、综合解读、建议与参考文献。
  • 图表与解释并置把关键指标、能力图谱、原始表现和文字解读放在相邻阅读路径中。
  • 只作版式样例当前网站只采集并导出分年级任务数据,不会测完后自动生成这份报告。
查看 24 页报告样例
匿名历史样例 · 24 页 A3 · 非当前网页输出
数学核心能力多维评估报告匿名样例封面查看报告落地页
版式、章节与图表结构参考当前分年级网页测评不会自动生成该报告。

适用边界 · 诚实是可用性的一部分

现在能做什么,还不能做什么

请分开理解四件事:“五核二环”是当前理论框架;分年级页面列出的是现版实际任务;覆盖标注只说明可观察证据;常模、IRT 参数、完整效度证据、诊断切点和个体化矫正效果仍未验证。

使用范围

理论框架不等于已验证量表

“五核二环”用于组织理论解释、当前任务证据与后续研究假设;当前网页只覆盖其中一部分可观察表现。覆盖标注不代表模型已被现版任务完整验证,也不能在一次作答后给出个体瓶颈、风险或矫正处方。

当前缺口

尚未建立分年级常模与诊断切点

1–3 年级与 4–6 年级协议都尚未建立常模、IRT 参数或诊断切点。在完成真实样本的信度、效度、测量等值性与纵向验证前,不展示百分位、排名、标准分、风险等级或“超过同龄人多少”等结论。

使用范围

结果只描述本次任务表现

完成页可展示原始正确数、正确率、平均反应时、超时与跳过情况及数据完整性。当前结果不属于常模参照评价,也不能单独用于诊断数学学习困难或数学学习障碍。

解释原则

正式数据由研究服务器保存

正式测评只有在明确知情同意后才会开始,作答和检查点由研究服务器自动保存;服务器未确认写入时测评会暂停,不会改存浏览器。快速预览只使用当前页面内存,刷新或关闭即消失。

解释原则

不收集姓名,只使用匿名编号

基本信息只保留具体年级和可选研究编号;编号留空时由网页自动生成。不要在研究编号中填写姓名、学号、联系方式或其他可直接识别个人的信息。

当前缺口

情境题不是 PISA 等值测验

生活情境任务仅参考 PISA 数学素养框架的情境、过程与内容组织方式;题目为面向小学生的自建任务,不能换算、对标或解释为 PISA 分数。

当前缺口

几何模型化尚非独立完整测量

当前数轴任务只提供一维数量—空间映射的受限代理证据;翻转、拼补、心理旋转、面积、体积和完整空间建模仍需独立任务补齐。

当前缺口

数学元认知尚非独立完整测量

现版没有独立口述、草稿、辅助线、检查或认知卸载任务;修改、跳过、失焦和链式心算表现也不能单独用来推断儿童的元认知策略。

解释原则

Flanker 不是数学特异性执行功能诊断

4 个正式 Flanker 试次只提供领域一般的组级背景基线。当前尚无完整的数学规则维持、切换、更新和错误恢复测量,不输出个体执行功能结论。

解释原则

数学学习可塑性尚未直接测量

现版没有标准化短教学、近迁移和平行复测;练习答错后的再次尝试只用于确认理解规则,不能解释为学习潜力、训练效果或稳定学习斜率。

使用范围

报告仅为早期框架的匿名历史样例

24 页 A3 文件采用早期报告框架,与当前五核二环理论不等同;它只用于展示版式、章节和图表结构,非当前网页自动生成,也不代表当前被试结果。

解释原则

单项时长为体验估时

1–3 年级 6 项协议预计约 20–25 分钟,4–6 年级 9 项协议预计约 30 分钟;实际时长会随阅读、作答速度与休息选择而变化。

准备好了吗?

从一次边界清楚的数学专项测评开始

当前结果仅用于描述本次任务表现,不属于常模参照评价,也不能单独用于诊断数学学习困难或数学学习障碍。

开始测评