跳转到内容

基准测试方法

请针对你准备变更的具体集成和工作负载进行基准测量。2026 年 7 月的历史基准测试记录属于历史佐证,不能作为当前版本的延迟承诺。

工具适用场景局限性
pnpm bench:unit独立的 LaTeX 预处理微基准测试不测量渲染、布局或跨文档协调开销
Storybook 对比用例分析解析阶段与 React 提交计算工作归属开发模式下的测量数据不能作为生产环境延迟指标
pnpm bench:web生产环境浏览器集成、帧间隔、长任务以及 DOM/视口行为当前应用覆盖 React、Mantine 以及 React 文本控件;不能直接推导 Vue 性能表现

在运行浏览器基准测试套件之前,先构建工作区相关包:

终端窗口
pnpm build
pnpm bench:web:selftest
pnpm bench:web --app react-core --scenario code-dense --repeats 5

自检步骤用于验证测量工具本身能够对注入的工作负载做出响应,它并非代码库的执行速度阈值。测试结果输出到被 Git 忽略的 benchmarks/results/ 目录下。有关测试场景选择、对比命令、超时时间及调度默认值,请参阅浏览器测试套件指南

切勿根据仅提供均匀节奏源数据更新的场景来推断平滑展现的性能表现。必须核验该场景实际执行了哪个控制器、哪条协调路径以及哪些展现功能特性。

首先明确需要验证的核心问题。对于增量解析器的改动,应在完全相同的插件选择和输入快照下,对比 parse 和 transform 阶段的耗时。对于自定义渲染器或代码高亮相关的改动,应使用生产构建的浏览器应用,并包含与真实应用完全相同的 CSS 和 Context 提供者。对于跨片段协调引用,测试应包含多个挂载的片段以及定义变更;单机独立测试的数值无法用于估算注册表的状态广播开销。

在记录测试结果时,请一并记录对应的 Git 提交、相关包版本、浏览器、设备、构建模式、测试载荷、投递调度策略以及重复运行次数。在计时的同时,必须保留正确性验证。仅在等价性测试框架确实需要时才对生成的文档前缀进行规范化;切勿仅仅为了让对比测试通过而抹去有意义的 href、缺失的页脚或重新排序的节点。

针对每个场景,对比改动前后的自身数据。报告中位数值或带有离散度区间的多次运行结果,明确指出出现的超时情况,并将冷启动开销与稳态流式传输开销区分开来。当语法高亮或浏览器布局成为主要开销时,解析器的大幅相对节省可能会与较小的端到端整体改善并存;这是非常有价值的归因分析结论,而不是矛盾现象。