本次要看的项目是一篇量子化学计算方向的基准测试研究主题是Spin audit of SQD/QSCI quantum-chemistry benchmarks on iron–sulfur clusters铁硫簇上 SQD/QSCI 量子化学基准测试的自旋审计。先给结论这不是一个拿来就能跑的“一键部署工具”而是一篇带有方法验证性质的量子化学基准研究。它的价值在于回答一个很实际的问题——量子化学模拟里常用的 SQDSparse Quantum State Detection稀疏量子态检测和 QSCIQuantum State Chemistry Imputation量子态化学插补这两类方法在铁硫簇这种强关联体系上做基准测试时算出来的自旋期望值到底对不对、有没有系统性偏差。对做量子计算、量子化学模拟、理论化学计算的人来说这篇文章可以直接作为方法选型和误差分析的参考材料。对只想找现成部署包的人这篇文章的意义更多是“帮你判断这类方法是否值得进入你的技术栈”。下面我会从研究背景、方法原理、基准测试设计、自旋审计逻辑、验证流程、误差分析、适用边界、复现排查、实践建议几个维度展开。中间会给出通用的测试脚本、数据检查方式和排查清单方便你在自己的计算环境里做类似验证。1. 核心能力速览先把这篇研究的“硬信息”整理出来。能力项说明项目类型量子化学基准测试与方法审计研究研究对象铁硫簇iron–sulfur clusters核心方法SQD稀疏量子态检测、QSCI量子态化学插补核心问题自旋期望值审计、基准测试误差分析主要功能对比 SQD/QSCI 在铁硫簇上的能量、自旋、布居数等量子化学性质适用硬件理论分析为主可在经典计算环境模拟量子电路实际量子硬件需按资源评估显存占用不适用非 GPU 推理类项目支持平台论文/基准测试框架具体实现需查阅原文与配套代码启动方式非一键启动类项目需按计算环境配置量子化学软件栈是否支持 API未提供通用 API是否支持批量任务基准测试本身含多体系、多样本测试逻辑可扩展为批量计算任务适合读者量子计算、量子化学、理论化学、计算化学方向研究者和工程师这里有两点需要明确本材料没有给出具体版本号、显存占用、启动脚本和 API 细节所以这些参数我不会编造。铁硫簇是自然界中广泛存在的金属蛋白活性中心比如铁氧还蛋白、固氮酶、氢化酶它们在电子传递、催化、能量转换中起核心作用。这类体系电子结构复杂强关联效应明显是量子化学方法验证的“硬骨头”。2. SQD 与 QSCI 是什么为什么要做“自旋审计”这一节先把方法背景讲清楚否则后面谈基准测试没有根基。2.1 量子化学中为什么要引入量子计算方法传统量子化学方法比如 DFT密度泛函理论、CCSD(T)耦合簇、CASSCF完全活性空间自洽场在中小分子上已经足够成熟。但铁硫簇这类体系有几个特点含有多个过渡金属原子d 电子数量多。自旋态密集不同自旋多重度之间能量差很小。强关联效应显著单参考态方法容易失效。活性空间规模大传统精确对角化方法计算量随体系尺寸指数增长。这些问题让量子计算成为一个潜在的突破口。量子计算机天然适合处理多体量子态的演化理论上可以在多项式时间内完成某些经典计算机难以处理的模拟任务。SQD 和 QSCI 就是在这条路线下发展起来的量子化学计算方法。2.2 SQD稀疏量子态检测SQD 的核心思想是假设目标量子态在计算基下是稀疏的也就是说真正占据主导地位的基态基矢Slater 行列式数量不多。实际做法大致是在量子计算机上制备近似的试探波函数比如 UCCSD幺正耦合簇或其他变分拟设。对量子态进行测量得到一组测量样本。从测量样本中筛选出出现频率较高的行列式只保留这些“重要”的行列式。在经典计算机上对这些筛选出来的行列式做对角化或微扰处理得到更精确的能量和性质。这种“量子测量采样 经典后处理”的混合路线可以大幅减少量子测量次数同时保留强关联效应。SQD 的关键假设就是“稀疏性”如果真实波函数确实只由少数行列式主导这个方法就会很高效。2.3 QSCI量子态化学插补QSCI 的思路和 SQD 有相近之处但更强调“对测量得到的量子态做统计插补”。QSCI 的大致逻辑是在量子计算机上准备试探态。执行测量获得测量结果的统计分布。利用经典后处理把测量分布“插补”成完整的量子态信息。基于插补后的量子态计算哈密顿量期望值、自旋期望值等。QSCI 更适合处理测量噪声较大、采样样本不完善的场景。它通过统计方法来弥补测量不完全带来的误差。2.4 为什么铁硫簇要专门做自旋审计自旋spin是量子化学中最基本的物理量之一。铁硫簇的不同自旋态对应不同的电子构型和化学反应活性。比如固氮酶铁钼辅因子FeMoco的自旋态直接关系到氮气的活化机制。如果 SQD 或 QSCI 在计算能量时表现很好但算出来的自旋期望值是错的那整个方法在铁硫簇上的可信度就要打折扣。因为自旋期望值错误说明测量样本或后处理的统计信息不完整。自旋污染可能导致后续能量、梯度、性质计算全部漂移。铁硫簇的自旋耦合方案复杂自旋期望值比总能量更敏感能暴露方法内部问题。所以自旋审计本质上是对 SQD/QSCI 基准测试结果做一次“物理合理性”校验而不只是数值精度对比。3. 基准测试设计的核心逻辑从标题和公开材料看这项研究的基准测试设计可以拆成几条主线。3.1 基准测试对象基准测试以铁硫簇为核心对象。常见的模型体系包括[Fe2S2] 双铁簇比如铁氧还蛋白中的 [Fe2S2] 活性中心。[Fe3S4] 三铁簇。[Fe4S4] 四铁四硫立方烷簇这是铁硫蛋白中最常见的构型。更复杂的铁硫钼簇如 FeMoco。这些体系的自旋多重度、氧化态、配位环境各不相同适合作为多维度基准测试集。3.2 基准测试的对比方式常见的基准测试设计会做以下几类对比SQD 与 QSCI 结果对比相同体系下两种方法的能量、自旋期望值、占据数是否一致。与精确解对比对小体系可以用 FCI全组态相互作用或 DMRG密度矩阵重正化群做精确参考。对比 SQD/QSCI 与参考值的偏差。与实验数据对比如果有谱学数据比如 Mössbauer 谱、EPR 谱对应的自旋态信息可以对比计算结果与实验观测。不同活性空间对比铁硫簇计算高度依赖活性空间选择。活性空间扩大后SQD/QSCI 的结果是否稳定。3.3 自旋审计的具体内容自旋审计通常包含以下几个层面总自旋期望值 S² 的计算值与理论值的比对。不同自旋多重度之间的能量排序是否正确。局域自旋布居分析即每个铁原子上分配的电子数和自旋数是否合理。由自旋污染导致的能量误差估算。如果 SQD/QSCI 算出来的 S² 严重偏离理论期望值说明采样得到的量子态已经偏离了物理上正确的自旋态。4. 环境准备与前置条件虽然这不是一个“一键部署”项目但如果你想复现或验证类似的基准测试流程环境准备是绕不开的。下面给出通用的量子化学 量子电路模拟环境清单。4.1 软件栈建议的软件栈包括组件用途可选工具Python主脚本语言Python 3.10量子电路模拟框架模拟量子态制备与测量Qiskit、Cirq、Pennylane量子化学计算库分子哈密顿量、活性空间构建PySCF、Psi4、OpenFermion经典量子化学软件参考计算ORCA、GAMESS、PySCF数据处理统计分析、绘图NumPy、Pandas、Matplotlib后处理稀疏采样与对角化自写脚本或 SQD 配套代码4.2 硬件要求纯经典模拟场景普通多核 CPU 工作站即可运行中小型体系。铁硫簇模型如果活性空间较大建议 16G 以上内存。量子硬件场景需要接入真实量子计算服务或云平台资源门槛和方法论都更复杂。GPU 可选如果哈密顿量构造和采样后处理使用 GPU 加速可以缩短周期但不是必需。这里必须说明我不掌握具体论文用了多少量子比特、多少采样数、什么硬件所以更细的硬件参数需要查看原论文的 methods 部分。4.3 通用安装命令以下命令是基于量子化学常见软件的通用安装方式具体版本请以官方文档为准。# 创建虚拟环境 python -m venv qchenv source qchenv/bin/activate # 安装量子化学基础库 pip install pyscf pip install openfermion pip install qiskit pip install qiskit-aer # 数据处理工具 pip install numpy pandas matplotlib # 如需从源码安装特定基准测试框架按项目 README 操作 # git clone repository_url # cd repository_name # pip install -e .提醒一点SQD 和 QSCI 的具体实现可能由原作者的代码库提供。如果要复现优先去找论文对应的 GitHub 仓库和数据文件。找不到再按通用流程自己搭建。5. 基准测试验证流程从哈密顿量到自旋审计这一节给出一个通用的验证流程帮你理解铁硫簇基准测试是怎么一步步做出来的。即使你没有复现原论文的代码也可以按这个逻辑设计自己的测试。5.1 第一步构建分子模型与哈密顿量铁硫簇的基准测试需要先确定分子结构和电子活性空间。从一个简化的 [Fe2S2] 模型开始大致流程是import numpy as np from pyscf import gto, scf, mcscf # 定义铁硫簇的分子构型实际坐标需要由晶体结构或几何优化提供 mol gto.Mole() mol.atom Fe 0.0 0.0 0.0 Fe 0.0 0.0 3.5 S 0.0 2.0 1.75 S 0.0 -2.0 1.75 mol.basis def2-svp mol.spin 0 # 按实际体系设置自旋多重度 mol.charge 0 # 按实际体系设置电荷 mol.build() # 先做 HF 计算 mf scf.RKS(mol) mf.xc PBE mf.kernel() # 构建活性空间例如 CAS(8, 8) mc mcscf.CASSCF(mf, 8, 8) mc.kernel()这里只是一个框架示例。实际铁硫簇的活性空间选择很讲究通常包含 Fe 的 3d 轨道和 S 的 3p 轨道。活性空间规模可以从 CAS(8,8) 扩展到 CAS(20,20) 甚至更大。5.2 第二步提取第二量子化哈密顿量在 CASSCF 或 CASCI 的基础上可以导出活性空间的第二量子化哈密顿量作为量子算法的输入。from openfermion.chem import MolecularData # 从 PySCF 生成分子数据 molecule MolecularData(geometry, basis, multiplicity, charge) molecule.load() # 获取费米子哈密顿量 fermionic_hamiltonian molecule.get_molecular_hamiltonian()这一步会生成一个哈密顿量对象包含单电子积分和双电子积分。后续 SQD/QSCI 的量子电路就是围绕这个哈密顿量展开的。5.3 第三步量子态制备与测量采样量子电路部分的核心是制备一个近似目标自旋态的波函数。如果用试探态制备的通用思路类似这样from qiskit import QuantumCircuit, Aer, execute from qiskit.circuit.library import TwoLocal # 量子比特数取比如活性空间轨道数的两倍 n_qubits 16 # 使用带自旋约束的拟设 ansatz TwoLocal(n_qubits, [ry, cz], full, entanglementlinear, reps2) # 编译电路 circuit ansatz circuit.measure_all() # 在模拟器上执行测量采样 backend Aer.get_backend(qasm_simulator) job execute(circuit, backend, shots100000) counts job.result().get_counts()这是量子电路采样那一环。SQD 会从这些测量结果中筛选重要行列式QSCI 则会做统计插补。5.4 第四步自旋期望值计算自旋审计的核心计算是 S²。在二次量子化形式下S² 的期望值需要从量子态和自旋算符得到。通用做法是先构造 S² 算符的第二量子化形式然后基于采样得到的量子态密度矩阵计算期望值。# 伪代码计算自旋期望值 # S^2 算符需要表示为费米子算符的组合 # 然后转换到量子比特表示 # 最后计算 Psi|S^2|Psi这里没有给出完整代码因为 S² 的具体实现依赖你的量子比特映射方式Jordan-Wigner、Bravyi-Kitaev、tapering 等和采样后处理方式。做自旋审计时确认 S² 算符的构造正确永远是第一步。5.5 第五步结果对比与审计报告把 SQD/QSCI 的自旋期望值和参考值放到一起对比核心指标包括总能量偏差。S² 偏差。不同自旋态能量排序是否正确。每个 Fe 位点的局域自旋布居。可以做一个简单的统计表体系方法总能量 (Ha)S²S² 理论值能量偏差 (mHa)[Fe2S2] 模型SQD待填待填待填待填[Fe2S2] 模型QSCI待填待填待填待填[Fe2S2] 模型FCI 参考待填待填待填0实际复现时按你的计算环境填表即可。关键是观察“自旋期望值偏离”的趋势。6. 自旋审计中可能踩的坑这一节写实际操作中很常见的误差来源。铁硫簇量子化学基准测试最容易翻车的点基本集中在下面几个地方。6.1 活性空间选择不当铁硫簇的自旋耦合严重依赖活性空间。如果活性空间太小可能漏掉关键的自旋耦合轨道导致后续 SQD/QSCI 结果整体失真。排查方式先做经典 CASSCF 扫描不同活性空间。对比不同活性空间下的自旋布居和能量排序。如果活性空间变化导致自旋态排序剧烈变化说明计算本身不稳定。6.2 采样噪声导致自旋污染SQD 和 QSCI 都依赖测量采样。采样次数不足时稀疏筛选可能丢掉重要行列式或者 QSCI 插补出非物理的量子态。排查方式逐步增加 shots如 1000、10000、100000、1000000。观察能量和 S² 是否收敛。如果 shots 增加后结果明显漂移说明采样收敛性不足。6.3 S² 算符映射错误这是最隐蔽的坑。S² 算符在费米子空间到量子比特空间的映射过程中很容易出错尤其是自旋阶梯算符的组合形式。排查方式用一个已知精确解的极小体系验证 S² 计算代码。比如 H2 或 HeH 的单重态、三重态验证 S² 是否正确。验证通过后再应用到铁硫簇体系。6.4 参考态自旋对称性被破坏量子电路拟设如果不保证自旋对称性制备的试探态可能混入不同自旋多重度的成分。排查方式检查试探态和参考态的自旋期望值。对拟设增加自旋对称性约束。比较不同拟设下 SQD/QSCI 的自旋审计结果。6.5 基组收敛性不足较小球基组下铁硫簇的自旋耦合和布居数可能不够准确。排查方式从 def2-svp 到 def2-tzvp 逐步增大基组。观察自旋布居和 S² 是否稳定。如果基组敏感度高结果解读要更谨慎。7. 复现与扩展如何把基准测试变成批量任务如果你是做工程化研究的人可能关心怎么把这类基准测试做成批量任务。虽然原论文不提供一键脚本但你可以自建一个批量计算框架。7.1 批量任务设计思路建议的目录结构iron_sulfur_bench/ ├── molecules/ # 分子结构文件 │ ├── fe2s2/ │ ├── fe3s4/ │ └── fe4s4/ ├── inputs/ # 输入参数 JSON │ ├── case001.json │ └── case002.json ├── scripts/ # 计算脚本 │ ├── run_cas.py │ └── run_sampling.py ├── outputs/ # 输出结果 │ └── results.csv └── logs/ # 日志 └── batch.log输入参数 JSON 示例{ molecule: fe2s2, basis: def2-svp, charge: 0, spin: 0, active_space: [8, 8], method: SQD, shots: 100000, noise_model: ideal }批量调度脚本可以用 Python 写一个简单队列import json import subprocess import os from pathlib import Path def run_case(json_path, scriptrun_calculate.py): with open(json_path, r) as f: config json.load(f) case_name config[molecule] _ config[method] _spin str(config[spin]) log_file flogs/{case_name}.log result subprocess.run( [python, script, str(json_path)], capture_outputTrue, textTrue, timeout7200 ) print(f{case_name}: {result.returncode}) with open(log_file, w) as f: f.write(result.stdout if result.stdout else ) f.write(result.stderr if result.stderr else ) if __name__ __main__: input_dir Path(inputs) for json_file in sorted(input_dir.glob(*.json)): run_case(json_file)批量任务要特别留意每个 case 设置独立的工作目录避免临时文件冲突。加超时控制防止单个 case 卡死影响整批任务。输出结果统一落到 CSV方便后续做自旋审计汇总。失败 case 要有重试机制但要注意不要盲目重试同一个参数。7.2 结果汇总与自旋审计报告批量计算完成后建议生成一份结果汇总表包含以下字段体系名称。方法SQD/QSCI/参考。电荷、自旋。活性空间。总能量。S²。能量参考偏差。采样数。是否通过自旋审计S² 偏差小于阈值。这样你可以快速看出哪种方法、哪个活性空间、哪个体系最不稳定。8. 资源占用与性能观察方法虽然这不是 GPU 推理类项目但性能观察仍然有价值。铁硫簇基准测试的计算瓶颈可能出现在几个位置8.1 计算瓶颈经典 CASSCF 计算活性空间越大内存和时间消耗越高。量子电路模拟测量采样需要大量状态向量模拟或近似采样CPU 时间敏感。稀疏行列式对角化SQD 后处理需要求解有效 Hamiltonian 的本征值对角化规模受保留行列式数量影响。QSCI 插补统计后处理的矩阵运算开销。8.2 性能观察方法用time命令统计每个阶段的耗时。用psutil监控 Python 进程的内存占用。对采样阶段的性能可以通过逐步增加 shots 观察耗时增长曲线。对活性空间的影响可以用不同 active_space 配置做一组扫描。import time import psutil start_time time.time() # 在这里执行计算任务 elapsed time.time() - start_time memory_mb psutil.Process().memory_info().rss / 1024 / 1024 print(f耗时: {elapsed:.2f}s, 内存: {memory_mb:.1f}MB)这些观察结果可以帮助你做资源规划决定哪些体系适合在本地跑哪些必须上高性能计算集群。8.3 如何降低资源占用减小基组先用 def2-svp 做方法测试再换大基组做精算。减小活性空间先测试小活性空间确认流程再扩大。降低采样数先观察趋势再收敛采样。使用稀疏采样和子采样技术减少不必要的测量。如果使用 PySCF可以开启磁盘缓存降低内存峰值。9. 常见问题与排查方法下面按实际计算场景整理一份排查清单。注意如果遇到“论文中的具体数字”相关的问题以原文为准。问题现象可能原因排查方式解决方案哈密顿量构建失败分子坐标或 charge/spin 设置不正确检查 molecule 输出结构校准 Fe 的氧化态和整体电荷活性空间对角化太慢活性空间过大或矩阵未稀疏化观察内存和耗时减小活性空间使用 DMRG 或稀疏求解器测量采样后行列式筛选为空shots 太少或拟设与目标态重叠度过低增加 shots检查测量分布优化拟设增加电路深度自旋期望值偏离理论值S² 算符映射错误或采样噪声用小型体系验证 S² 代码修正映射增加对称性约束SQD/QSCI 能量结果有偏差后处理参数不一致对比参考 FCI 结果统一后处理参数和有效空间批量任务中途卡死单一 case 无超时保护检查日志尾部为每个 case 设置超时内存溢出对角化矩阵过大查看内存占用日志用稀疏求解器或减小保留行列式数量不同软件算出的自旋布居不一致布居分析方法不同对比方法定义统一使用同一种布居分析方案9.1 自旋审计失败时优先检查什么如果 SQD/QSCI 结果没通过自旋审计我的建议是按下述顺序排查先确认参考计算的 S² 是否正确。参考值如果错了后面全部白做。再确认 SQD/QSCI 拿到的量子态是否正交于错误的对称性子空间。然后看采样数是否足够。100 万 shots 和 1 万 shots 在很多情况下差异巨大。最后检查后处理阶段的有效哈密顿量是否包含所有必要项。10. 适用场景与使用边界明确说清楚这篇研究适合什么不适合什么。10.1 适合的场景量子化学计算方法研究想评估 SQD/QSCI 在强关联过渡金属簇上的表现。量子算法选型在做量子化学模拟项目选型时需要了解不同量子后处理方法在铁硫簇上的差异。自旋污染误差分析如果担心自旋污染影响能量和性质可以借鉴自旋审计的思路。教学和入门理解量子化学与量子计算的结合方式了解基准测试的设计逻辑。10.2 不适合的场景找“一键生成化学结构”的普通用户这不是这类项目定位。想直接拿现成 API 做生产集成的团队原研究没有提供常用 API。需要大规模工程化量子化学计算的企业用户需要自行开发或引入成熟量子化学平台。要立刻在真实量子硬件上跑铁硫簇的场景需要充分评估硬件噪声、纠错和成本。10.3 合规与边界提醒铁硫簇催化研究可能涉及生物无机化学、酶催化机制、固氮机制等方向这些属于基础科学研究范畴。做研究时注意如果使用实验结构数据确认来源和授权。如果计算结果用于论文发表遵循期刊的数据可用性规范。如果后续涉及工业催化剂设计注意知识产权和数据合规。不涉及敏感数据但量子化学计算平台和云服务账号的安全仍要重视。11. 最佳实践与使用建议从工程和研究角度看这类基准测试项目的最佳实践可以总结成几条。11.1 先跑通最小体系不要一上来就跑 FeMoco 或者大活性空间。先用最小的铁硫簇模型比如 [Fe2S2] 双铁模型把 SQD/QSCI 的完整流程跑通。最小验证目标哈密顿量构建成功。量子电路采样正常。后处理对角化能收敛。自旋期望值能计算出来。S² 与理论值偏差在一个可接受的范围内。这套最小流程跑通后再逐步扩大体系。11.2 保留可复现的配置建议把每一次计算的参数整理成 JSON 配置文件而不是在代码里硬编码。{ molecule: fe2s2, basis: def2-svp, method: QSCI, shots: 100000, active_space: [8, 8], spin: 0, charge: 0, optimization_level: 2, post_processing: sparse_diag, reference: FCI }这样后续无论复现还是排错都方便。11.3 分目录管理molecules/放结构文件。inputs/放参数。scripts/放代码。outputs/放结果。logs/放日志。references/放参考计算数据。不要让临时文件混在一起铁硫簇计算往往要试很多活性空间目录混乱会浪费大量时间。11.4 加日志和失败重试批量任务中每个 case 都要记录开始时间。结束时间。状态。输出摘要。错误信息。失败重试时要留意如果同一个 case 连续失败三次就应该停止重试人工介入检查参数而不是无限循环。11.5 审计结果要可视化自旋审计的结果建议用图表呈现横轴不同自旋多重度。纵轴能量或 S² 偏差。不同颜色不同方法。这种图能快速暴露方法在哪个自旋态上偏差最大。12. 同类方法与扩展方向如果你对铁硫簇量子化学基准测试产生兴趣可以从以下几个方向继续扩展。12.1 其他量子后处理方法除了 SQD 和 QSCI还有一些相关路线值得关注量子子空间扩展Quantum Subspace Expansion。多参考选簇扩展。基于测量结果的经典后处理变体。量子误差缓解与对称性投影结合的方法。把自旋审计的思路应用到这些方法上同样可以评估它们的物理合理性。12.2 更大尺度的铁硫簇模型从 [Fe2S2] 到 [Fe4S4]再到 FeMoco体系的复杂度指数上升。越大的体系自旋耦合越密集对采样和后处理的容错能力要求越高。如果想继续深入研究可以做一套活性空间和采样数的线性扫描测试找出每种方法的能力边界。12.3 与经典方法对比把 SQD/QSCI 的结果和 CASSCF、NEVPT2、DMRG 做系统对比可以明确量子方法在铁硫簇上相对经典方法的优势区间和劣势区间。这才是量子化学基准测试的核心价值之一。12.4 接口化和平台化如果你所在团队有量子化学计算平台的开发需求可以把这类基准测试流程封装成服务输入分子结构文件。自动构建活性空间。调度量子电路采样。执行经典后处理。汇总自旋审计报告。虽然原研究没有提供 API但基于这套方法论工程化的道路是清晰的。13. 总结这次研究的实际参考价值回到最开始的问题SQD/QSCI 在铁硫簇量子化学基准测试中表现如何从标题“Spin audit”这个措辞就能看出这项研究的重心不是单纯报一个能量精度表而是审计方法在自旋这一关键物理量上的可靠性。自旋是铁硫簇电子结构的核心自旋态算错能量再“对”也缺乏物理意义。所以自旋审计本质上是对基准测试质量的一道“质检”。从这个角度说这项研究的方法论价值高于具体的能量数值价值。对新进入量子化学计算领域的工程师和研究者这篇研究的参考点在于SQD 和 QSCI 这类量子后处理方法核心依赖是采样与稀疏筛选不是“万能计算器”。铁硫簇这类强关联体系自旋期望值是比总能量更严苛的测试指标。基准测试的可复现性来自活性空间、基组、采样参数和 S² 算符的一致性。工程化之前先跑通最小体系、保留统一参数配置、做有效日志比追求大体系更快出结果。如果你接下来要做类似的工作我建议第一步不是去堆更大的活性空间而是先用一个已知精确解的极小体系把 S² 计算和自旋审计代码验证到位。这一层验证做完后面的铁硫簇测试才有可信度。核心路径就是最小体系验证 S² 算符 - 单点铁硫簇模型跑通 SQD/QSCI - 对比参考计算 - 自旋审计 - 批量扩展。这套流程走完你对量子化学基准测试的理解会比单纯看论文数字深得多。