列相关矩阵
用完整 CSV 计算 Pearson 或 Spearman 相关矩阵,保留原始列名、重复选择、每对有效 N 和状态。
- 1添加输入
- 2调整设置
- 3获取结果
工具输入和文件在当前浏览器处理,不会上传。
开始之前
按原表列序号选择经济、社会或其他数值变量。保留原标签和重复选择,计算所有变量对,并通过 N 和状态解释无法计算的单元格。成对删除和整行删除可以得到不同的有效行集合。
如何使用
- 选择完整 UTF-8 文件,核对分隔符和表头设置。
- 按原表物理列填写序号,选择 Pearson/Spearman、缺失值政策及明确的缺失标记。
- 检查有限预览中的系数、N 和状态,下载完整矩阵、有效 N、状态 JSON、SVG、原件、设置及许可证。
支持范围与限制
仅接受一个非空 UTF-8 CSV/TSV/TXT 文件,最多 20 MiB、50,000 个数据行、2,000,000 个单元格(含存在的表头),每行宽度相同。允许 UTF-8 BOM、引号和引号内换行。
选择 1–64 个序号,重复选择保留。所选非缺失值须为有限二进制 64 位数值,可使用十进制或科学记数法;其他文本、无穷值及输入下溢会拒绝整个任务。原始数值字符串和未选列仍完整保留。
缺失标记最多 20 个,每个 100 字符,整个输入 2,048 字符。少于两行有效数据或常量列返回空系数和明确状态;算术下溢、精度丢失或非有限中间值也返回明确状态。只有超过 ±1 不多于 32 个 Number.EPSILON 的偏差才校正并记录。
这是联合预算:配对行工作最多 100,000,000 次、实际排序比较最多 20,000,000 次;文件加完整文本最多 32 MiB、紧凑类型 JSON 16 MiB、三者合计 48 MiB、二进制加元数据传输 64 MiB、保守估算内存 512 MiB。各轴上限不能作为可同时达到的容量承诺。
30 秒绝对截止线涵盖原生文件校验、读取、Worker 加载、计算、完整结果校验、清理及等待后的首次界面发布。失败或取消不发布部分结果。界面只展示前 10×10 个单元格和每个标签前 120 个字符;下载保留全部单元格和完整标签。
操作示例
示例输入
Age_55_64,GDP,Age_55_64,Constant,Few,Note 1,10,7,5,NA,alpha 2,20,7,5,NA,beta 2,NA,8,5,NA,"quoted, note" 4,40,8,5,NA,γ NA,50,9,5,NA,missing 6,60,10,5,12,tail
示例参数
{"columns": "1,2,3,1", "method": "pearson", "deletion": "pairwise", "delimiter": ",", "headerMode": "first-row", "missingMarkers": "NA"}示例输出
,Age_55_64,GDP,Age_55_64,Age_55_64 Age_55_64,0.9999999999999999,1,0.9185586535436918,0.9999999999999999 GDP,1,1,0.961644737891902,1 Age_55_64,0.9185586535436918,0.961644737891902,0.9999999999999998,0.9185586535436918 Age_55_64,0.9999999999999999,1,0.9185586535436918,0.9999999999999999
出现问题时
核对 UTF-8、引号、分隔符、行宽和列序号;纠正非法数值或将明确标记声明为缺失。遇到联合预算或截止线拒绝时,缩小行数或选择数,再用原文件和原设置重新开始。
常见问题
重复表头或重复选择会被合并吗?
不会。轴标签保持原始表头;JSON 同时记录从 0 开始的物理列索引、从 1 开始的列号及选择序号。即使标签相同,也能区分来源。
成对 Spearman 如何处理缺失值?
先筛选同一对变量都有效的行,再为这个子集分别计算平均并列秩。每对可能使用不同的行和 N;不会先对整列排序再删行。
空系数是否代表零相关?
不代表。空值附带常量、样本不足或数值状态。零系数是有效数值;请同时看 N 和状态。全部原始记录、缺失掩码和政策可恢复每对有效行集合。
这是原帖作者的数值复现吗?
不是。原帖没有保存完整数值 CSV 或矩阵。本页使用已验证的合成样例;原帖的标签需求已在 R 中解决。Spearman、N、状态和 SVG 是本工具扩展。