Dzzz

关联两个 CSV 文件

通过共同的列在两个 CSV 文件之间匹配行——全部在你的设备上完成。

在你的设备上

小文件直接在本页面内关联;大文件则使用与分析器和查看器相同的设备端数据库引擎,只下载一次,之后就保存在你的设备上。

通过共同的列在两个 CSV 文件之间匹配行——全部在你的设备上完成。 小文件直接在本页面内关联;大文件则使用与分析器和查看器相同的设备端数据库引擎,只下载一次,之后就保存在你的设备上。

关于本工具

你需要提供

  • 两个 CSV 或 TSV 文件。

你将获得

  • 连接后的行——除非你自行缩减,否则包含两个文件的全部列——按你选择的连接类型:仅匹配的行、第一个文件的全部行,或仅第一个文件中未匹配的行。
  • 这对文件的三个精确计数:匹配的行数、第一个文件中未匹配的行数和第二个文件中未匹配的行数,无论运行哪种连接都以同样方式计算。

使用限制

  • 小文件就在本页面里连接;两个文件合计达到 5 MB 后,工具会切换到与分析器和查看器相同的本机数据库引擎,只需下载一次(约 7 MB)并保存在你的设备上。
  • 如果两个匹配列存放的值类型不同——一边是数字,另一边是文本——会有警告指出两者并给出各自的样本;但它不会阻止连接。
  • 连接结果每次显示 100 行;导出会下载完整结果,而不只是屏幕上的行。
  • 全部在你的设备上运行,两个文件都不会被上传到任何地方。

使用方法

  1. 选择第一个 CSV 文件

    点击“选择第一个 CSV 文件”来挑选第一个 .csv 或 .tsv 文件。

  2. 选择第二个 CSV 文件

    点击“选择第二个 CSV 文件”——较小的一对文件会立即载入其列名;当两个文件合计达到 5 MB 时,会先提示进行一次性的引擎下载。

  3. 选择匹配列与连接方式

    在两侧各选一列作为匹配依据,然后选择你想要的行:仅两个文件中都匹配上的行、第一个文件的全部行,或仅第一个文件中未匹配上的行。

  4. 执行连接并查看结果

    点击“连接文件”即可看到连接后的表格和三个精确计数,再点“导出结果”把整个连接结果下载为 CSV 文件。

常见问题

为什么这个工具有时要求下载引擎,有时不用?

两个文件合计低于 5 MB 时,直接在页面内完成连接,无需任何下载。达到或超过该大小时,连接会改在与分析器和查看器相同的设备端数据库引擎中运行——只下载一次,之后保存在你的设备上。

什么是反连接(anti join),为什么没有全外连接?

“第一个文件中在第二个文件里没有匹配的行”就是本工具所说的反连接——它回答哪些行始终没有匹配上。这里没有全外连接选项;三个选项已覆盖匹配的行、第一个文件的全部行,以及没有任何匹配的行。

两个匹配列显示的值类型不同——连接还能进行吗?

可以。该警告仅供参考,绝不会阻止连接——运行它,然后自行判断这种不一致对你的数据是否重要。

执行连接会把文件上传到什么地方吗?

不会。两条路径都在你的设备上读取文件——小文件直接在页面内处理,较大的文件通过下载的引擎处理——不会向服务器发送关于任何一个文件的信息。