Batch HTML to PDF Converter Batch HTML to PDF Converter

下载批量 HTML 转 PDF 转换器软件,将页面合并为一个 PDF

批量 HTML 转 PDF 转换器可处理已保存的 .HTML、.HTM 和 .XHTML 页面目录,并在您的 Windows PC 上生成 PDF。它会自动读取每个页面旁边的资源文件夹,确保图片也能包含在 PDF 中。

Batch HTML to PDF Converter 屏幕截图.
保存网页时,每个网页都会在磁盘上生成两个文件,而非一个。一个是.HTML文件,旁边还有一个以网页命名的文件夹,用于存放图片和样式表。仅移动文件本身,页面将无法正常打开。这种分离是手动转换保存网页时容易出错的原因--文件看起来正常,但生成的PDF却缺失内容。SoftOrbits Batch HTML to PDF Converter可以一次性读取整个列表,并将每个网页与其对应的文件夹一起处理。输出格式为PDF或纯TXT。

如何下载和使用Batch HTML to PDF Converter软件

排队处理整个目录.

1. 排队处理整个目录

1. 排队处理整个目录

下载Batch HTML to PDF Converter工具,并将所有需要转换的已保存网页拖入。保留资源文件夹的原有位置。程序会根据名称找到每个文件夹,并将其与对应的网页关联。

勾选"合并所有页面到一个PDF".

2. 勾选"合并所有页面到一个PDF"

2. 勾选"合并所有页面到一个PDF"

该复选框位于"输出"区域,下方是"合并后的文件名"。在此处输入名称,整个队列将合并成一个文档。顺序按照屏幕上的列表从上到下排列,程序不会自行排序,因此请按您想要的顺序添加页面。

设置格式和输出文件夹.

3. 设置格式和输出文件夹

3. 设置格式和输出文件夹

"输出格式"提供两个选项:PDF和TXT。合并功能仅适用于PDF。如果勾选了"合并",然后切换到TXT格式,该选项将被忽略,屏幕上会显示原因。然后,指定输出文件夹,您希望将结果保存在何处。

按"开始"并阅读摘要.

4. 按"开始"并阅读摘要

4. 按"开始"并阅读摘要

随着队列向下滚动,每一行都会显示状态。无法渲染的页面会被标记并跳过,而不是影响整个批处理,跳过的文件数量会在最后显示。

桌面转换器为何值得拥有

一次点击,处理目录中的所有导出.

一次点击,处理目录中的所有导出

生成HTML的应用会产生大量数据。报告工具每个时期生成一个文件,发票由会计软件按客户生成,聊天客户端每个对话写入一个线程。一位支持论坛的用户有50多个.HTM文件,需要逐一手动打开。问题在于宏是否能加快此过程。浏览器从未提供批量处理此功能。将整个目录拖入,然后离开。

在当前机器上保留内部报告

对于从公共网站保存的页面,上传是可行的。但对于工资单导出、侦测集或内部维基转储,则需要不同的处理方式。而且,在隐私问题之前,还有一个实际的难点。网页表单接受文件,而你保存的页面是文件加上一个文件夹,所以对于一堆页面中的每个页面,你都必须手动将它们压缩在一起。没有那个文件夹,阅读器就会丢失页面大部分的原始外观。免费网络层级将文档限制为每份 20 页,或每小时 3 个任务。批量 HTML 转 PDF 转换器 在你自己的 PC 上运行,并且在完成运行后,嗅探器没有捕获到任何传出的请求。

在当前机器上保留内部报告.
随文本一起显示的图像.

随文本一起显示的图像

支持论坛上的抱怨几乎是以完全相同的措辞重复的。转换了页面,但图片所在的位置只显示一个蓝色的问号。有时原因是通过相对路径(如 ./images/header.jpg)访问的背景,而转换器从未解析过该路径。更常见的情况是文件夹根本没有随文件一起传输。当时没有人警告你。你会在打开 PDF 时发现这个问题,而到那时原始文件可能已经丢失了。

四十页内容,一份输出文档

勾选"将所有页面合并到一个 PDF 中"后,每个页面首先独立渲染,然后按照屏幕上显示的顺序将各部分缝合起来。失败的页面将从合并中剔除,其余部分仍构成文档。

页面旁边的文件夹也一并传输

以这种方式存储的页面会将其图片和样式表保留在旁边的文件夹中。该文件夹的名称因浏览器和语言而异--page_files、page.files、page-files、_fichiers、_dateien。该程序匹配名称的形状,而不是固定的后缀列表,因此它也能找到它们,整个文件树会随页面一起传输。它会跳过内部的连接点,这可以防止链接将你硬盘的一半内容拉入任务。同一个页面,旁边有文件夹时,在两张纸上输出了 77,415 字节;没有文件夹时,在一张纸上输出了 64,042 字节。

深度路径仍可渲染

页面在目录深处--项目文件夹、日期,或从原始 URL 中截取的 slug。超过 260 个字符时,渲染器会返回一张空白页。HTML to PDF Converter Software 会监听 200 个字符,并将文档先暂存到一个临时的短文件夹中,名为 page.html,相关资源会一并复制到旁边。生成的 PDF 是正常的,您永远不会看到那个临时文件夹。

Word 和 CMS 输出的 XHTML

Word 会保存为 .XHTML,许多内容管理系统在您导出文章时也会这样做。渲染器会将该标记视为普通 HTML,并且暂存步骤会给它一个 .html 名称,这样后续步骤就不会因为扩展名问题产生争议。.HTML、.HTM 和 .XHTML 共享同一个队列和一套设置。

当布局阻碍纯文本输出时

Output Format 有第二个选项:TXT。它会移除页面装饰,只保留文本。当接下来是对三年导出工单进行 grep 搜索,而不是需要有人坐下来阅读的文档时,这就是您想要的。merge 开关在这里无效。TXT 输出时,每个页面生成一个文件。

ultra-hd-4k

仍在更新的渲染器

许多批量 HTML 工具仍在使用 wkhtmltopdf,这是一个于 2023 年 1 月 2 日归档的项目,其最后一个版本不再获得安全补丁,并且仍然携带 CVE-2022-35583(一个 SSRF 漏洞,评级为 9.8)。本软件通过 WebView2 进行渲染,这是 Windows 11 自带的 Chromium 运行时,Windows 10 也可通过 Microsoft Update 获取。它为整个批量处理启动一次,约 1.9 秒,然后处理每个文档约一秒。挂起的页面将有 120 秒的处理时间,之后软件将放弃并继续处理下一个。

Batch HTML to PDF Converter
Batch HTML to PDF Converter下载批量 HTML 转 PDF 转换器软件,添加已保存的页面,然后勾选"将所有页面合并到一个 PDF"。

谁需要 Batch HTML to PDF Converter Tool

财务和后台团队

报表、发票和周期性报告从会计软件中导出的形式比预期的 HTML 要多得多。文件管理部门每月需要一个 PDF,而不是 90 个散页,旁边还有 90 个文件夹。

Web 和文档团队

静态文档构建是一个包含 HTML 和资产的目录,资产会附着在每个文件上。成套的页面校样也是如此。将其打包发送给审阅者时,您在邮件中最先写的就是要打开哪个文件。PDF 可以为您省去这些邮件。

分析师通过已保存的源文件进行工作

浏览器中的研究会在驱动器上留下数十个已保存的页面,每个页面都有自己的文件夹。该驱动器迟早会被重新成像。案例文件夹中过时的 PDF 比它寿命长,并且在两年后仍可引用。

Batch HTML to PDF Converter

Batch HTML to PDF Converter

语言
文件尺寸

18.5 Mb

版本

3.2

最近更新时间

08/08/26

¥ 69.99

🖥️ System Requirements

  • Windows 11/10/8.1/8/7 (32/64 位)
  • Intel i3, AMD Ryzen 5 或以上
  • 4 GB 或以上内存
  • NVIDIA® GeForce® 系列 8 和 8M、Intel® HD Graphics 2000、Quadro FX 4800、Quadro FX 5600、AMD Radeon™ R600、Mobility Radeon™ HD 4330、Mobility FirePro™ 系列、Radeon™ R5 M230 或更高显卡,并具有最新驱动程序
  • 1280 × 768 屏幕分辨率,32 位色彩
  • 1 GB 或以上可用硬盘空间

🙋 常见问题

简而言之:将它们全部放入一个列表中,然后按一次"开始"。长话短说:没有内容会中断运行。该程序从不停下来询问文件或确认下一页。拖入页面。在"输出格式"框中选择"PDF",指定输出位置,然后按"开始"。演示模式每天允许处理三页,这足以对您自己的页面进行试运行。

是的。"将所有页面合并为一个 PDF"复选框可以实现此目的,并且它写入的文件将采用您为其指定的任何名称。列表会保留您构建的顺序,并且页面将按该顺序在文档中显示,因此请按您希望它们被阅读的顺序放置它们。合并仅适用于 PDF 输出。在 TXT 中,您始终会为每页获得一个文本文件。

否,它可以离线将 HTML 转换为 PDF。渲染器启动时网络已关闭,因此名称查找会失败,页面也无处可去。这对于 HTML 来说比您想象的更重要。已保存的页面通常仍然指向某人 CDN 上的样式表或字体,而这些引用将保持未解析状态。打印出来的是您磁盘上的内容。另存为"网页,完整"并附带其文件夹的页面会整体转换;依赖远程资源的纯 HTML 文件将作为纯标记进行转换。

当图像和 CSS 与页面位于同一文件夹中时,它们会一并显示。诸如 ./page_files 之类的相对引用会像在浏览器中一样解析,CSS 背景也会随之而来。这部分是直接从浏览器打印失败的地方,因为打印对话框中的"背景图形"框默认是关闭的,而且没有任何提示。该程序会特意关闭 JavaScript:您是在打印别人的页面,而不是在运行它。脚本运行后内容才出现的页面将显示其下方的标记。

不需要。PDF 是一种开放格式,任何能够打印页面的渲染器都可以生成 PDF。一个通用的 PDF 套件可以很好地处理单个 HTML 文件。但如果需要处理九十个文件,则情况就不同了。您需要将每一页与其资源文件夹一起保留,并需要一个能够自动运行的目录。

有四点决定了这一点。每一页都必须与其资源文件夹一起保留。工具必须将整个运行合并成一个文档,并且必须在不将任何数据发送到您机器外的情况下完成工作。第四点是人们后来才发现的:如果中间的文件出现故障会怎么样。在这里,它会在窗口中标记,并且队列会继续运行。

队列本身没有文件数量限制。演示模式限制的是天数,而不是批次。每天三个页面,无水印且不限制单个文档中的页面数量。计数器在午夜重置。在合并模式下,检查会在运行开始前进行,因此程序会修剪列表,将其调整为当天剩余额度内的数量,而不是在半途中失败。暂存功能可处理非常长的路径,并且程序会丢弃一个运行 120 秒仍未完成的文档,以便其余文档可以完成。

评价 Batch HTML to PDF Converter

  • Windows 7
  • Windows 8
  • Windows 10
  • Windows 11
作者: SoftOrbits (English)
平均评价: 4.5 1161 投票

Risk-free download

progressive-webapps/apis/offline-first Created with Sketch.
100% offline
Your files never leave your PC
Safe & secure download
Directly from the official website
No sign-up required
No account or email to get started
Trusted since 2006
Desktop software for Windows