把 Word 文件(DOCX)转换成 HTML
转换器读取的是文档的结构 —— 标题、列表、表格 —— 而不是它的外观,所以你得到的是规范的 HTML 标题和列表,而不是一堆样式代码。这正是 HTML 要放进建站系统(CMS)时你真正需要的东西。
- 完全在你的浏览器里运行
- 断网也能用
- 不上传
- 不用注册
- 没有水印
正在加载工具……
工作原理
- 把一个 .docx 文件拖进来。
- 选择 HTML 作为输出格式。
- 复制 HTML,或者把它下载成文件。下方会显示预览。
为什么什么都不用上传
这个页面上的每一步操作,都由运行在你浏览器标签页里的代码完成,用的就是渲染网页的那套引擎。文件从磁盘读进标签页的内存,在那里被处理,再作为下载写回去。它不会被送到任何地方 —— 不会送给我们,也不会送给第三方。
自己动手验证
- 打开浏览器的开发者工具(F12),选择“网络”(Network)面板。
- 载入你的文件,运行这个工具。
- 你能看到的请求只有这些:工具自己的代码 —— 少数几个重型工具还会从公共 CDN 取它们的开源引擎 —— 外加一条发往 loreatec.jp 的小小访问记录(页面地址和标题,仅此而已)。没有一条带着你的文件。
常见问题
Word 的排版格式为什么没了?
这是故意的。Word 会给文档里的每一小段文字都记下字体、大小和颜色。把这些原样搬进 HTML,得到的代码没人能维护。转换器改用另一种做法:把 Word 里的命名样式 —— 标题 1、项目符号列表、引用 —— 转换成对应的 HTML 元素,其余的都丢掉。这正是让结果能直接用在网站上的原因。
图片会怎么处理?
会直接写进 HTML 里面(作为“data URI”),所以结果是一个自包含的文件。这也意味着,一份图片很多的文档会生成一个很大的 HTML 文件。如果这会带来问题,转换完之后再把图片单独取出来。
我的文档会被上传吗?
不会。文件在这个浏览器标签页里读取和转换,全过程都在你自己的设备上完成。你可以打开页面、断开网络,它照样能用。对合同或客户名单来说,这才是真正要紧的保证。