0

0

Java如何修改XML文件并保持原有格式

幻夢星雲

幻夢星雲

发布时间:2025-12-24 03:49:20

|

356人浏览过

|

来源于php中文网

原创

Java修改XML并保持原有格式需禁用DOM默认美化:解析时关闭空白规范化,Transformer设不缩进且保留换行,替换文本节点时不破坏空白/注释结构;推荐dom4j或jdom2替代原生JAXP以提升格式保真度。

java如何修改xml文件并保持原有格式

Java 修改 XML 文件并保持原有格式的关键在于避免使用会重排版的 DOM 解析器默认序列化方式,改用支持保留空白、缩进和换行的方案。标准 Transformer 默认会“美化”输出(如自动缩进、合并空格),导致原始格式丢失;需显式配置其属性,并配合谨慎的解析与写入策略。

使用 DocumentBuilder 保留原始空白结构

解析时必须关闭元素内容空白的自动规范化,否则文本节点中的换行和缩进会被丢弃:

  • 设置 builderFactory.setIgnoringElementContentWhitespace(false)
  • 调用 document.setXmlStandalone(true)(可选,避免写入 standalone 声明干扰)
  • 确保 XML 文件本身有明确的换行和缩进,且不依赖 DTD 或 Schema 进行格式校验

用 Transformer 设置格式化参数并禁用缩进

即使不缩进,也要控制换行和空格行为,防止 Transformer 自动“整理”结构:

  • 设置 transformer.setOutputProperty(OutputKeys.INDENT, "no")
  • 设置 transformer.setOutputProperty("{http://xml.apache.org/xslt}indent-amount", "0")
  • 关键:设置 transformer.setOutputProperty(OutputKeys.OMIT_XML_DECLARATION, "no") 并确保声明行与原文件一致(如编码、版本)

替换文本节点时保留父节点的空白子节点

直接修改 Node.getTextContent() 会破坏相邻的 Text/Comment/CDATA 节点顺序。正确做法是:

一点PPT
一点PPT

一句话生成专业PPT,AI自动排版配图

下载

立即学习Java免费学习笔记(深入)”;

  • 定位目标元素后,遍历其子节点,只替换第一个非空白 Text 节点(或指定位置的 Text 节点)
  • 若需更新值但保留前后换行,手动重建该 Text 节点,并维持其在 childNodes 中的位置
  • 避免调用 element.setTextContent("new value") —— 它会清空所有子节点,包括注释和空白

推荐替代方案:使用 dom4j 或 jdom2(更易控格式)

标准 JAXP 在格式保真上限制较多;开源库提供更细粒度控制:

  • dom4j:支持 OutputFormat.setPreserveSpace(true),写入时可指定是否换行、缩进宽度、是否转义特殊字符
  • jdom2XMLOutputter 构造时传入 Format.getPrettyFormat().setIndent(" ").setExpandEmptyElements(false),再用 setIgnoreTrAXEscapingPIs(true) 防止意外转义
  • 二者均能读取原始空白、保留注释、按需输出,比原生 Transformer 更可靠

不复杂但容易忽略:格式保持不是“打开某个开关”就能解决,而是从解析、修改到序列化的每一步都要克制“自动美化”冲动。优先考虑 dom4j 或 jdom2,能省去大量底层细节调试。

热门AI工具

更多
DeepSeek
DeepSeek

幻方量化公司旗下的开源大模型平台

豆包大模型
豆包大模型

字节跳动自主研发的一系列大型语言模型

WorkBuddy
WorkBuddy

腾讯云推出的AI原生桌面智能体工作台

腾讯元宝
腾讯元宝

腾讯混元平台推出的AI助手

文心一言
文心一言

文心一言是百度开发的AI聊天机器人,通过对话可以生成各种形式的内容。

讯飞写作
讯飞写作

基于讯飞星火大模型的AI写作工具,可以快速生成新闻稿件、品宣文案、工作总结、心得体会等各种文文稿

即梦AI
即梦AI

一站式AI创作平台,免费AI图片和视频生成。

ChatGPT
ChatGPT

最最强大的AI聊天机器人程序,ChatGPT不单是聊天机器人,还能进行撰写邮件、视频脚本、文案、翻译、代码等任务。

相关专题

更多
format在python中的用法
format在python中的用法

Python中的format是一种字符串格式化方法,用于将变量或值插入到字符串中的占位符位置。通过format方法,我们可以动态地构建字符串,使其包含不同值。php中文网给大家带来了相关的教程以及文章,欢迎大家前来阅读学习。

887

2023.07.31

python中的format是什么意思
python中的format是什么意思

python中的format是一种字符串格式化方法,用于将变量或值插入到字符串中的占位符位置。通过format方法,我们可以动态地构建字符串,使其包含不同值。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

463

2024.06.27

pdf怎么转换成xml格式
pdf怎么转换成xml格式

将 pdf 转换为 xml 的方法:1. 使用在线转换器;2. 使用桌面软件(如 adobe acrobat、itext);3. 使用命令行工具(如 pdftoxml)。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

1949

2024.04.01

xml怎么变成word
xml怎么变成word

步骤:1. 导入 xml 文件;2. 选择 xml 结构;3. 映射 xml 元素到 word 元素;4. 生成 word 文档。提示:确保 xml 文件结构良好,并预览 word 文档以验证转换是否成功。想了解更多xml的相关内容,可以阅读本专题下面的文章。

2119

2024.08.01

xml是什么格式的文件
xml是什么格式的文件

xml是一种纯文本格式的文件。xml指的是可扩展标记语言,标准通用标记语言的子集,是一种用于标记电子文件使其具有结构性的标记语言。想了解更多相关的内容,可阅读本专题下面的相关文章。

1171

2024.11.28

DOM是什么意思
DOM是什么意思

dom的英文全称是documentobjectmodel,表示文件对象模型,是w3c组织推荐的处理可扩展置标语言的标准编程接口;dom是html文档的内存中对象表示,它提供了使用javascript与网页交互的方式。想了解更多的相关内容,可以阅读本专题下面的文章。

4344

2024.08.14

apache是什么意思
apache是什么意思

Apache是Apache HTTP Server的简称,是一个开源的Web服务器软件。是目前全球使用最广泛的Web服务器软件之一,由Apache软件基金会开发和维护,Apache具有稳定、安全和高性能的特点,得益于其成熟的开发和广泛的应用实践,被广泛用于托管网站、搭建Web应用程序、构建Web服务和代理等场景。本专题为大家提供了Apache相关的各种文章、以及下载和课程,希望对各位有所帮助。

421

2023.08.23

apache启动失败
apache启动失败

Apache启动失败可能有多种原因。需要检查日志文件、检查配置文件等等。想了解更多apache启动的相关内容,可以阅读本专题下面的文章。

939

2024.01.16

TypeScript类型系统进阶与大型前端项目实践
TypeScript类型系统进阶与大型前端项目实践

本专题围绕 TypeScript 在大型前端项目中的应用展开,深入讲解类型系统设计与工程化开发方法。内容包括泛型与高级类型、类型推断机制、声明文件编写、模块化结构设计以及代码规范管理。通过真实项目案例分析,帮助开发者构建类型安全、结构清晰、易维护的前端工程体系,提高团队协作效率与代码质量。

26

2026.03.13

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
Kotlin 教程
Kotlin 教程

共23课时 | 4.4万人学习

C# 教程
C# 教程

共94课时 | 11.3万人学习

Java 教程
Java 教程

共578课时 | 81.7万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号