0

0

如何在 iTextPDF 中正确显示匈牙利语特殊字符(如 ő、ű、Ő、Ű)

聖光之護

聖光之護

发布时间:2026-02-01 11:39:08

|

627人浏览过

|

来源于php中文网

原创

如何在 iTextPDF 中正确显示匈牙利语特殊字符(如 ő、ű、Ő、Ű)

本文详解在 itext 7 中渲染东欧语言(如匈牙利语)特殊字符的完整方案,重点解决 `ő`、`ű` 等字符显示为空白的问题,指出 utf-8 编码在某些字体加载场景下的局限性,并推荐使用 cp1250 编码配合系统字体的可靠实践。

在使用 iText 7 生成 PDF 时,若需正确显示匈牙利语、捷克语或波兰语等中欧语言中的扩展拉丁字符(如 ő、ű、Ő、Ű、á、é、í),仅依赖 StandardFonts.TIMES_BOLD 或默认 UTF-8 编码往往会导致字符渲染为空白或方块——这是因为 iText 的 StandardFonts 类提供的内置字体(如 TIMES_BOLD)本质上是Type 1 字体子集,不包含 Unicode 完整字形映射,且其内部编码机制无法覆盖 ISO-8859-2 或 Windows-1250 所定义的东欧字符区。

✅ 正确做法是:显式加载支持这些字符的 TrueType 字体(TTF),并指定兼容的字符编码(如 CP1250),而非 UTF-8。虽然 UTF-8 是通用编码标准,但 iText 7 的 PdfFontFactory.createFont(String, String, boolean) 方法中,第二个参数 encoding 并非指“输入字符串的编码”,而是用于构建字体内置 CMap(字符映射表)的编码方案。对于 Windows 系统字体(如 arial.ttf, times.ttf, tahoma.ttf),其字形索引与 CP1250(Windows Latin-2)编码严格对齐,而 UTF-8 在此上下文中无法正确建立 Unicode 码点到字形的映射,导致 ő(U+0151)等字符被忽略。

以下是可直接运行的修复版代码示例(适配您的原始逻辑):

Outwrite
Outwrite

AI写作浏览器插件,将您的想法变成有力的句子

下载
import com.itextpdf.io.font.PdfEncodings;
import com.itextpdf.kernel.font.PdfFont;
import com.itextpdf.kernel.font.PdfFontFactory;
import com.itextpdf.layout.Document;
import com.itextpdf.layout.element.Paragraph;
import com.itextpdf.layout.element.Tab;
import com.itextpdf.layout.properties.HorizontalAlignment;
import com.itextpdf.layout.properties.TextAlignment;
import com.itextpdf.layout.properties.VerticalAlignment;

private static void addCenteredParagraph(Document document, float width, String text) {
    PdfFont font = null;
    try {
        // ✅ 关键:使用系统中真实存在的 TTF 文件 + CP1250 编码
        // Windows 示例路径(请按实际环境调整):
        font = PdfFontFactory.createFont("C:/Windows/Fonts/arial.ttf", PdfEncodings.CP1250, true);
        // Linux/macOS 可替换为:"/usr/share/fonts/truetype/dejavu/DejaVuSans.ttf"
    } catch (Exception e) {
        // 回退到支持 Unicode 的 Noto Sans(需提前下载字体文件)
        try {
            font = PdfFontFactory.createFont("path/to/noto-sans-hungarian.ttf", PdfEncodings.IDENTITY_H, true);
        } catch (Exception ex) {
            throw new RuntimeException("No suitable font available for Hungarian characters", ex);
        }
    }

    // 构建居中段落(使用 TabStops 实现水平居中)
    Paragraph p = new Paragraph()
            .setFontSize(14)
            .setFont(font)
            .setTextAlignment(TextAlignment.CENTER) // 更简洁的居中方式(推荐)
            .add(text);

    document.add(p);
}

? 关键注意事项:

  • PdfEncodings.CP1250 是 Windows-1250 编码,原生覆盖 ő(0xF5)、ű(0xFB)、Ő(0xD5)、Ű(0xDB)等字符;而 PdfEncodings.UTF8 在 iText 7 中不适用于 TTF 字体加载(该参数仅对旧式 Type 1 字体或嵌入子集有效)。
  • 若需跨平台部署,建议将 arial.ttf 替换为开源字体如 Noto Sans(需下载 .ttf 文件),并改用 IDENTITY_H 编码(支持完整 Unicode):
    PdfFont noto = PdfFontFactory.createFont("noto-sans-v27-latin-ext-regular.ttf", PdfEncodings.IDENTITY_H, true);
  • 避免使用 StandardFonts 加载的字体处理多语言文本——它们仅适合英文 ASCII 场景。
  • Java 源文件本身必须保存为 UTF-8 编码,确保字符串字面量(如 "Árvíztűrő tükörfúrógép")能被正确编译;iText 的 IDENTITY_H 或 CP1250 处理的是字体内部映射,与源码编码无关。

✅ 总结:要让 ő, ű 稳定显示,请始终
① 使用本地 .ttf 字体文件(非 StandardFonts);
② 指定 PdfEncodings.CP1250(Windows 环境)或 PdfEncodings.IDENTITY_H(通用 Unicode,需字体含对应字形);
③ 优先采用 Paragraph.setTextAlignment(TextAlignment.CENTER) 替代复杂 TabStop 逻辑,提升可维护性。

热门AI工具

更多
DeepSeek
DeepSeek

幻方量化公司旗下的开源大模型平台

豆包大模型
豆包大模型

字节跳动自主研发的一系列大型语言模型

通义千问
通义千问

阿里巴巴推出的全能AI助手

腾讯元宝
腾讯元宝

腾讯混元平台推出的AI助手

文心一言
文心一言

文心一言是百度开发的AI聊天机器人,通过对话可以生成各种形式的内容。

讯飞写作
讯飞写作

基于讯飞星火大模型的AI写作工具,可以快速生成新闻稿件、品宣文案、工作总结、心得体会等各种文文稿

即梦AI
即梦AI

一站式AI创作平台,免费AI图片和视频生成。

ChatGPT
ChatGPT

最最强大的AI聊天机器人程序,ChatGPT不单是聊天机器人,还能进行撰写邮件、视频脚本、文案、翻译、代码等任务。

相关专题

更多
string转int
string转int

在编程中,我们经常会遇到需要将字符串(str)转换为整数(int)的情况。这可能是因为我们需要对字符串进行数值计算,或者需要将用户输入的字符串转换为整数进行处理。php中文网给大家带来了相关的教程以及文章,欢迎大家前来学习阅读。

503

2023.08.02

java中boolean的用法
java中boolean的用法

在Java中,boolean是一种基本数据类型,它只有两个可能的值:true和false。boolean类型经常用于条件测试,比如进行比较或者检查某个条件是否满足。想了解更多java中boolean的相关内容,可以阅读本专题下面的文章。

351

2023.11.13

java boolean类型
java boolean类型

本专题整合了java中boolean类型相关教程,阅读专题下面的文章了解更多详细内容。

34

2025.11.30

js 字符串转数组
js 字符串转数组

js字符串转数组的方法:1、使用“split()”方法;2、使用“Array.from()”方法;3、使用for循环遍历;4、使用“Array.split()”方法。本专题为大家提供js字符串转数组的相关的文章、下载、课程内容,供大家免费下载体验。

360

2023.08.03

js截取字符串的方法
js截取字符串的方法

js截取字符串的方法有substring()方法、substr()方法、slice()方法、split()方法和slice()方法。本专题为大家提供字符串相关的文章、下载、课程内容,供大家免费下载体验。

212

2023.09.04

java基础知识汇总
java基础知识汇总

java基础知识有Java的历史和特点、Java的开发环境、Java的基本数据类型、变量和常量、运算符和表达式、控制语句、数组和字符串等等知识点。想要知道更多关于java基础知识的朋友,请阅读本专题下面的的有关文章,欢迎大家来php中文网学习。

1503

2023.10.24

字符串介绍
字符串介绍

字符串是一种数据类型,它可以是任何文本,包括字母、数字、符号等。字符串可以由不同的字符组成,例如空格、标点符号、数字等。在编程中,字符串通常用引号括起来,如单引号、双引号或反引号。想了解更多字符串的相关内容,可以阅读本专题下面的文章。

625

2023.11.24

java读取文件转成字符串的方法
java读取文件转成字符串的方法

Java8引入了新的文件I/O API,使用java.nio.file.Files类读取文件内容更加方便。对于较旧版本的Java,可以使用java.io.FileReader和java.io.BufferedReader来读取文件。在这些方法中,你需要将文件路径替换为你的实际文件路径,并且可能需要处理可能的IOException异常。想了解更多java的相关内容,可以阅读本专题下面的文章。

676

2024.03.22

2026赚钱平台入口大全
2026赚钱平台入口大全

2026年最新赚钱平台入口汇总,涵盖任务众包、内容创作、电商运营、技能变现等多类正规渠道,助你轻松开启副业增收之路。阅读专题下面的文章了解更多详细内容。

54

2026.01.31

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
PostgreSQL 教程
PostgreSQL 教程

共48课时 | 8.2万人学习

Git 教程
Git 教程

共21课时 | 3.2万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号