JAVA将中文转换为拼音简单实现方法

 更新时间:2024年10月15日 09:29:04   作者:天天都要早睡  
拼音转换是中文处理的常见需求,TinyPinyin、HanLP、pinyin4j是常用的本地拼音转换库,各有特点,开发者可根据具体需求选择合适的拼音转换工具,需要的朋友可以参考下

一、TinyPinyin

TinyPinyin 是一个轻量级且高效的拼音转换库。它适用于Android和Java项目。

TinyPinyin 是一个轻量级且高效的拼音转换库,特别适用于移动设备和需要高性能的场景。它采用了较为简单的实现方式,性能较好。

  • 依赖
<dependency>
    <groupId>com.github.promeg</groupId>
    <artifactId>tinypinyin</artifactId>
    <version>2.0.3</version>
</dependency>
  • 示例
import com.github.promeg.pinyinhelper.Pinyin;

public class ChineseToPinyin {
    public static void main(String[] args) {
        String chinese = "你好,世界!";
        System.out.println("Chinese: " + chinese);
        System.out.println("Pinyin: " + convertToPinyin(chinese));
    }

    public static String convertToPinyin(String chinese) {
        return Pinyin.toPinyin(chinese, "");
    }
}

二、HanLP

HanLP 是一个功能强大的自然语言处理库,支持中文分词、词性标注、命名实体识别等功能,同时也支持拼音转换。

HanLP 是一个功能强大的自然语言处理库,支持多种NLP任务,包括拼音转换。虽然功能强大,但其整体性能可能会受到库中其他功能的影响,加载时间和内存占用可能较高。不过,HanLP的拼音转换部分效率也不错,适合需要多功能NLP处理的场景。

  • 依赖
<dependency>
    <groupId>com.hankcs</groupId>
    <artifactId>hanlp</artifactId>
    <version>1.7.8</version>
</dependency>
  • 示例
import com.hankcs.hanlp.HanLP;

public class ChineseToPinyin {
    public static void main(String[] args) {
        String chinese = "你好,世界!";
        System.out.println("Chinese: " + chinese);
        System.out.println("Pinyin: " + convertToPinyin(chinese));
    }

    public static String convertToPinyin(String chinese) {
        return HanLP.convertToPinyinString(chinese, " ", false);
    }
}

三、pinyin4j

Pinyin4j 是一个经典的拼音转换库,功能全面,但其性能可能不如TinyPinyin。对于大规模文本处理,Pinyin4j的性能可能稍逊一筹。

  • 依赖
<dependency>
    <groupId>com.belerweb</groupId>
    <artifactId>pinyin4j</artifactId>
    <version>2.5.0</version>
</dependency>
  • 示例
import net.sourceforge.pinyin4j.PinyinHelper;
import net.sourceforge.pinyin4j.format.HanyuPinyinCaseType;
import net.sourceforge.pinyin4j.format.HanyuPinyinOutputFormat;
import net.sourceforge.pinyin4j.format.HanyuPinyinToneType;
import net.sourceforge.pinyin4j.format.exception.BadHanyuPinyinOutputFormatCombination;

public class ChineseToPinyin {
    public static void main(String[] args) {
        String chinese = "你好,世界!";
        System.out.println("Chinese: " + chinese);
        System.out.println("Pinyin: " + convertToPinyin(chinese));
    }

    public static String convertToPinyin(String chinese) {
        HanyuPinyinOutputFormat format = new HanyuPinyinOutputFormat();
        format.setCaseType(HanyuPinyinCaseType.LOWERCASE);
        format.setToneType(HanyuPinyinToneType.WITHOUT_TONE);

        StringBuilder pinyin = new StringBuilder();

        for (char c : chinese.toCharArray()) {
            try {
                if (Character.toString(c).matches("[\\u4E00-\\u9FA5]+")) { // Check if the character is a Chinese character
                    String[] pinyinArray = PinyinHelper.toHanyuPinyinStringArray(c, format);
                    if (pinyinArray != null) {
                        pinyin.append(pinyinArray[0]); // Append the first pinyin result
                    }
                } else {
                    pinyin.append(c); // Append non-Chinese characters as is
                }
            } catch (BadHanyuPinyinOutputFormatCombination e) {
                e.printStackTrace();
            }
        }

        return pinyin.toString();
    }
}

四、Google Translate API

如果需要更加准确的拼音转换并且不介意使用网络服务,可以使用Google Translate API。不过,这种方法需要进行网络请求,并且可能需要API Key。需要申请API Key,并且可能会产生费用。

Google Translate API 是一个在线服务,性能主要受网络速度和API响应时间的影响。虽然准确性较高,但因为需要进行网络请求,效率通常不如本地库。伪代码如下:

import com.google.cloud.translate.Translate;
import com.google.cloud.translate.TranslateOptions;
import com.google.cloud.translate.Translation;

public class ChineseToPinyin {
    public static void main(String[] args) {
        String chinese = "你好,世界!";
        System.out.println("Chinese: " + chinese);
        System.out.println("Pinyin: " + convertToPinyin(chinese));
    }

    public static String convertToPinyin(String chinese) {
        Translate translate = TranslateOptions.getDefaultInstance().getService();
        Translation translation = translate.translate(
            chinese,
            Translate.TranslateOption.targetLanguage("zh-CN"),
            Translate.TranslateOption.format("text")
        );
        return translation.getTranslatedText();
    }
}

简单基准测试

import com.github.promeg.pinyinhelper.Pinyin;
import com.hankcs.hanlp.HanLP;
import net.sourceforge.pinyin4j.PinyinHelper;
import net.sourceforge.pinyin4j.format.HanyuPinyinCaseType;
import net.sourceforge.pinyin4j.format.HanyuPinyinOutputFormat;
import net.sourceforge.pinyin4j.format.HanyuPinyinToneType;
import net.sourceforge.pinyin4j.format.exception.BadHanyuPinyinOutputFormatCombination;

public class PinyinBenchmark {
    public static void main(String[] args) {
        String chinese = "中华人民共和国,欢迎您!";

        long startTime, endTime;

        // TinyPinyin
        startTime = System.currentTimeMillis();
        for (int i = 0; i < 10000; i++) {
            Pinyin.toPinyin(chinese, "");
        }
        endTime = System.currentTimeMillis();
        System.out.println("TinyPinyin: " + (endTime - startTime) + " ms");

        // HanLP
        startTime = System.currentTimeMillis();
        for (int i = 0; i < 10000; i++) {
            HanLP.convertToPinyinString(chinese, " ", false);
        }
        endTime = System.currentTimeMillis();
        System.out.println("HanLP: " + (endTime - startTime) + " ms");

        // Pinyin4j
        startTime = System.currentTimeMillis();
        for (int i = 0; i < 10000; i++) {
            convertUsingPinyin4j(chinese);
        }
        endTime = System.currentTimeMillis();
        System.out.println("Pinyin4j: " + (endTime - startTime) + " ms");
    }

    public static String convertUsingPinyin4j(String chinese) {
        HanyuPinyinOutputFormat format = new HanyuPinyinOutputFormat();
        format.setCaseType(HanyuPinyinCaseType.LOWERCASE);
        format.setToneType(HanyuPinyinToneType.WITHOUT_TONE);

        StringBuilder pinyin = new StringBuilder();

        for (char c : chinese.toCharArray()) {
            try {
                if (Character.toString(c).matches("[\\u4E00-\\u9FA5]+")) {
                    String[] pinyinArray = PinyinHelper.toHanyuPinyinStringArray(c, format);
                    if (pinyinArray != null) {
                        pinyin.append(pinyinArray[0]);
                    }
                } else {
                    pinyin.append(c);
                }
            } catch (BadHanyuPinyinOutputFormatCombination e) {
                e.printStackTrace();
            }
        }

        return pinyin.toString();
    }
}

总结 

到此这篇关于JAVA将中文转换为拼音简单实现的文章就介绍到这了,更多相关JAVA中文转换为拼音内容请搜索脚本之家以前的文章或继续浏览下面的相关文章希望大家以后多多支持脚本之家!

相关文章

  • 探究Java中Integer缓冲区底层原理

    探究Java中Integer缓冲区底层原理

    本文将会给大家讲一讲Integer这个包装类的底层原理。在现在的就业环境下,我们需要知其然,还要知其所以然,才能更好地满足就业需求,感兴趣的小伙伴可以参考阅读
    2023-05-05
  • maven依赖的version声明控制方式

    maven依赖的version声明控制方式

    这篇文章主要介绍了maven依赖的version声明控制方式,具有很好的参考价值,希望对大家有所帮助。如有错误或未考虑完全的地方,望不吝赐教
    2022-01-01
  • Idea中Springboot热部署无效问题解决

    Idea中Springboot热部署无效问题解决

    这篇文章主要介绍了Idea中Springboot热部署无效问题解决,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友可以参考下
    2019-11-11
  • java实现多数据源切换方式

    java实现多数据源切换方式

    本文介绍实现多数据源切换的四步方法:导入依赖、配置文件、启动类注解、使用@DS标记mapper和服务层,通过注解实现数据源动态切换,适用于实际开发中的多数据源场景
    2025-08-08
  • SpringBoot 整合 ShardingSphere4.1.1实现分库分表功能

    SpringBoot 整合 ShardingSphere4.1.1实现分库分表功能

    ShardingSphere是一套开源的分布式数据库中间件解决方案组成的生态圈,它由Sharding-JDBC、Sharding-Proxy和Sharding-Sidecar(计划中)这3款相互独立的产品组成,本文给大家介绍SpringBoot 整合 ShardingSphere4.1.1实现分库分表,感兴趣的朋友一起看看吧
    2023-12-12
  • 浅析Java中如何优雅地处理null值

    浅析Java中如何优雅地处理null值

    这篇文章主要为大家详细介绍了如何结合 Lambda 表达式和 Optional,让 Java 更优雅地处理 null 值,感兴趣的小伙伴可以跟随小编一起学习一下
    2025-04-04
  • Java多线程 ReentrantLock互斥锁详解

    Java多线程 ReentrantLock互斥锁详解

    这篇文章主要介绍了Java多线程 ReentrantLock互斥锁详解,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友可以参考下
    2019-09-09
  • 详解Spring boot上配置与使用mybatis plus

    详解Spring boot上配置与使用mybatis plus

    这篇文章主要介绍了详解Spring boot上配置与使用mybatis plus,小编觉得挺不错的,现在分享给大家,也给大家做个参考。一起跟随小编过来看看吧
    2017-05-05
  • 在SpringBoot中使用MongoDB完成数据存储

    在SpringBoot中使用MongoDB完成数据存储

    本文主要介绍了在SpringBoot中如恶化使用MongoDB完成数据存储,接下来这篇我们将围绕MongoDB进行,MongoDB是一个开源的,面向文档的NoSQL数据库管理系统,使用类似JSON的BSON(二进制JSON)格式来存储数据,具有灵活的数据模型和强大的查询功能,需要的朋友可以参考下
    2023-11-11
  • Java同时处理多个数据的常见方法

    Java同时处理多个数据的常见方法

    在Java中,同时处理多个数据通常涉及多线程、并发编程或异步编程,这里我将提供一个使用多线程的示例,因为多线程是处理多个数据并行的常见方式,文中有详细的代码示例供大家参考,需要的朋友可以参考下
    2024-11-11

最新评论