中文繁体和简体相互转换

/**

 * 繁体和简体的转换

 * 

 */

public class TrandtionalToSimplified {

private static String encoding = "utf-8";

private static String tra;

private static String sim;

 

/**

* 初始化繁体和简体字库

*/

public static void initChars() {

String trapath = TrandtionalToSimplified.class.getResource(

"tranditional.txt").getPath();

File trafile = new File(trapath);

String simpath = TrandtionalToSimplified.class.getResource(

"simplified.txt").getPath();

File simfile = new File(simpath);

try {

tra = FileUtils.readFileToString(trafile, encoding);

sim = FileUtils.readFileToString(simfile, encoding);

} catch (IOException e) {

e.printStackTrace();

}

}

 

/**

* 简体转繁体

* @param simplified

* @return

*/

public static String simTotra(String simplified) {

if (sim == null) {

initChars();

}

String traditional = "";

for (int i = 0; i < simplified.length(); i++) {

if (sim.indexOf(simplified.charAt(i)) != -1) {

traditional += tra.charAt(sim.indexOf(simplified.charAt(i)));

} else {

traditional += traditional.charAt(i);

}

}

return traditional;

}

 

/**

* 繁体转简体

* @param traditional

* @return

*/

public static String traTosim(String traditional) {

if (tra == null) {

initChars();

}

String simplified = "";

for (int i = 0; i < traditional.length(); i++) {

if (tra.indexOf(traditional.charAt(i)) != -1) {

simplified += sim.charAt(tra.indexOf(traditional.charAt(i)));

} else {

simplified += traditional.charAt(i);

}

}

return simplified;

}

 

/**

* 判断是否是繁体

* @param str

* @return

*/

public static boolean isTrandtional(String str) {

if (null == str)

return false;

if (str.trim() == " ")

return false;

byte[] bytes = str.getBytes();

if (bytes.length < 2)

return false;

byte aa = (byte) 0xB0;

byte bb = (byte) 0xF7;

byte cc = (byte) 0xA1;

byte dd = (byte) 0xFE;

if (bytes[0] >= aa && bytes[0] <= bb) {

if (bytes[1] < cc || bytes[1] > dd) {

return false;

}

return true;

}

return false;

}

 

/**

* 判断是否是简体

* @param str

* @return

*/

public static boolean isSimplified(String str) {

if (null == str)

return false;

if (str.trim() == " ")

return false;

byte[] bytes = str.getBytes();

if (bytes.length < 2)

return false;

byte aa = (byte) 0xB0;

byte bb = (byte) 0xF7;

byte cc = (byte) 0xA1;

byte dd = (byte) 0xFE;

if (bytes[0] >= aa && bytes[0] <= bb) {

if (bytes[1] < cc || bytes[1] > dd) {

return true;

}

return false;

}

return false;

}

Lazarus 将gb2312的MemoryStream转换成String 业余爱好用lazarus写了个小程序读取网页数据,读取数据很快就实现了。但是碰到了汉字编码的问题,乱码。 实现过程: 1.用IndHttp 读取网页数据,获取的数据会放在TMemoryStream 里面 2.将TMemoryStream 里面的数据提取到String里面显示出来。 碰到的问题: 1.用TStringStream, 强制类型转换TMemoryStream 里面的数据,然后读 阅读详情

相关推荐

金融科技创新中人工智能的应用:8篇优质论文精选(含2023)

随着科技的飞速发展,金融领域正经历着前所未有的变革。在这个过程中,人工智能技术发挥着越来越重要的作用。为了深入探讨金融人工智能的研究应用,享享特地整理了几篇金融人工智能方面的论文,大家可以看一下金融人工智能方向最新的研究成果!面向金融领域的大型语言模型本文介绍了BloombergGPT,一个基于广泛金融数据训练的500亿参数模型。基于彭博(Bloomberg)广泛数据来源,建立了一个基于彭博数据的3630亿令牌数据集,并结合了额外3450亿通用数据令牌。

2401_82426425的博客 3180

UTF-7 邮件安全的 Unicode 转换编码

摘要Unicode标准,2.0版本, 以及ISO/IEC 10646-1联合定义了一种字符集,它包含了世界上大多数可书写的字符系统。(后文都直接用Unicode一词)。事实上,因特网邮件(STD 11, RFC 822)目前所支持的仅仅是7-bit的ASCII字符集。MIME(RFC 2045到2049)扩展了网络邮件以支持不同的媒体类型字符集,也因此能够在邮件信息里支持Unicode了

...... 3366

YOLOv13涨点改进| CVPR 2026 |独家创新首发、主干改进篇 |利用RIS-PiDiNet主干让YOLOv13更加强大!适合遥感目标检测、小目标检测、旋转目标检测,变化检测,图像分割涨点

🔥本文提出了一种改进的RIS-PiDiNet主干网络,通过引入几何先验构建几何一致性检测器,显著提升了模型在任意方向、结构规则目标场景下的检测性能。包含两个核心模块:S-PDC利用极谐变换的谐波核建模目标结构对称性,RIS-PDC通过SO(2)群平均实现旋转不变性。网络采用基于RIS-block的主干结构并融合轻量级LBP特征,增强了细粒度结构表达能力。实验表明,该方法特别适用于遥感复杂几何分布场景,能有效提升目标检测的鲁棒性精度。文章还详细介绍了如何将RIS-PiDiNet集成到YOLOv13框架

Ai缝合怪、助力小伙伴高效发论文 69

编码格式转换--常见编码间的转换以及中文简繁互换

常见编码间的转换,例如:中文 GB2312/UTF8/UTF7/Unicode/ASCII/UTF32/GBK/BIG5。代码如下: 但是不能解决转换是出现乱码问题。这是我一直没有解决的问题。很头疼。 ///        /// 不同编码间的相互转换       ///        /// 输入字符串的编码格式        /// 处理后字符串的编码格式       /// 

Guixue 4405

在Lazarus中对字符串进行代码页转换

由于Lazarus基于UTF-8,因此当读写Windows建立的纯文本文件的时候,由于其中的中文使用GBK(CP936)编码,可能会出现错误。此时可使用Lazarus自带的代码页转换单元LConvEncoding对编码进行转换。如UTF8GBK互转function CP936ToUTF8(const s: string): string; // Chinese function UTF8

晓风残露 3027

java 中文繁体转换简体

方法一 :ZHConverter 使用ZHConverter可以进行中文的繁简体转换 maven依赖: <!-- https://mvnrepository.com/artifact/com.github.nobodxbodon/zhconverter --> <dependency> <groupId>com.github.nobodxbodon</groupId> <artifactId>zhconverter</...

serialization_rong的博客 7642

中文字符 简体繁体相互转换

package tatung.util.base; import java.util.HashMap; import java.util.Map; import java.util.Scanner; /**  * 思路二:采用哈希算法实现  */ public class JianFanConvert {     public static final String jia

Charles_yee的博客 1881

在英文版的Office 2007中实现 中文 繁体简体相互转换

<br /> <br />默认安装的英文版Office 2007 standard (也就是仅包括word, excel, powerpoint, outlook简装版)<br /> <br />转换简体繁体中文的时候:<br /> <br />在word 2007的菜单里: Review> "Chinese translation" ribbon<br /> <br />选择转换 "简Simplified", "繁Traditional", 都会出现: <br /> <br />类似more than

stereohomology 1万+

简体繁体相互转换

简体繁体相互转换 //$type=1 简体繁体 //$type=2 繁体简体 //$str = '爱国' 转内容 function font_conversion($type, $str) { $jians = "么万与丑专业丛东丝丢两严丧个丬丰临为丽举么义乌乐乔习乡书买乱争于亏云亘亚产亩亲亵亸亿仅从仑仓仪们价众优伙会伛伞伟传伤伥伦伧伪伫体余佣佥侠侣侥侦侧侨侩侪侬俣俦俨俩俪俭债倾偬偻偾偿傥傧储傩儿兑兖党兰关兴兹养兽冁内冈册写军农冢冯冲决况冻净凄凉凌减凑凛几凤凫凭凯击凼凿刍划刘则刚创删别刬刭刽

john987321456的博客 1670

Python--繁体中文简体中文相互转换

工作中需要将繁体中文转换简体中文 上网找了些资料,发现这个包最方便 安装方法 不需要什么安装方法,只需要把这两个文件下载下来,保存到与代码同一目录下即可 https://raw.githubusercontent.com/skydark/nstools/master/zhtools/langconv.py https://raw.githubusercontent.com/skydark/nst...

直到世界的尽头 3万+

中文繁体简体相互转换simplified.txt文件

啊阿埃挨哎唉哀皑癌蔼矮艾碍爱隘鞍氨安俺按暗岸胺案肮昂盎凹敖熬翱袄傲奥懊澳芭捌扒叭吧笆八疤巴拔跋靶把耙坝霸罢爸白柏百摆佰败拜稗斑班搬扳般颁板版扮拌伴瓣半办绊邦帮梆榜膀绑棒磅蚌镑傍谤苞胞包褒剥薄雹保堡饱宝抱报暴豹鲍爆杯碑悲卑北辈背贝钡倍狈备惫焙被奔苯本笨崩绷甭泵蹦迸逼鼻比鄙笔彼碧蓖蔽毕毙毖币庇痹闭敝弊必辟壁臂避陛鞭边编贬扁便变卞辨辩辫遍标彪膘表鳖憋别瘪彬斌濒滨宾摈兵冰柄丙秉饼炳病并玻菠播拨钵波博勃搏铂...

程序员的艺术人生! 2791

中文繁体简体相互转换tranditional.txt文件

啊阿埃挨哎唉哀皚癌藹矮艾礙愛隘鞍氨安俺按暗岸胺案骯昂盎凹敖熬翱襖傲奧懊澳芭捌扒叭吧笆八疤巴拔跋靶把耙壩霸罷爸白柏百擺佰敗拜稗斑班搬扳般頒板版扮拌伴瓣半辦絆邦幫梆榜膀綁棒磅蚌鎊傍謗苞胞包褒剝薄雹保堡飽寶抱報暴豹鮑爆杯碑悲卑北輩背貝鋇倍狽備憊焙被奔苯本笨崩繃甭泵蹦迸逼鼻比鄙筆彼碧蓖蔽畢斃毖幣庇痺閉敝弊必辟壁臂避陛鞭邊編貶扁便變卞辨辯辮遍標彪膘表鱉憋別癟彬斌瀕濱賓擯兵冰柄丙秉餅炳病並玻菠播撥缽波博勃搏鉑...

程序员的艺术人生! 948

C#实现简体繁体之间转换

C#实现简体繁体之间转换 1.下载ChineseConverter.dll         链接地址:http://pan.baidu.com/s/1kTxZEuz 2.包含using Microsoft.International.Converters.TraditionalChineseToSimplifiedConverter; 命名空间 3.繁体简体转换函数 public st

小小的CODEING的专栏 6542

繁体简体之间的转化

中文简体繁体之间的转换方便之处在于每一个简体字与每一个繁体字一一对应。这样我们就可以利用map。对每一个字符进行一一转换。一下是代码。import java.io.BufferedReader;import java.io.File;import java.io.FileNotFoundException;import java.io.FileReader;import

bbzhouxinxin的专栏 6462

Vb 实现简体繁体

 //LCmapString  映像字符串Private Declare Function LCMapString Lib "kernel32" Alias "LCMapStringA" ( _                                                                          ByVal Locale As Long, _     

yulu380393306的专栏 1403

汉字简繁体转换

  今天早上看到有个兄弟发了篇汉字简繁体转换的文章,俺也来凑个热闹。      下面是手动实现的方法:   1、搜集简体汉字集:    代码 private static string GetSimplifiedChinese(){ return @"皑蔼碍爱翱袄奥坝罢摆败颁办绊帮绑镑谤剥饱宝报鲍辈贝钡狈备惫绷笔毕毙闭边编贬变辩辫鳖瘪濒滨宾摈饼拨钵铂驳卜补参蚕...

weixin_33738578的博客 225

繁体转换问题解决办法

1、繁体字编码应该是big5编码的,这里假设原来简体字符串为gbstring,转换后为kk;代码如下:string kk=Encoding.GetEncoding("big5").GetString(Encoding.Convert(Encoding.GetEncoding("gb2312"),Encoding.GetEncoding("big5"),Encoding.GetEncoding("b

樱*夜精灵 2480

Encoding数据格式转化

string u16s = "测试数据abc"; //默认的字符编码是unicode,也就是utf16 //4种编码 Encoding utf8 = Encoding.UTF8; Encoding utf16 = Encoding.Unicode; Encoding gb = Encoding.GetEncoding("gbk"); E...

qq_42899641的博客 1140

简繁转换

注: 原来的linux-wiki突然当掉了,于是就粘贴过来: http://www.linux-wiki.cn/index.php?title=%E7%AE%80%E7%B9%81%E8%BD%AC%E6%8D%A2&variant=zh-tw 漢字簡繁轉換的意義不言而喻

1202

简体中文繁体中文转换

目前,大陆地区常见的中文编码有以下三种。 GB2312 GB2312(1980年)一共收录了7445个字符,包括6763个汉字682个其它符号。汉字区的内码范围高字节从B0-F7,低字节从A1-FE,占用的码位是72*94=6768。其中有5个空位是D7FA-D7FE。在windows中的代码页是CP936。 GBK GBK最初是由微软对GB2312的扩展,也就是CP936字码表 (Code P...

weixin_34360651的博客 1617

YOLO无人机目标检测数据集(含1000张图片)+对应voc、cocoyolo三种格式标签+划分脚本+训练教程.rar

1、YOLO无人机目标检测数据集,真实场景的高质量图片数据,数据场景丰富。使用lableimg标注软件标注,标注框质量高,含voc(xml)、coco(json)yolo(txt)三种格式标签,分别存放在不同文件夹下,可以直接用于YOLO系列的目标检测。2、附赠YOLO环境搭建、训练案例教程数据集划分脚本,可以根据需求自行划分训练集、验证集、测试集。3、数据集详情展示更多数据集下载:https://blog.csdn.net/m0_64879847/article/details/132301975

上一篇: 词性标注程序探讨
下一篇: 中文繁体和简体相互转换simplified.txt文件
iteye_10664
博客等级 码龄8年 0粉丝 38原创
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值