找回密码
 注册
搜索
查看: 704|回复: 2

【原创】全球编码统一的新思考与建议

[复制链接]
发表于 2005-8-19 10:47:31 | 显示全部楼层 |阅读模式
随着unicode的发明,世界信息语言也有全球化趋势,但是unicode并没有取代原有的编码,只是起辅助功能,而且结构很乱.为此,本人提出几个建议.
1.信息处理全面采用unicode(UTF-16)编码,以unicode为主,其他编码为辅,并有取代其他编码趋势.
2.精简unicode编码,一些罕用字就不加入unicode,而是采用一种特殊图片方式处理.一些已经消亡的语言(如EX-C中的古朝鲜语)、小语种(如彝文)和不常用的符号也不加入unicode,也采用一种特殊图片方式处理.这样留出更多的空位给其它语种,把unicode字数控制在65536个,
3.所有的字都统一为2个字节(16位元),不使用UTF-8
4.对编码的结构顺序进行调整,文字放前面,符号放中间,最后是图标
5.新字体均采用这种unicode
6.推动世界文字改革,拼音文字拉丁化(这种改革例子很多),以把unicode字数控制在65536个.

[ 本帖最后由 tiyz 于 2005-08-19 10:55:55 编辑 ]
发表于 2005-9-30 19:23:32 | 显示全部楼层
基本同意(没有看懂那些英文单词)
1、采取变码长内码(完全码)
2、精简码内码(精简码)全部采用1个字(两个字节)
3、精简码仅仅存放构字的基本元素:笔划、符号、字母、部首等,和一些常用字,甚至词(汉语词)。一些罕用字就不加入,采用完全码存储;一些已经消亡的语言(如EX-C中的古朝鲜语)、小语种(如彝文)和不常用的符号也不加入,也采用完全码存储。
4、对编码的结构顺序进行调整:符号,各个语种。
5、各个语种及其符号聚集在一起,不得分开
6、每个语种都是符号放前面,文字放最后面
7、汉语的存放格式:笔划、部首、汉字、词。计50个笔划、几百个部首、几千个常用字、几千个词。给汉字预留2万个字的空间完全能适应。

[ 本帖最后由 foxsql 于 2005-09-30 20:15:48 编辑 ]
发表于 2005-10-23 11:39:03 | 显示全部楼层
我看这个统一还是没必要
计算机在发展
存储容量和处理速度一直再加快
你们因该想想把字符编码再加长
用双字 就是4个字节
这样就可以记录4294967296个字符
就有能力把世界上所有的字符记录到这个字库里面
我们先自己定义 后推广普及
一定会得到支持的
您需要登录后才可以回帖 登录 | 注册

本版积分规则

手机版|小黑屋|中语书院

GMT+8, 2026-9-4 21:33 , Processed in 0.023211 second(s), 16 queries .

Powered by Discuz! X3.5

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表