找回密码
 注册
搜索
查看: 925|回复: 7

【讨论】汉语还有再简化的余地或方法吗?语言文字跟经济的关系有多大?

[复制链接]
发表于 2006-3-2 17:15:14 | 显示全部楼层 |阅读模式
汉语还有再简化的余地或方法吗?语言文字跟经济的关系有多大?

1、汉语还有再简化的余地或方法吗?从56年加入拼音辅助方案,汉语经历了几次简化,由少到多?书写速度确实比原来快多了,扫文盲率也高点,但后间就停下来了,相对稳定的发展。不再简化,且出现新字的机率也低得难得一见。

2、语言文字跟经济的关系有多大?为什么简化后,中国大陆的经济仍然没有台湾或是香港这些地区的发展速度快?且创新能力也看不出比他们强?这样是否影响到我们的就业率?

3、汉语对于实现全民免费教育有多大的可能性,多方面的免费福利的可能性有多大?是否再次的简化?能解决这些存在的问题?

板主们,朋友们有何高见?

{han menoji foda mim mons hida omenotv sindatv?......}

汉语工具能帮我们做多少有效的事情?

——opagin进化道(叶佳)*书
       2006年3月2日星期三揭阳
       QQ:76973266


[ 本帖最后由 opagin进化道 于 2006-03-02 17:30:42 编辑 ]
发表于 2006-3-2 17:57:05 | 显示全部楼层
汉字不会再简化

象形文字向符号文字的发展,为表义文字的简化提供了条件。冯志伟计算汉字的信息熵为9点多,印欧文是3——5。可见汉字仍有很大简化空间。但社会交流要求文字稳定,汉字在既有方式和结构上的简化不能带来更多效益,故汉字不可能再简化。要变只可能向拼音化变,因为这可能带来信息处理的效益。
发表于 2006-3-14 22:41:44 | 显示全部楼层
冯志伟的理论依据是错误的,基于笔划的漢字信息熵4点多。信息处理的效益不等于科学效益,首先考虑科学的效益,然后是信息,然后是生产、经济,最后其他。漢字拼音化降低科学效益,因此不能拼音化。

现在漢字简化停止的原因还有一个,就是使用计算机打字了,繁简与书写速度已不是主要矛盾。
发表于 2006-4-5 10:25:03 | 显示全部楼层
引用
原文由 Echinese 发表于 2006-3-2 17:57:05 :

汉字不会再简化

象形文字向符号文字的发展,为表义文字的简化提供了条件。冯志伟计算汉字的信息熵为9点多,印欧文是3——5。可见汉字仍有很大简化空间。但社会交流要求文字稳定,汉字在既有方式和结构上的简化不能带来更多效益,故汉字不可能再简化。要变只可能向拼音化变,因为这可能带来信息处理的效益。



信息熵是用在通訊方面的數學模型概念, 而且是用於離散的通訊系統不是連續的通訊系統, 信訊熵用以衡量一個指定符號(代表了一個或一組訊號)的出現機率的, 是一個不確定性的測量數字, 最後引伸到衡量通道的通訊容量(通道=大陸譯作信道channel, 通訊道路之謂, 可看作是一條通訊線路)。信息熵根本不是電腦的設計概念, 完全用錯地方。在這裡先生把信息熵錯誤地轉用了兩次, 一、由通訊(而且還是離散訊號的)轉用到電腦(是連續訊號), 二、把取樣統計(樣本sample)視為全部樣本空間(母體population)(註1), 另外還有一隱藏的錯誤是信息熵大即說有簡化空間(第一步錯), 也是錯誤的論述, 這是通訊編碼上的事, 要簡化是指通訊上編碼的簡化, 但也要有一個標準才可以作研判, 完全跟電腦的中文內碼編排無關; 再者接下來的第二步錯就是取歐文的信息熵作比較, 若要比是以中文內碼跟歐文的內碼比, 不是文字符號(但第一步已錯, 第二步是越錯越離譜), 第三步又說「社会交流要求文字稳定,汉字在既有方式和结构上的简化不能带来更多效益,故汉字不可能再简化。」這個簡化本是指通訊編碼上的重新安排, 一個常用符號若用佔時間長的訊號代表, 如e常用, 不用佔時一秒的「點」訊號編碼, 卻用佔時三秒的「横」訊號來編碼, 這就浪費時間, 即降低通道容量。(註: 「點」和「横」是摩斯電碼的兩個基本訊號。)所以要說「社会交流要求文字稳定.....故汉字不可能再简化。」根本兩者是無關係的事, 卻混在一起。漢字簡化, 跟該被簡化的字的出現率有何相關(註2)。簡化了, 該字就會多些出現嗎? 來個反方向思考, 「的」是出現率最高的字之一, 現在把它「繁化」增力筆劃, 那照理論說, 就是這個繁化後的「的」字便會出現得少了。有這種道理嗎? 「柝」是古時晚上打更報時用的竹筒, 現在想辦法把它簡化, 於是這個「柝」字就出現得多了, 可能嗎? (因為現在已經沒有晚上打更巡夜的更夫了!)
060409補(未發表) 註1: 信息熵實驗所取樣的是現實文章且其字符集是全字符集。但現實文章中所取用的中文字只有全中文字集合(自古至今十萬)的一部份, 不齊全; 不若英文現實文章所取用字母是其全字母集合(26個字母)已齊全; 兩者的現實文章的取樣空間即不同, 怎可以相比? (中文有十萬字, 相對於歐文26字母, 以統計術語講, 中文的群體幾可叫無限群體infinite population, 而英文叫有限群體finite population)。)
註2: 信息熵= 用一極其簡單的粗略說法, 信息熵就是指某字符出現的機率; 更確切講是出現機率的倒數的對數logarithm)。信息熵大表示大堆的字符中, 某字符的出現率低, 或說其出現的不確定性較高。

錯錯錯!!! 把信息熵觀念用到這個漢改上, 完全是科盲!!!即如foxql之前曾說過的張時釗老師說的字母只相當於中文的筆劃等級(這是對的), 但卻也被誤導到用馮志偉的信息熵來作為漢字信息熵的這樣的錯誤路上。信息熵只用在通訊上(而且是離散通訊系統, 不是連續通訊系統)傳輸訊號(這裡是傳文字的內碼或聲音或影像或其他訊號)的編碼衡量。對不同文字的信息熵研究是對其基本字符集這個全樣本空間編碼(用點和横), 再更進一步說 , 現在的電腦間通訊所傳輸的, 以英文字母為例, 不是「a=.- b=-... c=-.-. ......(信息熵就是研究這個編碼)http://www.babbage.demon.co.uk/morseabc.html」, 而是ascii碼(這是電腦內碼) 「a=HEX61 b=HEX62 c=HEX63 .... http://www.lookuptables.com/」, 兩種碼根本是兩件事。所以張老師也跟著馮志偉在搞漢字信息熵, 也是走錯路了!!!

漢字信息熵是一個錯誤的觀念, 利用大眾的科盲(註)把一大堆人推向漢改, 是非常不道德的!!!

註: 大眾本來就不是電腦的專業人士, 當然是電腦科盲, 這個詞並不是有貶意, 而是述說事實, 即大眾是不懂電腦的內部結構、設計及咦髟?淼摹
发表于 2006-4-7 00:53:34 | 显示全部楼层
1. 2樓: 「象形文字向符号文字的发展,为表义文字的简化提供了条件。」
=> 發展? 敢情這又是中了盧梭的毒了:
瞿秋白又由馬克思學到了盧梭的《语言起源论》的三對應論“这三种书写方式与人类
据以组成民族的三种不同状态完全对应。描画物体适合于野蛮民族,使用字句式符号
适合于原始民族,使用字母适合于文明民族.”
見(汉字起源论坛 http://www.hzqylt.cn/01.htm 二 从卢梭到瞿秋白)

2. 上面4樓的附加解說: 「若要比是以中文內碼跟歐文的內碼比, 不是文字符號」
電腦之間的通訊不是用代表了人的文字的通訊編碼, 而是直接採用電腦內部的內碼。於
是, 大家又可看到傳輸或處理中文信息(註)時漢文比不上歐文的謬論了。既然中文和歐
文都是內碼, 全是0101010...., 不管電腦內部或電腦外部的電腦之間的通訊, 中文和英
文都已是010101...., 兩者比較起來, 根本就沒有差別了。再者, 不要說一個字母佔一
位元組(字節)而中文要佔用兩位元組(字節)的廢話, 要傳送或處理(註)的必定是一篇文
章, 也即有意義的事件或事物; 就算是單一意義的詞, 通常中文都比英文短。同樣內容
的文章, 其所佔用位元組(字節)數目, 中文版本的只有英文版本的60%; 這反而證明了
中文比英文等拼音文字優越。
註: 所謂中文處理, 其實只有文秘的文字編輯而已, 其他的咚愫臀淖譄o關。
发表于 2006-4-9 06:29:07 | 显示全部楼层
首先,纠正楼主一个错误,"台湾\香港"是地区,不是国家.

另外,

一个地区或国家的经济发展的快慢,是由政治制度\人民平均文化技术水平\原先的经济技术积累基础\外部环境等多种因素综合作用的结果.文字的情况如何,直接影响到人民的平均文化水平,间接地作用于经济,而且这个间接作用比其他的直接作用因素弱得多.
发表于 2006-4-10 19:50:32 | 显示全部楼层
軍事、經濟、文化、宗教是互相影響的, 你無法說那一個是決定性的影響因素(或說借用西方唯字派哲學謬論的「第一性」好了), 歷史的發展, 很難講出一個整體規律, 總有偶然和必然的更疊出現。人的智慧總是永遠比不上自然, 因為人的肉體受到自然的時空限制, 人的思想可以天馬行空, 但終歸要回到現實。文字只是文化裡面的一部份, 作為一個承載資的符號體系。

在問中文或國語有沒有簡化的餘地及方法之前, 必先要問是否有其必要性。認為必要, 又要問所產生的正面作用和負面的副作用, 兩者利益得失, 必要權量清楚。而衡量一件事, 或做一個決策, 又要想到時空的有效性及限制性。你蒐集的資訊足夠嗎? 你真能看到現在全部的空間? 能看到未來嗎?

5樓說了:
由「盧梭→黑格爾→馬克思」的途徑, 瞿秋白得到盧梭的《语言起源论》中的三對應論:
“这三种书写方式与人类据以组成民族的三种不同状态完全对应。描画物体适合于野蛮民族
,使用字句式符号适合于原始民族,使用字母适合于文明民族.”
(見: 汉字起源论坛 http://www.hzqylt.cn/01.htm 二 从卢梭到瞿秋白)
於是, 揭開了漢字拉丁化夢魘的序幕。 盧梭這個法國人, 對東方, 尤其中國是不瞭解的, 他
所見的所謂象形字、描畫物體, 全是在法國的非洲殖民地所見的非洲人的象形圖文, 相當於
我們中國比甲骨文還更更古遠的陶文或繩文的舊石器時代的圖文。
那麼這個中共創始人之一的瞿秋白, 和被感染的錢玄同、魯迅等, 就以為馬克思所引述自盧梭
的「描画物体」就是我們象形字的漢字。錯誤地用別人的理論亂套到自己身上。四川人不但吃
辣, 而且吃的辣是麻辣, 吃了可以辣到頭皮發癢的。我們外省的沒吃慣, 一聽說好吃就大口大
口地吃一大鍋, 這可要吃出毛病的。同一件東西, 用在別人身上有用的不一定對我是有用。電
腦也是好東西, 但朱邦復還未搞出中文電腦化的解決技術之前, 我們也只能看得發呆, 要嗎就
把英文學好些, 用英文了。

台灣在國民政府撤退過來之時, 經濟也是很慘的, 米價一日數漲, 所以後來才有發行新台幣,
把舊台幣換掉, 及各種政策穩定貨幣。但是, 中華民國憲法就是規定國家預算百份之十五是教
育經費, 再窮, 100塊錢也是要花至少15塊錢在教育上。而且教育的成效又不是馬上可見的。
至少都要近二十年才有成果看到。國家要建設, 就要自己培養人才, 而這是沒有投機取巧的。
发表于 2006-4-17 01:46:19 | 显示全部楼层
5樓補充 060412補
「冯志伟计算汉字的信息熵为9点多,印欧文是3——5。可见汉字仍有很大简化空间。」
1. → 設若印歐文的信息熵是5, 這句話表示馮的實驗所用的現實文章中, 平均一特定中文字是出現機率是印歐文一特定字母的「2的(9-5)次方」倍低(2的4次方=16), 也即某一中文字的出現機率「平均」只有印歐文某一字母的出現機率的16分之一那麼低。(平均, 應要把全部中文十萬字都計進去。但馮志偉並沒有取那麼多字。)
2. → 如果馮志偉用這個信息熵來研究通訊, 而非錯誤地用在電腦的中文研究。那也要有一種情況出現, 中文和歐文才能是平等比較。
即是, 在實際通訊中, 把實驗所用的文章中所出現的中文字(這並不是全部的十萬字喔!!!)全部算一下有多少個, 假設是20000字好了。這時, 他要找到一個通訊線路及設備, 其上的訊號有20000個變化以代表這兩萬個字, 而英文只要26個變化即夠。以電壓變化來代表, 0.1伏特是一個變化, 馮志偉的實驗針對20000個中文字就需要一條通訊線路上可由0.0伏特、0,1伏特、....到2000伏特的變化。而事實上根本這樣的一條線路要有2萬個變化狀態的通訊機器, 根本沒有。(注意, 這裡還是假設馮志偉對熵瞭解, 而且真的用於通訊方面的研究喔!!!事實他是用錯在電腦內部, 更離譜!)
那麼事實中文電報是如何? 在未談之前, 先看英文的:
英文有26個字母, 要設計一個具有26個變化狀態的通訊機器是沒問題的。但, 從效率及電能的消耗上計, 不花算!
※摩期把26個字母用點.和横-來編碼,叫摩斯電碼。一個指定的時間間隔內(叫時槽)不是送點訊號就是送横訊號, 也即是每個訊號只有點和横2種訊號狀態, 這就是二進位了。「點」是電報鍵按一下即放開(按和放的時間一樣短; 按下叫閉路, 放開叫開路), 「横」是電報鍵按著不放為時是「點」的三倍長, 再放開。
※2的4次方等於16, <26, 不夠用; 2的5次方等於32, >26, 於是用5個二進位訊號(5個時槽的時間間隔)來編碼就足夠了。那中文有20000字的話, 就要15個二進位訊號(12個時槽的時間間隔); 因2的15次方是32768, 多於20000, 而2的14次方是16384, 少於20000。如熵是用二進位來計算的話, 那麼馮志偉要做的實驗就適合於這個情況了。現在, 中文和英文兩者符號系統是在同一對等的狀況下比較了, 但比較的是英文字母和中文字啊!(字母和字是同一意義等級麼?) 注意, 對等是指符號, 不是指有意義的單位(但這還只是前奏而已), 難道我們打電報不是傳送有意義的文字符號麼? 英文在這水平上, 一個字母可代表甚麼意義? 至少中文一個字還可能會有意義(一字詞)。信息熵就是在這個字母層次上做研究的!!!信息熵就是在這個字母層次上做研究的!!!信息熵就是在這個字母層次上做研究的!!!所以, foxql之前曾說過的張時釗老師, 他說拼音文的字母只相當於中文字的筆劃這個等級, 真是真知灼見!
所以, 要比較應該考慮是word字詞和中文詞。這個類似: 比較「international」 和「國際」、比較「English」和「英文」, 比較「Chinese」和「中文」, 看誰的訊號比較長。當然是英文的長, 比較花時間。難道不是中文比英文優越? 算一下, 一個英文字母佔一位元組(字節)長, 一個中文字佔兩個位元組(字節)長, 比較這幾組英文詞word和中文詞, 分別是13對4, 7對4, 7對4。一般而言, 同一內容的一篇中文稿和英文稿, 中文的字節數只有英文的60%。
還有, 中文的電報不是這樣編碼的!!!中文電報是用數字, 由0000編到9999(註), 打電報時, 用摩斯電碼(因為只傳數字, 所以用摩斯簡碼集更快), 每個字只傳4個符號(代表號碼)的訊號。但, 這樣比, 中英兩者又是不同的東西了, 一個是代表了「英文字母」的碼, 一個「代表了中文字的號碼數字」的碼。
注意, 這是作電報的通訊比較, 不是馮志偉的作電腦內部的傳輸的比較(熵, 根本就不是用在電腦內部傳輸的)。
註: 好, 中文電信碼用4位數字編碼, 0000-9999才只能給一萬字(含標點符號)編碼。想想, 1970以前中文電腦未發明之前, 看著中文電報, 各位漢改高手是不是更加振振有詞地說: 「我們要漢改, 我們要拼音中文!」中文實在太高深了, 是科技追不上, 不是中文不好。哪有捨寶貝而就糟粕的?

那電腦之間的通訊呢, 它們全是傳輸電腦的內碼, 英文是ASCII碼, 中文有Big5碼、GB碼, 或簡繁中英及各種語文可共存的Unicode或ISO/IEC 10646, 那個和上面打※的那句所描述的狀況, 根本是兩回事! 電腦通訊傳的內碼訊號就是電腦內的010101...訊號。
其實電腦的中文更應改為使用圖形格式的檔案(這種檔案比較大), 而不是使用文字格式的檔案(因為要編中文內碼, 而且這種檔案比較小), 這是台灣瘋子朱邦復所說的話, 真知灼見。他雖然把電腦搞成可以處理中文了, 使大家可以用微軟Windows來「寫」中文, 但有人聽嗎? 因為編內碼方法的中文檔, 和英文的現有軟體相容性更佳, 否則所有中文軟體另外開發。那些電腦廠商都想省錢(省研發成本), 只要對現成的英文軟體改一下畫面及顯示訊息就可, 又是另一種的拿來主義(台灣版本), 還自行開發純中文軟體幹嗎?
3. 你所謂的「簡化」在閃農原始論文引申的是「通訊編碼的壓縮」(壓碼data compression), 這個壓碼是另一門專門學問。中英要比, 是在上面打※那句上的情況, 來談壓碼。所以, 這個所謂「簡化」又錯得離譜! 壓碼, 簡單說, 要送10個碼(訊號), 但實際上利用壓碼技術(數學咚
您需要登录后才可以回帖 登录 | 注册

本版积分规则

手机版|小黑屋|中语书院

GMT+8, 2026-9-4 18:35 , Processed in 0.024569 second(s), 16 queries .

Powered by Discuz! X3.5

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表