中共中央機關報《人民日報》旗下「人民網」 8 月 6 日發表評論文章,批評中國社會現時廣泛直接使用「Token」、「Agent」及「LLM」(大型語言模型)等英文縮寫,認為做法正逐步侵蝕中文表意空間,更暗藏科技話語權旁落及母語體系被消解的深層危機,文章題為《用「Token」還是「詞元」,事關科技話語權》,由人民網評論員李瑋撰寫。
英文符號缺乏中文表意特質
文章指出,人工智能技術發展速度遠超語言規範完善步伐,大量相關英文術語未經本土化轉換,已直接湧入公共傳播及日常交流場景,英文字母縮寫頻繁取代中文表達,評論回顧,過往「電腦」及「互聯網」等外來概念,均能透過本土化譯名精準貼合中文字形音義邏輯,順利融入大眾生活。相反現時「Token」、「Agent」等英文縮寫僅屬單純符號,缺乏中文字形音義統一特質,公眾難以「望文生義」,亦欠缺文化底蘊。
憂數碼鴻溝擴大 侵蝕語言傳承
文章擔憂,這類欠缺內核的術語頻繁見於中國教材、政策文件及媒體報道當中,不斷擠壓中文表意空間,無形中提高一般市民理解前沿科技的門檻,同時加劇社會數碼鴻溝,長遠更會逐步侵蝕中文體系的完整性及傳承,評論進一步警告,語言能塑造思維,若社會長期依附外來術語並照搬西方語言邏輯,將令中國科技認知局限於既定框架,難以孕育出貼合國情的原創科技理論。
文章形容,術語是科技敘事的基礎單元,若核心概念的定義權及闡釋權始終掌握在他人手中,具中國特色的科技話語體系便無從建立,強調這種認知層面的依附較實質技術落後更為隱蔽,對國家科技自立自強長遠發展構成威脅。
「詞元」譯名已獲官方採用
事實上,「Token」的標準中文譯名「詞元」並非今次評論首次提出,中國數據局早於今年 3 月中國發展高層論壇上,已正式將「Token」定名為「詞元」,將這個原本隱身技術後台的概念推至台前,並定義其為連接技術與商業的「結算單位」。至於「Agent」一詞,中國目前普遍統一譯作「智能體」,惟港台科技媒體則多採用「智慧體」或「代理」,顯示同一術語在兩岸三地暫未有完全一致的中文譯法。
強調非全面排外 學術交流仍可用英文
人民網評論澄清,規範科技術語並非要走向全面排外或封閉,而是主張建構「分層有序」的語言使用體系,文章呼籲,中國社會在公共傳播、教育教學及政策普及等通用場景,應大力推廣「詞元」及「智能體」等標準中文譯名;至於國際學術交流及跨國合作等場合,則仍可保留英文原詞,以維持溝通效率。評論期望透過此做法,兼顧對外開放與本土語言規範,在全球科技競爭中掌握話語主動權。
