月旦知識庫
 
  1. 熱門:
 
首頁 臺灣期刊   法律   公行政治   醫事相關   財經   社會學   教育   其他 大陸期刊   核心   重要期刊 DOI文章
中文計算語言學期刊 本站僅提供期刊文獻檢索。
  【月旦知識庫】是否收錄該篇全文,敬請【登入】查詢為準。
最新【購點活動】


篇名
基於對照表以及語言模型之簡繁字體轉換
並列篇名
Chinese Characters Conversion System based on Lookup Table and Language Model
作者 李民祥吳世弘曾議慶楊秉哲谷圳
中文摘要
中國大陸與台灣的文字同屬於華文字體,但字體上卻分為簡體字與繁體字。中國大陸與台灣近年來在中文書籍及網路上皆有大量的資訊交流。基於閱讀習慣,文字勢必需要執行簡繁轉換後才利於雙方的讀者閱讀。傳統的簡繁轉換擁有簡體一字對繁體多字的歧異問題以及兩岸用語不同的問題。因此,本研究設計一個具有擴展性的簡繁轉換系統,透過人工擷取維基百科新增對照表內容來改善兩岸用語不同的問題,以及使用語言模型改善簡體字一個字對繁體字多個字的歧異問題。此系統可以降低各種中文電子書及執行簡繁轉換後人工校正的成本。具有彈性的架構使得系統可以持續擴充改進。
起訖頁 19-36
關鍵詞 簡繁轉換語言模型維基百科對照表Chinese character conversionLanguage modelWikipediaLookup table
刊名 中文計算語言學期刊  
期數 201003 (15:1期)
出版單位 中華民國計算語言學學會
該期刊-上一篇 Harmony Graph, a Social-Network-Like Structure, and Its Applications to Music Corpus Visualization, Distinguishing and Music Generation
該期刊-下一篇 Tourism-Related Opinion Detection and Tourist-Attraction Target Identification
 

新書閱讀



最新影音


優惠活動




讀者服務專線:+886-2-23756688 傳真:+886-2-23318496
地址:臺北市館前路28 號 7 樓 客服信箱
Copyright © 元照出版 All rights reserved. 版權所有,禁止轉貼節錄