计算机工程与应用 ›› 2007, Vol. 43 ›› Issue (32): 44-46.
孙广范,宋金平,袁 琦,肖 健,单玉秋
SUN Guang-fan,SONG Jin-ping,YUAN Qi,XIAO Jian,SHAN Yu-qiu
摘要: 回顾了语料库分类及可比语料库中翻译等价对抽取方法研究的历史。根据从可比语料库中提取翻译等价对所依据的基本假设:一个语言中一个词在对应到另外一种语言时其与周围词之间的共现搭配关系仍然被保持,采用双向等价对获取计算然后求交集、词加权因数TF(iw)*IDF(i)值计算、上下文词的词性信息利用的方法来提高翻译等价对提取正确率。描述了翻译等价对抽取实验步骤,并对实验结果进行了简要分析。实验结果表明上述方法可以有效提高翻译等价对计算结果的正确率。最后提出了需要进一研究的问题。