Entropy-based discrimination between translated Chinese and original Chinese using data mining techniques

Kanglong Liu1, Rongguang Ye2, Liu Zhongzhu3

  • 1Department of Chinese and Bilingual Studies, The Hong Kong Polytechnic University, Hong Kong, China.

Plos One
|March 24, 2022
PubMed
Summary

Data mining effectively distinguishes translated Chinese from original Chinese using entropy metrics and machine learning. Support Vector Machines (SVMs) achieved high accuracy, confirming translational language differs from original.