Concept
Targeted Idiom Translation Evaluation Results
Targeted idiom-level evaluation macro-averages scores over individual idioms to reduce the influence of frequency imbalance. LiTER measures literal translation errors, whereas APT-Eval measures idiom translation accuracy. Models trained on the joint split produce fewer literal translation errors, and pretraining improves idiom translation accuracy. Encoder-side word replacement lowers LiTER but degrades overall idiom translation accuracy.
0
1
Updated 2026-08-30
Contributors are:
Who are from:
Tags
Data Science