Concept icon
Concept

Targeted Idiom Translation Evaluation Results

Targeted idiom-level evaluation macro-averages scores over individual idioms to reduce the influence of frequency imbalance. LiTER measures literal translation errors, whereas APT-Eval measures idiom translation accuracy. Models trained on the joint split produce fewer literal translation errors, and pretraining improves idiom translation accuracy. Encoder-side word replacement lowers LiTER but degrades overall idiom translation accuracy.

0

1

Concept icon
Updated 2026-08-30

Tags

Data Science

Learn After