機械翻訳評価とは、コンピュータによって自動生成された翻訳結果の品質を、正確性や流暢性などの多様な観点から測るプロセスのことを指します。従来は人間の評価者が手動で品質を詳細に採点することが主流でしたが、近年では翻訳技術の急速な発展やデータ量の増大に伴い、評価の効率化と迅速化を目指してコンピュータを用いた自動評価手法も広く研究され実用化が進んでいます。これは翻訳システムの性能を客観的に測定し、さらなるアルゴリズムの改善やニューラル翻訳モデルのチューニングに役立てるための不可欠な工程となっており、自然言語処理や人工知能の研究開発において中心的な役割を担っています。