Trong các mô hình sequence-to-sequence như Transformer, cơ chế "encoder-decoder attention" (chú ý bộ mã hóa-giải mã) giúp ích gì trong quá trình dịch máy?
24/30
Trong các mô hình sequence-to-sequence như Transformer, cơ chế "encoder-decoder attention" (chú ý bộ mã hóa-giải mã) giúp ích gì trong quá trình dịch máy?
Tăng tốc độ huấn luyện mô hình
Cho phép bộ giải mã (decoder) tập trung vào các phần liên quan của câu nguồn khi tạo từ dịch
Giảm độ phức tạp tính toán của mô hình
Cải thiện khả năng xử lý ngữ cảnh hai chiều của mô hình