1000+ câu Trắc nghiệm Nhập môn xử lý ngôn ngữ tự nhiên có đáp án - Phần 26
Đề thi

1000+ câu Trắc nghiệm Nhập môn xử lý ngôn ngữ tự nhiên có đáp án - Phần 26

A
Admin
Đại họcTrắc nghiệm tổng hợp27 lượt thi
30 câu hỏi
1. Trắc nghiệm
1 điểm

Trong xử lý ngôn ngữ tự nhiên (NLP), quá trình nào liên quan đến việc phân tách văn bản thành các đơn vị nhỏ hơn, chẳng hạn như từ, cụm từ, ký hiệu hoặc các thành phần có ý nghĩa khác?

Token hóa (Tokenization)

Gán nhãn POS (Part-of-Speech Tagging)

Phân tích cú pháp (Parsing)

Chuẩn hóa văn bản (Text Normalization)

Xem đáp án

Chọn đáp án A

2. Trắc nghiệm
1 điểm

Xét câu: "Tôi rất thích bộ phim này, nhưng hơi dài.". Phân tích tình cảm (Sentiment Analysis) ở mức độ câu văn bản này sẽ đưa ra kết quả gì?

Tích cực

Trung tính

Tiêu cực

Không xác định

Xem đáp án

Chọn đáp án A

3. Trắc nghiệm
1 điểm

Phương pháp "Bag-of-Words" (BoW) biểu diễn văn bản bằng cách nào?

Biểu diễn văn bản dưới dạng đồ thị quan hệ giữa các từ.

Biểu diễn văn bản bằng cách mã hóa vị trí tương đối của các từ.

Biểu diễn văn bản dựa trên tần suất xuất hiện của mỗi từ trong toàn bộ văn bản.

Biểu diễn văn bản bằng cách sử dụng mạng nơ-ron để học ngữ nghĩa.

Xem đáp án

Chọn đáp án C

4. Trắc nghiệm
1 điểm

Trong các mô hình ngôn ngữ n-gram, điều gì quyết định kích thước của "n"?

Số lượng từ vựng trong tập dữ liệu huấn luyện.

Độ dài trung bình của câu trong văn bản.

Số lượng lớp ẩn trong mạng nơ-ron của mô hình.

Số lượng từ liên tiếp được xem xét để dự đoán từ tiếp theo.

Xem đáp án

Chọn đáp án D

5. Trắc nghiệm
1 điểm

Word2Vec và GloVe là những kỹ thuật gì trong NLP?

Kỹ thuật phân tích cú pháp câu.

Kỹ thuật biểu diễn từ dưới dạng vectơ (word embeddings).

Kỹ thuật giảm chiều dữ liệu văn bản.

Kỹ thuật sinh văn bản tự động.

Xem đáp án

Chọn đáp án B

6. Trắc nghiệm
1 điểm

Mục đích chính của việc sử dụng "stop words" (từ dừng) trong tiền xử lý văn bản là gì?

Tăng cường tính đa dạng từ vựng trong văn bản.

Đảm bảo tính chính xác ngữ pháp của văn bản.

Giảm kích thước dữ liệu và loại bỏ các từ phổ biến không mang nhiều thông tin ngữ nghĩa.

Chuẩn hóa cách viết của các từ trong văn bản.

Xem đáp án

Chọn đáp án C

7. Trắc nghiệm
1 điểm

Trong nhiệm vụ Nhận dạng Thực thể Có tên (Named Entity Recognition - NER), mục tiêu là gì?

Phân loại văn bản theo chủ đề.

Phân tích cảm xúc và thái độ trong văn bản.

Dịch văn bản từ ngôn ngữ này sang ngôn ngữ khác.

Xác định và phân loại các thực thể có tên (ví dụ: người, tổ chức, địa điểm) trong văn bản.

Xem đáp án

Chọn đáp án D

8. Trắc nghiệm
1 điểm

Kỹ thuật "stemming" (gốc từ) và "lemmatization" (từ gốc) có điểm chung nào?

Cả hai đều nhằm mục đích giảm các từ về dạng gốc của chúng.

Cả hai đều sử dụng từ điển để tra cứu dạng gốc của từ.

Cả hai đều loại bỏ hoàn toàn hậu tố và tiền tố của từ.

Cả hai đều giữ lại tất cả các dạng biến thể của từ để phân tích.

Xem đáp án

Chọn đáp án A

9. Trắc nghiệm
1 điểm

Mô hình Transformer, được sử dụng rộng rãi trong NLP, dựa trên cơ chế chính nào?

Mạng nơ-ron hồi quy (Recurrent Neural Network - RNN).

Cơ chế tự chú ý (Self-attention).

Mạng nơ-ron tích chập (Convolutional Neural Network - CNN).

Mô hình Markov ẩn (Hidden Markov Model - HMM).

Xem đáp án

Chọn đáp án B

10. Trắc nghiệm
1 điểm

Trong bài toán dịch máy (Machine Translation), BLEU score được sử dụng để làm gì?

Đo tốc độ dịch của mô hình.

Đánh giá khả năng hiểu ngôn ngữ nguồn của mô hình.

Đo mức độ tương đồng giữa bản dịch của mô hình với bản dịch tham khảo.

Xác định ngôn ngữ nguồn và ngôn ngữ đích của văn bản.

Xem đáp án

Chọn đáp án C

11. Trắc nghiệm
1 điểm

Phân tích cú pháp phụ thuộc (Dependency Parsing) trong NLP tập trung vào việc xác định điều gì?

Mối quan hệ phụ thuộc giữa các từ trong câu.

Cấu trúc ngữ pháp tổng thể của câu.

Ý nghĩa ngữ nghĩa của từng từ trong câu.

Loại từ (part-of-speech) của mỗi từ trong câu.

Xem đáp án

Chọn đáp án A

12. Trắc nghiệm
1 điểm

Kỹ thuật "TF-IDF" (Term Frequency-Inverse Document Frequency) được sử dụng để làm gì?

Phân cụm các văn bản tương tự nhau.

Đánh giá tầm quan trọng của từ trong một văn bản so với toàn bộ tập văn bản.

Giảm số chiều của dữ liệu văn bản.

Tăng cường tính biểu cảm của văn bản.

Xem đáp án

Chọn đáp án D

13. Trắc nghiệm
1 điểm

Mạng nơ-ron hồi quy (RNN) đặc biệt phù hợp với việc xử lý loại dữ liệu nào?

Dữ liệu hình ảnh tĩnh.

Dữ liệu dạng bảng.

Dữ liệu âm thanh độc lập.

Dữ liệu chuỗi tuần tự (ví dụ: văn bản, chuỗi thời gian).

Xem đáp án

Chọn đáp án C

14. Trắc nghiệm
1 điểm

"Contextual word embeddings" (ví dụ: BERT, ELMo) khác biệt so với "static word embeddings" (ví dụ: Word2Vec, GloVe) như thế nào?

Contextual embeddings có kích thước vectơ cố định, static embeddings thì thay đổi.

Static embeddings учитывают ngữ cảnh của từ, contextual embeddings thì không.

Contextual embeddings tạo ra biểu diễn khác nhau cho cùng một từ tùy thuộc vào ngữ cảnh sử dụng, static embeddings thì tạo ra biểu diễn cố định.

Static embeddings yêu cầu lượng dữ liệu huấn luyện lớn hơn contextual embeddings.

Xem đáp án

Chọn đáp án B

15. Trắc nghiệm
1 điểm

Ứng dụng nào sau đây KHÔNG phải là ứng dụng phổ biến của NLP?

Trợ lý ảo (Chatbots).

Phân tích và nhận diện hình ảnh.

Phân tích tình cảm trên mạng xã hội.

Dịch máy tự động.

Xem đáp án

Chọn đáp án D

16. Trắc nghiệm
1 điểm

"Fine-tuning" (tinh chỉnh) một mô hình ngôn ngữ tiền huấn luyện (pre-trained language model) là gì?

Huấn luyện mô hình ngôn ngữ từ đầu với dữ liệu lớn.

Sử dụng mô hình ngôn ngữ đã huấn luyện sẵn mà không cần điều chỉnh gì thêm.

Nén kích thước của mô hình ngôn ngữ để triển khai hiệu quả hơn.

Huấn luyện tiếp mô hình ngôn ngữ tiền huấn luyện trên một tập dữ liệu nhỏ hơn, cụ thể cho một nhiệm vụ nhất định.

Xem đáp án

Chọn đáp án D

17. Trắc nghiệm
1 điểm

Khi xử lý văn bản tiếng Việt, điều gì cần đặc biệt lưu ý so với tiếng Anh?

Tiếng Việt có số lượng từ vựng ít hơn tiếng Anh.

Tiếng Việt có cấu trúc ngữ pháp đơn giản hơn tiếng Anh.

Tiếng Việt là ngôn ngữ đơn lập, có thanh điệu và không có dạng biến tố, đòi hỏi các phương pháp xử lý đặc thù.

Các công cụ NLP cho tiếng Việt phát triển hơn tiếng Anh.

Xem đáp án

Chọn đáp án C

18. Trắc nghiệm
1 điểm

Trong ngữ cảnh của chatbot, "intent recognition" (nhận diện ý định) là gì?

Quá trình tạo ra câu trả lời tự động từ chatbot.

Quá trình xác định mục đích hoặc ý định của người dùng dựa trên câu nói của họ.

Quá trình chuyển đổi văn bản thành giọng nói trong chatbot.

Quá trình ghi nhớ lịch sử hội thoại của người dùng với chatbot.

Xem đáp án

Chọn đáp án B

19. Trắc nghiệm
1 điểm

"Zero-shot learning" trong NLP có nghĩa là gì?

Huấn luyện mô hình NLP với dữ liệu không nhãn.

Huấn luyện mô hình NLP chỉ với một lượng nhỏ dữ liệu.

Khả năng của mô hình NLP thực hiện nhiệm vụ trên các lớp hoặc nhãn mà nó chưa từng được huấn luyện trực tiếp.

Khả năng của mô hình NLP tự động sửa lỗi chính tả trong văn bản.

Xem đáp án

Chọn đáp án C

20. Trắc nghiệm
1 điểm

Phương pháp "back-translation" (dịch ngược) được sử dụng để làm gì trong NLP?

Tăng cường dữ liệu huấn luyện cho các mô hình dịch máy bằng cách tạo ra các biến thể của dữ liệu gốc.

Đánh giá chất lượng của mô hình dịch máy.

Cải thiện khả năng hiểu ngôn ngữ nguồn của mô hình NLP.

Giảm độ phức tạp tính toán của mô hình dịch máy.

Xem đáp án

Chọn đáp án A

21. Trắc nghiệm
1 điểm

"Attention mechanism" (cơ chế chú ý) giúp mô hình Transformer cải thiện hiệu suất trong các nhiệm vụ NLP như thế nào?

Giảm số lượng tham số của mô hình.

Tăng tốc độ huấn luyện mô hình.

Cải thiện khả năng xử lý dữ liệu không có cấu trúc.

Cho phép mô hình tập trung vào các phần liên quan nhất của dữ liệu đầu vào khi đưa ra dự đoán.

Xem đáp án

Chọn đáp án D

22. Trắc nghiệm
1 điểm

"Knowledge graph" (đồ thị tri thức) được sử dụng trong NLP để làm gì?

Phân tích cấu trúc cú pháp của câu.

Biểu diễn văn bản dưới dạng đồ thị từ.

Biểu diễn tri thức và quan hệ giữa các thực thể để hỗ trợ suy luận và trả lời câu hỏi.

Tạo ra các biểu diễn vectơ cho từ và câu.

Xem đáp án

Chọn đáp án C

23. Trắc nghiệm
1 điểm

Phương pháp "cross-lingual transfer" (chuyển giao tri thức đa ngôn ngữ) trong NLP nhằm mục đích gì?

Dịch văn bản giữa nhiều ngôn ngữ khác nhau.

Chuyển giao kiến thức từ mô hình huấn luyện trên một ngôn ngữ sang ngôn ngữ khác, đặc biệt hữu ích cho các ngôn ngữ ít tài nguyên.

Đánh giá hiệu suất của mô hình NLP trên nhiều ngôn ngữ.

Chuẩn hóa văn bản đa ngôn ngữ về một định dạng chung.

Xem đáp án

Chọn đáp án B

24. Trắc nghiệm
1 điểm

"Explainable AI (XAI)" trong NLP có vai trò gì?

Tăng độ chính xác của các mô hình NLP.

Giảm thời gian huấn luyện các mô hình NLP.

Tự động hóa quá trình gán nhãn dữ liệu huấn luyện.

Làm cho các quyết định của mô hình NLP trở nên dễ hiểu và minh bạch hơn cho con người.

Xem đáp án

Chọn đáp án D

25. Trắc nghiệm
1 điểm

Trong bài toán tóm tắt văn bản (Text Summarization), phương pháp "extractive summarization" (tóm tắt trích rút) hoạt động như thế nào?

Chọn lọc và kết hợp các câu quan trọng nhất từ văn bản gốc để tạo thành bản tóm tắt.

Diễn giải lại nội dung của văn bản gốc bằng ngôn ngữ mới ngắn gọn hơn.

Sử dụng mô hình sinh văn bản để tạo ra bản tóm tắt hoàn toàn mới.

Loại bỏ các thông tin không quan trọng trong văn bản gốc để tạo bản tóm tắt.

Xem đáp án

Chọn đáp án A

26. Trắc nghiệm
1 điểm

"Adversarial attacks" (tấn công đối nghịch) trong NLP là gì?

Các phương pháp tăng cường độ mạnh mẽ của mô hình NLP trước dữ liệu nhiễu.

Các kỹ thuật phát hiện lỗi và sửa lỗi trong văn bản.

Các kỹ thuật tạo ra dữ liệu đầu vào gây nhiễu một cách có chủ ý để đánh lừa các mô hình NLP.

Các phương pháp bảo vệ dữ liệu văn bản khỏi bị truy cập trái phép.

Xem đáp án

Chọn đáp án C

27. Trắc nghiệm
1 điểm

"Few-shot learning" trong NLP là gì và tại sao nó quan trọng?

Phương pháp huấn luyện mô hình NLP trên dữ liệu không nhãn để giảm chi phí.

Phương pháp cho phép mô hình NLP học hiệu quả từ một lượng nhỏ dữ liệu huấn luyện, quan trọng khi dữ liệu nhãn khan hiếm.

Kỹ thuật giảm kích thước mô hình NLP để triển khai trên các thiết bị hạn chế về tài nguyên.

Kỹ thuật tăng tốc độ suy luận của mô hình NLP trong thời gian thực.

Xem đáp án

Chọn đáp án B

28. Trắc nghiệm
1 điểm

Trong ngữ cảnh của hệ thống hỏi đáp (Question Answering), "reading comprehension" (đọc hiểu) đề cập đến khả năng gì?

Khả năng tạo ra câu hỏi tự động từ văn bản.

Khả năng chuyển đổi câu hỏi từ dạng văn bản sang dạng truy vấn cơ sở dữ liệu.

Khả năng đọc và hiểu văn bản để trả lời các câu hỏi liên quan đến nội dung văn bản đó.

Khả năng tóm tắt nội dung chính của một đoạn văn bản dài.

Xem đáp án

Chọn đáp án C

29. Trắc nghiệm
1 điểm

"Bias" (thiên kiến) trong mô hình NLP có thể phát sinh từ đâu và gây ra hậu quả gì?

Chỉ phát sinh từ lỗi thuật toán và không liên quan đến dữ liệu.

Chỉ ảnh hưởng đến tốc độ xử lý của mô hình, không ảnh hưởng đến kết quả.

Chỉ xảy ra khi mô hình được huấn luyện trên dữ liệu quá nhỏ.

Có thể phát sinh từ dữ liệu huấn luyện và dẫn đến kết quả không công bằng, phân biệt đối xử trong ứng dụng thực tế.

Xem đáp án

Chọn đáp án D

30. Trắc nghiệm
1 điểm

"Active learning" (học chủ động) có thể được áp dụng như thế nào trong NLP để cải thiện hiệu suất mô hình?

Tự động tăng cường dữ liệu huấn luyện bằng cách sinh dữ liệu giả.

Chọn lọc các mẫu dữ liệu "khó" hoặc "không chắc chắn" nhất để con người gán nhãn, giúp mô hình học hiệu quả hơn với ít dữ liệu hơn.

Phân chia dữ liệu huấn luyện thành các nhóm nhỏ hơn để huấn luyện song song.

Sử dụng phản hồi từ người dùng để điều chỉnh mô hình NLP trong quá trình sử dụng thực tế.

Xem đáp án

Chọn đáp án B