Trắc nghiệm Thu thập và phân loại dữ liệu lớp 8 (có đáp án)
15 câu hỏi
Phương pháp nào sau đây thuộc nhóm thu thập dữ liệu gián tiếp?
Đo nhiệt độ tại sân trường vào các giờ trong ngày.
Đếm số lượng xe máy đi qua cổng trường trong vòng 10 phút.
Truy cập trang web của Tổng cục Thống kê để lấy số liệu về dân số Việt Nam.
Gặp trực tiếp các bạn học sinh trong lớp để hỏi về môn học yêu thích.
Đáp án đúng là: C
Việc lấy số liệu từ một trang web hoặc tài liệu có sẵn do cơ quan khác công bố được gọi là thu thập dữ liệu gián tiếp, vì người nghiên cứu không tự mình đo đạc hay quan sát gốc.
Trong các dữ liệu sau, dữ liệu là số (số liệu) là
Chiều cao của các bạn trong tổ 1 (đơn vị: cm).
Tên các loài hoa được trồng trong vườn trường.
Nơi sinh của các học sinh trong lớp 8A.
Xếp loại học lực của học sinh (Tốt, Khá, Đạt, Chưa đạt).
Đáp án đúng là: A
Chiều cao của các bạn là dữ liệu được biểu diễn bằng các số thực (ví dụ: 150 cm, 155 cm,...), do đó đây là dữ liệu là số (số liệu). Các dữ liệu còn lại đều biểu diễn bằng chữ hoặc từ ngữ (dữ liệu không phải là số).
Khi thu thập dữ liệu về điểm số môn Ngữ văn của học sinh lớp 8B, một bạn học sinh thu được dữ liệu là các con số chỉ điểm số của mỗi bạn. Hỏi dữ liệu thu thập được thuộc loại:
Dữ liệu không là số, có thể sắp thứ tự.
Dữ liệu không là số, không thể sắp thứ tự.
Dữ liệu là số.
Dữ liệu dạng hình ảnh.
Đáp án đúng là: C
Điểm số môn Ngữ văn được ghi lại bằng các con số (ví dụ: 7; 8,5; 9,...), vì vậy đây là dữ liệu là số.
Dữ liệu nào sau đây thuộc loại dữ liệu không là số, không thể sắp thứ tự?
Điểm số của bài kiểm tra môn Toán.
Màu sắc yêu thích của các bạn trong lớp (Xanh, Đỏ, Vàng,...).
Thứ hạng của các đội bóng trong một giải đấu.
Các mức độ hài lòng về dịch vụ (Rất hài lòng, Hài lòng, Không hài lòng).
Đáp án đúng là: B
Màu sắc yêu thích là dữ liệu dạng chữ (dữ liệu không phải là số). Các màu sắc này không có tính chất so sánh cao thấp hay hơn kém nhau, vì vậy chúng thuộc loại dữ liệu không là số và không thể sắp thứ tự.
Trong cuộc khảo sát tìm hiểu về cách học của học sinh khối 7 được kết quả như sau:
Có 50% học sinh học qua đọc, viết;
Có 35% học sinh học qua nghe;
Có 10% học sinh học qua vận động;
Có 5% học sinh học qua quan sát.
Khẳng định nào sau đây là đúng?
Kết quả thu thập trên không phải là số.
Kết quả trên gồm cả dữ liệu là số liệu và dữ liệu không phải là số.
Kết quả trên là dữ liệu phần trăm không phải dữ liệu là số.
Kết quả thu thập trên không có số liệu.
Đáp án đúng là: B
Các tỉ lệ phần trăm (50%, 35%, 10%, 5%) là dữ liệu là số (số liệu), còn các cách học (đọc, viết, nghe, vận động, quan sát) là dữ liệu không phải là số.
Để đánh giá mức độ hài lòng của khách hàng về một sản phẩm mới, công ty đưa ra các mức lựa chọn: Rất không hài lòng, Không hài lòng, Bình thường, Hài lòng, Rất hài lòng. Dữ liệu thu thập được thuộc loại:
Dữ liệu không là số, không thể sắp thứ tự.
Dữ liệu không là số, có thể sắp thứ tự.
Dữ liệu rời rạc.
Dữ liệu liên tục.
Đáp án đúng là: B
Các mức độ hài lòng được biểu diễn bằng từ ngữ (không là số). Tuy nhiên, các mức độ này có sự phân cấp rõ ràng theo thứ tự tăng dần từ tệ nhất đến tốt nhất, vì vậy đây là dữ liệu không là số nhưng có thể sắp thứ tự.
Một cửa hàng thống kê số lượng quần áo bán được trong tuần qua và ghi lại các số liệu sau: Áo sơ mi: 45 chiếc, Quần tây: 30 chiếc, Váy: 15 chiếc, Áo khoác: −5 chiếc. Căn cứ nào giúp bạn nhận ra số liệu trên có điểm không hợp lí?
Số lượng áo sơ mi quá lớn.
Số lượng áo khoác là một số nguyên âm.
Số lượng váy ít hơn số lượng quần tây.
Tổng số lượng quần áo không chia hết cho 10.
Đáp án đúng là: B
Số lượng quần áo bán ra ngoài thực tế phải là một số nguyên không âm (lớn hơn hoặc bằng 0). Do đó, số liệu Áo khoác: −5 chiếc là hoàn toàn vô lí vì số lượng quần áo bán ra không thể âm.
Bạn Mai muốn tìm hiểu về nhiệt độ trung bình các tháng trong năm 2025 tại thành phố Hà Nội. Bạn ấy nên thu thập dữ liệu từ nguồn nào sau đây để đảm bảo độ tin cậy cao và nhanh chóng nhất?
Tự dùng nhiệt kế để đo nhiệt độ mỗi ngày rồi tính trung bình.
Đi hỏi người dân sống tại Hà Nội về cảm nhận thời tiết.
Xem số liệu lưu trữ chính thức trên trang web của Trung tâm Dự báo Khí tượng Thủy văn Quốc gia.
Đoán mò dựa trên thời tiết của năm nay.
Đáp án đúng là: C
Để có số liệu mang tính lịch sử và chính thống của cả một năm đã qua, việc tra cứu từ nguồn lưu trữ có sẵn của cơ quan chuyên môn (Trung tâm Dự báo Khí tượng Thủy văn Quốc gia) là phương pháp chính xác và nhanh chóng nhất.
Một công ty du lịch thực hiện khảo sát ý kiến của du khách nước ngoài về chất lượng dịch vụ lưu trú tại một khách sạn. Phiếu khảo sát sử dụng câu hỏi: “Bạn đánh giá thế nào về thái độ phục vụ của nhân viên?”. Các phương án trả lời được đưa ra bao gồm: Tốt, Trung bình, Tồi. Một nhân viên thống kê đã ghi nhận lại dữ liệu thu được và chia thành các nhóm. Dữ liệu thu được thuộc loại:
Dữ liệu là số rời rạc.
Dữ liệu là số liên tục.
Dữ liệu không là số và có thể sắp thứ tự.
Dữ liệu không là số và không thể sắp thứ tự.
Đáp án đúng là: C
Các câu trả lời “Tốt”, “Trung bình”, “Tồi” là dữ liệu dạng chữ, không phải là số nên thuộc nhóm dữ liệu không là số. Tuy nhiên, các giá trị này có mối quan hệ hơn kém, thể hiện mức độ từ cao xuống thấp (Tốt > Trung bình > Tồi), do đó chúng là dữ liệu không là số có thể sắp thứ tự.
Giáo viên chủ nhiệm muốn chọn ra 5 bạn học sinh đại diện cho lớp tham gia câu lạc bộ thể thao. Phương pháp nào sau đây giúp giáo viên thu thập được dữ liệu về nguyện vọng tham gia của từng học sinh một cách dân chủ và chính xác nhất?
Giáo viên tự chỉ định ngẫu nhiên 5 học sinh trong danh sách lớp.
Cho cả lớp tiến hành bỏ phiếu kín hoặc đăng ký nguyện vọng công khai dựa trên danh sách câu lạc bộ.
Lấy danh sách 5 bạn học sinh có điểm số môn Toán cao nhất lớp.
Hỏi ý kiến của riêng bạn lớp trưởng để bạn chọn thay cho cả lớp.
Đáp án đúng là: B
Để đảm bảo tính dân chủ và thu thập chính xác nguyện vọng cá nhân của học sinh, phương pháp cho học sinh tự đăng ký nguyện vọng hoặc bỏ phiếu là giải pháp tối ưu và khách quan nhất.
Trong một cuộc khảo sát về thể loại phim yêu thích của học sinh khối 8, phiếu hỏi thu được kết quả như sau: Phim hoạt hình: 55%, Phim hành động: 25%, Phim khoa học viễn tưởng: 15%, Phim kinh dị: 10%. Đánh giá tính hợp lí của số liệu trên được:
Số liệu hợp lí vì các phần trăm đều dương.
Số liệu không hợp lí vì phim hoạt hình có tỉ lệ quá cao.
Số liệu không hợp lí vì tổng các tỉ lệ phần trăm bằng 105%, vượt quá 100%.
Số liệu hợp lí vì phim kinh dị có tỉ lệ thấp nhất.
Đáp án đúng là: C
Đối với một cuộc khảo sát phân chia tỉ lệ phần trăm của các thành phần trong một tổng thể, tổng các tỉ lệ phần trăm bắt buộc phải bằng đúng 100%.
Ở đây tổng là 55% + 25% + 15% + 10% = 105%, do đó số liệu này không hợp lí.
Khi lập danh sách các bạn đăng ký tham gia thi chạy cự ly 100m, lớp trưởng thu được dữ liệu về cân nặng của 5 bạn như sau: 42 kg; 45 kg; 150 kg; 48 kg; 43 kg. Nhân định đúng về tính hợp lí của dãy số liệu trên là:
Không có điểm nào bất hợp lí vì tất cả đều là số dương.
Số liệu 150 kg là không hợp lí vì đối với học sinh lớp 8 thông thường, cân nặng này là quá lớn và bất thường.
Số liệu 42 kg không hợp lí vì quá nhẹ.
Tất cả các số liệu đều không hợp lí vì không có đơn vị đi kèm từng số.
Đáp án đúng là: B
Cân nặng của học sinh lớp 8 thông thường dao động trong khoảng từ 35 kg đến dưới 80 kg. Giá trị 150 kg là một trường hợp cực đoan, quá lớn so với lứa tuổi học sinh THCS, cho thấy số liệu này có thể do gõ nhầm (ví dụ gõ thừa số 0 hoặc nhầm sang chỉ số khác) và cần được xác minh lại.
Bạn Hoàng tiến hành khảo sát số lượng tivi của mỗi hộ gia đình trong khu phố của mình bằng cách phát phiếu hỏi. Kết quả thu được gồm các giá trị: 1; 2; 0; 3; 1,5; 2. Giá trị không hợp lí trong dãy dữ liệu thu được:
Giá trị 0 vì nhà nào cũng phải có tivi.
Giá trị 3 vì số lượng tivi như vậy là quá nhiều cho một hộ gia đình.
Giá trị 1,5 vì số lượng tivi của một hộ gia đình phải là một số tự nhiên, không thể là số thập phân.
Giá trị 1 vì đây là số lượng quá phổ biến.
Đáp án đúng là: C
Số lượng đồ vật như chiếc tivi trong một gia đình phải được biểu diễn bằng một số nguyên không âm (số tự nhiên). Việc xuất hiện số thập phân 1,5 chiếc tivi là hoàn toàn vô lí vì không tồn tại trong thực tế:
Nhóm nghiên cứu sinh học muốn thu thập dữ liệu về tốc độ phát triển chiều cao của một loài cây quý hiếm trong vòng một tháng ở điều kiện phòng thí nghiệm. Phương pháp thu thập dữ liệu đảm bảo tính xác thực cao nhất là:
Đọc thông tin mô tả chung về loài cây đó từ sách giáo khoa sinh học.
Lên mạng Internet và tìm kiếm các video clip quay về loài cây này.
Trực tiếp gieo trồng, chăm sóc và tiến hành đo đạc chiều cao của cây định kỳ bằng thước đo theo từng ngày.
Đi hỏi các bác nông dân trồng lúa ở xung quanh khu vực trường học.
Đáp án đúng là: C
Để có dữ liệu chính xác, đặc thù phục vụ nghiên cứu một loài cây trong môi trường phòng thí nghiệm, phương pháp thực nghiệm (trực tiếp trồng, chăm sóc và tiến hành đo đạc thực tế) là phương pháp duy nhất đem lại số liệu gốc có độ tin cậy tối đa.
Để tối ưu hóa hệ thống Logistics, một tập đoàn thương mại điện tử tiến hành chạy thử nghiệm một thuật toán tự động phân loại thông tin khách hàng dựa trên lịch sử mua sắm. Thuật toán này tự động quét và phân loại toàn bộ dữ liệu phản hồi của 10 000 người dùng thành các nhóm dựa theo hai tiêu chí lồng nhau: “Hình thức thanh toán” (gồm các từ khóa dạng chữ hiển thị các phương thức chi trả) và “Mức độ hài lòng” (gồm 5 mức: Rất không hài lòng, Không hài lòng, Bình thường, Hài lòng, Rất hài lòng; hệ thống chỉ lưu trữ các mức này bằng mã số từ 1 đến 5). Biết rằng hệ thống đã lọc bỏ hoàn toàn các trường dữ liệu trống và các tài khoản ảo. Sau khi kết thúc quá trình chạy thử nghiệm, tập dữ liệu tổng hợp thu được từ thuật toán phân loại đa tầng này được đánh giá là:
Tập dữ liệu không là số và các nhóm thành phần không thể sắp thứ tự.
Tập dữ liệu là số và các nhóm thành phần bắt buộc phải thực hiện phép toán cộng trừ.
Tập dữ liệu gồm cả dữ liệu không là số (không thể sắp thứ tự) và dữ liệu là số.
Tập dữ liệu gồm cả dữ liệu không là số (không thể sắp thứ tự) và dữ liệu không là số (có thể sắp thứ tự).
Đáp án đúng là: D
Tiêu chí thứ nhất “Hình thức thanh toán” thu được dữ liệu biểu diễn bằng các từ khóa dạng chữ (ví dụ: ví điện tử, chuyển khoản, tiền mặt,...), đây là dữ liệu không là số và không có tính chất hơn kém nên không thể sắp thứ tự.
Tiêu chí thứ hai “Mức độ hài lòng” ban đầu ở dạng số từ 1 đến 5 nhưng bản chất các con số này dùng để mã hóa thay thế cho các mức độ từ rất không hài lòng đến rất hài lòng, thể hiện sự phân cấp tăng dần về thứ bậc, do đó nó vẫn thuộc loại dữ liệu không là số nhưng có thể sắp thứ tự.
Vì vậy, tập dữ liệu tổng hợp đa tầng này bao gồm cả hai nhóm dữ liệu đều thuộc loại không là số, một nhóm không thể sắp thứ tự và một nhóm có thể sắp thứ tự.







