Dữ liệu lớn, hệ đề xuất và bong bóng thông tin
2
Chạy mô phỏng
Cần đăng nhập để mở; tài khoản miễn phí.
Luôn dùng bản mới nhất; khi bạn sửa lần đầu mới tạo bản riêng, bản gốc không đổi.

Dữ liệu lớn, hệ đề xuất và bong bóng thông tin

Nửa trên là dây chuyền dữ liệu lớn: thu thập bản ghi thô, làm sạch (bỏ bản trùng, bản thiếu trường, bản sai định dạng) rồi mới phân tích; học sinh kéo số bản ghi và mức lọc để thấy số bản ghi dùng được và độ tin cậy của kết quả đổi theo. Nửa dưới là hệ đề xuất chạy từng vòng: máy luôn gợi ý chủ đề em hay xem nhất, mức quan tâm tăng lên, độ đa dạng tính bằng entropy tụt dần và bong bóng thông tin hình thành; kéo mức khám phá lên thì bong bóng vỡ ra.

Chủ đề Máy tính và xã hội tri thức của Tin học 12 đề cập dữ liệu lớn và trí tuệ nhân tạo: thu thập, làm sạch, phân tích dữ liệu và hệ khuyến nghị. Phần trên là dây chuyền dữ liệu: chọn nguồn, kéo số bản ghi thô và mức làm sạch để thấy bản ghi trùng, thiếu trường, sai định dạng bị loại, số bản ghi dùng được và độ tin cậy kết quả đổi theo. Phần dưới là hệ đề xuất chạy 5 đến 50 vòng: máy luôn gợi ý chủ đề em hay xem, độ đa dạng đo bằng entropy giảm dần và bong bóng thông tin hình thành. Tăng mức khám phá lên thì bong bóng vỡ ra. Học sinh nhận ra dữ liệu thô chưa sạch cho kết quả kém tin cậy, và hệ đề xuất có thể thu hẹp tầm nhìn người dùng. Câu hỏi gợi ý: – Vì sao phải làm sạch dữ liệu trước khi phân tích? – Entropy giảm nói lên điều gì về các chủ đề em được xem? – Em làm gì để thoát khỏi bong bóng thông tin?

Tham số điều chỉnh được

  • Số vòng đề xuất (5–50 vòng)
  • Nguồn dữ liệu
  • Mức khám phá của hệ đề xuất (0–50 %)
  • Số bản ghi thô thu được (1–10000 nghìn bản ghi)
  • Mức làm sạch dữ liệu (0–100 %)