Thang đo Likert là gì? Chọn 5 hay 7 mức và phân tích đúng
Thang Likert biến mức độ đồng ý, hài lòng hoặc cảm nhận thành các lựa chọn có thứ tự. Nhưng chọn 5 hay 7 mức không quan trọng bằng việc viết đúng phát biểu, gắn nhãn cân bằng và phân tích phù hợp với loại dữ liệu.
Thang đo Likert thường gồm nhiều phát biểu cùng đo một khái niệm, mỗi phát biểu có các mức phản hồi theo thứ tự — chẳng hạn từ “hoàn toàn không đồng ý” đến “hoàn toàn đồng ý”. Một phát biểu đơn lẻ với các lựa chọn đó chính xác hơn nên gọi là Likert item; tổng hợp nhiều item đã được thiết kế và kiểm tra cùng nhau mới tạo thành một thang đo.
Khi nào nên dùng thang Likert?
Likert phù hợp khi cần đo cường độ của thái độ hoặc nhận thức: mức đồng ý với một phát biểu, mức hài lòng, cảm giác dễ hay khó, hoặc mức tin tưởng. Nó không thay thế câu hỏi hành vi. “Bạn đồng ý rằng mình tập thể dục thường xuyên” yếu hơn “Trong 7 ngày qua, bạn đã tập thể dục bao nhiêu ngày?” nếu mục tiêu là đo hành vi thực tế.
Trước khi chọn thang, hãy xác định đúng cấu trúc cần đo. Nếu “trải nghiệm tốt” gồm độ dễ dùng, tốc độ và độ tin cậy, đừng gộp cả ba vào một câu. Tách từng thuộc tính hoặc xây một bộ item có lý do lý thuyết rõ ràng.
Likert 5 điểm hay 7 điểm?
| Tiêu chí | 5 mức | 7 mức |
|---|---|---|
| Tải nhận thức | Đơn giản hơn, dễ dùng trên điện thoại | Đòi hỏi người trả lời phân biệt tinh hơn |
| Độ chi tiết | Đủ cho nhiều khảo sát vận hành | Có thể ghi nhận sắc thái tốt hơn khi khái niệm rõ |
| Gắn nhãn | Dễ viết nhãn đầy đủ cho mọi mức | Khó tìm từ ngữ để các khoảng cảm nhận đều nhau |
| So sánh | Ưu tiên nếu chuỗi lịch sử đang dùng 5 mức | Ưu tiên nếu thang đã được kiểm định ở 7 mức |
| Thiết bị và nhóm trả lời | Phù hợp hơn khi thời gian hoặc màn hình hạn chế | Hợp khi người trả lời quen chủ đề và cần độ phân giải cao |
Đừng thay số mức giữa các kỳ chỉ vì muốn “nhiều dữ liệu hơn”. Thay cấu trúc thang có thể làm đứt khả năng so sánh. Nếu cần chuyển, hãy thử nghiệm song song hoặc chia mẫu để đo ảnh hưởng của định dạng.
Cách viết một item tốt
Một phát biểu, một ý
“Ứng dụng nhanh và dễ sử dụng” là câu kép. Người dùng có thể thấy nhanh nhưng khó dùng. Hãy tạo hai item riêng nếu cả hai thuộc tính đều cần đo.
Ngôn ngữ cụ thể và có bối cảnh
“Tôi hài lòng với dịch vụ” thiếu thời điểm và phần dịch vụ. “Tôi hài lòng với quá trình đổi lịch giao của đơn hàng gần nhất” giúp người trả lời cùng tham chiếu một trải nghiệm.
Hai đầu thang phải cân bằng
Nếu một đầu là “hoàn toàn không đồng ý”, đầu kia nên là “hoàn toàn đồng ý”. Không dùng một đầu cực mạnh và đầu kia mơ hồ. Giữ hướng hiển thị ổn định để tránh người trả lời chọn nhầm vì thang bị đảo bất ngờ.
Gắn nhãn rõ khi có thể
Nhãn chữ giúp giảm diễn giải khác nhau giữa các con số. Nếu chỉ gắn nhãn hai đầu, hãy kiểm thử xem các mức ở giữa có được hiểu nhất quán không. Trên điện thoại, nhãn phải xuống dòng hợp lý và không bị che.
Có nên có điểm trung lập?
Điểm giữa phù hợp khi “trung lập” hoặc “không nghiêng về bên nào” là một trạng thái có ý nghĩa. Nhưng trung lập không đồng nghĩa với “không biết”, “không có trải nghiệm” hay “không muốn trả lời”. Các trạng thái này nên là lựa chọn riêng khi hợp lệ.
Thang số chẵn buộc người trả lời nghiêng về một phía. Điều này chỉ hợp lý khi mục tiêu thực sự cần lựa chọn có hướng và người trả lời đủ thông tin để chọn. Ép lựa chọn không làm thái độ trở nên rõ hơn; đôi khi chỉ tạo ra dữ liệu giả chính xác.
Phân tích kết quả Likert thế nào?
Với một item đơn lẻ
Hãy bắt đầu bằng phân bố từng mức, tỷ lệ ở hai đầu, trung vị và số quan sát hợp lệ. Biểu đồ phân kỳ có thể cho thấy đồng thuận, phân cực hoặc tập trung ở giữa — những điều một điểm trung bình duy nhất dễ che mất.
Với một thang nhiều item
Chỉ cộng hoặc lấy trung bình các item khi chúng được thiết kế để đo cùng một khái niệm, cùng chiều điểm và có kiểm tra độ nhất quán phù hợp. Nếu có item đảo chiều, cần mã hóa lại trước khi tổng hợp; nhưng dùng quá nhiều câu phủ định để “chống trả lời theo quán tính” có thể làm tăng nhầm lẫn.
Khi báo cáo điểm trung bình
Nhiều tổ chức dùng trung bình như một chỉ số vận hành. Nếu làm vậy, hãy công bố cấu trúc thang, số mẫu hợp lệ và cả phân bố hoặc ít nhất các tỷ lệ quan trọng. Không diễn giải khoảng cách từ 3 lên 4 như chắc chắn tương đương khoảng cách từ 4 lên 5 nếu chưa có cơ sở đo lường.
Ví dụ thang 5 mức có nhãn đầy đủ
Lựa chọn: Hoàn toàn không đồng ý · Không đồng ý · Không đồng ý cũng không phản đối · Đồng ý · Hoàn toàn đồng ý.
Lựa chọn ngoài thang: Tôi chưa từng cần hỗ trợ / Không nhớ.
Ví dụ này tách người không có trải nghiệm khỏi điểm trung lập và đặt một mốc thời gian. Nếu mục tiêu là đo “dễ tìm” và “thông tin giải quyết được vấn đề”, nên dùng hai item.
Checklist chất lượng cho thang Likert
- Khái niệm cần đo đã được định nghĩa bằng ngôn ngữ hành vi.
- Mỗi item chỉ có một ý và một bối cảnh.
- Hai đầu thang đối xứng về cường độ và ý nghĩa.
- Điểm giữa, không áp dụng và không biết không bị trộn lẫn.
- Hướng điểm được giữ nhất quán hoặc item đảo chiều được xử lý rõ.
- Định dạng hiển thị được thử trên điện thoại và với người dùng thật.
- Kế hoạch phân tích được viết trước khi xem kết quả.
Cần xây thang đo riêng cho sản phẩm?
Forely giúp xác định khái niệm cần đo, viết item, pretest và thiết kế cách phân tích để con số có nghĩa với quyết định.
Trao đổi đề bài nghiên cứu →Câu hỏi thường gặp
Likert 5 điểm hay 7 điểm chính xác hơn?
Không có lựa chọn tốt nhất cho mọi khảo sát. Bảy mức có thể cho thêm sắc thái khi người trả lời phân biệt được; năm mức đơn giản hơn. Hãy ưu tiên thang đã được kiểm thử, phù hợp thiết bị và giữ được khả năng so sánh.
Có thể tính trung bình cho dữ liệu Likert không?
Trung bình thường được dùng trong báo cáo vận hành, nhưng nên đi cùng phân bố, số mẫu và mô tả cấu trúc thang. Với item đơn lẻ, cần thận trọng vì dữ liệu có thứ tự; với thang nhiều item, chỉ tổng hợp sau khi kiểm tra chúng cùng đo một khái niệm.
Điểm trung lập có phải là không biết không?
Không. Trung lập là không nghiêng về hai phía; không biết là thiếu thông tin; không áp dụng là không có trải nghiệm. Nếu các trạng thái này hợp lệ, nên tách thành lựa chọn riêng.
Nguồn phương pháp
- Pew Research Center — Writing Survey Questions: cách diễn đạt, thứ tự câu hỏi và pretest.
- AAPOR — Best Practices for Survey Research: thiết kế mẫu, bảng hỏi, thu thập và minh bạch báo cáo.
- UK Government Analysis Function — Questionnaire Design Guidance: thiết kế lấy người trả lời làm trung tâm và kiểm thử nhận thức.