Thứ tự câu hỏi là gì? Cách sắp xếp bảng khảo sát

Khảo sát··16 phút đọc

Thứ tự câu hỏi là gì trong nghiên cứu định lượng

Thứ tự câu hỏi là cách bạn sắp xếp các nhóm câu hỏi trong bảng hỏi, từ lời giới thiệu, câu hỏi sàng lọc, câu hỏi hành vi đến các biến quan sát và thông tin cá nhân. Khi thứ tự hợp lý, người trả lời hiểu bối cảnh trước, chọn đúng đối tượng và hoàn thành bảng hỏi mà không bị đứt mạch.

Trong nghiên cứu định lượng, thứ tự câu hỏi còn ảnh hưởng đến chất lượng file dữ liệu. Một câu hỏi nhạy cảm đặt quá sớm có thể khiến người trả lời bỏ khảo sát. Một câu hỏi định nghĩa khái niệm quá dài đặt trước các biến quan sát có thể làm họ bị dẫn dắt. Vì vậy, bạn cần thiết kế thứ tự theo mục tiêu đo lường, chứ không chỉ xếp câu hỏi theo danh sách giả thuyết.

Bạn có thể xem thêm các chủ đề liên quan trong chuyên mục Khảo sát, đặc biệt nếu đang xây dựng toàn bộ quy trình thu thập dữ liệu.

Cách xác định thứ tự câu hỏi khảo sát

Hãy bắt đầu bằng sơ đồ luồng thay vì mở Google Forms rồi nhập câu hỏi ngay. Với một bảng hỏi định lượng thông thường, trình tự dễ áp dụng là: giới thiệu, đồng ý tham gia, câu hỏi sàng lọc, câu hỏi khởi động, câu hỏi hành vi hoặc trải nghiệm, các thang đo chính, câu hỏi nhân khẩu học và lời cảm ơn.

Bạn cần kiểm tra ba vấn đề trước khi chốt vị trí của từng câu. Thứ nhất, câu hỏi này có cần người trả lời biết thông tin từ câu trước không. Thứ hai, nó có thể làm thay đổi cách họ trả lời các câu sau không. Thứ ba, câu hỏi này dùng để đo biến nghiên cứu hay chỉ dùng để mô tả mẫu.

Dùng nguyên tắc từ dễ đến khó

Các câu hỏi đầu nên ngắn, quen thuộc và liên quan trực tiếp đến chủ đề. Chẳng hạn, với đề tài trải nghiệm mua sắm trực tuyến, bạn có thể hỏi người trả lời đã mua hàng trực tuyến trong sáu tháng gần đây hay chưa trước khi hỏi họ đánh giá chất lượng dịch vụ.

Câu hỏi yêu cầu hồi tưởng chi tiết, đánh giá nhiều khía cạnh hoặc đề cập đến thu nhập nên để sau khi người trả lời đã hiểu ngữ cảnh. Cách này làm giảm khả năng họ thoát khỏi bảng hỏi ở những màn hình đầu tiên.

Tách câu hỏi sàng lọc khỏi câu hỏi đo lường

Câu hỏi sàng lọc quyết định người trả lời có phù hợp với mẫu hay không. Ví dụ: “Bạn đã sử dụng ứng dụng X trong ba tháng gần đây chưa?”. Nếu chọn “Chưa”, biểu mẫu nên kết thúc hoặc chuyển đến lời cảm ơn, thay vì cho họ trả lời tiếp các biến quan sát về trải nghiệm sử dụng.

Không dùng câu hỏi sàng lọc như một biến quan sát để tính Cronbach's Alpha. Nó có chức năng chọn mẫu, còn biến quan sát phải phản ánh cùng một khái niệm đo lường.

Giữ các biến quan sát cùng khái niệm ở gần nhau

Nếu thang đo Sự thuận tiện gồm các biến TC1, TC2 và TC3, nên đặt chúng trong cùng một nhóm. Việc chèn câu hỏi về giá cả hoặc ý định quay lại giữa nhóm này làm người trả lời phải đổi ngữ cảnh liên tục.

Bạn có thể xem cách chọn số mức trả lời trong bài thang đo Likert 5 mức độ hoặc thang đo Likert 7 mức độ. Số mức độ phải nhất quán giữa các nhóm, trừ khi có lý do phương pháp rõ ràng.

Đặt thông tin cá nhân ở cuối

Giới tính, độ tuổi, nghề nghiệp, thu nhập và trình độ học vấn thường đặt sau phần thang đo. Người trả lời đã dành thời gian cho các câu hỏi chính nên có xu hướng hoàn thành phần cuối hơn. Nếu một đặc điểm là điều kiện bắt buộc của mẫu, bạn đưa nó lên phần sàng lọc, không chờ đến cuối mới hỏi.

Thiết kế bảng hỏi phục vụ mục tiêu này

Một bảng hỏi nên có phần giới thiệu ngắn, nêu mục đích nghiên cứu, thời gian hoàn thành, nguyên tắc bảo mật và thông tin liên hệ khi cần. Tránh viết lời giới thiệu theo hướng ca ngợi một thương hiệu hoặc gợi ý câu trả lời tích cực.

Bạn có thể đối chiếu cấu trúc tổng thể với hướng dẫn thiết kế bảng hỏi, sau đó điều chỉnh theo mô hình nghiên cứu và đối tượng khảo sát của mình.

Cấu trúc đề xuất cho bảng hỏi định lượng

PhầnNội dung nên đặtMục đích
AGiới thiệu, thời gian, đồng ý tham giaTạo bối cảnh và xác nhận sự tự nguyện
BCâu hỏi sàng lọcLoại người không thuộc đối tượng nghiên cứu
CHành vi hoặc trải nghiệm gần đâyGiúp người trả lời nhớ đúng tình huống
DCác thang đo chínhThu dữ liệu cho mô hình và giả thuyết
ECâu hỏi kết quả, ý định hoặc hành vi tiếp theoĐo biến phụ thuộc hoặc kết quả
FNhân khẩu họcMô tả mẫu và phân tích nhóm
GLời cảm ơnKết thúc bảng hỏi rõ ràng

Thứ tự trong phần D và E còn phụ thuộc vào mô hình. Nếu biến độc lập và biến phụ thuộc đều được đo bằng Likert, hãy trình bày tên nhóm và hướng dẫn trả lời nhất quán. Không cần cho người trả lời biết đâu là biến độc lập, biến phụ thuộc hay giả thuyết H1, H2.

Viết câu hỏi để không làm thay đổi thứ tự đo lường

Mỗi biến quan sát nên chỉ đề cập một ý. Câu “Ứng dụng dễ sử dụng và xử lý giao dịch nhanh” chứa hai nhận định, vì vậy người trả lời có thể đánh giá phần dễ sử dụng cao nhưng phần tốc độ thấp mà không biết chọn mức nào.

Không trộn câu khẳng định và phủ định trong cùng một nhóm nếu đối tượng khảo sát dễ đọc nhầm. Nếu bắt buộc dùng biến đảo chiều, đánh dấu rõ trong file mã hóa và kiểm tra lại trước khi chạy Reliability Analysis. Bản thân việc đảo chiều không làm thang đo tốt hơn nếu người trả lời không hiểu câu hỏi.

Chọn thang đo và mã hóa đáp án

Với Likert năm mức, bạn có thể dùng cùng một chiều từ 1 là hoàn toàn không đồng ý đến 5 là hoàn toàn đồng ý. Đừng đổi sang “rất không hài lòng” đến “rất hài lòng” giữa các nhóm nếu khái niệm vẫn là mức đồng ý, vì sự thay đổi nhãn làm người trả lời phải diễn giải lại.

Likert bắt nguồn từ kỹ thuật đo thái độ được trình bày trong (Likert, 1932). Khi xuất dữ liệu sang SPSS, mỗi lựa chọn nên có mã số rõ ràng, còn nhãn đầy đủ được lưu trong codebook.

Kiểm tra độ dài trước khi phát hành

Một bảng hỏi có quá nhiều câu hỏi sẽ làm tăng tỷ lệ bỏ dở và câu trả lời theo thói quen. Bạn nên chạy thử với một số người giống đối tượng nghiên cứu, ghi thời gian hoàn thành và hỏi họ câu nào khó hiểu. Đây là kiểm tra khả năng sử dụng bảng hỏi, không phải dùng kết quả chạy thử để kết luận giả thuyết.

Hãy mở mẫu phiếu khảo sát để đối chiếu cách trình bày, nhưng không sao chép nguyên văn các biến quan sát nếu bối cảnh, đối tượng hoặc khái niệm của bạn khác.

Triển khai thu dữ liệu

Trước khi gửi đường link, hãy hoàn thành một vòng kiểm tra từ góc nhìn người trả lời. Bạn tự điền bằng điện thoại, chọn từng nhánh sàng lọc và kiểm tra xem có câu nào bắt buộc nhưng không phù hợp với tất cả người tham gia hay không.

Bạn có thể dùng fillform.info, công cụ biểu mẫu của DoThesis dành cho việc thu thập phản hồi bảng hỏi tại Việt Nam. Google Forms là lựa chọn thay thế quen thuộc. Dù dùng công cụ nào, bạn vẫn cần kiểm soát một người gửi nhiều lần, thời gian trả lời bất thường và việc xuất đúng tên cột.

Phân phối đúng đối tượng

Kênh phát bảng hỏi phải phù hợp với tiêu chí chọn mẫu trong chương phương pháp. Nếu đề tài nghiên cứu người đã sử dụng một dịch vụ, nhóm trả lời chỉ từng nghe tên dịch vụ đó chưa đủ điều kiện. Bạn nên ghi lại thời gian phát, kênh phát và số phản hồi theo từng kênh để giải trình khi cần.

Đừng thay đổi nội dung câu hỏi giữa các nhóm người trả lời nếu bạn muốn gộp dữ liệu vào cùng một file. Một phiên bản có thang đo 5 mức và một phiên bản có thang đo 7 mức sẽ không thể gộp tùy tiện chỉ bằng cách đổi tên cột.

Theo dõi tỷ lệ hoàn thành

Trong thời gian thu dữ liệu, xem số phản hồi hoàn chỉnh và số phản hồi bỏ dở. Nếu nhiều người dừng ở một câu, hãy kiểm tra câu đó có nhạy cảm, khó hiểu hoặc có lỗi hiển thị không. Không xóa các phản hồi bỏ dở trong nền tảng rồi quên ghi lại, vì bạn sẽ mất dấu quy trình làm sạch.

Bảng kiểm tra quyết định vị trí câu hỏi có thể dùng như sau. Các ngưỡng trong bảng là tiêu chí tham khảo có nguồn, không phải cam kết rằng dữ liệu của bạn sẽ đạt.

Hạng mục kiểm traMức tham khảoNguồn
Số quan sát trên một biến quan sát5 đến 10 quan sát(Hair và cộng sự, 2010)
Cronbach's AlphaTừ 0.7 trở lên(Nunnally, 1978)
Corrected Item-Total CorrelationTừ 0.3 trở lên(Nunnally và Bernstein, 1994)
KMO trước EFATừ 0.5 trở lên(Kaiser, 1974)
Total variance explainedTừ 50% trở lên(Hair và cộng sự, 2010)

Làm sạch dữ liệu trước khi nhập SPSS

Thứ tự câu hỏi tốt vẫn không cứu được file dữ liệu nếu bạn nhập sai mã hoặc giữ toàn bộ phản hồi không hợp lệ. Trước khi mở SPSS, hãy tạo một bản sao dữ liệu gốc và một codebook có tên biến, nhãn biến, loại thang đo và mã giá trị thiếu.

Kiểm tra phản hồi thiếu

Xác định người trả lời đã bỏ dở ở đâu. Nếu họ chưa hoàn thành phần sàng lọc hoặc thiếu nhiều biến quan sát chính, thường cần loại phản hồi theo tiêu chí đã định trước. Nếu chỉ thiếu một vài trường nhân khẩu học không dùng trong mô hình, bạn ghi nhận cách xử lý thay vì tự động xóa cả dòng.

Phát hiện trả lời theo đường thẳng

Straight-lining là tình trạng người trả lời chọn cùng một mức cho gần như toàn bộ nhóm Likert. Đây là dấu hiệu cần kiểm tra, không phải bằng chứng tự động để xóa. Một người thật sự đồng ý với nhiều nhận định vẫn có thể chọn cùng mức.

Hãy xem thêm thời gian hoàn thành, câu hỏi kiểm tra chú ý nếu có, và sự nhất quán giữa các câu hỏi. Chỉ loại phản hồi khi tiêu chí đã được xác định và có thể giải thích với giảng viên.

Kiểm tra mã và tên cột

Tên cột nên ngắn, không dấu, không khoảng trắng, chẳng hạn TC1, TC2, HL1. Không đặt tên cột giống nhau hoặc để một cột chứa cả chữ và số. Các câu trả lời “Không áp dụng” cần có mã riêng hoặc được khai báo là missing theo kế hoạch, không tùy tiện xem như mức 0.

Dưới đây là số liệu minh họa, mô phỏng dạng dữ liệu sau khi thiết kế thứ tự câu hỏi. Đây không phải kết quả của một nghiên cứu thật.

IDSCREENHV1HV2TC1TC2HL1AGE_GROUPThời gian giây
00114544518-24184
00213334325-34231
0030.....18-2419
00415555525-3447

Dòng 003 dừng ở câu sàng lọc nên không có dữ liệu thang đo. Dòng 004 có cùng mức trả lời và thời gian rất ngắn, vì vậy cần được kiểm tra thêm trước khi quyết định giữ hay loại. Số liệu minh họa này chỉ cho thấy cách đọc dấu hiệu, không cung cấp ngưỡng thời gian áp dụng cho mọi bảng hỏi.

Chạy kiểm tra sơ bộ trong SPSS

Sau khi nhập file, vào Analyze > Descriptive Statistics > Frequencies để kiểm tra mã ngoài phạm vi, giá trị thiếu và phân phối cơ bản. Với thang đo, vào Analyze > Scale > Reliability Analysis, đưa các biến cùng khái niệm vào một lần chạy và mở Statistics để chọn Scale if item deleted.

Không xóa biến chỉ vì cột Cronbach's Alpha if Item Deleted tăng nhẹ. Bạn cần xem nội dung biến, cơ sở lý thuyết và sự phù hợp với mô hình. Nếu loại biến, lưu lại phiên bản file và ghi rõ lý do, để lần chạy sau có thể truy lại.

Cách trình bày trong chương 3

Trong chương 3, bạn mô tả thứ tự câu hỏi như một phần của quy trình thiết kế công cụ đo lường. Nêu đối tượng khảo sát, tiêu chí sàng lọc, các nhóm thang đo, số mức Likert, phần thông tin cá nhân và cách thử nghiệm bảng hỏi.

Bạn không cần chép toàn bộ đường link biểu mẫu vào phần phương pháp nếu trường không yêu cầu. Thay vào đó, đưa bảng hỏi đầy đủ vào phụ lục, đánh mã từng biến quan sát và giải thích biến nào dùng để đo khái niệm nào.

Cách viết vào luận văn: “Bảng hỏi gồm [số phần] phần, được sắp xếp theo trình tự [giới thiệu và đồng ý tham gia], [sàng lọc], [câu hỏi hành vi], [các thang đo chính] và [thông tin nhân khẩu học]. Các biến quan sát được đo bằng thang Likert [5/7] mức, từ [mức thấp nhất] đến [mức cao nhất].”

Bạn có thể thêm: “Trước khi thu thập chính thức, bảng hỏi được kiểm tra thử với [số người] thuộc nhóm đối tượng nghiên cứu nhằm phát hiện câu hỏi khó hiểu, lỗi hiển thị và thời gian hoàn thành.” Chỉ điền số liệu bạn thực sự có, không lấy số minh họa trong bài này đưa vào luận văn.

Lỗi thường gặp

Đặt câu hỏi nhân khẩu học lên đầu

Nếu tuổi, thu nhập hoặc nghề nghiệp không phải điều kiện sàng lọc, đặt chúng ở đầu dễ làm người trả lời cảnh giác. Hãy chuyển chúng về cuối và chỉ giữ các nhóm phân loại phục vụ phân tích.

Đưa câu hỏi dẫn dắt vào trước thang đo

Câu giới thiệu như “Thương hiệu này vốn rất tiện lợi, bạn có đồng ý không?” tạo định hướng trước khi người trả lời đánh giá. Lời dẫn nên trung tính, chỉ giải thích khung thời gian và đối tượng được nhắc đến.

Trộn nhiều loại thang đo

Một nhóm dùng 1 là hoàn toàn không đồng ý, nhóm khác dùng 1 là hoàn toàn đồng ý sẽ tạo lỗi mã hóa nghiêm trọng. Kiểm tra nhãn giá trị trước khi xuất .csv hoặc .sav.

Xóa dữ liệu chỉ vì muốn output đẹp

Lần chạy EFA đầu tiên hiếm khi cho ra bảng gọn gàng. Bạn có thể phải xem lại biến quan sát, chạy lại và ghi chép từng vòng, nhưng việc loại dữ liệu phải dựa trên tiêu chí đã giải thích được. Thay đổi thứ tự câu hỏi sau khi đã thu một phần dữ liệu cũng tạo ra hai phiên bản bảng hỏi, cần được đánh dấu riêng.

Câu hỏi thường gặp

Thứ tự câu hỏi có ảnh hưởng đến kết quả khảo sát không?

Có. Câu hỏi trước có thể tạo ngữ cảnh, gây mệt mỏi hoặc dẫn hướng cho câu hỏi sau. Ảnh hưởng này không thể loại bỏ hoàn toàn, nhưng bạn giảm được bằng cách dùng lời dẫn trung tính, gom biến quan sát cùng khái niệm và thử bảng hỏi trước.

Có nên để câu hỏi nhạy cảm ở cuối không?

Thông thường nên để sau phần đo lường chính, cùng nhóm thông tin cá nhân. Nếu câu hỏi nhạy cảm là điều kiện chọn mẫu, bạn vẫn phải đưa nó vào phần sàng lọc, nhưng nên giải thích mục đích và giới hạn sử dụng dữ liệu.

Có cần đảo ngược thứ tự câu hỏi để tránh người trả lời đoán giả thuyết không?

Bạn có thể thay đổi thứ tự các nhóm nếu có lý do giảm dẫn dắt, nhưng không nên xáo trộn ngẫu nhiên các biến quan sát trong cùng một thang đo khi điều đó làm bảng hỏi khó đọc. Người trả lời không cần biết mô hình có H1, H2 hay biến nào là độc lập.

Nên đặt câu hỏi mở ở đâu trong bảng hỏi định lượng?

Nếu câu hỏi mở chỉ để người trả lời bổ sung ý kiến, đặt ở gần cuối, trước lời cảm ơn. Không biến câu trả lời mở thành bước phân tích định tính trong một nghiên cứu định lượng nếu thiết kế của bạn không dự kiến cách mã hóa và xử lý dữ liệu đó.

Một bảng hỏi nên có bao nhiêu câu?

Không có một con số duy nhất áp dụng cho mọi đề tài. Bạn cần căn cứ vào số khái niệm, số biến quan sát, tiêu chí sàng lọc và thời gian hoàn thành thử nghiệm. Khi nhiều câu đo cùng một khái niệm bị lặp ý, hãy trao đổi với giảng viên để giữ lại các biến có cơ sở lý thuyết và ngôn ngữ rõ nhất.

Bây giờ bạn hãy mở bản nháp bảng hỏi, đánh số từng phần theo trình tự giới thiệu, sàng lọc, hành vi, thang đo và nhân khẩu học, rồi chạy thử một lượt trên điện thoại; nếu cần thiết kế lại mô hình, thang đo và bảng hỏi bằng dữ liệu đề tài của mình, bạn có thể dùng M3 của DoThesis.