تحلیل پرسشنامهی لیکرت در اکسل و SPSS؛ قدم به قدم
هفت گام از دادهی خام تا جدولِ فصل چهارم: کدگذاری، پاکسازی، معکوسکردنِ گویههای منفی، آلفای هر بعد، نمرهی ابعاد، آمار توصیفی و آزمون t تکنمونهای در برابر میانگینِ نظریِ ۳، با فرمولهای اکسل، سینتکس SPSS و اینکه کِی باید سراغ آزمونِ ناپارامتری بروید.
پرسشنامهها جمع شده و حالا یک فایل با چند صد ردیف دارید. این نوشته همان مسیری است که از دادهی خام به جدولهای فصل چهارم میرسد، با فرمولِ اکسل و سینتکسِ SPSS برای هر گام. مثالِ سراسریِ متن یک پرسشنامهی فرضی است: «رضایت از آموزش مجازی» با سه بعد — محتوا (گویههای q1 تا q4)، تعامل (q5 تا q8) و فناوری (q9 تا q12) — روی طیفِ پنجدرجهای (۱ = کاملاً مخالفم تا ۵ = کاملاً موافقم)، که گویههای q4 و q8 آن منفی نوشته شدهاند، و ۱۲۰ پاسخدهنده.
گام ۱ — داده را درست وارد کنید: هر ردیف یک نفر
ساختارِ درست ساده است: هر ردیف یک پاسخدهنده، هر ستون یک گویه، ستونِ اول یک شناسه. در خانهها عدد باشد، نه متنِ گزینه.
اگر خروجیتان بهجای عدد متنِ گزینه دارد («موافقم»)، در اکسل یک جدولِ کمکیِ کوچک بسازید: در ستونِ Q پنج برچسب («کاملاً مخالفم» تا «کاملاً موافقم») و در ستونِ R کنارِ هر کدام کدِ ۱ تا ۵. بعد هر خانه را با یک فرمول به کد تبدیل کنید:
=VLOOKUP(B2, $Q$2:$R$6, 2, FALSE)
اگر نتیجه #N/A شد، تقریباً همیشه مشکل از نویسههاست: «ي» و «ك» عربی بهجای «ی» و «ک» فارسی، یا نیمفاصلهای که در یکجا هست و در جای دیگر نیست. با Find & Replace یکدستشان کنید.
اگر پرسشنامه را در پرسینو ساختهاید، این گام را لازم ندارید: فایلِ SPSS (با پسوندِ sav) نامِ متغیرها را از کلیدِ هر سؤال میسازد، کدِ گزینهها و برچسبهای فارسی را دارد و سطحِ سنجش را هم تعیین کرده است. فقط پیش از انتشار، کلیدِ گویهها را کوتاه و معنادار بگذارید (مثلاً q1 تا q12).
در SPSS، در نمای Variable View برای گویهها Measure را Ordinal و برای نمرهی ابعاد (که در گام ۵ میسازید) Scale بگذارید و در ستونِ Values برچسبِ هر کد را بنویسید.
گام ۲ — پیش از هر تحلیلی، پاکسازی
- کدهای خارج از دامنه. یک جدولِ فراوانی بگیرید؛ عددِ ۵۵ در طیفِ ۱ تا ۵ یعنی خطای ورود.
- پاسخهای یکنواخت. کسی که برای همهی گویهها، حتی گویههای منفی، «کاملاً موافقم» زده، با خودش تناقض دارد.
- پاسخهای خیلی سریع. اگر پرکردنِ پرسشنامه برای بیشترِ افراد حدودِ ۶ دقیقه طول کشیده، پاسخِ ۴۰ ثانیهای خوانده نشده است.
- پاسخهای تکراری از یک نفر.
FREQUENCIES VARIABLES=q1 TO q12 /ORDER=ANALYSIS.
قاعدهی حذف را پیش از دیدنِ نتیجهها بنویسید و تعدادِ حذفشدهها را گزارش کنید. در پرسینو گزارشِ «پاسخهای مشکوک» پاسخهای خیلی سریع و ماتریسهای یکنواخت را خودکار جدا میکند.
گام ۳ — معکوسکردنِ گویههای منفی
گویهی منفی («در کلاسهای مجازی معمولاً حوصلهام سر میرود») باید پیش از هر محاسبهای برگردد تا عددِ بزرگتر همهجا یعنی رضایتِ بیشتر. فرمول: نمرهی جدید = (تعدادِ درجهها + ۱) − نمرهی قدیم؛ برای طیفِ ۵ درجه ۶ منهای نمره و برای ۷ درجه ۸ منهای نمره.
Excel: =6-E2
SPSS: RECODE q4 q8 (1=5) (2=4) (3=3) (4=2) (5=1) INTO q4r q8r.
EXECUTE.
در اکسل، اگر q1 تا q4 در ستونهای B تا E باشند، فرمولِ بالا را در ستونِ تازهی F (همان q4r) بنویسید و تا پایین بکشید.
دو احتیاط: همیشه INTO متغیرِ جدید بسازید و اصلی را نگه دارید، و یک گویه را هرگز دو بار معکوس نکنید. فراموشکردنِ همین گام پرتکرارترین دلیلِ آلفای پایین است؛ در مثالِ عددیِ روایی و پایایی پرسشنامه آلفا با معکوسکردنِ یک گویه از ۰٫۴۰− به ۰٫۸۵ رسید.
گام ۴ — پایاییِ هر بعد
آلفای کرونباخ را برای هر بعد جداگانه بگیرید، با نسخهی معکوسشدهی گویهها:
RELIABILITY
/VARIABLES=q1 q2 q3 q4r
/SCALE('Content') ALL
/MODEL=ALPHA
/STATISTICS=DESCRIPTIVE SCALE
/SUMMARY=TOTAL.
در خروجی، جدولِ Item-Total Statistics مهمترین بخش است. برای دادهی هشتنفرهی همان مثال، آلفای بعد ۰٫۸۵ است و جدول این شکلی است:
| گویه | همبستگیِ اصلاحشده با کل | آلفا در صورتِ حذف |
|---|---|---|
| q1 | ۰٫۸۳ | ۰٫۷۴ |
| q2 | ۰٫۶۴ | ۰٫۸۳ |
| q3 | ۰٫۵۰ | ۰٫۸۸ |
| q4r | ۰٫۸۲ | ۰٫۷۵ |
q3 ضعیفترین گویه است و حذفش آلفا را به ۰٫۸۸ میرساند. ولی ۰٫۸۵ همین حالا خوب است و اگر q3 بخشی از محتوای بعد را پوشش میدهد، میماند؛ گویه را فقط برای چند صدم بالاتر بردنِ آلفا حذف نکنید. در اکسل تابعِ آمادهای برای آلفا نیست؛ داده را در ابزار محاسبه آلفای کرونباخ بگذارید تا آلفا و «آلفا در صورتِ حذف» را یکجا ببینید.
گام ۵ — نمرهی هر بعد: میانگین، نه جمع
SPSS: COMPUTE content = MEAN.3(q1, q2, q3, q4r).
COMPUTE interaction = MEAN.3(q5, q6, q7, q8r).
COMPUTE tech = MEAN.3(q9, q10, q11, q12).
EXECUTE.
Excel: =AVERAGE(B2:D2, F2)
میانگین دو مزیت دارد: نمره روی همان طیفِ ۱ تا ۵ میماند و قابلتفسیر است، و ابعادی که تعدادِ گویهی متفاوت دارند با هم قابلمقایسه میشوند. MEAN.3 یعنی «فقط اگر دستکم سه گویه پاسخ داشته باشند»؛ اینطور یک گویهی بیپاسخ، کلِ نمرهی آن نفر را از بین نمیبرد. در فرمولِ اکسل، ستونِ F همان گویهی معکوسشده است، نه ستونِ اصلیِ E؛ نتیجه را در ستونِ G (نمرهی بعدِ محتوا) بگذارید.
گام ۶ — آمار توصیفی که داور میخواهد
برای هر گویه، توزیعِ درصدیِ پاسخها و درصدِ موافق (۴ و ۵)؛ برای هر بعد، میانگین، انحراف معیار، کمینه، بیشینه، چولگی و کشیدگی.
SPSS: DESCRIPTIVES VARIABLES=content interaction tech
/STATISTICS=MEAN STDDEV MIN MAX SKEWNESS KURTOSIS.
Excel: =AVERAGE(G2:G121) =STDEV.S(G2:G121) =MEDIAN(G2:G121)
=SKEW(G2:G121) =KURT(G2:G121)
=COUNTIF(B2:B121,">=4")/COUNT(B2:B121)
برای تفسیرِ میانگینِ طیفِ ۵ درجه، در بسیاری از پایاننامهها دامنهی ۱ تا ۵ به پنج بازهی ۰٫۸ واحدی تقسیم میشود: ۱ تا ۱٫۸۰ خیلی کم، ۱٫۸۱ تا ۲٫۶۰ کم، ۲٫۶۱ تا ۳٫۴۰ متوسط، ۳٫۴۱ تا ۴٫۲۰ زیاد و ۴٫۲۱ تا ۵ خیلی زیاد. این یک قرارداد برای توصیف است، نه آزمونِ آماری؛ اگر میخواهید بگویید «بیشتر از متوسط»، گامِ بعد را لازم دارید.
و همیشه کنارِ میانگین، توزیع را هم نگاه کنید؛ میانگینِ ۳ میتواند «همه نظری ندارند» باشد یا «نیمی کاملاً موافق و نیمی کاملاً مخالف». پنج یا هفت گزینهبودنِ طیف هم روی این تفسیر اثر دارد؛ در طیف لیکرت: پنج گزینه یا هفت گزینه؟ توضیح دادهایم.
گام ۷ — آزمون t تکنمونهای در برابر ۳
فرضیهی پرتکرارِ پایاننامهها: «میانگینِ رضایت از محتوا از حدِ متوسط بیشتر است». حدِ متوسط در طیفِ ۱ تا ۵ عددِ ۳ است (و در طیفِ ۷ درجه، ۴).
T-TEST
/TESTVAL=3
/VARIABLES=content interaction tech
/CRITERIA=CI(.95).
نتیجه برای دادهی فرضیِ ۱۲۰ نفره:
| بعد | میانگین | انحراف معیار | t | df | p (دوطرفه) | d کوهن |
|---|---|---|---|---|---|---|
| محتوا | ۳٫۴۲ | ۰٫۸۱ | ۵٫۶۸ | ۱۱۹ | < ۰٫۰۰۱ | ۰٫۵۲ |
| تعامل | ۲٫۹۱ | ۰٫۸۸ | ۱٫۱۲− | ۱۱۹ | ۰٫۲۶۵ | ۰٫۱۰− |
| فناوری | ۳٫۰۸ | ۰٫۹۵ | ۰٫۹۲ | ۱۱۹ | ۰٫۳۵۸ | ۰٫۰۸ |
خوانشِ درست: میانگینِ «محتوا» بهطور معناداری از ۳ بیشتر است و اندازهی اثرش متوسط (d حدودِ ۰٫۵). میانگینِ «تعامل» کمتر از ۳ است ولی تفاوتش معنادار نیست، پس نمیتوانید بنویسید «رضایت از تعامل پایینتر از حدِ متوسط است». «فناوری» هم با ۳ تفاوتِ معناداری ندارد — و «تفاوتِ معنادار نیافتیم» با «ثابت شد برابر است» یکی نیست.
در اکسل همین آزمون با دو فرمول انجام میشود (G ستونِ نمرهی بعد است):
t = (AVERAGE(G2:G121)-3) / (STDEV.S(G2:G121)/SQRT(COUNT(G2:G121)))
p = T.DIST.2T(ABS(t), COUNT(G2:G121)-1)
d = (AVERAGE(G2:G121)-3) / STDEV.S(G2:G121)
اگر فرضیه جهتدار است («بیشتر از ۳») و میانگین در همان جهت است، p یکطرفه نصفِ p دوطرفه است؛ نسخههای جدیدترِ SPSS هر دو را نشان میدهند. اندازهی اثر را هم گزارش کنید؛ با نمونهی بزرگ، تفاوتهای خیلی کوچک هم «معنادار» میشوند.
نمونهی جمله برای فصل چهارم: «میانگینِ بعدِ محتوا (M = ۳٫۴۲، SD = ۰٫۸۱) بهطور معناداری از میانگینِ نظریِ ۳ بیشتر بود؛ t(۱۱۹) = ۵٫۶۸، p < ۰٫۰۰۱، d = ۰٫۵۲.»
کِی سراغ آزمونِ ناپارامتری بروید؟
بحثِ «لیکرت ترتیبی است یا فاصلهای» قدیمی است، ولی تصمیمِ عملی سادهتر است:
- نمرهی بعد (میانگینِ چند گویه) با نمونهی ۳۰ نفر یا بیشتر و بدونِ چولگیِ شدید: آزمونهای پارامتری مثلِ t قابلاتکایند. معیارِ رایجِ چولگی و کشیدگی بینِ ۲− و ۲+ است.
- تکگویه (یک سؤالِ لیکرت بهتنهایی): دادهی ترتیبی با فقط پنج مقدار؛ آزمونِ ناپارامتری امنتر است.
- نمونهی کوچک (کمتر از ۳۰) با چولگیِ آشکار یا انباشتگی در یک سرِ طیف: ناپارامتری.
آزمونهای نرمالبودن مثلِ کولموگروف–اسمیرنوف با نمونهی بزرگ حتی انحرافهای بیاهمیت را هم معنادار نشان میدهند؛ برای نمونهی کوچک شاپیرو–ویلک مناسبتر است و برای نمونهی بزرگ، نگاه به هیستوگرام و چولگی.
| هدف | آزمونِ پارامتری | معادلِ ناپارامتری |
|---|---|---|
| مقایسه با میانگینِ نظری (۳) | t تکنمونهای | ویلکاکسونِ تکنمونهای (یا آزمونِ دوجملهای برای نسبتِ موافقان) |
| دو گروهِ مستقل (زن/مرد) | t مستقل | من–ویتنی |
| سه گروه یا بیشتر | تحلیل واریانس یکطرفه | کروسکال–والیس |
| رابطهی دو متغیر | همبستگیِ پیرسون | همبستگیِ اسپیرمن |
| رتبهبندیِ ابعاد در یک گروه | تحلیل واریانس با اندازهگیریِ مکرر | فریدمن |
ویلکاکسونِ تکنمونهای در SPSS از مسیرِ Analyze → Nonparametric Tests → One Sample اجرا میشود؛ در تنظیمات، مقایسهی میانه با مقدارِ فرضی (Wilcoxon signed-rank) را با مقدارِ ۳ انتخاب کنید. اگر میخواهید درصدِ موافقانِ دو گروه را مقایسه کنید (مثلاً ۶۲٪ زنان در برابر ۵۱٪ مردان)، آزمون معناداری دو نسبت را بدونِ SPSS هم دارید.
اکسل یا SPSS؟
برای کدگذاری، معکوسکردن، آمار توصیفی و t تکنمونهای، اکسل کافی است. برای آلفا با جدولِ گویهها، آزمونهای ناپارامتری، تحلیل واریانس و هر چیزی که باید در پیوست قابلبازتولید باشد، SPSS (یا JASP رایگان) راحتتر و مطمئنتر است. یک قاعدهی ساده: هر کاری را که در SPSS میکنید با سینتکس انجام بدهید (دکمهی Paste در هر پنجره) و فایلِ سینتکس را نگه دارید؛ اگر داور پرسید یا داده عوض شد، کلِ تحلیل با یک اجرا تکرار میشود.
پرسشهای پرتکرار
میانگینگرفتن از گویههای لیکرت مجاز است؟
برای تکگویه محل بحث است؛ برای نمرهی بعد که از چند گویه ساخته شده، رویهی رایج و پذیرفته است و پژوهشهای روششناختی، از جمله نورمن (Norman, 2010)، نشان دادهاند آزمونهای پارامتری روی این نمرهها قابلاتکایند.
«نظری ندارم» را چه کنم؟
اگر درجهی وسطِ طیف است، همان ۳ است. اگر گزینهای بیرون از طیف است، به معنای «نمیدانم/مربوط نیست»، باید گمشده حساب شود نه ۳. در ماتریسِ پرسینو این دو جدا هستند: درجهی وسط یکی از ستونهاست و گزینهی جداگانهی «نظری ندارم» در خروجیِ SPSS با کدِ ۹۹ و بهعنوانِ گمشده میآید.
با ۲۰ پاسخ هم میشود t گرفت؟
میشود، ولی توان کم است و به نرمالبودن حساسترید؛ ویلکاکسون را هم گزارش کنید. بهتر است پیش از جمعآوری حجم نمونه را حساب کنید.
نمرهی کلِ پرسشنامه را هم حساب کنم؟
فقط اگر از نظرِ نظری یک سازهی کلی وجود دارد و ابعاد زیرمجموعهی آناند (مثلاً «رضایت کلی»). جمعزدنِ ابعادِ نامربوط عددی بیمعنا میسازد.
اگر هنوز پرسشنامه را اجرا نکردهاید، از همان اول کدگذاری را درست بچینید: راهنمای اجرای آنلاین پرسشنامهی پایاننامه تا خروجی SPSS قدمبهقدم همین را میگوید، و پرسشنامهساز آنلاین پرسینو فایلِ SPSS با کدها و برچسبهای آماده میدهد.