حجم نمونه چطور تعیین می‌شود؟ فرمول کوکران، جدول مورگان یا تحلیل توان

کوکران و مورگان برای برآوردِ یک نسبت در جامعه ساخته شده‌اند، نه برای آزمونِ رابطه. این راهنما با مثال‌های حل‌شده نشان می‌دهد کِی از کدام روش استفاده کنید، اصلاحِ جامعه‌ی محدود و ریزش را چطور حساب کنید و حجم نمونه‌ی همبستگی، رگرسیون و مقایسه‌ی گروه‌ها با تحلیل توان چقدر است.

تیم پرسینو۱۳ مهر ۱۴۰۵۹ دقیقه خواندنRead this article in English

«حجم نمونه با فرمولِ کوکران ۳۸۴ نفر تعیین شد» شاید پرتکرارترین جمله‌ی فصل سومِ پایان‌نامه‌ها باشد، و در بسیاری از آن‌ها انتخابِ درستی نیست. نه چون کوکران غلط است؛ چون برای پرسشِ دیگری ساخته شده. این راهنما سه روشِ اصلی را با مثال‌های عددیِ حل‌شده کنارِ هم می‌گذارد و در پایان، متنِ آماده‌ی فصل سوم را دارد.

اول بپرسید: هدفِ تحلیل چیست؟

اگر پرسشِ اصلی‌تان این است…روشِ مناسبمثال
چند درصدِ جامعه فلان ویژگی را دارند؟فرمولِ کوکران یا جدولِ مورگاندرصدِ دانشجویانی که از آموزشِ مجازی راضی‌اند
میانگینِ فلان متغیر در جامعه چقدر است؟کوکرانِ میانگین (با انحراف معیار)میانگینِ نمره‌ی رضایت شغلیِ معلمان
آیا بینِ دو متغیر رابطه هست؟تحلیلِ توان برای همبستگیرابطه‌ی سبکِ رهبری و تعهدِ سازمانی
آیا دو یا چند گروه تفاوت دارند؟تحلیلِ توان برای t یا تحلیل واریانسمقایسه‌ی فرسودگیِ شغلی در سه شیفت
چند متغیر با هم چقدر پیش‌بینی می‌کنند؟تحلیلِ توان برای رگرسیونپیش‌بینیِ قصدِ خرید با پنج متغیر
مدل‌سازیِ معادلاتِ ساختاری یا تحلیلِ عاملیقاعده‌های ویژه‌ی همان روشمدلِ پذیرشِ فناوری

بیشترِ پایان‌نامه‌ها هم توصیف دارند و هم آزمونِ فرضیه. قاعده‌ی ساده: حجم نمونه را برای سخت‌گیرانه‌ترین تحلیلی که انجام می‌دهید حساب کنید و هر دو عدد را گزارش کنید.

فرمولِ کوکران، جزء به جزء

n₀ = z² × p × (1 − p) / d²
n  = n₀ / (1 + (n₀ − 1) / N)

خطِ اول برای جامعه‌ی بزرگ یا نامعلوم است و خطِ دوم اصلاحِ آن برای جامعه‌ی محدود:

  • z: برای اطمینانِ ۹۵٪ برابرِ ۱٫۹۶ (برای ۹۰٪، ۱٫۶۴۵ و برای ۹۹٪، ۲٫۵۷۶).
  • p: نسبتِ صفت در جامعه. اگر از پژوهشِ قبلی یا پیش‌آزمون عددی ندارید، ۰٫۵ بگذارید؛ حاصلِ p(1−p) در ۰٫۵ بیشینه است و محتاطانه‌ترین (بزرگ‌ترین) نمونه را می‌دهد.
  • d: خطای مجاز؛ معمولاً ۰٫۰۵، یعنی «درصدی که گزارش می‌کنم تا ۵ واحدِ درصد بالا یا پایین خطا دارد».
  • N: حجمِ جامعه، اگر معلوم است.

مثالِ ۱ — جامعه‌ی نامعلوم یا خیلی بزرگ

n₀ = 1.96² × 0.5 × 0.5 / 0.05² = 3.8416 × 0.25 / 0.0025 = 384.16  →  385

۳۸۴٫۱۶ را منابع معمولاً ۳۸۴ می‌نویسند؛ ولی حجم نمونه به بالا گرد می‌شود، پس ۳۸۵. این عدد برای جامعه‌ی یک‌میلیونی و ده‌میلیونی تقریباً یکی است؛ وقتی جامعه خیلی بزرگ است، اندازه‌اش دیگر نقشی ندارد.

مثالِ ۲ — جامعه‌ی محدود: ۱٬۲۰۰ معلم

n = 384.16 / (1 + 383.16 / 1200) = 384.16 / 1.3193 = 291.18  →  292

اصلاحِ جامعه‌ی محدود وقتی اثرِ جدی دارد که نمونه سهمِ قابل‌توجهی از جامعه باشد. برای جامعه‌ی ۳۰۰ نفره نتیجه ۱۶۹ است و برای جامعه‌ی ۵۰٬۰۰۰ نفره ۳۸۲، تقریباً همان ۳۸۵.

مثالِ ۳ — وقتی p را می‌دانید

اگر پژوهشِ قبلی نشان داده حدودِ ۲۰٪ دانشجویان کارِ پاره‌وقت دارند، p = ۰٫۲:

n₀ = 3.8416 × 0.2 × 0.8 / 0.0025 = 245.86  →  246

با جامعه‌ی ۱٬۲۰۰ نفره، ۲۰۵ نفر. منبعِ p را حتماً بنویسید؛ p بدونِ منبع را داور به ۰٫۵ برمی‌گرداند.

مثالِ ۴ — کوکران برای میانگین

اگر هدف برآوردِ میانگین است (مثلاً میانگینِ نمره‌ی رضایت روی طیفِ ۱ تا ۵)، به‌جای p(1−p) واریانس می‌آید و d به واحدِ همان متغیر است:

n₀ = z² × s² / d²        s = 0.8 , d = 0.1   →   3.8416 × 0.64 / 0.01 = 245.86  →  246

انحراف معیار (s) را از پیش‌آزمون بگیرید. d = ۰٫۱ روی طیفِ پنج‌درجه یعنی میانگین را تا ۰٫۱ واحد دقیق می‌خواهید؛ با d = ۰٫۱۵ همان محاسبه ۱۱۰ نفر می‌دهد. d را طوری انتخاب نکنید که فقط به عددِ دلخواه برسید؛ دلیلش را بنویسید.

سطحِ اطمینان و خطا چقدر عدد را عوض می‌کنند؟

سطحِ اطمینانخطای مجازجامعه‌ی نامعلومجامعه‌ی ۱٬۰۰۰ نفره
۹۰٪۰٫۰۵۲۷۱۲۱۴
۹۵٪۰٫۰۵۳۸۵۲۷۸
۹۵٪۰٫۰۳۱٬۰۶۸۵۱۷
۹۹٪۰٫۰۵۶۶۴۴۰۰

مثال‌های ۱ تا ۳ و هر ترکیبِ دیگری را با ماشین‌حساب فرمول کوکران حساب کنید؛ مراحلِ محاسبه را هم نشان می‌دهد تا در پایان‌نامه بیاورید.

جدولِ مورگان: همان کوکران، از پیش حساب‌شده

جدولِ کرجسی و مورگان (Krejcie & Morgan, 1970) همان محاسبه را برای حجم‌های رایجِ جامعه با سه فرضِ ثابت انجام داده است: اطمینانِ ۹۵٪ (χ² = ۳٫۸۴۱)، نسبتِ ۰٫۵ و خطای ۰٫۰۵. برای همین عددهایش با کوکرانِ اصلاح‌شده حداکثر یک نفر فرق دارد و آن یک نفر هم از گرد کردن است.

حجمِ جامعهجدولِ مورگانکوکران (گرد به بالا)
۱۰۰۸۰۸۰
۲۰۰۱۳۲۱۳۲
۳۰۰۱۶۹۱۶۹
۵۰۰۲۱۷۲۱۸
۱٬۰۰۰۲۷۸۲۷۸
۲٬۰۰۰۳۲۲۳۲۳
۵٬۰۰۰۳۵۷۳۵۷
۱۰٬۰۰۰۳۷۰۳۷۰
۵۰٬۰۰۰۳۸۱۳۸۲
۱٬۰۰۰٬۰۰۰۳۸۴۳۸۵

جدولِ کامل را با همه‌ی حجم‌های جامعه در جدول مورگان ببینید. محدودیتِ جدول: فقط برای همان سه فرض معتبر است. اگر خطای ۳٪ یا اطمینانِ ۹۹٪ می‌خواهید، یا p را از قبل می‌دانید، مستقیم از کوکران استفاده کنید. و مثلِ خودِ کوکران، جدولِ مورگان هم برای برآوردِ نسبت است، نه آزمونِ رابطه.

تحلیلِ توان: وقتی فرضیه‌ی رابطه یا تفاوت دارید

کوکران می‌پرسد «برآوردِ من چقدر دقیق است؟». تحلیلِ توان می‌پرسد «اگر اثری واقعاً وجود دارد، شانسِ این‌که آزمونم آن را ببیند چقدر است؟». چهار عدد به هم گره خورده‌اند و با داشتنِ سه‌تا، چهارمی به دست می‌آید:

  • سطحِ معناداری (α): معمولاً ۰٫۰۵.
  • توان: معمولاً ۰٫۸۰، یعنی ۸۰٪ شانس که اثرِ واقعی را پیدا کنید.
  • اندازه‌ی اثر: اثری که دنبالش هستید چقدر بزرگ است؛ بهتر است از پژوهش‌های مشابه بیاید.
  • حجمِ نمونه: همان چیزی که می‌خواهید.

اگر پژوهشِ مشابهی ندارید، قراردادهای کوهن (Cohen, 1988) رایج‌اند:

تحلیلشاخصِ اثرکوچکمتوسطبزرگ
مقایسه‌ی دو میانگینd۰٫۲۰٫۵۰٫۸
همبستگیr۰٫۱۰٫۳۰٫۵
تحلیل واریانسf۰٫۱۰۰٫۲۵۰٫۴۰
رگرسیونِ چندگانهf²۰٫۰۲۰٫۱۵۰٫۳۵

حجمِ نمونه برای اثرِ متوسط (α = ۰٫۰۵، توانِ ۰٫۸۰، دوطرفه)

طرححجمِ نمونه
مقایسه‌ی دو گروهِ مستقل، d = ۰٫۵۶۴ نفر در هر گروه (۱۲۸ نفر)
همبستگیِ دو متغیر، r = ۰٫۳حدودِ ۸۵ نفر
تحلیل واریانسِ سه‌گروهی، f = ۰٫۲۵۵۳ نفر در هر گروه (۱۵۹ نفر)
رگرسیون با ۳ پیش‌بین، f² = ۰٫۱۵۷۷ نفر
رگرسیون با ۵ پیش‌بین، f² = ۰٫۱۵۹۲ نفر
رگرسیون با ۱۰ پیش‌بین، f² = ۰٫۱۵۱۱۸ نفر

دو چیز از این جدول پیداست. اول، برای آزمونِ رابطه با اثرِ متوسط، اغلب نمونه‌ای خیلی کمتر از ۳۸۴ کافی است. دوم، اگر اثر کوچک باشد ورق برمی‌گردد: برای همبستگیِ r = ۰٫۱ حدودِ ۷۸۰ نفر و برای مقایسه‌ی دو گروه با d = ۰٫۲ حدودِ ۳۹۴ نفر در هر گروه لازم است. پس عددِ ۳۸۴ نه همیشه زیاد است و نه همیشه کافی.

این محاسبه‌ها را با نرم‌افزارِ رایگانِ G*Power انجام بدهید و تصویرِ خروجی‌اش را در پیوست بگذارید تا داور بتواند همان عدد را بازتولید کند.

مدل‌سازیِ معادلاتِ ساختاری و تحلیلِ عاملی

برای این روش‌ها فرمولِ واحدی نیست و قاعده‌های سرانگشتی رایج‌اند: برای تحلیلِ عاملی ۵ تا ۱۰ پاسخ به ازای هر گویه، و برای مدل‌سازیِ معادلاتِ ساختاری با روشِ کوواریانس‌محور دست‌کم ۲۰۰ نفر. در PLS قاعده‌ی «ده برابرِ بیشترین تعدادِ مسیرهایی که به یک سازه وارد می‌شوند» رایج است، ولی حداقل است نه هدف؛ اگر داور سخت‌گیر است، تحلیلِ توانِ رگرسیونِ همان سازه را هم بیاورید.

ریزش: عددِ نهایی، عددِ جمع‌آوری نیست

حجم نمونه یعنی تعدادِ پرسشنامه‌های کامل و قابل‌استفاده. در اجرای آنلاین بخشی از پاسخ‌ها نیمه‌کاره می‌مانند و بخشی به خاطرِ بی‌دقتی (پرکردن در چند ثانیه، یک ستون برای همه‌ی گویه‌ها) کنار می‌روند. اگر ۲۰٪ ریزش پیش‌بینی می‌کنید:

n_collect = n / (1 − 0.20) = 385 / 0.8 = 481.25  →  482

پیش‌آزمون بهترین منبع برای حدسِ ریزش است. در پرسشنامه‌ی آنلاین گزارش‌های «نقطه‌ی ریزشِ هر سؤال» و «پاسخ‌های مشکوک» همین عدد را از داده‌ی واقعی می‌دهند.

روشِ نمونه‌گیری را صادقانه بنویسید

فرمول فقط می‌گوید «چند نفر»؛ نمی‌گوید «چه کسانی». نمونه‌ی ۴۰۰ نفره‌ای که از گذاشتنِ لینک در دو گروهِ پیام‌رسان جمع شده، نمونه‌ی در دسترس است، نه تصادفی؛ و فرمولِ کوکران فرضش نمونه‌گیریِ تصادفی است. اگر فهرستِ جامعه را دارید (کارکنان، دانشجویانِ یک دانشکده)، نمونه‌ی تصادفی بکشید و برای همان افراد دعوت‌نامه‌ی شخصی بفرستید. اگر ندارید، روش را «در دسترس» یا «گلوله‌برفی» بنویسید و در محدودیت‌های پژوهش به آن اشاره کنید؛ صداقت در روش از ادعای بزرگ قابل‌دفاع‌تر است.

نمونه‌ی متن برای فصل سوم

جامعه‌ی آماریِ پژوهش [۱٬۲۰۰] نفر از [معلمانِ دوره‌ی دومِ متوسطه‌ی شهرِ …] در سالِ تحصیلیِ [۱۴۰۴–۱۴۰۵] است. حجم نمونه با فرمولِ کوکران برای جامعه‌ی محدود، با سطحِ اطمینانِ ۹۵٪ (z = ۱٫۹۶)، نسبتِ ۰٫۵ و خطای مجازِ ۰٫۰۵، ۲۹۲ نفر تعیین شد و با پیش‌بینیِ ۲۰٪ ریزش، پرسشنامه برای ۳۶۵ نفر ارسال شد. برای آزمونِ فرضیه‌ی [رگرسیون با پنج متغیرِ پیش‌بین]، تحلیلِ توان با نرم‌افزارِ G*Power (اندازه‌ی اثرِ متوسط f² = ۰٫۱۵، α = ۰٫۰۵، توانِ ۰٫۸۰) حداقلِ ۹۲ نفر را نشان داد که نمونه‌ی تعیین‌شده از آن بیشتر است. نمونه‌گیری به روشِ [تصادفیِ طبقه‌ای بر حسبِ ناحیه‌ی آموزشی] انجام شد.

اشتباه‌های رایج

  • کوکران برای پژوهشی که فقط فرضیه‌ی همبستگی دارد، بدونِ هیچ اشاره‌ای به توان.
  • گرد کردنِ ۲۹۱٫۱۸ به ۲۹۱؛ حجم نمونه همیشه به بالا گرد می‌شود.
  • استفاده از جدولِ مورگان با خطای ۳٪؛ جدول فقط برای ۵٪ است.
  • حسابِ حجم نمونه برای کلِ جامعه و بعد مقایسه‌ی زیرگروه‌های ۱۵ نفره.
  • ادعای «نمونه‌گیریِ تصادفیِ ساده» برای لینکی که در شبکه‌های اجتماعی پخش شده.
  • جمع‌آوریِ دقیقاً به اندازه‌ی حجم نمونه و بعد حذفِ پاسخ‌های ناقص، و رسیدن به عددی کمتر از حداقل.

پرسش‌های پرتکرار

جامعه‌ام ۸۰ نفر است؛ نمونه بگیرم؟

اگر می‌توانید، از همه بپرسید (سرشماری). کوکران برای ۸۰ نفر ۶۷ نفر می‌دهد؛ تلاش برای رسیدن به همه‌ی ۸۰ نفر هم ساده‌تر است و هم بحثِ روشِ نمونه‌گیری را حذف می‌کند.

کوکران یا مورگان، کدام معتبرتر است؟

هیچ‌کدام؛ یک محاسبه‌اند. کوکران انعطاف دارد (سطحِ اطمینان، خطا و p را عوض می‌کنید) و مورگان جدولِ آماده‌ی همان حالتِ رایج است. هر کدام را به کار بردید، منبعش را بنویسید.

چرا همه ۳۸۴ می‌نویسند ولی ماشین‌حساب ۳۸۵ می‌دهد؟

حاصلِ فرمول ۳۸۴٫۱۶ است. جدول‌ها آن را به نزدیک‌ترین عدد گرد کرده‌اند؛ قاعده‌ی دقیق‌تر گرد کردن به بالاست تا خطا از مقدارِ خواسته‌شده بیشتر نشود. هر دو در پایان‌نامه پذیرفته می‌شوند.

برای پیش‌آزمون چند نفر لازم است؟

حدودِ ۳۰ نفر از جامعه که در نمونه‌ی اصلی نباشند؛ برای دیدنِ آلفای کرونباخ، زمانِ پرکردن و گویه‌های مبهم کافی است. جزئیاتش در روایی و پایایی پرسشنامه آمده است.

برای نظرسنجیِ مشتری یا سازمانی هم همین‌قدر نمونه لازم است؟

منطق همان است، ولی تصمیم‌ها فرق دارند؛ در چند پاسخ برای نظرسنجی کافی است؟ از زاویه‌ی نظرسنجی‌های غیرپژوهشی نوشته‌ایم.

با پرسشنامه‌ی آنلاین می‌شود به حجم نمونه رسید؟

بله، به شرطِ این‌که از روزِ اول با ریزش برنامه‌ریزی کنید، پاسخِ تکراری را ببندید و پیشرفت را روزانه ببینید. راهنمای عملی‌اش: پرسشنامه‌ی پایان‌نامه را آنلاین پخش کنید.


عددتان را دارید؟ پرسشنامه را در پرسشنامه‌ساز آنلاین پرسینو بسازید، سقفِ پاسخ را روی حجمِ نمونه به‌علاوه‌ی ریزش بگذارید و پیشرفت را هر روز ببینید.

برچسب‌ها:حجم نمونهفرمول کوکرانجدول مورگانتحلیل توانG*Powerپایان‌نامهروش تحقیق
نظرسنجی و تحلیل

پرسشنامه‌ی پایان‌نامه را آنلاین پخش کنید: از طراحی تا خروجی SPSS

ده گامِ عملی برای اجرای پرسشنامه‌ی پایان‌نامه به‌صورتِ آنلاین: آماده‌سازی پیش از ساخت، شروع از پرسشنامه‌ی استاندارد یا محقق‌ساخته، کدگذاری برای SPSS، صفحه‌ی رضایتِ آگاهانه، بستنِ پاسخِ تکراری، پیش‌آزمون، پخش با لینکِ کوتاه و QR، پایشِ روزانه و خروجیِ SPSS با برچسب‌های آماده.

۱۳ مهر ۱۴۰۵۸ دقیقه
نظرسنجی و تحلیل

روایی و پایایی پرسشنامه چیست؟ انواع، روش سنجش و نمونه‌ی گزارش

روایی می‌گوید پرسشنامه همان چیزی را می‌سنجد که ادعا می‌کند؛ پایایی می‌گوید اگر دوباره بسنجد همان عدد را می‌دهد. انواعِ هر دو، حداقلِ رأیِ خبرگان در CVR لاوشه، محاسبه‌ی CVI، آلفای کرونباخ با مثالِ عددی، بازآزمایی و دونیمه‌سازی، و متنِ آماده‌ی گزارش در فصل سوم پایان‌نامه.

۱۳ مهر ۱۴۰۵۱۴ دقیقه
نظرسنجی و تحلیل

تحلیل پرسشنامه‌ی لیکرت در اکسل و SPSS؛ قدم به قدم

هفت گام از داده‌ی خام تا جدولِ فصل چهارم: کدگذاری، پاک‌سازی، معکوس‌کردنِ گویه‌های منفی، آلفای هر بعد، نمره‌ی ابعاد، آمار توصیفی و آزمون t تک‌نمونه‌ای در برابر میانگینِ نظریِ ۳، با فرمول‌های اکسل، سینتکس SPSS و این‌که کِی باید سراغ آزمونِ ناپارامتری بروید.

۱۳ مهر ۱۴۰۵۹ دقیقه