گزارشدهی تحلیلهای آماری
چگونه یک تحلیل را گزارش کنیم تا قابل فهم، بررسی و تجمیع باشد. خطاهای رایج، اصطلاحات آماری که معمولاً بهاشتباه بهکار میروند، کنوانسیونهای اعداد و اعشار، و آنچه باید در جداول و نمودارها قرار گیرد.
پس از این درس شما قادر خواهید بود
- توضیح دهید چرا کیفیت گزارشدهی بهطور مستقل از کیفیت رفتار اهمیت دارد.
- دستهبندیهای رایج خطاهای گزارشدهی را شناسایی کنید.
- اصطلاحات آماری را بهدرستی بهکار ببرید، از جمله آنهایی که اغلب اشتباه بهکار میروند.
- آمار توصیفی را با معیار خلاصه مناسب و تعداد صحیح اعشار گزارش کنید.
- مقایسهها و برآوردهای اثر را بهطور کامل گزارش کنید.
- یک مدل رگرسیون را طوری گزارش کنید که قابل تفسیر و بازتولید باشد.
- جدولها و نمودارها را طوری طراحی کنید که نتیجه را صادقانه منتقل کنند.
گزارش تحلیلهای آماری
چرا این موضوع اهمیت دارد
کیفیت یک مقالهٔ علمی بر اساس کیفیت گزارشدهی مطالعه سنجیده میشود. بیشتر مرورهای ادبیات نشان میدهند که گزارشدهی در حوزهها و مجلات مختلف ضعیف است.
یک تمایز اساسی: گزارشدهی ضعیف لزوماً به معنای رفتار نادرست نیست. مطالعهای که بهخوبی انجام شده اما بهخوبی گزارش نشده، برای خواننده تفاوتی با مطالعهای که بهخوبی انجام نشده ندارد. این کل مشکل است و به همین دلیل گزارشدهی موضوعی روششناختی است نه مسئلهای مربوط به سبک.
مزایای گزارشدهی خوب:
- این تفسیر صحیح نتایج را تسهیل میکند.
- این سوگیری را به حداقل میرساند، زیرا آنچه گزارش میشود را میتوان بهطور کامل بررسی کرد.
- این احتمال را افزایش میدهد که مقاله استناد و استفاده شود.
- این کار فراتحلیل نتایج در میان مطالعات را آسان میکند. مقالهای که انحراف معیار یا تعداد افراد هر گروه را نیاورد، قابل تلفیق نیست، و سهم آن در پیکره شواهد از دست میرود.
- مقالههای بهتر گزارششده نمرههای بهتری میگیرند.
خطاهای رایج
1. گزارشدهی ناقص مسائل طراحی
- نوع طراحی. این مطالعه از چه نوع است؟ مقالات معمولاً خواننده را وادار میکنند تا آن را استنباط کند.
- روشهای جذب. شرکتکنندگان چگونه یافت و ثبتنام شدند؟
- محاسبه و توجیه اندازه نمونه، همراه با تمامی ورودیهای آن.
2. گزارشدهی ناقص یا نامناسب روشها
- معیارهای خلاصهسازی نامناسب: میانگین وقتی که به میانه نیاز است، یا خطای استاندارد میانگین وقتی که به انحراف معیار نیاز است.
- توضیحات گیجکننده دربارهٔ روشها، بهطوریکه امکان بازتولید تحلیل وجود ندارد.
- روشهای بررسی مفروضات مدل و نکویی برازش، که معمولاً بهکلی حذف میشوند.
- روشهای برخورد با دادههای گمشده و دادههای پرت
- نرمافزار مورد استفاده، شامل نسخه و هرگونه بستهها.
3. گزارشدهی ناقص یا نامناسب نتایج
- مقادیر P بهجای فاصلههای اطمینان
- استفاده نادرست از اصطلاحات آماری: بهکارگیری مترادف «نسبت» و «درصد» و «خطر» و «نسبت» بهصورت یکسان.
- مکانهای اعشاری که دلالت بر دقت بیشتری دارند از آنچه دادهها پشتیبانی میکنند.
اصطلاحات آماری بهاشتباه بهکاررفته
این بخش ارزش دارد که با دقت خوانده شود، زیرا این خطاها بهطور مداوم در مقالات منتشرشده ظاهر میشوند و کاملاً قابل اجتناب هستند.
اهمیت
- واژه «insignificant» را با «not significant» جایگزین کنید. «Insignificant» به معنای «نامهم» است که ادعای متفاوتی است.
- «روند به سمت معناداری» را با «معنادار نیست» جایگزین کنید. یک نتیجه یا معنادار است یا نیست؛ هیچ روندی به سمت آن وجود ندارد.
- از «NS» خودداری کنید؛ مقدار واقعی p را گزارش کنید.
- از «معناداری» برای معناداری آماری و از «اهمیت» برای اهمیت بالینی یا ماهوی استفاده کنید. این دو با هم متفاوتاند و خلط میان آنها مهمترین اشتباه در این فهرست است.
متوسط
- از بهکار بردن «متوسط» بهمعنای «معمولی» خودداری کنید.
- اگر منظور شما «میانگین» است، بگویید «میانگین». «Average» بین میانگین، میانه و مد گنگ است.
محدوده
- هنگام توصیف تنوع، «ranged» را با «varied» جایگزین کنید.
- دامنه = حداکثر منهای حداقل، یک عدد واحد.
- وقتی گزارش میدهید Q1 و Q3، نباید بگویید IQR. بازه بینکوارتیلی، اختلاف بین آنهاست؛ این جفت، فاصله بینکوارتیلی است. گزارش «میانگین 12 (IQR 8, 19)» از نظر فنی نادرست است، هرچند رایج است؛ «میانگین 12 (Q1 8, Q3 19)» بیابهام است.
پارامتر
- پارامتر ویژگیای از یک جامعه آماری است، مانند میانگین.
- این واژه نام دیگری برای «متغیر»، «پیامد» یا «نقطه پایانی» نیست. «ما سه پارامتر را اندازه گرفتیم» تقریباً همیشه یعنی «سه متغیر».
دادهها
- دیتا واژهای جمع است: «data are»، «data were». صورت مفرد آن «datum» است.
واریانس و واریاسیون
- واریانس یک کمیت مشخص است: مربع انحراف معیار.
- تغییرپذیری مفهوم کلی تغییرناپذیری است. «در پاسخها تغییرپذیری زیادی وجود داشت» باید «تغییر» باشد.
نرخها و نسبتها
- یک نسبت، بخشی را با کل مقایسه میکند.
- نرخ، بسامد یک رویداد در طول یک دورهٔ قرارگیری است.
همانطور که در واحد فراوانی بیماری دوره مبانی مطرح شده است: شیوع یک نسبت است، نه یک نرخ، و «نرخ شیوع» اشتباه است.
جمعیت
- جمعیت، گروه کلی مورد علاقه برای مطالعه شما است.
- اگر نمونهای دارید، به آن نمونه مراجعه کنید. «در جمعیت 240 بیمار ما» باید «در نمونه ما» باشد.
چندمتغیره و چندگانهمتغیر
- چندمتغیره به تحلیل همزمان چندین نتیجه اشاره دارد.
- تحلیل چندمتغیره هر تحلیلی است که شامل دو یا چند متغیر مستقل باشد.
تقریباً هر مقالهای که عبارت «رگرسیون چندمتغیره» را به کار میبرد، منظور آن رگرسیون چندگانهمتغیره است. این رایجترین اشتباه در اصطلاحات آماری در متون سلامت است.
گزارش نتایج: توالی
- راهنمای گزارشدهی را که دنبال کردهاید اعلام کنید، مانند CONSORT برای کارآزماییها یا STROBE برای مطالعات مشاهدهای، و از آن پیروی کنید.
- روشهای خود را بهطور کامل گزارش کنید.
- تحلیلهای جمعیتشناختی یا ویژگیهای زمینهای را توصیف کنید.
- گروهها را مقایسه و اثرها را برآورد کنید، با آمارههای مناسب.
- با احتیاط لازم تفسیر کنید.
شبکه EQUATOR دستورالعملهای گزارشدهی را برای هر طراحی اصلی حفظ میکند: CONSORT برای کارآزماییها، STROBE برای مطالعات مشاهدهای، PRISMA برای مرورهای نظاممند، STARD برای صحت تشخیصی، TRIPOD برای مدلهای پیشبینی، SPIRIT برای پروتکلها، CHEERS برای ارزیابیهای اقتصادی. قبل از نوشتن، نه بعد از آن، راهنمای مناسب را پیدا کنید.
آمار توصیفی
ابتدا تحلیلهای توصیفی را گزارش کنید.
همیشه یک معیار برای میانگین و یک معیار برای پراکندگی ارائه دهید.
برای متغیرهای پیوسته از میانگین (SD)، میانه (min, max) یا میانه (Q1, Q3) استفاده کنید:
- میانگین (SD) برای توزیعهای متقارن مناسب است. برای دادههای نامتقارن از مدیان استفاده کنید.
- به جای SEM از SD استفاده کنید. انحراف معیار مقیاسی مشابه دادههای خام دارد و شرکتکنندگان را توصیف میکند؛ خطای استاندارد دقت یک برآورد را نشان میدهد و بسیار کوچکتر است، که باعث میشود دادهها بسیار کمتر از آنچه هستند متغیر به نظر برسند. این یکی از رایجترین و گمراهکنندهترین خطاها است.
- از «میانگین ± SD» استفاده نکنید. نشانهگذاری بهصورت «+ یا −» مبهم است (SD؟ SE؟ فاصله اطمینان؟) و چندین مجله آن را ممنوع کردهاند. بنویسید «میانگین 42.1 (SD 8.3)».
مکانهای اعشاری:
- بهطوریکه حداکثر یک رقم اعشاری بیشتر از دادههای اصلی باشد.
- SD تا حداکثر دو رقم اعشاری بیشتر از دادههای اصلی.
اگر سنین به سال کامل ثبت شده بودند، میانگین سنی 54.3 گزارش شود نه 54.3182. ارقام اضافی دلالت بر دقتی دارد که این اندازهگیری ندارد.
N و n: ** N نشاندهنده اندازه جمعیت و n نشاندهنده اندازه نمونه است.**
برای متغیرهای دستهای از عدد (درصد) استفاده کنید:
- n > 100: درصدها را تا یک اعشار گزارش کنید.
- 20 < n ≤ 100: درصدها را بهصورت اعداد صحیح گزارش کنید.
- برای n ≤ 20، معمولاً بهتر است درصدها حذف شوند: «3 از 17» صادقتر از «17.6%» است.
- آیا مخرج تغییر میکند؟ اگر دادههای گمشده باعث شود متغیرهای مختلف مخرجهای متفاوتی داشته باشند، آن را برای هر سطر مشخص کنید.
اصطلاحاتی که نباید با هم اشتباه گرفته شوند:
| دوره | عبارت معمول | مقیاس |
|---|---|---|
| نسبت | 1:2 | هر مقدار مثبت |
| نسبت | 0.35 | [0, 1] |
| احتمال | 0.35 | [0, 1] |
| درصد | 35% | [0, 100] |
مقایسههای آماری
برای هر مقایسه:
- گروهها و نتیجه را بهوضوح تعریف کنید.
- توزیع پیامد را توصیف کنید اگر در جدول 1 نیامده باشد.
- تفاوت مورد انتظار بین گروهها را مشخص کنید. حداقل تفاوت بالینی مهم چقدر است؟
- آزمون بهکاررفته را گزارش کنید برای هر مقایسه.
- روش تعدیل آلفا را اعلام کنید برای مقایسههای چندگانه، هر جا که کاربرد دارد.
- معیار معناداری آماری را مشخص کنید، برای مثال آلفا = 0.05.
- بیان کنید که آیا آزمونها یکطرفه هستند یا دوطرفه.
- جزئیات محاسبه اندازه نمونه را گزارش کنید.
- روشهای آماری برای بررسی فرضیات (طبیعی بودن، چندخطیبودن، مخاطرههای متناسب).
- روشهای دولتی برای رسیدگی به دادههای پرت و دادههای گمشده.
- تحلیلهای حساسیت برنامهریزیشده را مشخص کنید.
- نرمافزار بهکاررفته را اعلام کنید برای همه تحلیلها.
برای خود نتایج:
- خلاصه گزارش را بر اساس گروهها ارائه دهید.
- برآورد اثر و خطای استاندارد آن را گزارش کنید، هر جا که مناسب است.
- فواصل اطمینان 95% را برای مقایسههای اصلی ارائه دهید، چه معنادار باشند چه نباشند. این باارزشترین مورد در فهرست است.
- مقدار p واقعی و مقدار آماره آزمون را گزارش کنید برای آزمونهای t و خیدو، همراه با درجه آزادی.
- مقادیر p را تا دو یا سه رقم اعشاری گزارش کنید.
- p < 0.001 باید به صورت «p < 0.001» گزارش شود؛ هرگز p = 0 را گزارش نکنید.
- p > 0.999 باید به صورت «p > 0.999» گزارش شود؛ هرگز p = 1 را گزارش نکنید.
- نتایج برازش و ارزیابی فرضیات مدل را گزارش کنید.
- نتایج تحلیل دادههای گمشده را گزارش کنید و هر تحلیل حساسیتی را.
ارزش p دقیقاً برابر صفر یا یک غیرممکن است و گزارش آن نشان میدهد که عدد بدون تأمل از خروجی نرمافزار کپی شده است.
گزارشدهی مدل رگرسیون
فراتر از قواعد کلی، یک مدل رگرسیون نیازمند است:
- نوع مدل و دلیل تناسب آن با نتیجه.
- نتیجه، با کدگذاری آن و برای یک نتیجهٔ دودویی، اینکه کدام سطح مدلسازی میشود. «نسبت شانس مرگومیر» اگر خواننده نتواند تشخیص دهد کدام دسته رویداد است، غیرقابل تفسیر است.
- هر متغیر در مدل، همراه با کدگذاری، واحدها و گروه مرجع آن.
- آیا برآوردها تعدیل شدهاند و برای چه منظور؟ برآوردهای خام و تعدیلشده را در مواردی که مقایسه آموزنده است گزارش کنید.
- ضریب همراه با فاصله اطمینان آن، بر مقیاسی که خوانندگان نیاز دارند: میانگین اختلاف، نسبت شانس، نسبت خطر، نسبت نرخ.
- واحدها برای پیشبینهای پیوسته. «OR برابر با 1.03 در سال» و «OR برابر با 1.34 در هر دهه» یافتهای یکسان هستند؛ آن را که قابل تفسیر است ارائه کنید.
- اندازهٔ نمونهٔ واقعی مورد استفاده، که اغلب به دلیل دادههای گمشده کوچکتر از نمونهٔ جذبشده است.
- تعداد رویدادها برای مدلهای لجستیک و بقا، تا خوانندگان بتوانند قضاوت کنند که آیا مدل دچار ابربرازش شده است یا خیر.
- بررسیهای برازش و فرضیات، با آنچه انجام شد و آنچه نشان داد.
- چگونه به این مدل رسیدید. اگر متغیرها از دادهها انتخاب شدهاند، این را بگویید و نحوهٔ انتخاب آنها را توضیح دهید، زیرا این موضوع نحوهٔ خواندن مقادیر p را تغییر میدهد.
مدلی که بدون ذکر اندازهٔ نمونه، تعداد رویدادها و نحوهٔ کدگذاری متغیرهای آن ارائه شود، قابل تفسیر نیست، مهم نیست چه تعداد ضریب فهرست شده باشد.
جدولها و نمودارها
جدولها برای مقادیر دقیقی هستند که خوانندگان آنها را جستجو یا استخراج میکنند.
- هر میز یک ایده.
- عنوانی که جدول را بدون متن بهخودیخود قابلفهم میکند.
- ردهها و ستونها طوری چیده شدهاند که مقایسهٔ موردنظر مجاور باشد، زیرا خوانندگان همسایهها را مقایسه میکنند.
- واحدها در سربرگ ردیف یا ستون قرار دارند و در هر سلول تکرار نمیشوند.
- مکانهای اعشاری ثابت را در یک ستون پایین بیاورید.
- مخرجها زمانی که متفاوت هستند، ذکر میشوند.
- پانویسها که هر اختصار را تعریف میکنند.
اعداد برای الگوها و اشکال هستند.
- وقتی شکل یک رابطه یا توزیع اهمیت دارد، از یک نمودار استفاده کنید.
- وقتی اعداد دقیق موضوع اصلی هستند، از جدول استفاده کنید.
- وقتی حجم نمونه اجازه میدهد، دادهها را نشان دهید، نه فقط خلاصهها را. نمودار جعبهای همراه با نقاط فردی که روی آن قرار گرفتهاند، نسبت به هر یک بهتنهایی آموزندهتر است و بسیار بیشتر از نمودار میلهای میانگینها مفید است.
- از نمودارهای میلهای میانگین با نوارهای خطا برای دادههای پیوسته خودداری کنید. این نمودارها توزیع، اندازه نمونه و هرگونه دوقرتی بودن را پنهان میکنند و نوارهای خطا اغلب خطاهای استاندارد هستند که گویی انحرافات معیارند.
- محورهای نمودار را با مقادیری آغاز کنید که تفاوتها را اغراقآمیز نشان ندهند و اگر محوری ناقص است، آن را مشخص کنید.
- هر بار مشخص کنید که نوارهای خطا چه چیزی را نشان میدهند.
- برای منحنیهای بقا، اعداد در معرض خطر را زیر محور چاپ کنید.
- برای تحلیلهای زیرگروه، از نمودار جنگلی استفاده کنید که هر زیرگروه، برآورد کلی، و مقدار p اثر متقابل را نشان دهد.
تفسیر با احتیاط لازم
آخرین مرحله، مرحلهای که در آن گزارشدهی خوب اغلب فرو میپاشد.
- در واژگانی که بهکار میبرید، بین اهمیت آماری و اهمیت بالینی تمایز قائل شوید.
- از یک نتیجه غیرمعنادار نتیجه «عدم تفاوت» نگیرید. بگویید که فاصله اطمینان چه چیزهایی را مستثنی میکند.
- یک رابطه را علتمند توصیف نکنید مگر اینکه طرح پژوهش از آن پشتیبانی کند.
- نتیجهٔ اصلی را ابتدا و بهطور برجستهترین گزارش کنید، هرچه نشان داد.
- تحلیلهای اکتشافی و پسینی را به همین عنوان برچسبگذاری کنید.
- محدودیتهایی را که تفسیر را تغییر میدهند بیان کنید، نه یک فهرست کلی.
درک خود را بررسی کنید
- بازنویسی: «تحلیل چندمتغیره روند نامحسوسی به سمت معناداری را نشان داد (p = NS) در میانگین مقادیر پارامتر که از 12 تا 45 متغیر بود.» تمام خطاها را شناسایی کنید.
- یک مقاله گزارش میدهد «میانگین طول اقامت 8.2 ± 1.1 روز» برای 400 بیمار. دو نکته اشتباه را در این مورد بیان کنید و بگویید برای اصلاح آن چه اطلاعاتی نیاز دارید.
- یک جدول درصد 33.3% را برای یک زیرگروه گزارش میکند. این زیرگروه شامل 6 بیمار است. توضیح دهید.
- توضیح دهید چرا گزارش SEM بهجای SD در جدول ویژگیهای پایه گمراهکننده است و با n = 100 تقریباً تا چه ضریبی تغییرپذیری را دستکم نشان میدهد.
- جدول رگرسیون لجستیک هشت نسبت شانس را همراه با فواصل اطمینان فهرست میکند و هیچ اطلاعات دیگری ندارد. پنج موردی را که قبل از تفسیر آن نیاز دارید، فهرست کنید.
- تفاوت بین multivariate و multivariable را توضیح دهید و چرا این خطا فراتر از لغتتراشی اهمیت دارد.
- یک نمودار دو میله را همراه با نوارهای خطا و یک ستاره نشان میدهد. سه مورد اطلاعات را که خواننده نمیتواند بهدست آورد، توصیف کنید و یک نمودار بهتر پیشنهاد دهید.
- یک نتیجه به صورت «p = 0.000» گزارش شده است. توضیح دهید چه اشتباهی رخ داده و چه چیزی باید نوشته شود.
مطالعه بیشتر
- EQUATOR Network: reporting guidelines for all major study designs.
- Lang TA, Altman DG. Basic statistical reporting for articles published in biomedical journals: the "Statistical Analyses and Methods in the Published Literature" (SAMPL) guidelines.
- Assel M, Sjoberg D, Elders A, et al. Guidelines for reporting of statistics for clinical research in urology. BJU Int. 2019;123(3):401-410.
- Weissgerber TL, Milic NM, Winham SJ, Garovic VD. Beyond bar and line graphs: time for a new data presentation paradigm. PLoS Biol. 2015;13(4):e1002128.
- Altman DG, Bland JM. Standard deviations and standard errors. BMJ. 2005;331:903.