مدل لجستیک (Logistic Regression) یکی از مهم‌ترین مدل‌های اقتصادسنجی و آماری است که برای تحلیل حالتی به کار می‌رود که متغیر وابسته کیفی و دودویی باشد؛ یعنی فقط دو حالت مانند 0 و 1 بگیرد. در این مدل، هدف اصلی برآورد احتمال وقوع یک رویداد و بررسی اثر متغیرهای توضیحی بر این احتمال است.


چه زمانی از مدل لجستیک استفاده می‌کنیم؟

مدل لجستیک زمانی مناسب است که:

  • متغیر وابسته به‌صورت بله/خیر، وقوع/عدم وقوع، قبولی/ردی تعریف شود
  • هدف، پیش‌بینی یا تحلیل احتمال وقوع یک پدیده باشد
  • استفاده از رگرسیون خطی معمولی (OLS) باعث بروز مشکلات آماری شود

به‌عنوان مثال:

  • فقیر بودن یا نبودن خانوار
  • اشتغال یا بیکاری فرد
  • نکول یا عدم نکول وام


محدودیت رگرسیون خطی برای متغیرهای دودویی

اگر برای متغیر وابسته دودویی از رگرسیون خطی استفاده شود:

  • احتمال‌های پیش‌بینی‌شده ممکن است خارج از بازه [0,1][0,1][0,1] باشند
  • فرض همسانی واریانس نقض می‌شود
  • توزیع خطاها نرمال نخواهد بود

مدل لجستیک برای رفع این مشکلات طراحی شده است.


ایده اصلی مدل لجستیک

در مدل لجستیک، به‌جای مدل‌سازی مستقیم احتمال، لگاریتم نسبت شانس (Log-Odds) به‌عنوان تابعی خطی از متغیرهای مستقل مدل‌سازی می‌شود. این رویکرد باعث می‌شود:

  • احتمال همیشه بین صفر و یک باقی بماند
  • رابطه غیرخطی احتمال به شکلی قابل برآورد تبدیل شود


مفهوم احتمال، شانس و لگیت

  • احتمال (Probability): شانس وقوع یک رویداد
  • نسبت شانس (Odds): نسبت احتمال وقوع به عدم وقوع
  • لگیت (Logit): لگاریتم نسبت شانس که متغیر وابسته واقعی در مدل لجستیک است

این تبدیل ریاضی، ستون اصلی مدل لجستیک را تشکیل می‌دهد.


روش برآورد در مدل لجستیک

برخلاف رگرسیون خطی که با روش حداقل مربعات (OLS) برآورد می‌شود، مدل لجستیک با روش:

  • حداکثر درست‌نمایی (Maximum Likelihood Estimation)

تخمین زده می‌شود. این روش احتمال مشاهده داده‌های واقعی را بیشینه می‌کند.


تفسیر ضرایب در مدل لجستیک

ضرایب مدل لجستیک:

  • اثر متغیرهای مستقل را بر لگاریتم نسبت شانس نشان می‌دهند
  • به‌صورت مستقیم قابل تفسیر اقتصادی نیستند

به همین دلیل، در عمل از نسبت شانس (Odds Ratio) یا اثرات نهایی (Marginal Effects) برای تفسیر نتایج استفاده می‌شود.


کاربردهای مدل لجستیک

مدل لجستیک به‌طور گسترده در حوزه‌های مختلف استفاده می‌شود:

  • اقتصاد و بازار کار
  • مطالعات مالی و بانکی
  • علوم اجتماعی
  • پزشکی و اپیدمیولوژی

در نرم‌افزار Stata این مدل یکی از استانداردترین ابزارهای تحلیل داده‌های دودویی محسوب می‌شود.


جمع‌بندی

مدل لجستیک چارچوبی علمی و مناسب برای تحلیل متغیرهای وابسته دودویی فراهم می‌کند. این مدل با تمرکز بر احتمال وقوع یک رویداد و رفع محدودیت‌های رگرسیون خطی، ابزاری قابل اعتماد برای پژوهش‌های تجربی است و آشنایی مفهومی با آن، پیش‌نیاز پیاده‌سازی صحیح در Stata محسوب می‌شود.

کلیدواژه ها : مدل لجستیک در Stata – Logistic Regression – مقدمه مدل لجستیک – Logit Model – نسبت شانس – Odds Ratio – متغیر دودویی – Binary Dependent Variable – Stata