بازگشت به فهرست مقالات

    Random Forests

    Leo Breiman
    📅 2001🏛 Machine Learning, vol. 45, no. 1, pp. 5-32, DOI: 10.1023/A:1010933404324
    مسئله

    این مقاله روش جنگل تصادفی را معرفی می‌کند که ترکیبی از درخت‌های تصمیم با دو منبع تصادفی‌سازی است تا دقت را افزایش داده و بیش‌برازش را کاهش دهد.

    روش

    بریمن جنگل تصادفی را بر اساس ساخت تعداد زیادی درخت تصمیم بر روی نمونه‌های تصادفی از داده‌ها (با جایگذاری) و انتخاب تصادفی ویژگی‌ها در هر گره تعریف می‌کند.

    یافته

    نشان داده شد که جنگل تصادفی در مقایسه با درخت‌های منفرد و سایر روش‌های ensemble، دقت بالاتری دارد و به‌خوبی با داده‌های با ابعاد بالا و نویزدار کار می‌کند.

    محدودیت‌ها

    تفسیرپذیری جنگل تصادفی کمتر از یک درخت منفرد است و برای داده‌های بسیار بزرگ (چندین میلیون نمونه) ممکن است هزینه‌ی محاسباتی بالایی داشته باشد.

    کاربرد عملی

    جنگل تصادفی در بسیاری از مسائل صنعتی از جمله تشخیص کلاهبرداری، پیش‌بینی ریزش مشتریان، و تحلیل تصاویر پزشکی استفاده می‌شود.

    📇 فلش‌کارت خلاصه — 13 فیلد تحلیلی برای این مقاله

    خلاصه

    مقاله‌ی بریمن روش جنگل تصادفی را معرفی می‌کند که با ترکیب تعداد زیادی درخت تصمیم با تصادفی‌سازی، دقت مدل‌سازی را افزایش داده و از بیش‌برازش جلوگیری می‌کند.

    نمای سریع

    روش ensemble قدرتمند با درخت‌های تصمیم.

    یافته‌های کلیدی

    نشان داده شد که جنگل تصادفی در مقایسه با درخت‌های منفرد و سایر روش‌های ensemble، دقت بالاتری دارد و به‌خوبی با داده‌های با ابعاد بالا و نویزدار کار می‌کند.

    هدف

    ارائه‌ی یک الگوریتم ensemble که دقت بالایی داشته و در برابر نویز مقاوم باشد.

    روش

    بریمن جنگل تصادفی را بر اساس ساخت تعداد زیادی درخت تصمیم بر روی نمونه‌های تصادفی از داده‌ها (با جایگذاری) و انتخاب تصادفی ویژگی‌ها در هر گره تعریف می‌کند.

    نتایج

    جنگل تصادفی در بسیاری از مجموعه‌داده‌ها عملکردی بهتر از روش‌های قبلی داشت.

    نتیجه‌گیری

    جنگل تصادفی یکی از مؤثرترین الگوریتم‌های یادگیری ماشین برای طیف وسیعی از مسائل است.

    مفاهیم کلیدی

    جنگل تصادفی، درخت تصمیم، ensemble، طبقه‌بندی

    مطالعه‌ی بیشتر

    https://link.springer.com/article/10.1023/A:1010933404324

    تحلیل

    این مقاله یکی از پراستنادترین مقالات در یادگیری ماشین است و جنگل تصادفی به‌عنوان یک الگوریتم استاندارد در صنعت پذیرفته شده است.

    محدودیت‌ها

    تفسیرپذیری جنگل تصادفی کمتر از یک درخت منفرد است و برای داده‌های بسیار بزرگ (چندین میلیون نمونه) ممکن است هزینه‌ی محاسباتی بالایی داشته باشد.

    کارهای آینده

    بریمن بر نیاز به بهبود تفسیرپذیری و کاهش هزینه‌ی محاسباتی در داده‌های بزرگ تأکید کرده است.

    کاربرد عملی

    جنگل تصادفی در بسیاری از مسائل صنعتی از جمله تشخیص کلاهبرداری، پیش‌بینی ریزش مشتریان، و تحلیل تصاویر پزشکی استفاده می‌شود.

    ارجاعات (این مقاله از این‌ها استفاده کرده) (0)

    ارجاعی ثبت نشده است.

    ارجاع‌شده توسط (0) ▶

    هنوز مقاله‌ای به این ارجاع نداده است.

    مسیر یادگیری پیش‌نیاز این مقاله