آموزشهوش مصنوعی چیست، از صفر

درس ۴ از ۶۴، هوش مصنوعی، حدود ۱۰ دقیقه خواندن

هوش مصنوعی چطور یاد می‌گیرد

جواب کوتاه

هوش مصنوعی با یک چرخه یاد می‌گیرد: برای یک نمونه حدس می‌زند، حدسش را با جواب درست مقایسه می‌کند، پیچ‌های درونش، که به آن‌ها وزن می‌گویند، را کمی در جهتی می‌چرخاند که خطا کمتر شود، و این را هزاران بار تکرار می‌کند. داده را دو بخش می‌کنند: داده‌ی آموزش برای یاد گرفتن، و داده‌ی آزمون، جدا و ندیده، برای سنجیدن. سه راه اصلی یاد گرفتن هست: با نظارت (نمونه با جواب)، بی نظارت (بی جواب، پیدا کردن گروه‌ها)، و تقویتی (با پاداش و جریمه). اگر مدل داده را حفظ کند به‌جای اینکه الگو را یاد بگیرد، به آن بیش‌برازش می‌گویند.

پرتاب توپ

فرض کنید می‌خواهید پرتاب توپ به سبد را یاد بگیرید. هیچ‌کس برایتان فرمول نمی‌نویسد که با چه زاویه و نیرویی پرتاب کنید. پرتاب می‌کنید، می‌بینید توپ کجا افتاد، کمی عوض می‌کنید، و دوباره:

پرتاب اول: توپ خیلی دورتر از سبد می‌افتد.
پرتاب دهم: کمی زاویه را عوض کرده‌اید؛ نزدیک‌تر.
پرتاب صدم: توپ در سبد می‌نشیند.

هوش مصنوعی هم همین‌طور یاد می‌گیرد، فقط به‌جای صد پرتاب، میلیون‌ها نمونه. برای همین در درس قبل گفتیم قاعده را خودش پیدا می‌کند.

چرخه‌ی چهارقدمی

برای هر نمونه چهار قدم: حدس می‌زند (پرتاب)، حدس را با جواب درست مقایسه می‌کند (توپ چقدر و به کدام طرف از سبد دور افتاد)، کمی خودش را اصلاح می‌کند (زاویه را کمی عوض می‌کند)، و دوباره:

به این کار «آموزش» مدل می‌گویند. اصلاح همیشه کوچک است، در جهتی که خطا کمتر شود؛ مثل کسی که در تاریکی از تپه پایین می‌آید و هر بار قدمی به سمتی برمی‌دارد که سراشیبی تندتر است. نام این روش «گرادیان کاهشی» است.

پیچ‌های کوچک

«اصلاح» یعنی چه؟ درون مدل عددهای زیادی هست، مثل پیچ‌های کوچکی روی یک دستگاه. به این عددها وزن می‌گویند. هر بار که حدس اشتباه است، هر پیچ کمی می‌چرخد:

مدل‌های بزرگ امروزی میلیاردها پیچ دارند. وقتی آموزش تمام شد، جای همه‌ی پیچ‌ها ثابت می‌ماند، و همین پیچ‌های تنظیم‌شده همان چیزی است که به آن «مدل» می‌گوییم؛ در درس مدل بیشتر می‌بینید.

داده‌ی آموزش و آزمون

نمونه‌ها را دو بخش می‌کنند. با بخش بزرگ‌تر، داده‌ی آموزش، مدل یاد می‌گیرد. بخش کوچک‌تر، داده‌ی آزمون، کنار گذاشته می‌شود و مدل هرگز آن را در آموزش نمی‌بیند. آخر کار، مدل را با داده‌ی آزمون می‌سنجند، چون هدف این است که در نمونه‌های تازه درست جواب بدهد، نه در همان‌هایی که دیده. مثل امتحانی که پرسش‌هایش از کتاب تمرین نیست.

گاهی بخش سومی هم کنار می‌گذارند، داده‌ی اعتبارسنجی، برای اینکه در میانه‌ی کار، میان چند مدل یکی را انتخاب کنند.

سه راه یاد گرفتن

  • با نظارتنمونه‌ها جوابشان را همراه دارند، مثل عکسی که زیرش نوشته «گربه»؛ معلمی جواب درست را می‌دهد. هرزنامه‌یاب‌ها این‌طور یاد می‌گیرند.
  • بی نظارتنمونه‌ها جواب ندارند؛ برنامه خودش گروه‌ها و شباهت‌ها را پیدا می‌کند، مثل جدا کردن عکس‌ها بر پایه‌ی شباهت، بی آنکه کسی بگوید هر کدام چیست.
  • تقویتیبرنامه کاری می‌کند و پاداش یا جریمه می‌گیرد، و کم‌کم یاد می‌گیرد چه کاری پاداش بیشتری دارد؛ گاهی چیز تازه امتحان می‌کند و گاهی از دانسته‌اش استفاده می‌کند.

پرتاب توپ با نظارت است: سبد جواب درست را نشان می‌دهد. این سه راه در مسیر یادگیری ماشین کامل‌تر می‌آیند.

حفظ کردن یاد گرفتن نیست

اگر مدل نمونه‌های آموزش را حفظ کند، به‌جای اینکه الگوی پشتشان را یاد بگیرد، در همان نمونه‌ها عالی است و در نمونه‌ی تازه شکست می‌خورد. به این بیش‌برازش می‌گویند، به انگلیسی overfitting:

حفظ کردن: کسی که فقط از یک نقطه تمرین کرده، از آن نقطه توپ را در سبد می‌اندازد؛ ولی از نقطه‌ی تازه، نه.
یاد گرفتن: تمرین از جاهای گوناگون، و آزمودن از جایی که هرگز تمرین نشده؛ همان داده‌ی آزمون.

برعکسش هم هست: مدلی که بیش از اندازه ساده است و الگو را اصلا نمی‌گیرد؛ به این کم‌برازش می‌گویند. مدل خوب میان این دو است.

سه اشتباه

  • «مدل یک بار نمونه‌ها را می‌خواند و یاد می‌گیرد.»یاد گرفتن چرخه‌ای است که هزاران بار تکرار می‌شود؛ هر بار کمی کمتر اشتباه.
  • «هر چه در داده‌ی آموزش بهتر، مدل بهتر.»اگر مدل داده‌ی آموزش را حفظ کرده باشد، در آن عالی است و در داده‌ی تازه بد؛ سنجش واقعی با داده‌ی آزمون است.
  • «داده‌ی آزمون را هم به آموزش بدهیم تا مدل بهتر شود.»آن‌وقت دیگر چیزی ندارید که با آن بی‌طرف بسنجید؛ داده‌ی آزمون باید از آموزش جدا بماند.

جمع‌بندی. آنچه از این درس با خودتان می‌برید.

  • چرخه: حدس، مقایسه، اصلاح کمی، دوباره.
  • وزن‌ها: پیچ‌های کوچکی که بعد از هر خطا کمی می‌چرخند.
  • داده‌ی آموزش برای یاد گرفتن؛ داده‌ی آزمون، جدا، برای سنجیدن.
  • سه راه: با نظارت، بی نظارت، تقویتی.
  • بیش‌برازش: حفظ کردن به‌جای یاد گرفتن.

خودتان را بسنجید

۱۵ پرسش، هر بار تازه از میان ۳۰ پرسش این درس. آخر آزمون فقط کارنامه را می‌بینید: چند درست، چند نادرست.

خودتان را بسنجید

۱۵ پرسش

  • هر بار پرسش‌ها و ترتیب گزینه‌ها تازه است.
  • تا آخر، درست یا نادرست بودن جواب‌ها گفته نمی‌شود؛ می‌توانید برگردید و جوابی را عوض کنید.
  • آخرش کارنامه می‌گیرید: چند پرسش درست و چند نادرست.
  • هر وقت بستید، دوباره که باز کنید از همان‌جا ادامه می‌دهید.

فصل‌های این درس

درس بعد