یادگیری ماشین دور و بر شما
جواب کوتاه
همین گوشی شما پر از یادگیری ماشینه: فیلتر هرزنامه، پیشنهاد فیلم و کالا، باز شدن قفل با چهره، ترجمه، و کلمهای که کیبورد پیشنهاد میده. پشت هر کدوم یه مدله که یه ورودی میگیره و یه جواب میده، و از یه عالمه داده یاد گرفته. مثلا فیلتر هرزنامه ایمیل رو میگیره و میگه «هرزنامه» یا «نه»؛ و از ایمیلهایی یاد گرفته که مردم خودشون هرزنامه زدن. یعنی هر بار شما دکمهی «هرزنامه» رو میزنید، دارید بهش یاد میدید.
توی گوشی شما
گوشیتون رو بردارید. همین الان چند تا یادگیری ماشین توش داره کار میکنه. بیایید پشت یکیش رو باز کنیم.
یه ایمیل میاد. پیش از اینکه شما ببینید، یه مدل میخونتش و میگه «هرزنامهست». همهی کاربردهای یادگیری ماشین همین سه تیکه رو دارن: ورودی، مدل، جواب. و پشتشون یه عالمه داده که مدل ازش یاد گرفته.
پنج تا، باز شده
این پنج تا رو احتمالا همین امروز دیدید:
| چی | ورودی | جواب | از چی یاد گرفته | نوع |
|---|---|---|---|---|
| فیلتر هرزنامه | یه ایمیل تازه | «هرزنامه» یا «نه» | ایمیلهایی که مردم هرزنامه زدن | نظارتشده، دستهبندی |
| پیشنهاد فیلم و کالا | چیزهایی که دیدید یا خریدید | فهرست پیشنهادها | رفتار آدمهایی که سلیقهشون شبیه شماست | ترکیبی؛ اغلب گروهبندی آدمهای شبیه |
| قفل گوشی با چهره | عکس صورت جلوی دوربین | «خودشه» یا «نه» | عکسهایی که اول کار از صورتتون گرفته | نظارتشده، دستهبندی، یادگیری عمیق |
| ترجمه | یه جمله به یه زبون | همون جمله به زبون دیگه | میلیونها جملهی ترجمهشده | نظارتشده، یادگیری عمیق |
| پیشنهاد کلمهی کیبورد | کلمههایی که تا حالا نوشتید | کلمهی بعدی | یه عالمه متن | نظارتشده؛ جواب از توی خود متن |
کیبورد یه نکتهی قشنگ داره: جوابش رو کسی ننوشته. توی هر متن، کلمهی بعدی خودش جوابه. برای همین دادهی آموزشش تقریبا بیپایانه. مدلهای زبانی بزرگ هم همینطوری یاد میگیرن. درس سه نوع یادگیری.
جایزهی یک میلیون دلاری
سال ۲۰۰۶ یه سرویس اجارهی فیلم یه مسابقه گذاشت: هر کی بتونه پیشبینی سلیقهی مشتریها رو دستکم ۱۰ درصد بهتر کنه، یک میلیون دلار میبره. سه سال طول کشید. ۲۰۰۹ یه تیم برد که چند تا مدل رو با هم ترکیب کرده بود.
ولی جالبش بعدش بود: فهمیدن امتیازی که مردم به فیلمها میدن، بهترین نشونهی چیزی که واقعا نگاه میکنن نیست. آدمها به یه فیلم مستند پنج ستاره میدن و شب یه سریال سبک میبینن. برای همین پیشنهادها رو بیشتر از روی رفتار ساختن تا حرف. درسش برای ما: دادهی درست، از مدل باهوشتر مهمتره. ایستگاه داده.
شما دارید یادش میدید
اون ایمیلهایی که فیلتر هرزنامه ازشون یاد گرفته، از کجا اومدن؟ از آدمهایی مثل شما که دکمهی «هرزنامه» رو زدن.
- هر بار «هرزنامه» میزنید، یه برچسب تازه میسازید.
- هر فیلمی که تا آخر میبینید یا وسطش ول میکنید، یه نشونهست برای پیشنهادهای بعدی.
- هر کلمهای که از پیشنهادهای کیبورد انتخاب میکنید، بهش میگه درست حدس زده.
برای همین این ابزارها با گذشت زمان بهتر میشن؛ و برای همین، همون حرف درس اول: تجربهی بیشتر، کار بهتر. ولی یادتون باشه هر رفتاری از شما، دادهست؛ پس حواستون به اینکه چی رو با کی شریک میشید، باشه. درس بعد تاریخچهی کوتاه یادگیری ماشینه: تاریخچه.
جمعبندی. آنچه از این درس با خودتان میبرید.
- هر کاربرد: ورودی، مدل، جواب.
- هرزنامه و قفل با چهره: دستهبندی.
- پیشنهادها: از رفتار آدمهای شبیه شما.
- کیبورد: جواب از توی خود متن.
- هر کلیک شما یه برچسب تازهست.
خودتون رو بسنجید
۱۵ پرسش، هر بار تازه از میان ۳۰ پرسش این درس. آخرش فقط کارنامه رو میبینید: چند تا درست، چند تا نادرست.