مکانیسم‌های پاداش و اولویت‌بندی بینایی

مغز انسان برای بقا و تسهیل رفتارهای انطباقی، به‌گونه‌ای تکامل یافته است که محرک‌های محیطی نشان‌دهنده پاداش‌های بالقوه را در اولویت پردازش قرار دهد. توجه انتخابی به محرک‌های پیش‌بینی‌کننده پاداش، به ارگانیسم‌ها کمک می‌کند تا در محیط‌های پیچیده به سمت حالت‌های پربارتر حرکت کنند. این فرآیند انتخاب با توجه به ظرفیت محدود پردازش مغز بسیار حیاتی است، زیرا بازنمایی‌های درونی محرک‌های ارزشمند را تقویت کرده و به شکل‌گیری تداعی‌های میان محرک و پاداش کمک می‌کند. در حالی که سوگیری به سمت پردازش محرک‌های مرتبط با پاداش‌های ملموس بیرونی مانند پول یا غذا به‌خوبی اثبات شده است، تأثیر پاداش‌های درونی — یعنی حالت‌های انگیزشی مثبت مرتبط با احساس رضایت و شایستگی — بر پردازش‌های حسی کمتر شناخته شده است.

آزمایش‌های گذشته با استفاده از انگیزه‌های مبتنی بر امتیاز و پول نشان داده‌اند که ارتباط دادن محرک‌ها با احتمال یا مقدار بیشتر پاداش بیرونی، توجه ارادی یا بالا به پایین را تسهیل می‌کند. علاوه بر این، در تکالیف جستجوی بینایی، زمان جستجو برای اهدافی که با پاداش‌های بالاتر مرتبط هستند، سریع‌تر است. نکته قابل توجه این است که اولویت‌بندی محرک‌های مرتبط با پاداش در تکالیف بعدی نیز پایدار می‌ماند، حتی زمانی که پاداش‌ها حذف شده و ویژگی‌های قبلاً پاداش‌داده‌شده دیگر برجسته یا مرتبط با تکلیف نباشند. مطالعات نشان داده‌اند که حرکات چشم نیز به سمت اشیاء و مکان‌های فضایی که قبلاً با پاداش مرتبط بوده‌اند، سوگیری دارند. این امر نشان می‌دهد یادگیری پاداش اثری پایدار ایجاد می‌کند که می‌تواند به‌طور غیرارادی توجه را به سمت این محرک‌ها جلب کند.

تأثیر پاداش بر حافظه کاری بینایی

تأثیر پاداش‌های بیرونی بر رفتار به حافظه کاری بینایی نیز گسترش می‌یابد که به توانایی ذخیره و نگهداری انعطاف‌پذیر ویژگی‌های چندین شیء در یک ظرفیت محدود معروف است. دقت بازنمایی‌ها به عنوان تابعی از پاداش مرتبط افزایش می‌یابد، که نشان می‌دهد تخصیص حافظه کاری بینایی نیز ارزش‌های پاداش را ردیابی می‌کند. با این حال، ظرفیت کل حافظه کاری بینایی با پاداش انعطاف‌پذیری نشان نمی‌دهد؛ به این معنی که بهبود عملکرد برای موارد با پاداش بالا با کاهش متناظر در عملکرد برای موارد با پاداش پایین همراه است. این نتایج نشان می‌دهند که محرک‌ها می‌توانند به‌طور استراتژیک برای رمزگذاری در حافظه کاری بینایی از طریق توجه انتخابی اولویت‌بندی شوند و ظرفیت محدود بین آیتم‌ها بر اساس ارزش‌های ذهنی اختصاص‌یافته توزیع شود.

نقش پاداش‌های درونی و اعتمادبه‌نفس

بسیاری از رفتارهای روزمره فاقد بازخورد بیرونی فوری هستند، که این امر سیگنال‌های تولیدشده درونی — یعنی پاداش‌های درونی — را بسیار مهم می‌سازد. یکی از منابع فرضی این هدایت درونی، احساس ذهنی دقت یا اعتمادبه‌نفس است. کارهای اخیر نشان می‌دهند که سیگنال‌های مرتبط با اعتمادبه‌نفس یک محرک درونی مهم برای یادگیری هستند و یادگیری شبه‌تقویتی می‌تواند صرفاً از ارزیابی درونی ناظر از اعتمادبه‌نفس حاصل شود. سیستم دوپامینرژیک — و به‌ویژه جسم مخطط — که از دیرباز در رمزگذاری ارزش انگیزشی اعمال نقش داشته است، سیگنال‌های انگیزشی تولیدشده درونی از جمله اعتمادبه‌نفس را نیز رمزگذاری می‌کند.

پژوهشگران در یک سلسله آزمایش ارزیابی بینایی، نحوه رقابت محرک‌ها برای جذب منابع پردازشی را بررسی کردند. در آزمایش نخست، شرکت‌کنندگان دو محرک حرکتی رنگی را مشاهده کردند و جهت حرکت محرک هدف را بازسازی کردند. در این آزمایش، رنگ‌های محرک‌ها با پاداش‌های بیرونی متفاوتی مرتبط بودند؛ بازخوانی دقیق با خطای مطلق کمتر از ۵۰ درجه، برای یک رنگ ۱۵ امتیاز و برای رنگ دیگر ۵ امتیاز به همراه داشت. نتایج نشان داد که خطای پاسخ برای محرک‌های مرتبط با پاداش بزرگ‌تر به‌طور معناداری کوچک‌تر بود و شاخص فاکتور بیز معادل ۱۸٫۷ به دست آمد.

در ادامه، پژوهشگران با استفاده از بازخوردهای فریب‌دهنده یا ایجاد تفاوت‌های واقعی در قابلیت اطمینان محرک‌ها، حس اعتمادبه‌نفس شرکت‌کنندگان را دستکاری کردند. یافته‌ها نشان داد که ناظران رمزگذاری محرک‌های مرتبط با عدم قطعیت یا خطای کمتر را در اولویت قرار می‌دهند. این امر عملکرد را برای محرک‌هایی که پیش‌تر به‌دقت ارزیابی شده بودند بهبود بخشید، اما عملکرد را برای محرک‌هایی با ارزیابی ضعیف، بدتر کرد. برای توضیح این یافته‌ها، پژوهشگران یک مدل نرمال‌سازی تخصیص منابع عصبی را با یک قاعده ساده یادگیری تقویتی ترکیب کردند. پاداش‌های درونی و بیرونی به‌طور تجمعی ارزش‌های تخصیص‌یافته به محرک‌های مختلف را شکل دادند و سوگیری‌های حاصل، تخصیص منابع و در نتیجه خطای تخمین را تحت تأثیر قرار دادند.