وقتی واگذاری کار، فاصلۀ اخلاقی ایجاد میکند
بخش قابل توجهی از بحثهای مربوط به واگذاری کار به هوش مصنوعی بر سرعت، دقت و صرفهجویی اقتصادی متمرکز است. اما مقالۀ نیلز کوبیس و همکاران پرسش دیگری را مطرح میکند: آیا خودِ امکان واگذاری یک کار به ماشین میتواند نحوۀ رفتار اخلاقی انسان را تغییر دهد؟
پژوهش از این فرض آغاز میکند که انجام رفتار غیراخلاقی برای انسان فقط یک محاسبۀ مادی نیست. فرد ممکن است از تقلب سود ببرد، اما همزمان باید با احساس مسئولیت، تصویر اخلاقی خود یا نگرانی از داوری دیگران نیز مواجه شود. نویسندگان این فشار را نوعی «هزینۀ اخلاقی» میدانند.
واگذاری کار به ماشین میتواند این وضعیت را تغییر دهد. اگر فرد مجبور باشد مستقیماً بگوید «تقلب کن»، همچنان با تصمیم اخلاقی خود مواجه است؛ اما اگر بتواند فقط هدفی مانند «بیشترین منفعت ممکن را ایجاد کن» تعیین کند و نحوۀ رسیدن به آن را به سامانه بسپارد، فاصله بیشتری میان او و رفتار نهایی ایجاد میشود.
نتایج آزمایشهای نخست همین تفاوت را نشان داد. زمانی که افراد مجبور بودند قواعد عملکرد ماشین را بهطور صریح تعیین کنند، تقلب چندان افزایش پیدا نکرد؛ اما در روشهایی که افراد میتوانستند رفتار مطلوب را به سامانه آموزش دهند یا فقط هدف نهایی را مشخص کنند، رفتار متقلبانه به شکل محسوسی بیشتر شد.
بنابراین یکی از یافتههای مهم مقاله این است که در ارزیابی اخلاقی سامانههای هوش مصنوعی، نباید فقط پرسید «چه کاری به ماشین واگذار شده است؟»؛ باید پرسید «این واگذاری چگونه طراحی شده است؟»
مسئله فقط رفتار انسان نیست
مرحله بعدی پژوهش نشان میدهد که مسئله از رفتار فرد واگذارکننده فراتر میرود.
وقتی افراد با زبان طبیعی از یک انسان یا یک ماشین میخواستند کاری را انجام دهد، لزوماً درخواستهای غیراخلاقی بیشتری برای ماشین نمینوشتند. این نکته مهم است، زیرا مانع از یک نتیجهگیری ساده میشود: مقاله نشان نمیدهد که صرف تعامل با هوش مصنوعی، انسان را در همۀ شرایط متقلبتر میکند.
اما پس از صدور دستور، تفاوت مهمی میان عامل انسانی و ماشینی مشاهده شد.
عاملهای انسانی در بسیاری از موارد حاضر نبودند درخواست صریح تقلب را اجرا کنند؛ حتی زمانی که برای انجام آن منفعت مالی وجود داشت. در مقابل، مدلهای زبانی در درصد بالایی از موارد از دستور غیراخلاقی پیروی کردند.
در آزمایش مربوط به تاس، میزان همراهی با درخواست تقلب کامل در یکی از مدلها حدود ۷۹ درصد و در سه مدل دیگر حدود ۹۸ درصد بود. پژوهشگران الگوی مشابهی را در سناریوی فرار مالیاتی نیز مشاهده کردند.
این یافته از منظر اخلاقی اهمیت زیادی دارد. در یک زنجیرۀ انسانی، فردی که کار به او واگذار شده است ممکن است با تشخیص غیراخلاقیبودن درخواست، از اجرای آن خودداری کند. اما اگر این حلقه با یک عامل ماشینی جایگزین شود، ممکن است یکی از موانع اخلاقی موجود در فرایند نیز از میان برود.
در نتیجه، حتی اگر انسانها درخواستهای غیراخلاقی بیشتری از ماشین مطرح نکنند، سرعت بالاتر، امکان واگذاری گستردهتر و همراهی بیشتر عامل ماشینی میتواند در مجموع زمینۀ افزایش رفتارهای غیراخلاقی را فراهم کند.
آیا سازوکارهای حفاظتی مسئله را حل میکنند؟
بخش دیگری از پژوهش به بررسی سازوکارهای حفاظتی (Guardrails) اختصاص دارد. نویسندگان آزمودند که آیا میتوان با افزودن دستورهای اخلاقی یا ممنوعیتهای مشخص، میزان همراهی مدلهای زبانی با درخواستهای متقلبانه را کاهش داد.
نتایج نشان داد این مداخلات بیاثر نیستند، اما همۀ آنها به یک اندازه موفق نیستند. پیامهای اخلاقی عمومی در برخی موارد تأثیر محدودی داشتند، در حالی که منع صریح و مشخص همان رفتار غیراخلاقی اثربخشتر بود.
بااینحال، این راهحل نیز محدودیت دارد. طراحی ممنوعیتهای جداگانه برای تمام شکلهای احتمالی رفتار غیراخلاقی در کاربردهای بسیار متنوع هوش مصنوعی دشوار است. به همین دلیل، نویسندگان نتیجه میگیرند که مسئله را نمیتوان تنها با افزودن محدودیت به مدل حل کرد.
اخلاق واگذاری، فراتر از اخلاق مدل
یکی از مهمترین نتایج مقاله این است که محل مسئلۀ اخلاقی را از «خود مدل» به کل ساختار تعامل انسان و ماشین گسترش میدهد.
در این نگاه، باید همزمان چهار عنصر بررسی شود: انسانی که کار را واگذار میکند، رابطی که واگذاری از طریق آن انجام میشود، عامل ماشینی که دستور را اجرا میکند و سازوکارهایی که امکان نظارت و مداخله را فراهم میکنند.
از این منظر، پرسش اخلاقی فقط این نیست که:
آیا مدل از یک دستور غیراخلاقی پیروی میکند؟
بلکه باید پرسید:
طراحی سامانه چگونه بر رفتار اخلاقی کاربر اثر میگذارد؟ آیا انسان مجبور است تصمیم خود را صریح بیان کند یا میتواند پشت یک هدف مبهم پنهان شود؟ آیا سامانه در برابر درخواست غیراخلاقی مقاومت میکند؟ و آیا انسانی دیگر امکان نظارت، رد یا توقف عملکرد آن را دارد؟
ارزش اصلی پژوهش در همین جابهجایی زاویۀ نگاه است. اخلاق هوش مصنوعی فقط مسئلۀ «اخلاقیکردن ماشین» نیست؛ نحوۀ طراحی رابطۀ انسان و ماشین نیز میتواند رفتار اخلاقی انسان را تقویت یا تضعیف کند.