یکی از کارکنان سابق شرکت آنتروپیک مدعی شده است که گروهی از پژوهشگران این شرکت تصور میکردند با آموزش مدل هوش مصنوعی Claude توانستهاند مسئله طنز را حل کنند. این ادعا که در مصاحبهای با مجله نیویورک مطرح شده، بحثهایی درباره میزان درک هوش مصنوعی از شوخی و فضای فکری شرکتهای فعال در این حوزه ایجاد کرده است.
به گزارش تکراتو، جیکوب کاکسون (Jacob Coxon)، پژوهشگر سابق آنتروپیک، در گفتوگو با نیویورک مگزین خاطرهای از دوران فعالیت خود در این شرکت تعریف کرده است. به گفته او، برخی همکارانش مدلی از Claude را برای تولید یا درک طنز آموزش داده بودند و با اطمینان ادعا میکردند که مسئله طنز را حل کردهاند. بااینحال، این ادعا صرفاً روایت یک کارمند سابق است و هیچ پژوهش مستقلی موفقیت قطعی Claude در درک طنز انسانی را تأیید نکرده است.
پژوهشگران آنتروپیک چگونه مدعی حل مسئله طنز شدند؟
جیکوب کاکسون در مصاحبه خود توضیح داده است که هنگام پیوستن به آنتروپیک، با یک کانال داخلی در پیامرسان Slack مواجه شد که در آن نسخهای از Claude برای حل مسئله طنز آموزش داده شده بود.
به گفته او، برخی اعضای تیم با هیجان از موفقیت این مدل صحبت میکردند و معتقد بودند که توانستهاند طنز را به مسئلهای حلشده تبدیل کنند.
کاکسون میگوید این ادعا برایش عجیب بود؛ زیرا به اعتقاد او، طنز پدیدهای پیچیدهتر از آن است که بتوان با آموزش یک مدل زبانی، آن را بهطور کامل حل کرد.
او در واکنش به همکارانش تأکید کرده بود که آنها هنوز موفق به حل مسئله طنز نشدهاند.
این خاطره اکنون به یکی از نمونههای بحثبرانگیز درباره میزان خوشبینی پژوهشگران هوش مصنوعی به توانایی مدلهای خود تبدیل شده است.
چرا جیکوب کاکسون با ادعای همکارانش مخالف بود؟
کاکسون در مصاحبه خود از پدیدهای به نام تفکر گروهی یا Groupthink در محیط کاری آنتروپیک صحبت کرده است.
تفکر گروهی زمانی اتفاق میافتد که اعضای یک مجموعه، تحت تأثیر دیدگاههای مشترک یا فضای غالب سازمان، کمتر به نقد فرضیات یکدیگر میپردازند.
به اعتقاد این پژوهشگر سابق، برخی کارکنان شرکتهای هوش مصنوعی ممکن است به دلیل تمرکز شدید بر پیشرفت فناوری، تواناییهای مدلهای خود را بیش از اندازه ارزیابی کنند.
او ماجرای حل مسئله طنز را نمونهای از همین طرز فکر میداند.
البته این اظهارات دیدگاه شخصی کاکسون درباره تجربه کاری او هستند و لزوماً نشاندهنده نظر رسمی آنتروپیک یا تمام پژوهشگران این شرکت نیستند.
آیا Claude واقعاً میتواند شوخی و طنز را درک کند؟
مدلهای زبانی پیشرفته مانند Claude، ChatGPT و Gemini میتوانند جوک تولید کنند، کنایهها را تشخیص دهند و در بسیاری از مکالمات به شوخیهای کاربران پاسخ مناسب بدهند.
این توانایی نتیجه آموزش مدلها با حجم بزرگی از دادههای متنی و یادگیری الگوهای زبانی و ارتباط میان مفاهیم است.
بااینحال، تولید یک شوخی مناسب لزوماً به معنای درک طنز به همان شیوهای نیست که انسانها آن را تجربه میکنند.
طنز انسانی به عوامل مختلفی از جمله فرهنگ، تجربه شخصی، موقعیت اجتماعی، لحن، زمانبندی و انتظارات مخاطب وابسته است.
برای مثال، یک جمله ممکن است در یک فرهنگ بسیار خندهدار باشد، اما در فرهنگی دیگر هیچ معنای طنزآمیزی نداشته باشد.
به همین دلیل، ارزیابی توانایی هوش مصنوعی در طنزپردازی همچنان یکی از موضوعات پژوهشی در حوزه پردازش زبان طبیعی محسوب میشود.
تفاوت تولید جوک با حل مسئله طنز چیست؟
یکی از نکات مهم در این بحث، تفاوت میان تولید محتوای طنزآمیز و ارائه توضیحی جامع درباره سازوکار طنز است.
یک مدل هوش مصنوعی ممکن است بتواند هزاران جوک تولید کند یا حتی تشخیص دهد کدام شوخی برای گروهی از مخاطبان جذابتر است.
اما چنین عملکردی ثابت نمیکند که مدل تمام جنبههای روانشناختی، اجتماعی و فرهنگی طنز را درک کرده است.
پژوهشگران برای بررسی توانایی مدلهای زبانی در این زمینه، از آزمونهایی مانند تشخیص کنایه، توضیح دلیل خندهداربودن یک جمله و مقایسه کیفیت جوکها استفاده میکنند.
نتایج این آزمونها میتوانند عملکرد مدل را در وظایف مشخص نشان دهند، اما بهتنهایی اثباتکننده حل کامل مسئله طنز نیستند.
در واقع، حتی تعریف یک معیار واحد و جهانی برای خندهداربودن یک شوخی نیز دشوار است.
انتقاد کارمند سابق آنتروپیک از فرهنگ شرکتهای هوش مصنوعی
ماجرای Claude تنها یکی از موضوعاتی است که کاکسون در مصاحبه خود مطرح کرده است.
او درباره فضای کاری شرکتهای پیشرو در حوزه هوش مصنوعی و باورهای برخی پژوهشگران نسبت به آینده این فناوری نیز صحبت کرده است.
کاکسون معتقد است تمرکز شدید بر توسعه هوش مصنوعی فوقپیشرفته میتواند باعث شود برخی افراد اهمیت مسائل روزمره و کاربردهای واقعی فناوری را کمتر در نظر بگیرند.
او همچنین به بحثهای داخلی درباره احتمال آگاهی یا تجربه ذهنی مدلهای هوش مصنوعی اشاره کرده است.
موضوع آگاهی ماشین همچنان محل اختلاف پژوهشگران است و تاکنون شواهد علمی پذیرفتهشدهای برای اثبات تجربه ذهنی در مدلهای زبانی ارائه نشده است.
آیا آنتروپیک رسماً اعلام کرده که مسئله طنز حل شده است؟
نکته مهم این است که ادعای حل مسئله طنز از طریق روایت جیکوب کاکسون درباره گفتوگوهای داخلی شرکت مطرح شده است.
این موضوع به معنای انتشار یک دستاورد علمی رسمی از سوی آنتروپیک نیست.
همچنین اطلاعات مستقلی درباره روش آموزش مدل مورد اشاره، نتایج آزمایشها یا معیارهای سنجش موفقیت آن منتشر نشده است.
بنابراین نمیتوان نتیجه گرفت که Claude واقعاً توانسته تمام پیچیدگیهای طنز انسانی را درک کند.
این ماجرا بیش از آنکه اثباتکننده یک پیشرفت علمی قطعی باشد، پرسش مهمی درباره نحوه ارزیابی تواناییهای هوش مصنوعی مطرح میکند: آیا عملکرد چشمگیر یک مدل در یک وظیفه مشخص، به معنای درک کامل آن مفهوم است؟
پاسخ به این پرسش نیازمند آزمایشهای دقیق، معیارهای روشن و بررسی مستقل نتایج است.






دیدگاهها