» هوش مصنوعی و رباتیک » یک ریاضی‌دان از OpenAI توضیح می‌خواهد: داده‌های هوش مصنوعی شما از کجا آمده‌اند؟

یک ریاضی‌دان از OpenAI توضیح می‌خواهد: داده‌های هوش مصنوعی شما از کجا آمده‌اند؟

شهریور ۱۹, ۱۴۰۵ 1013

در ادامه حواشی مربوط به دستاوردهای اخیر OpenAI در حل مسائل پیچیده علمی، اکنون پژوهشگر دیگری نیز این شرکت را به چالش کشیده است. پس از ابهامات مطرح‌شده درباره دستاورد ناویر-استوکس و ادعاهای «تریستان باک‌مستر»، یک ریاضیدان دیگر این شرکت هوش مصنوعی را به رفتار غیراخلاقی، «غیرصادقانه» و فقدان شفافیت درباره منبع داده‌های آموزشی متهم کرد.

ماجرای جدید با پست‌های «آندریاس تام»، ریاضیدان برجسته، در شبکه اجتماعی Mastodon آغاز شد. او ابراز نگرانی کرده است که تعاملات او و همکارانش با چت‌بات ChatGPT پیش از اعلام دستاوردهای بزرگ OpenAI، ممکن است به موفقیت‌های اخیر این شرکت در حوزه ریاضی کمک کرده باشد. ماه گذشته میلادی، OpenAI ده دستاورد مهم علمی را معرفی کرد که یکی از آنها مستقیماً در حوزه تخصصی تام، یعنی «گروه‌های غیرسوفیک» (Non-sofic groups)، قرار داشت؛ ساختارهای ریاضی نامتناهی و پیچیده‌ای که امکان تقریب آنها با ساختارهای متناهی وجود ندارد.

پس از اعلام اولیه این نتیجه، انتقادهای گسترده‌ای از سوی محافل دانشگاهی به OpenAI وارد شد، زیرا این شرکت در متن اولیه خود به مشارکت‌ها و کارهای اخیر تام و همکارش «گابور کُن» اشاره نکرده بود. این شرکت در نهایت بدون سر و صدا گزارش خود را اصلاح و اعلام کرد که دستاوردش تا حد زیادی بر پایه کارهای قبلی تام و کُن ساخته شده است. بااین‌حال، تام می‌گوید تسلط دقیق و جزئی OpenAI بر تکنیک‌های آنها او را شوکه کرده است، زیرا این تکنیک‌ها در آن مقطع زمانی، نه بدیهی‌ترین مسیر برای رسیدن به راه‌حل محسوب می‌شدند و نه امیدوارکننده‌ترین روش بودند.

یک ریاضی‌دان از OpenAI توضیح می‌خواهد: داده‌های هوش مصنوعی شما از کجا آمده‌اند؟
یک ریاضی‌دان از OpenAI توضیح می‌خواهد: داده‌های هوش مصنوعی شما از کجا آمده‌اند؟

ابهام در نحوه استفاده OpenAI از داده‌های کاربران در حل مسائل ریاضی

تام توضیح داده که پس از اعتراض عمومی باک‌مستر درباره ماجرای ناویر-استوکس و احتمال استفاده از تاریخچه کارهایش در ابزار Codex، به این فکر افتاده است که تعاملات خود با این چت‌بات را ارزیابی کند. در پی این تردیدها، تام در ایمیل‌هایی به دو پژوهشگر ارشد OpenAI، یعنی «سباستین بوبک» و «مارک سلکی»، مستقیماً از آنها سؤال کرده که آیا مکالمات او با چت‌بات بخشی از داده‌های آموزشی بوده یا در فرایند استدلال مدل در دسترس قرار گرفته است یا خیر.

پاسخ ارائه‌شده از سوی این شرکت نتوانست تام را قانع کند. به گفته او، پژوهشگران OpenAI تنها به این موضوع اشاره کردند که به گفتگوهای او به شکل مستقیم دسترسی پیدا نشده است، اما هیچ توضیحی درباره اینکه آیا این تعاملات وارد مجموعه عظیم داده‌های آموزشی مدل‌ها شده‌اند یا نه، ارائه ندادند.

تام این رویکرد را نشانه‌ای آشکار از عدم صداقت دانسته و اعلام کرده است که پاسخ دریافتی گمراه‌کننده بوده است. او تأکید دارد که پژوهشگران خارج از شرکت ابزار مهندسی معکوس برای بررسی خط لوله آموزش مدل‌ها را ندارند و وظیفه OpenAI است که با شفاف‌سازی مجموعه‌داده‌ها و مقررات داده‌ای، بی‌گناهی خود را اثبات کند.

یک ریاضی‌دان از OpenAI توضیح می‌خواهد: داده‌های هوش مصنوعی شما از کجا آمده‌اند؟
یک ریاضی‌دان از OpenAI توضیح می‌خواهد: داده‌های هوش مصنوعی شما از کجا آمده‌اند؟

این شیوه پاسخ‌دهی مبهم، شباهت زیادی به موضع‌گیری OpenAI در ماجرای قبلی دارد. در آن پرونده نیز هرچند OpenAI دسترسی مستقیم به داده‌های کاربر را رد کرد، اما رسماً اعتراف کرد که نمی‌تواند تأثیر غیرمستقیم داده‌های ناشناس‌سازی‌شده را بر بهبود مدل‌ها انکار کند.

به گفته تام، حذف هویت و نام افراد شاید روی کاغذ انجام شود، اما ماهیت فکری و بار علمی یک ایده ریاضی را از بین نمی‌برد. به باور این پژوهشگر، اگر یک شرکت با استفاده از کار منتشرنشده کاربران مدلی را بهبود ببخشد و سپس با همان کاربران برای انتشار سریع‌تر نتیجه وارد رقابت شود، اقدامی کاملاً غیرقابل دفاع از نظر اخلاقی انجام داده است؛ رفتاری که در صورت تداوم، فضای باز علمی را به سمت پنهان‌کاری بیشتر سوق خواهد داد.

به این نوشته امتیاز بدهید!

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

  • ×