شرکت چینی مونشات به دنبال استخراج اطلاعات مدلهای ما بود

طبق ادعای اخیر OpenAI، رقبای چینی از جمله شرکت Moonshot AI در تلاش بودند تا با بهرهگیری از فرایند تقطیر هوش مصنوعی، دادههای محرمانه و پنهان مرتبط با توانایی استدلال مدلها را بدست آورند.
کارزار استخراج دادههای استدلالی OpenAI؛ پای چینیها در میان است
شرکت OpenAI پست جدیدی منتشر کرده است که در آن ادعا میکند کاربران مرتبط با شرکت چینی Moonshot AI در تلاش بودهاند دادههای مربوط به توانایی استدلال مدلهای این شرکت را استخراج کنند. در متن این پست اشاره شده است که کارزاری هماهنگشده و هدفمند برای سرقت دادههای محافظتشده مرتبط با توانایی استدلال مدلها به راه افتاده بود. هنوز مشخص نیست که همه حسابهای کاربری از یک مبدأ مدیریت شدهاند یا اپراتورهای متعددی از آنها استفاده کردهاند.
این رخداد در راستای پدیده تقطیر هوش مصنوعی صورت میگیرد؛ پدیدهای که طی ماههای اخیر شدت بیشتری گرفته و به یکی از معضلات شرکتهای غربی تبدیل شده است. OpenAI گفته است که در ابتدای ماه ژولای، تعداد درخواستهای ثبتشده با این هدف چندان زیاد نبود، اما با گذشت زمان و رسیدن به روزهای ۲۴ و ۲۵ ژولای، افزایشی ناگهانی باعث ثبت ۱۶ هزار درخواست شد. این درخواستها از سوی ۴ هزار حساب کاربری ثبت شده بودند و همه آنها با موفقیت همراه نبودهاند. در نهایت، در تاریخ ۲۸ ژولای دسترسی تمام این حسابها به سرویسهای OpenAI قطع شد تا از تقطیر بیشتر اطلاعات جلوگیری شود.
در پست وبلاگ OpenAI اشاره نشده است که نرخ موفقیت درخواستها برای دسترسی به دادههای استدلالی چه میزان بوده است. همچنین مشخص نیست کدامیک از مدلهای این شرکت هدف قرار گرفتهاند و چه تعداد از حسابهای کاربری به شرکت چینی Moonshot AI مرتبط بودهاند.
OpenAI ادعا میکند که دادههای استدلالی پنهان برای عملکرد صحیح مدلها در جریان انجام یک کار یا فرایند محولشده به هوش مصنوعی استفاده میشوند و بهرهبرداری سیستماتیک و غیرمجاز از خروجی مدلها و دادههای استدلالی آنها، مصداق تقطیر اطلاعات است.
بازیگران شرقی، بهویژه شرکتهای چینی، از دادههای بهدستآمده از طریق فرایند تقطیر برای آموزش و بهبود عملکرد مدلهای خود استفاده میکنند. در واقع، آنها از نتایج تحقیق و توسعه شرکتهای غربی بهره میگیرند تا محصولات خود را بدون طیکردن مسیری مشابه، پیشرفت دهند. معمولاً چنین دادههایی در فرایند استدلال مدلها بهصورت رمزنگاریشده مورد استفاده قرار میگیرند و کاربران بهشکل عادی امکان مشاهده آنها را ندارند. با این حال، بهنظر میرسد برخی کاربران تلاش کردهاند از خود مدل برای رمزگشایی بلاکهای محرمانه استفاده کنند.
طبق ادعای OpenAI، رمزنگاری مورد استفاده برای پنهانکردن دادههای استدلالی شکسته نشده است و گفتگوهای کاربران با چتباتها، در کنار سایر دیتابیسها، کاملاً در امان هستند. مقامات کاخ سفید تاکنون چند بار به رقابت ناسالم شرکتهای چینی با رقبای غربی خود اشاره کردهاند و معتقدند تقطیر دادههای هوش مصنوعی نوعی سرقت محسوب میشود. در سوی دیگر، برخی از بزرگان دنیای فناوری، مانند «جنسن هوآنگ»، مدیرعامل انویدیا، اعتقاد دارند که فرایند تقطیر بخشی از رقابت طبیعی در بازار است؛ اما ارائهدهندگان خدمات حق دارند دسترسی کاربران مشکوک را به سرویسها و امکانات خود سلب کنند.




