پرش به محتوای اصلی
OpenAI

۲۸ مرداد ۱۴۰۵

شرکتایمنی

ارائه عدم ذخیره داده برای مدل‌های پیشرو

پیش‌نمایش پردازش خصوصی ایمنی که ضمن سازگاری با ZDR، سازوکارهای حفاظتی را در سراسر تعاملات تقویت می‌کند.

در حال بارگذاری…

عدم ذخیره داده، تضمینی روشن به مشتریان واجد شرایط API می‌دهد: OpenAI پس از پردازش درخواست، پرامپت‌ها یا پاسخ‌های مدل را نگه نمی‌دارد. محتوای مشتری برای بازبینی در دسترس کارکنان OpenAI قرار نمی‌گیرد1 و داده‌های مشتریان سازمانی نیز، مگر با موافقت صریح خودشان، برای آموزش مدل‌های ما استفاده نمی‌شود.

با برعهده‌گرفتن وظایف طولانی‌تر و پیچیده‌تر توسط مدل‌ها، برخی خطرهای جدی ممکن است تنها در چندین تعامل آشکار شوند. سامانه‌های ایمنی فعلیِ سازگار با ZDR، هر تعامل را جداگانه ارزیابی می‌کنند. امروز پیش‌نمایشی از پردازش خصوصی ایمنی ارائه می‌کنیم که برای شناسایی الگوها در تعاملات مرتبط طراحی شده است، بدون آنکه کارکنان OpenAI به محتوای اصلی دسترسی داشته باشند.

در پیاده‌سازی‌های ZDR، محتوای مشتری روی زیرساخت تحت کنترل او باقی می‌ماند. همچنین در حال توسعه گزینه‌ای هستیم که در آن، محتوا روی زیرساخت OpenAI ذخیره و با کلیدهای تحت کنترل مشتری رمزگذاری می‌شود. در هر دو حالت، سامانه‌های خودکار می‌توانند سوءاستفاده احتمالی را شناسایی و سیگنال‌های ایمنی محدودی ارسال کنند، بدون آنکه پرامپت‌ها یا پاسخ‌های اصلی در معرض دید کارکنان OpenAI قرار گیرند.

چرا سامانه‌های ایمنی باید تکامل یابند

جدی‌ترین خطرهای ایمنی هوش مصنوعی همیشه در یک تعامل آشکار نمی‌شوند. اغلب، نیت‌های بالقوه زیان‌بار تنها زمانی روشن می‌شوند که چندین تعامل در کنار هم بررسی شوند. خطرهای مشابهی ممکن است زمانی پدید آیند که عاملان مخرب بارها سازوکارهای حفاظتی را محک بزنند، میان چند حساب هماهنگ شوند یا تهدیدها را در پوشش پژوهش‌های عادی پنهان کنند. خطرها ممکن است در جریان یک وظیفه عامل‌محور نیز شکل بگیرند؛ برای مثال، وقتی سامانه با ادامه فعالیت پس از دریافت دستور توقف، از قصد کاربر منحرف شود.

هرچه سامانه‌های هوش مصنوعی وظایف طولانی‌تر و پیچیده‌تری بر عهده می‌گیرند، این زمینه گسترده‌تر برای تمایز فعالیت مشروع از سوءاستفاده و اطمینان از باقی‌ماندن عامل‌های هوش مصنوعی در محدوده اختیارات موردنظرشان اهمیت بیشتری می‌یابد.

در برخی پیاده‌سازی‌های اخیر مدل‌های پیشرو، مشتریان ملزم شده‌اند به ارائه‌دهنده هوش مصنوعی خود اجازه دهند محتوای حساس را برای پایش ایمنی نگه دارد. برای بسیاری از سازمان‌ها، چنین الزاماتی با تعهدات امنیتی آن‌ها یا تعهدشان به افرادی که به آن‌ها خدمت می‌کنند، در تعارض است.

پردازش خصوصی ایمنی به‌گونه‌ای طراحی شده است که بتوانیم همچنان ZDR را ارائه کنیم.

پردازش خصوصی ایمنی چگونه کار می‌کند

پردازش خصوصی ایمنی بر پایه سازوکارهای حفاظتی خودکاری بنا شده است که هم‌اکنون در ZDR و سایر پیاده‌سازی‌ها به کار می‌روند. سامانه‌های ایمنی فعلیِ سازگار با ZDR، تعاملات را جداگانه ارزیابی می‌کنند. پردازش خصوصی ایمنی این سازوکارهای حفاظتی را به تعاملات مرتبط گسترش می‌دهد تا سامانه‌های خودکار بتوانند الگوها را شناسایی کنند، بدون آنکه کارکنان OpenAI به محتوای ذخیره‌شده مشتری دسترسی داشته باشند.

پردازش خصوصی ایمنی، صرف‌نظر از محل ذخیره‌سازی، از محتوای مشتری استفاده می‌کند؛ چه در زیرساخت تحت کنترل مشتریان (پیاده‌سازی‌های ZDR) و چه در فضای ذخیره‌سازی ارائه‌شده توسط OpenAI. در فضای ذخیره‌سازی ارائه‌شده توسط OpenAI، محتوای مشتری با کلیدهای تحت کنترل او رمزگذاری می‌شود. کارکنان OpenAI نسخه‌ای از این کلیدها ندارند؛ بنابراین نمی‌توانند به محتوای اصلی دسترسی پیدا کنند.

هنگام شناسایی خطر، OpenAI سیگنالی با دامنه دقیق و محدود دریافت می‌کند که نوع فعالیت مربوط را نشان می‌دهد؛ مشابه آنچه امروز در سامانه‌های ایمنی موجود ما انجام می‌شود. از این سیگنال می‌توان برای تشخیص ضرورت اجرای اقدامات انضباطی استفاده کرد. حتی در صورت علامت‌گذاری محتوا، کارکنان OpenAI به محتوای مشتری دسترسی پیدا نمی‌کنند.

مشتریان می‌توانند با استفاده از اطلاعات موجود در سامانه‌های خود، هشدارها و تصمیم‌های اجرایی را بررسی کنند. اگر بخواهند اعتراض کنند، مشروع‌بودن فعالیتی را توضیح دهند یا از تحقیق درباره سوءاستفاده تأییدشده پشتیبانی کنند، می‌توانند اطلاعات مرتبط را با OpenAI به اشتراک بگذارند.

پردازش خصوصی ایمنی در حال حاضر با گروهی از مشتریان اولیه آزمایش می‌شود. اکنون این پیش‌نمایش را منتشر می‌کنیم، زیرا مشتریانمان به‌روشنی گفته‌اند که با افزایش توانمندی سامانه‌های هوش مصنوعی، باید بدانند محتوایشان چگونه محافظت خواهد شد.

نمودار کنترل دسترسی به محتوا که ورود یک درخواست API به پردازش خصوصی ایمنی را همراه با فضای ذخیره‌سازی رمزگذاری‌شده تحت کنترل مشتری و بازبینی خودکار ایمنی نشان می‌دهد. مشتریان هشدارهای کامل را دریافت می‌کنند و می‌توانند محتوا را با OpenAI به اشتراک بگذارند؛ در غیر این صورت، OpenAI فقط دسته و شدت هشدار را می‌بیند و به محتوای مشتری دسترسی ندارد.

حریم خصوصی و ایمنی، ساخته‌شده با و برای مشتریانمان

مأموریت ما تضمین این است که هوش مصنوعی عمومی به نفع همه بشریت باشد. همکاری با مشتریان و شرکا، بخش ضروری فرایند ساخت سازوکارهای حفاظتی مؤثر ماست. همان‌طور که اصول ما به‌روشنی بیان می‌کنند، هیچ آزمایشگاه هوش مصنوعی نمی‌تواند به‌تنهایی با خطرهای نوظهور مقابله کند. پردازش خصوصی ایمنی بازتاب‌دهنده همین رویکرد است و مشتریانی از صنایع، مناطق و شرکت‌هایی با اندازه‌های گوناگون در شکل‌گیری آن نقش دارند.

سازمان‌هایی که با آن‌ها همکاری می‌کنیم، برخی از حساس‌ترین اطلاعات حوزه خود را مدیریت می‌کنند؛ از جمله سوابق مالی، داده‌های سلامت، برنامه‌های تجاری محرمانه و پژوهش‌های اختصاصی. حفاظت از این اطلاعات برای رعایت الزامات قانونی، حفظ اعتماد مشتریان و صیانت از مزیت رقابتی آن‌ها ضروری است.

بازخورد آن‌ها به ما کمک می‌کند ضمن حفظ کنترلشان بر اطلاعات خود، سازوکارهای حفاظتی قوی‌تری ایجاد کنیم.

«پذیرش هوش مصنوعی در سازمان‌ها کاملاً به کنترل مشتری بر داده‌هایش وابسته است، بدون آنکه خارج از خدمت انتخابی، استفاده مستقیم یا مشتقی از آن‌ها صورت گیرد. تعهد OpenAI به استفاده‌نکردن از داده‌ها برای آموزش و همچنین ZDR، به Glean اطمینان می‌دهد تا محصولاتش را با OpenAI بسازد. با افزایش توانمندی مدل‌ها، OpenAI نشان می‌دهد که می‌توان ایمنی را بدون لطمه‌زدن به حریم خصوصی و کنترلی که اعتماد سازمان‌ها بر آن استوار است، ارتقا داد.»

—سونیل آگراوال، مدیر ارشد امنیت اطلاعات Glean

همکاری با مشتریان را درباره جزئیات فنی و عملیاتی رویکردمان ادامه خواهیم داد. قصد داریم عرضه تدریجی پردازش خصوصی ایمنی را در سپتامبر آغاز و یک سپیدنامه فنی منتشر کنیم. در تمام مراحل، مشتریان را در جریان خواهیم گذاشت؛ به‌روزرسانی‌ها را زودهنگام منتشر می‌کنیم، تأثیر آن‌ها بر تعهدات موجود را توضیح می‌دهیم و زمان و پشتیبانی لازم را برای برنامه‌ریزی پیشاپیش در اختیار مشتریان قرار می‌دهیم.

نویسنده

OpenAI
  1. 1

    OpenAI نیز مانند دیگر ارائه‌دهندگان مدل‌های پیشرو، طبق قانون ملزم است(در یک پنجره جدید باز می‌شود) مواردی را که ظاهراً شامل مطالب سوء استفاده جنسی کودکان (CSAM) هستند گزارش کند. تصاویری که به‌عنوان موارد احتمالی مطالب سوء استفاده جنسی کودکان (CSAM) علامت‌گذاری شده‌اند، همچنان برای بازبینی دستی و گزارش‌دهی نگهداری خواهند شد، حتی در پیاده‌سازی‌های عدم ذخیره داده، همان‌طور که امروز نیز چنین است.