شرکت OpenAI اعلام کرده توسعه برخی بخشهای مدل هوش مصنوعی جدید خود با نام Astra را بهدلیل نگرانیهای امنیتی متوقف کرده است. بررسیهای داخلی نشان دادهاند این مدل در زمینه کدنویسی خودکار و امنیت سایبری پیشرفت قابلتوجهی داشته و ممکن است به سطحی از توانایی برسد که خطرات امنیتی جدی ایجاد کند.
بر اساس ارزیابیهای اولیه OpenAI، Astra به آستانهای رسیده که این شرکت آن را «سطح بحرانی توانایی سایبری» مینامد. این یعنی مدل بالقوه میتواند برخی حملات سایبری را بهصورت مستقل شناسایی و اجرا کند؛ حتی علیه سامانههایی که معمولاً از امنیت بالایی برخوردارند.
OpenAI اعلام کرده تا زمان تکمیل ارزیابیها، نمیتواند احتمال قرار گرفتن Astra در این سطح را رد کند. به همین دلیل، این شرکت طبق چارچوب ایمنی خود، محدودیتها و تدابیر حفاظتی بیشتری برای مدل اعمال کرده و فعالیتهایی را که با این الزامات جدید مطابقت ندارند، متوقف کرده است.
این تصمیم در شرایطی گرفته شده که آزمایشهای امنیتی مدلهای هوش مصنوعی طی هفتههای اخیر با حوادث متعددی همراه بوده است. پیشتر یک مدل منتشرنشده OpenAI در جریان آزمایشهای داخلی توانسته بود از محیط آزمایشی خود خارج شود و به سامانههای Hugging Face نفوذ کند؛ اتفاقی که بحثهای زیادی درباره کنترلپذیری مدلهای پیشرفته هوش مصنوعی ایجاد کرد.
شرکتهای دیگری مانند Anthropic نیز از مواردی خبر دادهاند که مدلهایشان در آزمایشهای امنیتی توانستهاند از محیطهای ایزوله خارج شوند.
OpenAI میگوید هدف از انتشار جزئیات مربوط به Astra، شفافیت با جامعه عمومی، کارشناسان امنیت سایبری و نهادهای ایمنی هوش مصنوعی است. این شرکت همچنین اعلام کرده برای ارزیابی دقیقتر تواناییهای مدل، با برخی نهادهای دولتی و سازمانهای منتخب ایمنی هوش مصنوعی همکاری خواهد کرد.
OpenAI تأکید کرده Astra هنوز در حال توسعه است و هیچ نقشی در نفوذ به Hugging Face نداشته است.
کد خبر ۲۰۲۰۵۰۵۱۸.۰۲۶
منبع: تک کرانچ