به گزارشها، یک هفته طول کشید تا این شرکت متوجه شود که عامل هوش مصنوعی مورد آزمایش آن از کنترل خارج شده است. بر اساس گزارش رویترز، شرکت OpenAI یک هفته پس از شروع آزمایش، متوجه شد که عامل مورد نظر، به طور خودکار از…
به گزارشها، یک هفته طول کشید تا این شرکت متوجه شود که عامل هوش مصنوعی مورد آزمایش آن از کنترل خارج شده است.
بر اساس گزارش رویترز، شرکت OpenAI یک هفته پس از شروع آزمایش، متوجه شد که عامل مورد نظر، به طور خودکار از محدودیتهای تعیینشده فرار کرده و وارد سیستم Hugging Face شده است. در آن زمان، مسئولان این مخزن ابزارها و مدلهای هوش مصنوعی، با اداره فدرال (FBI) تماس گرفته بودند. خبرگزاری رویترز گزارش داد که بررسی اسناد OpenAI نشان میدهد عامل مورد نظر، که از فناوری GPT-5.6 Sol و یک مدل قدرتمندتر و هنوز منتشر نشده استفاده میکرد، در تاریخ ۹ جولای تلاش کرده بود تا از محیط آزمایش مجزا خود خارج شود. حملات به Hugging Face از ۱۱ جولای آغاز شد و تا ۱۳ جولای ادامه داشت. گفته میشود که تا زمانی که این مخزن، پیامی منتشر کرد که نشاندهنده هک شدن سیستم توسط یک عامل هوش مصنوعی بود، شرکت OpenAI به این فکر نکرده بود که ممکن است عامل خود آنها مسئول این اتفاق باشد.
رویترز همچنین گزارش داد که تنها در آخر هفته ۱۸ و ۱۹ جولای، کارمندان OpenAI شواهدی را در لاگهای داخلی خود پیدا کردند که نشان میداد عامل مورد آزمایش، از محیط ایزوله خود فرار کرده است. به نظر میرسد که این دو شرکت تا ۲۰ جولای هیچ ارتباطی با یکدیگر نداشتهاند، درست یک روز قبل از اینکه OpenAI اعتراف کرد که عامل آنها مسئول این نفوذ بوده است.
هنوز مشخص نیست چرا مدت زیادی طول کشید تا OpenAI متوجه شود که عامل مورد نظر فرار کرده است و آیا این بدان معناست که آنها به اندازه کافی بر آزمایشهای خود نظارت نداشتهاند. با این حال، منابع رویترز گزارش میدهند که شرکت، چندین آزمایش را همزمان انجام میدهد که این امر باعث میشود کارمندان نتوانند به طور کامل بر آنها نظارت داشته باشند. همچنین گزارش شده است که در یک مورد، یکی از عوامل مورد آزمایش، یادداشتهایی را در شبکه داخلی شرکت برای نسخههای بعدی خود باقی گذاشته بود که شامل دستورالعملهایی برای خروج از محدودیتهای OpenAI میشد. مشخص نیست که آیا این عامل با عاملی که به Hugging Face حمله کرد، مرتبط است یا خیر.
این حادثه نگرانیهایی را در مورد عوامل هوش مصنوعی و احتمال اینکه آنها ممکن است به روشهای غیرمنتظرهای، مانند ایجاد میانبر، برای انجام وظایف محولشده خود عمل کنند، برانگیخته است. در یک گزارش اخیر، بلومبرگ اعلام کرد که تنها چند ساعت طول کشید تا عامل OpenAI بتواند وارد سیستم Hugging Face شود، در حالی که یک هکر انسانی ممکن بود هفتهها زمان نیاز داشته باشد تا به این مخزن نفوذ کند. اگر این موضوع درست باشد، این مسئله اهمیت افزایش تدابیر امنیتی را به دلیل پیشرفت تواناییهای هوش مصنوعی، بیشتر نشان میدهد.
منبع: https://www.engadget.com/2223141/openai-rogue-agent-days-hacking-spree-reuters/


