به گزارش شهرآرانیوز، در شرایطی که مخاطرات عاملهای هوش مصنوعی به یکی از پربحثترین موضوعات دنیای تکنولوژی تبدیل شده است، اوایل سال ۲۰۲۶ یک agent با تمرکز بر حوزه امنیت سایبری و تست نفوذ رونمایی شده است. این عامل هوش مصنوعی از طریق مدلهای زبانی مختلف و معروف شرکتهای صاحب نظر این حوزه مانند xAI، گوگل، آنتروپیک و deepseek میتواند بخشی از فرایندهای تست امنیتی، شناسایی آسیبپذیریها و اجرای ابزارهای امنیتی را بهصورت خودکار انجام دهد.
HackerAI یک عامل هوش مصنوعی برای تست امنیت است. به زبان ساده، این ابزار به جای اینکه فقط درباره هک و امنیت به کاربر توضیح بدهد، میتواند در یک محیط مشخص بعضی کارهای امنیتی را خودش انجام دهد. برای مثال، میتواند یک هدف مجاز را بررسی کند، ابزارهای امنیتی را اجرا کند، نتیجه را ببیند و بر اساس همان نتیجه تصمیم بگیرد مرحله بعدی چه باشد.
البته این به معنی آن نیست که HackerAI میتواند وارد هر سایتی شود و آن را هک کند. استفاده قانونی از این ابزار باید روی سامانهای باشد که کاربر اجازه بررسی آن را دارد.
یکی از نکات مهم درباره HackerAI این است که خودش یک مدل زبانی نیست، در واقع این سرویس یک agent است که بر پایه مدلهایی از شرکتهایی مانند Anthropic، Google، DeepSeek، Moonshot و xAI کار میکند.
در شرایطی که عاملهای هوش مصنوعی رفتارهای خارج از چارچوبی که برای آنها مشخص شده است، داشتهاند، وجود چنین agentهایی در حوزهی امنیت سایبری میتواند باعث ایجاد مخاطرات غیرقابل انکاری باشد. این agent در حالت وب سرویس داخل یک محیط ایزوله اجرا میشود. این یعنی Agent برای انجام عملیات، یک محیط محاسباتی جدا دریافت میکند، اما در حالت Local، شرایط متفاوت است. در این حالت، Agent میتواند دستورات ترمینال را مستقیماً روی سیستم کاربر اجرا کند و این دستورات با سطح دسترسی کاربر اجرا میشوند؛ ضمن اینکه در این حالت لایهای از جداسازی برای محدود کردن Agent وجود ندارد. خود HackerAI نیز توصیه کرده است Local Mode تنها روی دستگاهی که برای تستهای امنیتی اختصاص داده شده استفاده شود؛ بنابراین هرچه اختیار و دسترسی Agent بیشتر باشد، اهمیت نظارت انسانی و محدود کردن محیط اجرای آن نیز بیشتر میشود.
البته این موضوع به معنای آن نیست که HackerAI بهصورت خودکار اقدام به نفوذ غیرمجاز میکند. شرایط استفاده این سرویس، انجام تستهای امنیتی را تنها روی سامانههایی که کاربر مالک آنهاست یا برایشان مجوز معتبر دارد، مجاز میداند. با این حال، تجربههای اخیر از ارزیابیهای امنیتی نشان داده است که Agentهای مجهز به ابزار و دسترسی واقعی میتوانند در شرایط خاص رفتارهایی فراتر از انتظار ایجاد کنند؛ موضوعی که ضرورت نظارت انسانی را بر این عامل خودمختار پررنگتر میکند.
در پایان باید بگوییم، هوش مصنوعی همیشه درست تصمیم نمیگیرد. حتی HackerAI نیز در مستندات خود هشدار داده است که خروجی Agent ممکن است ناقص یا اشتباه باشد و کاربر باید نتایج را بررسی و اعتبارسنجی کند. حالا تصور کنید یک چتبات معمولی اشتباه کند؛ این یعنی فقط یک پاسخ اشتباه دریافت شده است. اما اگر یک Agent دسترسی به Terminal، فایلها یا ابزارهای واقعی داشته باشد، یک تصمیم اشتباه میتواند مخاطرات غیرقابل انکاری داشته باشد.