agent mode
منبع: ونچربیت
تاریخ: 9 مارس 2026
دیروز OpenAI حالت جدیدی به نام «agent mode» را منتشر کرد، جایی که چتجیپیتی میتواند با مجوز شما وارد ایمیل و حسابهای وب شود و بهطور خودکار ایمیل بنویسد، فایل دانلود و ویرایش کند و کاری مشابه یک دستیار انسانی انجام دهد.
چالش امنیتی و هدف تیم قرمز
- تیم قرمز شامل ۱۶ محقق دارای درجه دکترا در حوزه امنیت و زیستشناسی بود که در مدت ۴۰ ساعت، ۱۱۰ حمله آزمایشی انجام دادند. از بین آنها، ۱۶ حمله به سطح خطرناک رسید که نیاز به مداخله داشت .
- این تیم کشف کرد ۷ ضعف عمومی وجود دارد، از جمله دستورات مخفی در مرورگر بصری، استخراج اطلاعات زیستی، و حملات زنجیره چندمرحلهای.
اقدامات امنیتی اتخاذشده
پس از کشف آسیبپذیریها، OpenAI این اقدامات را اجرا کرد :
- ناظر دومرحلهای (Dual-layer inspection) برای تحلیل ۱۰۰٪ ترافیک.
- فعالسازی «Watch Mode»: هنگام فعالیتهای حساس مثل ایمیل یا امور بانکی، کاربر نباید صفحه را ترک کند یا فعالیت متوقف میشود.
- غیرفعالسازی قابلیت حافظه (Memory) در شروع، برای جلوگیری از نشت تدریجی دادهها.
- محدودیت در ترمینال: فقط درخواستهای GET اجازه دارند، انجام دستورات خطرناک ممنوع است.
- پچ سریع: آسیبپذیریها در عرض ساعات رفع میشوند، نه هفتهها.
محافظت در برابر خطرات زیستی
- با توجه به توانایی استخراج اطلاعات حساس زیستی، سیستم به سطح تهدید «High capability» ارتقا یافت.
- ابزارهای مانیتور زیستی همیشگی، واکنش سریع و برنامه جایزه یافتهها (bug bounty) برای امنیت این حوزه راهاندازی شد ).
نتیجهگیری
OpenAI با استفاده از تستهای منظم تیم قرمز و پاسخ سریع به حملات کشفشده، چتجیپیتی ایجنت را به یکی از امنترین سامانههای AI فعال مشابه یک دژ واقعی تبدیل کرده است. اکنون این ابزار با پوشش ۹۵٪ علیه حملات مرورگر بصری و نظارت کامل بر سیستم ارایه میشود—و بازتابدهنده استاندارد جدیدی برای امنیت سامانههای عامل هوشمند است.
لینک:
https://venturebeat.com/security/openais-red-team-plan-make-chatgpt-agent-an-ai-fortress/



