نمایش نوار کناری

agent mode

agent mode

منبع: ونچربیت

تاریخ: 9 مارس 2026

دیروز OpenAI حالت جدیدی به نام «agent mode» را منتشر کرد، جایی که چت‌جی‌پی‌تی می‌تواند با مجوز شما وارد ایمیل و حساب‌های وب شود و به‌طور خودکار ایمیل بنویسد، فایل دانلود و ویرایش کند و کاری مشابه یک دستیار انسانی انجام دهد.

چالش امنیتی و هدف تیم قرمز

  • تیم قرمز شامل ۱۶ محقق دارای درجه دکترا در حوزه امنیت و زیست‌شناسی بود که در مدت ۴۰ ساعت، ۱۱۰ حمله آزمایشی انجام دادند. از بین آنها، ۱۶ حمله به سطح خطرناک رسید که نیاز به مداخله داشت .
  • این تیم کشف کرد ۷ ضعف عمومی وجود دارد، از جمله دستورات مخفی در مرورگر بصری، استخراج اطلاعات زیستی، و حملات زنجیره چندمرحله‌ای.

اقدامات امنیتی اتخاذشده

پس از کشف آسیب‌پذیری‌ها، OpenAI این اقدامات را اجرا کرد :

  1. ناظر دومرحله‌ای (Dual-layer inspection) برای تحلیل ۱۰۰٪ ترافیک.
  2. فعال‌سازی «Watch Mode»: هنگام فعالیت‌های حساس مثل ایمیل یا امور بانکی، کاربر نباید صفحه را ترک کند یا فعالیت متوقف می‌شود.
  3. غیرفعال‌سازی قابلیت حافظه (Memory) در شروع، برای جلوگیری از نشت تدریجی داده‌ها.
  4. محدودیت در ترمینال: فقط درخواست‌های GET اجازه دارند، انجام دستورات خطرناک ممنوع است.
  5. پچ سریع: آسیب‌پذیری‌ها در عرض ساعات رفع می‌شوند، نه هفته‌ها.

محافظت در برابر خطرات زیستی

  • با توجه به توانایی استخراج اطلاعات حساس زیستی، سیستم به سطح تهدید «High capability» ارتقا یافت.
  • ابزارهای مانیتور زیستی همیشگی، واکنش سریع و برنامه جایزه یافته‌ها (bug bounty) برای امنیت این حوزه راه‌اندازی شد ).

نتیجه‌گیری

OpenAI با استفاده از تست‌های منظم تیم قرمز و پاسخ سریع به حملات کشف‌شده، چت‌جی‌پی‌تی ایجنت را به یکی از امن‌ترین سامانه‌های AI فعال مشابه یک دژ واقعی تبدیل کرده است. اکنون این ابزار با پوشش ۹۵٪ علیه حملات مرورگر بصری و نظارت کامل بر سیستم ارایه می‌شود—و بازتاب‌دهنده استاندارد جدیدی برای امنیت سامانه‌های عامل هوشمند است.

 

لینک:

https://venturebeat.com/security/openais-red-team-plan-make-chatgpt-agent-an-ai-fortress/

 

نوشتن دیدگاه

اگر تصمیم به تغییر و شروع یک حرکت جدی گرفتی، صدرا تا آخر کنارته…!

صدرا،
شروعی برای رشد و پرورش استعدادهای شما