این اسکنر سه نشانه عملی را شناسایی میکند: الگوی توجه “مثلث دوگانه” مشخص در مدلهای مسموم، نشت دادههای مسمومسازی از طریق حافظه، و فعالسازی بکدور توسط محرکهای تقریبی متعدد. مایکروسافت تأکید کرد که این روش نیازی به آموزش اضافی مدل یا دانش قبلی از رفتار بکدور ندارد و در مدلهای رایج سبک GPT کار میکند. با این حال، محدودیتهایی دارد؛ از جمله اینکه روی مدلهای اختصاصی کار نمیکند و بهترین عملکرد را در بکدورهای مبتنی بر محرک با خروجیهای قطعی دارد. این توسعه همزمان با گسترش چرخه توسعه امن (SDL) مایکروسافت برای رسیدگی به نگرانیهای امنیتی ویژه هوش مصنوعی از جمله تزریق پرامپت (prompt injection) و مسمومسازی داده (data poisoning) صورت گرفته است.
کلمات کلیدی : مایکروسافت، بکدور، هوش مصنوعی، مدلهای زبانی، امنیت، مسمومسازی داده

نظر شما چیست؟
خوشحال میشویم نظر شما را بدانیم. نظری بنویسید.