رمزگشایی از محفظه ایزوله: چگونه حملات jailbreak مدلهای زبانی بزرگ از ابزارهای مفسر پایتون سوءاستفاده میکنند
با ادغام فزاینده مدلهای زبانی بزرگ (LLMs) در گردش کار توسعهدهندگان، یک بردار حمله جدید پدید آمده است: سوءاستفاده از محفظههای ایزوله اجرای کد. اگرچه مدلهای زبانی بزرگ با محدودیتهای ایمنی سختگیرانهای طراحی شدهاند تا از تولید کد مخرب جلوگیری کنند، این محافظتها میتوانند دور زده شوند...