چکیده
User Safety: safe
متن کامل
**عنوان:** جداسازی شخصیت‑اجرا: الگوی معماری برای تکامل عوامل مدل زبانی بزرگ (LLM) تحت ممیزی اجرا
**نویسندگان:** ییسن شی
**چکیده:** عوامل مدل زبانی بزرگ (LLM) در سازمانهای تحت حاکمیت باید به شخصیت (دستورات، لحن، ارائه ذاتی) اجازه تکامل آزادانه بدهند، در حالی که اجرا (کار حالتدار و ممیزیشده) را قابل پیگیری نگه دارند. یک حوزه اعتماد واحد هر دو را ارزان تأمین نمیکند. ما جداسازی شخصیت‑اجرا (PES) را پیشنهادی میکنیم: شخصیت و اجرا در حوزههای اعتماد متفاوت قرار میگیرند که توسط یک پل قراردادی حاکمیتپذیر به هم متصل شدهاند. شخصیت بهصورت منحصربهفرد میزبانی میشود و ممکن است انحراف یابد؛ اجرا بیچهره و ممیزیشده است. خلاصههای وضعیت ممکن است بازگردند؛ بدنههای داده در حوزه محدودکننده باقی میمانند به جز یک استثنای درجهبندیشده پیشگیری از از دست رفتن داده (DLP)؛ هویت پیوسته باقی میماند. یک ماتریس تصویب، DLP و ممیزی عبور را اعمال میکنند. PES از سه هدف پیروی میکند: انحراف آزاد، قابلیت پیگیری اجرا و کاهش جفتشدگی. تحت عدم تمایز بازنمایی LLM، هر مکانیزم تک‑حوزهای که هر سه هدف را برآورده کند، باید دوباره اشیاء تغییر تایپدار، یک دروازه خارجی و یک لنگر ممیزی پایدار را معرفی کند؛ PES با هزینه جفتشدگی بالاتر بازسازی شده. یک مورد توسعه/آزمایشی در یک پلتفرم کارمند دیجیتال تنظیمشده، پنج تصمیم را در طول یک ماه ثبت کرد، هر کدام با یک جایگزین رد شده. بررسی مکانیزم بر روی پیادهسازی ارسال شده نشان داد که بدون باز‑اعتبارسنجی سمت اجرا تحت اختلال شخصیت (پنج پیکربندی مدل) و بدون اثر انگشت شخصیت بر روی فیلدهای سختتثبیتشده. بررسی یک ساختار بازیابیشده پیش از جداسازی نشان داد که مسیر اجرای حاکمیتپذیر از شخصیت به صورت سهوی و نه از طریق ساختار، جداسازی شده بود؛ یک تغییر سیمکشی بعدی میتواند آن جداسازی را معکوس کند، که PES آن را به یک قاعده معماری ممیزیشده تبدیل میکند. این الگو زمانی کاربرد دارد که استقرار چندکاربره، ممیزی اجرا و تغییر مورد انتظار شخصیت به طور مشترک برقرار باشند.
**موضوعات:** مهندسی نرمافزار (cs.SE)؛ هوش مصنوعی (cs.AI)
**استناد:** arXiv:2608.27427 [cs.SE] (یا arXiv:2608.27427v1 [cs.SE] برای این نسخه)
**تاریخچه ارسال:** از: ییسن شی [مشاهده ایمیل] [v1] پنجشنبه، ۲۷ آگوست ۲۰۲۶ ۱۷:۵۰:۰۷ UTC (۱۹۲ کیلوبایت)