پرش به مطلب اصلی

PII پایه

گاردریل basic_pii چند الگوی رایج داده شخصی پایه (PII) را در متن پیدا می‌کند. از این نوع وقتی استفاده کنید که می‌خواهید ایمیل، شماره موبایل ایران یا شماره‌های رایج پیش از رسیدن به مدل یا پیش از نمایش پاسخ کنترل شوند.

این گاردریل می‌تواند داده شخصی را فقط تشخیص دهد یا آن را با متن جایگزین ماسک کند.

اطلاع

basic_pii تشخیص معنایی انجام نمی‌دهد. نام افراد، نشانی، توضیح‌های غیرساخت‌یافته و شناسه‌هایی که فقط از زمینه جمله قابل تشخیص‌اند، با این نوع پوشش داده نمی‌شوند.

چه زمانی استفاده کنید؟

این گاردریل برای سناریوهای زیر مناسب است:

  • ماسک‌کردن ایمیل در ورودی کاربر.
  • ماسک‌کردن شماره موبایل ایران.
  • جلوگیری از عبور عددهای ۱۰ رقمی که ممکن است شناسه حساس باشند.
  • ماسک‌کردن شماره‌های ۱۶ رقمی با فاصله یا خط تیره اختیاری.
  • کنترل پاسخ مدل پیش از نمایش به کاربر، وقتی احتمال برگشت داده شخصی وجود دارد.

برای داده‌های اختصاصی سازمان، این گاردریل را کنار Regex استفاده کنید.

رفتار اجرایی

این نوع از هر دو «نوع اقدام» پشتیبانی می‌کند:

نوع اقداممقدار APIرفتار
اعتبارسنجیvalidateاگر داده شخصی پایه پیدا شود، نتیجه بررسی ناموفق می‌شود.
اصلاح محتواmutateتطابق‌ها با «متن جایگزین» جایگزین می‌شوند.

در حالت «اصلاح محتوا»، متن اصلاح‌شده به ارائه‌دهنده مدل یا مصرف‌کننده پاسخ می‌رسد. در حالت «اعتبارسنجی»، توقف یا ادامه مسیر به «شیوه اعمال» بستگی دارد.

الگوهای داخلی

این نوع الگوهای زیر را بررسی می‌کند:

  • ایمیل.
  • شماره موبایل ایران، مثل 09123456789 یا +989123456789.
  • عدد ۱۰ رقمی.
  • شماره ۱۶ رقمی با فاصله یا خط تیره اختیاری.
هشدار

عدد ۱۰ رقمی یا ۱۶ رقمی همیشه داده شخصی نیست. اگر متن‌های شما شامل شماره سفارش، شماره پیگیری یا شناسه داخلی بی‌خطر است، ابتدا با «عبور همراه با نشانه‌گذاری» اثر قانون را بررسی کنید.

تنظیمات

عنوان UIمقدار APIتوضیح
متن جایگزینredaction_textفقط برای «اصلاح محتوا» استفاده می‌شود. اگر مقدار ندهید، مقدار پیش‌فرض [REDACTED] است.

نمونه تعریف

{
"slug": "mask-basic-pii",
"name": "ماسک‌کردن داده شخصی پایه",
"description": "ایمیل و شماره‌های رایج را پیش از ارسال به مدل ماسک می‌کند.",
"type": "basic_pii",
"operation": "mutate",
"enforcement": "enforce",
"enabled": true,
"config": {
"redaction_text": "[***]"
}
}

نمونه استفاده

x-godarai-guardrails: {"llm_input_guardrails":["guardrails/mask-basic-pii"]}

اگر متن کاربر این باشد:

ایمیل من customer@company.ir است.

در حالت «اصلاح محتوا»، متن ارسالی به مدل به این شکل تغییر می‌کند:

ایمیل من [***] است.
نکته

اگر وجود داده شخصی ناخواسته است، اما کار اصلی بدون آن داده هم ادامه پیدا می‌کند، «اصلاح محتوا» معمولاً تجربه بهتری می‌دهد. اگر خود وجود داده تخطی جدی از سیاست شماست، «اعتبارسنجی» همراه با «عدم عبور و لاگ» مناسب‌تر است.

گاردریل‌های آماده

گدارAI این شناسه‌های فنی آماده را برای همین رفتار دارد:

guardrails/basic-pii
guardrails/pii-redaction
guardrails/pii-detection

هر سه شناسه فنی به گاردریل داخلی basic_pii می‌رسند و مقدارهای پیدا‌شده را با [REDACTED] جایگزین می‌کنند.

محدودیت‌ها

  • این گاردریل فقط چند الگوی پایه را می‌شناسد.
  • عددهای مشابه ممکن است همیشه داده شخصی نباشند.
  • نام افراد، نشانی، شناسه‌های داخلی و داده‌های مبهم معنایی پوشش داده نمی‌شوند.
  • اگر داده پیش از اجرای گاردریل در جایی ثبت شده باشد، اصلاح بعدی آن ثبت قبلی را پاک نمی‌کند.
  • گاردریل خروجی با پاسخ جریانی پشتیبانی نمی‌شود.

گام بعدی