خروجی گرفتن از لاگها
خروجی گرفتن از لاگها زمانی بهکار میآید که بخواهید دادههای «لاگ درخواستها» را خارج از UI گدارAI تحلیل کنید؛ برای نمونه در گزارش مدیریتی، ابزار BI، انبار داده، دفترچه تحلیلی یا فرایند ممیزی داخلی.
در گدارAI خروجی لاگها بر اساس فیلترهای فعلی ساخته میشود و میتواند در دو فرمت CSV یا JSONL باشد. اگر گزینه «همراه payload» را فعال کنید، محتوای درخواست و پاسخ هم تا جایی که سیاست ثبت و مجوز شما اجازه دهد وارد خروجی میشود.
خروجی گرفتن، داده را از محیط اصلی مشاهدهپذیری خارج میکند. قبل از انتخاب «همراه payload»، مطمئن شوید نگهداری، اشتراکگذاری و حذف فایل خروجی با سیاست داده سازمان شما سازگار است.
چه زمانی خروجی بگیرید؟
خروجی گرفتن از لاگها وقتی مناسب است که:
- میخواهید هزاران درخواست را خارج از UI تحلیل کنید.
- باید گزارش هزینه، تاخیر، خطا یا مصرف برای تیم یا مدیریت بسازید.
- میخواهید داده را وارد ابزار BI، انبار داده یا مسیر پردازش داخلی کنید.
- برای ممیزی یا بررسی انطباق به یک تصویر لحظهای مشخص از لاگها نیاز دارید.
- میخواهید داده گدارAI را با داده محصول خودتان join کنید.
اگر فقط یک درخواست یا چند درخواست اخیر را بررسی میکنید، لاگ درخواستها معمولاً مسیر سریعتری است.
فرمتهای خروجی
| فرمت | کاربرد مناسب |
|---|---|
CSV | گزارشهای جدولی، صفحهگسترده، تحلیل ساده و اشتراکگذاری با تیمهای غیرفنی. |
JSONL | مسیر پردازش داده، ورود مرحلهای داده و نگهداری رکوردهای ساختیافته. |
در خروجی CSV، ستونهای اصلی شامل شناسهها، مدل، ارائهدهنده، مسیر، وضعیت، زمان، مدت، توکن، هزینه، وضعیت کش، تلاش دوباره، مسیر جایگزین، توازن بار و حالت payload است. در خروجی JSONL، هر خط یک رکورد لاگ ساختیافته است.
برای تحلیلهای تکرارشونده و مسیرهای پردازش داده، JSONL معمولاً انتخاب پایدارتری است. برای گزارش انسانی سریع، CSV خواناتر است.
گزینه «همراه payload»
گزینه «همراه payload» با مقدار فنی include_content مشخص میکند که محتوای درخواست و پاسخ هم وارد خروجی شود یا نه. فعالکردن این گزینه به دو شرط وابسته است:
- کاربر باید دسترسی خروجی گرفتن از لاگها را داشته باشد.
- اگر محتوا قرار است وارد خروجی شود، کاربر باید دسترسی خواندن محتوای لاگ را هم داشته باشد.
اگر حالت ثبت لاگ روی «عدم ثبت» یا «فقط فراداده» باشد، payload خام در لاگ ذخیره نشده و خروجی هم نمیتواند آن را بازسازی کند.
سقف و وضعیت خروجی
خروجیها بهصورت job ساخته میشوند و شناسه خروجی (export_id) دارند. هر خروجی شامل فیلترها، فرمت، وضعیت، تعداد ردیف و زمان ایجاد است.
در مسیر دانلود، گدارAI حداکثر ۱۰٬۰۰۰ ردیف از لاگهای منطبق با فیلتر را در فایل خروجی میگذارد. اگر به تحلیل گستردهتر نیاز دارید، بازه زمانی یا فیلترها را خرد کنید و چند خروجی جدا بسازید.
طراحی خروجی امن
برای خروجی گرفتن کمریسکتر:
- فقط بازه زمانی و فیلترهای لازم را انتخاب کنید.
- تا وقتی payload لازم نیست، «همراه payload» را خاموش نگه دارید.
- برای تحلیل هزینه و عملکرد، معمولاً فیلدهای فراداده کافیاند: زمان، مدل، ارائهدهنده، توکن، هزینه، تاخیر، وضعیت و شناسهها.
- فایل خروجی را مثل داده عملیاتی حساس مدیریت کنید.
- اگر داده شخصی یا محرمانه دارید، قبل از export سیاستهای گاردریل داده حساس و تنظیمات ثبت لاگ را بررسی کنید.
نمونه سناریوها
| سناریو | فیلدهای مهم |
|---|---|
| گزارش هزینه تیمی | زمان، تیم، مدل، توکن، هزینه، مدل مجازی، اکانت مجازی. |
| تحلیل عملکرد | زمان، مدل، ارائهدهنده، اندپوینت، مدت، کد وضعیت، نوع خطا. |
| تحلیل کش | وضعیت کش، hit/miss، توکن، هزینه، مدل و بازه زمانی. |
| ممیزی داخلی | شناسه لاگ، شناسه درخواست، شناسه ردیابی درخواست، actor، scope، وضعیت و زمان. |
عیبیابی سریع
| نشانه | علتهای محتمل | راهحل |
|---|---|---|
| گزینه خروجی در دسترس نیست | سطح دسترسی خروجی گرفتن از لاگها را ندارید. | با مدیر فضای کاری برای دسترسی مناسب هماهنگ کنید. |
| payload در خروجی نیست | «همراه payload» خاموش است، مجوز محتوا ندارید یا حالت ثبت لاگ payload را ذخیره نکرده است. | تنظیمات لاگ درخواست و سطح دسترسی را بررسی کنید. |
| فایل بزرگتر از انتظار است | فیلترها خیلی باز هستند یا payload را وارد خروجی کردهاید. | بازه را محدود کنید، فرمت مناسب انتخاب کنید و payload را فقط در صورت نیاز بگیرید. |
| تعداد ردیفها کامل نیست | سقف دانلود روی ۱۰٬۰۰۰ ردیف اعمال شده است. | خروجی را به چند بازه کوچکتر تقسیم کنید. |
گام بعدی
- برای انتخاب فیلترهای دقیقتر، لاگ درخواستها را مرور کنید.
- برای تحلیل روندها بدون export، متریکهای مدل را ببینید.
- برای همبستگی با ابزارهای بیرونی، OpenTelemetry برای مشاهدهپذیری را بخوانید.
پرسشهای پرتکرار
آیا باید همیشه payload را همراه خروجی بگیرم؟
خیر. برای بیشتر گزارشهای هزینه، عملکرد و خطا، فراداده کافی است. payload فقط وقتی لازم است که تحلیل محتوای درخواست یا پاسخ واقعاً بخشی از مسئله باشد.
CSV بهتر است یا JSONL؟
برای گزارشهای انسانی و صفحهگسترده، CSV سادهتر است. برای مسیر پردازش داده و پردازش ماشینی، JSONL مناسبتر است.
آیا خروجی لاگها جای OpenTelemetry را میگیرد؟
خیر. خروجی لاگها برای تحلیل تاریخی و دستهای مناسب است. OpenTelemetry برای همبستگی پیوسته بین سرویسها و مسیر اجرای درخواست کاربرد دارد.