چگونه Agent را وادار کنیم فایلهای بزرگ را به صورت بخشبندی شده تجزیه و تحلیل کند؟
مواد را بر اساس ساختار، کلمات کلیدی و محدوده محدود کنید و در عین حال شواهد قابل ردیابی را حفظ کنید.
ابتدا ساختار را به جای متن کامل دریافت کنید
فایلهای بزرگ ممکن است در یک مرحله به طور کامل برگردانده نشوند؛ ابزارهای خواندن اطلاعات فایل یا راهنمایی محدوده را ارائه میدهند. در این مرحله، شما باید ابتدا دایرکتوری، فصلها، محدودههای زمانی یا توزیع کلمات کلیدی را درک کنید، سپس بخش به بخش پردازش کنید بدون اینکه به طور مکرر کل محتوا را به مکالمه وارد کنید.
توضیحات وظیفه باید مشخص کند که به دنبال چه چیزی هستید، مانند خطاها در یک دوره زمانی خاص، به جای بیان مبهم «همه لاگها را تجزیه و تحلیل کن».
چگونه پس از بخشبندی، سازگاری را حفظ کنیم
از ساختار خروجی یکسان برای هر بخش استفاده کنید و مکانهای منبع را حفظ کنید، سپس در نهایت روابط را خلاصه و متقاطع ارجاع دهید.
به عنوان مثال، هنگام تجزیه و تحلیل لاگهایی که چندین روز را پوشش میدهند، ابتدا دوره زمانی که ناهنجاریها رخ دادهاند را مشخص کنید، سپس رویدادهای مرتبط قبل و بعد را بررسی کنید. هر بار که دامنه خواندن را گسترش میدهید، دلیل آن را توضیح دهید و تاریخهای واقعی پوشش داده شده را در انتها لیست کنید؛ این محتوای نامربوط را کاهش میدهد و از نتیجهگیریهای نادرست از نمونههای ناقص جلوگیری میکند.
- اندازه فایل، فرمت و بخشهای مرتبط را تأیید کنید.
- محدوده خواندن را بر اساس سوال انتخاب کنید.
- خط، زمان یا پاراگراف مربوط به هر یافته را ثبت کنید.
- هنگام خلاصه کردن، بین بخشهای پوشش داده شده و بخشهای بررسی نشده تمایز قائل شوید.
خواندن جزئی را به عنوان یک بررسی جامع تلقی نکنید
پیدا نکردن مشکلات در بخشهای خوانده شده فقط به این معنی است که در آن محدوده مشکلی پیدا نشده است؛ این به طور مستقیم به این معنی نیست که کل فایل بدون مشکل است. برای خروجیهای دستور طولانی، میتوانید نتایج را ابتدا ذخیره کنید و سپس خلاصهها را استخراج کنید؛ برای فرمتهای پیچیده، ابتدا بررسی کنید که آیا استخراج متن کامل است. نتیجه نهایی باید دامنه پوشش را نشان دهد تا از سوء استفاده از نتایج ناقص در آینده جلوگیری شود.