Agentで大きなファイルをセグメントごとに分析するには?
構造、キーワード、範囲で素材を絞り込み、追跡可能な証拠を保持します。
全文ではなく、まず構造を取得する
大きなファイルは一度にすべて返されない場合があります。読み込みツールは、ファイル情報または範囲のヒントを提供します。この時点で、まずディレクトリ、章、時間範囲、またはキーワードの分布を理解し、会話に全体の内容を繰り返しフィードすることなく、セグメントごとに処理する必要があります。
タスクの説明では、「すべてのログを分析する」といった曖昧な表現ではなく、特定の期間中のエラーなど、探しているものを指定する必要があります。
セグメント化後に一貫性を維持するには
各セグメントで同じ出力構造を使用し、ソースの場所を保持してから、最後に要約して関係を相互参照します。
例えば、数日間にわたるログを分析する場合、まず異常が発生した時間範囲を特定し、その前後の関連イベントを確認します。読み込み範囲を拡大するたびに、その理由を説明し、最後にカバーされた実際の日付をリストしてください。これにより、無関係なコンテンツが減り、部分的なサンプルから誤って完全な結論を導き出すことを回避できます。
- ファイルサイズ、形式、および関連セクションを確認します。
- 質問に基づいて読み込み範囲を選択します。
- 各発見に対応する行、時間、または段落を記録します。
- 要約する際に、カバーされた部分とチェックされていない部分を区別します。
部分的な読み込みを包括的なチェックとみなさない
読み込んだセグメントに問題が見つからない場合、それはその範囲内に問題がなかったことを意味するだけで、ファイル全体に問題がないことを直接意味するものではありません。長いコマンド出力の場合は、まず結果を保存してから要約を抽出できます。複雑な形式の場合は、まずテキスト抽出が完了しているかどうかを確認してください。最終結果には、後で不完全な結論が悪用されるのを避けるために、カバレッジ範囲を示す必要があります。