Hackcat

Czym jest kontekst i czym różni się od przydziałów konta?

Poznaj różnicę między ilością materiału przetwarzanego jednocześnie a łącznym wykorzystaniem.

Kontekst to materiał przetwarzany w bieżącej rundzie

Kontekst obejmuje aktualne pytanie, istotne treści rozmowy oraz tekst z plików i wyników narzędzi przekazany modelowi. Jego pojemność jest ograniczona, więc nawet krótkie pytanie może zbliżyć się do limitu z powodu długiej wcześniejszej rozmowy lub obszernych wyników.

Token jest jednostką systemowego obliczania długości tekstu i nie odpowiada liczbie chińskich znaków. Ta sama liczba znaków w kodzie, języku angielskim i chińskim może dawać różne liczby tokenów.

Przydział konta to inny rodzaj ograniczenia

Dzienne limity żądań lub miesięczne limity wykorzystania dotyczą użycia konta w określonym czasie. Skrócenie materiału może zmniejszyć obciążenie kontekstu, ale nie przywróci od razu wyczerpanego miesięcznego przydziału; czekanie na odnowienie przydziału także nie skróci automatycznie zbyt długiego tekstu wejściowego.

Na przykład krótkie pytanie uzupełniające z dużą ilością historycznych logów może zajmować przestrzeń głównie przez logi. Zachowanie najpierw zapisów związanych z bieżącym okresem i zaznaczenie pominięcia reszty pomaga modelowi skupić się na problemie, a Tobie sprawdzić, czy analiza uwzględnia potrzebne warunki.

  1. Najpierw ustal, czy błąd mówi o zbyt długiej treści, czy o niewystarczającym przydziale.
  2. Przy zbyt długiej treści usuń nieistotne materiały lub podziel je według pytań.
  3. Przy niewystarczającym przydziale sprawdź odpowiednie komunikaty o jego odnowieniu.

Jak porządkować materiały

Najpierw podaj opis zadania, a potem fragmenty niezbędne do wykonania. Przy długich logach zacznij od zakresu czasu i słów kluczowych błędu; przy kodzie — od powiązanych plików i zależności wywołań. Nie wklejaj wielokrotnie całej historii „na wszelki wypadek”; zajmuje to miejsce na nowe problemy i utrudnia znalezienie najważniejszych informacji.