Czym jest kontekst i czym różni się od przydziałów konta?
Poznaj różnicę między ilością materiału przetwarzanego jednocześnie a łącznym wykorzystaniem.
Kontekst to materiał przetwarzany w bieżącej rundzie
Kontekst obejmuje aktualne pytanie, istotne treści rozmowy oraz tekst z plików i wyników narzędzi przekazany modelowi. Jego pojemność jest ograniczona, więc nawet krótkie pytanie może zbliżyć się do limitu z powodu długiej wcześniejszej rozmowy lub obszernych wyników.
Token jest jednostką systemowego obliczania długości tekstu i nie odpowiada liczbie chińskich znaków. Ta sama liczba znaków w kodzie, języku angielskim i chińskim może dawać różne liczby tokenów.
Przydział konta to inny rodzaj ograniczenia
Dzienne limity żądań lub miesięczne limity wykorzystania dotyczą użycia konta w określonym czasie. Skrócenie materiału może zmniejszyć obciążenie kontekstu, ale nie przywróci od razu wyczerpanego miesięcznego przydziału; czekanie na odnowienie przydziału także nie skróci automatycznie zbyt długiego tekstu wejściowego.
Na przykład krótkie pytanie uzupełniające z dużą ilością historycznych logów może zajmować przestrzeń głównie przez logi. Zachowanie najpierw zapisów związanych z bieżącym okresem i zaznaczenie pominięcia reszty pomaga modelowi skupić się na problemie, a Tobie sprawdzić, czy analiza uwzględnia potrzebne warunki.
- Najpierw ustal, czy błąd mówi o zbyt długiej treści, czy o niewystarczającym przydziale.
- Przy zbyt długiej treści usuń nieistotne materiały lub podziel je według pytań.
- Przy niewystarczającym przydziale sprawdź odpowiednie komunikaty o jego odnowieniu.
Jak porządkować materiały
Najpierw podaj opis zadania, a potem fragmenty niezbędne do wykonania. Przy długich logach zacznij od zakresu czasu i słów kluczowych błędu; przy kodzie — od powiązanych plików i zależności wywołań. Nie wklejaj wielokrotnie całej historii „na wszelki wypadek”; zajmuje to miejsce na nowe problemy i utrudnia znalezienie najważniejszych informacji.