1. W tablicy wiadomości ostatni wpis ma rolę "assistant" i zawiera częściowy tekst (prefiks). 2. Model traktuje ten tekst jako początek własnej odpowiedzi i generuje dalszy ciąg bezpośrednio od niego. 3. Prefiks warunkuje rozkład prawdopodobieństwa kolejnych tokenów, więc dobór pierwszych znaków (np. {, [Imię], nagłówek) narzuca format i ton. 4. Przykład z dokumentacji: dla pytania wyboru wpisuje się prefiks "The best answer is (", a model kontynuuje np. "B)". 5. Prefill działa wyłącznie na ostatniej turze asystenta; wcześniejsze tury asystenta w rozmowie nie są tym objęte.
Modele językowe często dodają zbędne wstępy, odbiegają od wymaganego formatu wyjścia, wychodzą z narzuconej roli lub niepotrzebnie odmawiają — co utrudnia uzyskanie deterministycznego, maszynowo parsowalnego wyniku. Prefill daje bezpośrednią kontrolę nad początkiem odpowiedzi bez fine-tuningu.
Częściowy tekst wpisany w ostatniej wiadomości o roli assistant, od którego model kontynuuje generację.
Oficjalna
Tokeny generowane przez model bezpośrednio po prefiksie, warunkowane na jego treści.
Prefill ostatniej tury asystenta zwraca błąd 400 w Claude 4.6+ i Mythos Preview.
Prefill ogranicza część odpowiedzi modelu, więc źle dobrany prefiks może wymusić niepoprawną strukturę lub treść.
Prefill działa wyłącznie, gdy prefiks jest w ostatniej wiadomości assistant; wcześniejsze tury go nie wykorzystują.
API Messages Claude umożliwia kontynuowanie odpowiedzi od częściowej wiadomości o roli assistant — techniczna podstawa prefillu.
Anthropic opisuje prefill w przewodniku prompt engineeringu jako sposób na kontrolę formatu, pomijanie wstępów i utrzymanie roli.
Wg aktualnej dokumentacji Anthropic prefill ostatniej tury asystenta nie jest wspierany w modelach Claude 4.6+ i Mythos Preview (błąd 400); rekomendowane alternatywy to Structured Outputs, instrukcje w system prompt i tool calling.
Dokładne znaki wpisane jako początek odpowiedzi; determinują format i kierunek kontynuacji.
Prefill działa tylko wtedy, gdy prefiks znajduje się w ostatniej wiadomości o roli assistant.
Dostępność prefillu zależy od modelu — wcześniejsze modele Claude wspierają, Claude 4.6+ i Mythos Preview zwracają 400.
Prefill to technika na poziomie promptu/API, niezależna od sprzętu wykonującego inferencję.