kontextové okno
Co je kontextové okno a proč ovlivňuje kvalitu odpovědí AI
Kontextové okno je omezený prostor, ve kterém jazykový model při tvorbě odpovědi pracuje s instrukcemi, historií konverzace a dalšími podklady. Měří se v tokenech, tedy v menších částech textu, na které model rozděluje slova, čísla, interpunkci i kód. Jednoduše si ho lze představit jako pracovní stůl AI: model může využít jen to, co na něm v danou chvíli leží. Co se do prostoru nevejde nebo z něj bylo odstraněno, nemůže přímo zohlednit. Kontextové okno je důležitou vlastností každého AI jazykového modelu, protože určuje, jak dlouhou konverzaci, dokument nebo část projektu zvládne zpracovat najednou.
Nejde přitom o dlouhodobou paměť ani o znalosti, které model získal při trénování. Kontext je dočasný pracovní materiál pro konkrétní požadavek nebo konverzaci. Když otevřete nový chat, předchozí diskuse obvykle není automaticky součástí nového okna. A pokud aplikace nabízí paměť napříč konverzacemi, jde o další vrstvu, která vybrané informace znovu vkládá do aktuálního kontextu.
Jak kontextové okno funguje:
- Text se rozdělí na tokeny: Token nemusí odpovídat jednomu slovu. Může jít o celé krátké slovo, část delšího slova, číslo nebo interpunkční znak. Stejný text může mít u různých modelů jiný počet tokenů, protože používají odlišné tokenizéry.
- Do okna se skládá více vrstev: Kapacitu nespotřebovává jen poslední dotaz. Patří sem systémové instrukce, předchozí zprávy, vložené dokumenty, výsledky nástrojů a často také prostor potřebný pro generovanou odpověď. U AI agenta se mohou přidat i popisy dostupných nástrojů a průběžné výsledky jeho práce.
- Model hledá vztahy v dostupném kontextu: Moderní jazykové modely pomocí mechanismu pozornosti vyhodnocují, které části vstupu jsou pro další token odpovědi relevantní. Díky tomu mohou navázat na dřívější zadání, porovnat dvě pasáže dokumentu nebo držet terminologii napříč delším textem.
- Po překročení limitu se musí obsah omezit: Aplikace může nejstarší zprávy zahodit, shrnout je, rozdělit dokument na části nebo požadavek odmítnout. Konkrétní chování záleží na použitém nástroji. Výsledkem ale vždy je, že model nemá k dispozici všechno v původní podobě.
Co se do kontextového okna skutečně počítá
U běžného chatbota je nejviditelnější historie rozhovoru. Do okna se však často načítají i instrukce provozovatele, pravidla chování asistenta, přiložené soubory a odpovědi z webového vyhledávání. U nástrojů pro programování mohou velkou část zabrat zdrojové soubory, dokumentace projektu, chybové logy a popisy připojených služeb. Člověk tak může mít pocit, že napsal jen krátký dotaz, zatímco aplikace modelu ve skutečnosti poslala mnohem větší balík informací.
Velikost okna se obvykle uvádí jako maximální počet tokenů. Toto číslo není bezpečné převádět pevným poměrem na počet českých slov nebo stran. Čeština, angličtina, zdrojový kód a tabulková data se tokenizují odlišně. Praktický limit navíc může zahrnovat vstup i výstup dohromady. Pokud celý prostor zaplníte podklady, nemusí zbýt dost místa na dlouhou odpověď.
Kontextové okno v praxi:
Představte si, že chcete shrnout stostránkovou smlouvu. Pokud se celý dokument vejde do okna, model může porovnávat ustanovení z různých částí a odpovídat na otázky nad celkem. Když se nevejde, musíte text rozdělit, jednotlivé části nejprve shrnout a teprve potom pracovat se souhrny. Podobně funguje analýza zákaznických rozhovorů, dlouhého e-mailového vlákna nebo většího množství podkladů pro obsah.
U programování může model díky většímu oknu současně vidět zadání, relevantní soubory, testy i chybové hlášky. To ale neznamená, že je rozumné nahrát celý repozitář bez výběru. Nepodstatné soubory mohou překrýt důležité instrukce a ztížit orientaci. Lepší výsledek obvykle přinese menší, dobře vybraný kontext než obrovská směs všeho, co bylo po ruce.
Kontextové okno je podstatné také pro AI agenty. Agent během úkolu čte soubory, volá nástroje a ukládá jejich výstupy do pracovní historie. U delší práce se proto okno postupně plní. Dobře navržený agent průběžně ukládá důležitý stav mimo konverzaci, pracuje po menších krocích a vrací si jen informace potřebné pro aktuální rozhodnutí.
Dalším příkladem je RAG. Systém nejprve vyhledá v databázi několik relevantních úryvků a vloží je modelu do kontextu spolu s otázkou. Smyslem není nacpat do okna celou firemní znalostní bázi. Smyslem je vybrat právě ty podklady, které mohou pomoci vytvořit správnou odpověď. Kvalita vyhledání a pořadí úryvků pak mohou být stejně důležité jako samotná velikost okna.
Proč je kontextové okno důležité:
Limit okna vysvětluje řadu situací, které jinak vypadají jako náhodné selhání AI. Model může v dlouhé konverzaci přestat dodržovat pravidlo z úvodu, zaměnit dříve dohodnutý pojem nebo odpovědět bez znalosti části dokumentu. Nemusí jít o skutečné zapomenutí. Informace se už nemusela vejít do aktuálního kontextu, mohla být při automatickém shrnutí zjednodušena nebo se ztratila mezi množstvím méně důležitých dat.
Větší okno umožňuje řešit rozsáhlejší úkoly, ale samo o sobě negarantuje lepší odpověď. Model nemusí využít každý dostupný detail stejně spolehlivě a důležitá informace ukrytá uprostřed dlouhého vstupu může dostat menší pozornost. Delší kontext také znamená vyšší nároky na výpočet, delší odezvu a u placených API často vyšší cenu. Proto se vyplatí kontext nejen zvětšovat, ale hlavně čistit a strukturovat.
V praxi pomáhá uvést cíl a nejdůležitější omezení jasně, podklady rozdělit do pojmenovaných částí a odstranit duplicity. Při delší práci je užitečné zapisovat rozhodnutí do samostatného dokumentu a v nové konverzaci načíst stručný aktuální stav. Kvalitu vstupu zlepšuje také dobrý prompt engineering: model by měl vědět, který zdroj je autoritativní, co má ignorovat a v jakém formátu má odpovědět.
Časté otázky:
Je kontextové okno totéž co paměť AI?
Ne. Kontextové okno je dočasný pracovní prostor pro informace dostupné při aktuální odpovědi. Dlouhodobá paměť je samostatný mechanismus, který ukládá informace mimo tento prostor a podle potřeby je do něj znovu načítá. Ani model s velkým oknem si automaticky nepamatuje všechno z minulých konverzací.
Co se stane, když se kontextové okno zaplní?
Záleží na aplikaci. Může odstranit nejstarší zprávy, nahradit část historie souhrnem, zkrátit vložený dokument nebo oznámit překročení limitu. V každém případě už model nemusí vidět původní informace beze změny, což může ovlivnit přesnost a konzistenci odpovědi.
Je větší kontextové okno vždy lepší?
Je užitečné, když potřebujete zpracovat dlouhé dokumenty, více souborů nebo rozsáhlou konverzaci. Kvalita ale závisí také na relevanci, uspořádání a srozumitelnosti vstupu. Větší kapacita dovolí přinést na pracovní stůl více materiálu, ale neudělá pořádek v hromadě nepotřebných podkladů.
Jak pracovat s kontextovým oknem efektivně?
Posílejte jen podklady potřebné pro daný krok, nejdůležitější pravidla formulujte jednoznačně a dlouhé úkoly rozdělte na menší části. Průběžné závěry ukládejte mimo chat a při pokračování použijte krátké shrnutí ověřeného stavu. Tím snížíte riziko, že podstatná informace zmizí v dlouhé historii nebo ji přehluší nerelevantní obsah.