fine-tuning

Vojtěch Bruk Vojtěch Bruk 7 min čtení

Co je fine-tuning a jak přizpůsobuje AI model konkrétní úloze

Fine-tuning, česky jemné doladění, je dodatečné trénování předem natrénovaného AI modelu na menší sadě vlastních příkladů. Model nezačíná od nuly: už umí pracovat s jazykem, obrazem nebo jiným typem dat a během fine-tuningu se pouze přizpůsobí konkrétní úloze, oboru či požadovanému způsobu odpovídání. U jazykových modelů mohou trénovací data například ukazovat, jak má model klasifikovat zákaznické dotazy, psát text v určitém formátu nebo správně volat firemní nástroje. Fine-tuning tak navazuje na prompt engineering, ale instrukce a příklady už nejsou jen součástí každého jednotlivého zadání. Ovlivní samotné chování upravené verze modelu.

Jak fine-tuning funguje:

  • Výběr základního modelu: Nejprve se zvolí předem natrénovaný model, který už danému typu úlohy rozumně odpovídá. Čím blíž je jeho výchozí schopnost reálnému použití, tím méně práce a dat bývá potřeba k doladění.
  • Příprava příkladů: Trénovací sada obsahuje reprezentativní dvojice vstupů a správných výstupů. U chatbotu to mohou být otázky zákazníků a ideální odpovědi, u klasifikace text a správná kategorie. Data se čistí, sjednocují a oddělují od testovací sady.
  • Dodatečné trénování: Model prochází příklady a upravuje své parametry neboli váhy tak, aby u podobných vstupů častěji vytvářel požadované výstupy. Některé metody upravují všechny váhy, úspornější postupy jako LoRA mění jen malou sadu přidaných parametrů.
  • Vyhodnocení: Doladěný model se porovnává s původním modelem na datech, která při tréninku neviděl. Nestačí, že dobře zopakuje známé příklady. Musí zvládnout nové případy a nesmí zhoršit jiné důležité schopnosti.
  • Nasazení a iterace: Pokud výsledky dávají smysl, vznikne samostatná verze modelu dostupná přes API nebo ve vlastní infrastruktuře. Reálný provoz pak ukáže další chyby, které se mohou promítnout do nové verze dat a dalšího kola ladění.

Technicky jde o formu transfer learningu. Znalosti získané při rozsáhlém předtrénování se přenesou do užšího použití, takže není nutné shánět miliardy dokumentů ani platit trénování modelu od začátku. U moderních velkých modelů se často používá supervised fine-tuning: člověk připraví ukázky správného chování a model se je učí napodobovat. Existují i postupy založené na preferencích, kde data neříkají jen „toto je správná odpověď“, ale porovnávají lepší a horší varianty.

Fine-tuning v praxi:

Představte si e-shop, který chce automaticky třídit příchozí zprávy na reklamace, dotazy k dopravě, vrácení zboží a ostatní požadavky. Obecný model úkol zvládne už z dobrého promptu. Pokud však firma denně zpracovává tisíce zpráv, potřebuje stálý výstup v přesném JSON formátu a používá vlastní názvy kategorií, může doladění na historických příkladech zvýšit konzistenci. Výsledkem může být i menší model s kratším promptem, nižší latencí a levnějším provozem.

Dalším příkladem je tvorba produktových popisů. Trénovací data mohou ukazovat povolenou délku, pořadí parametrů, terminologii a podobu výsledného HTML. Model se neučí nové aktuální informace o produktech, ale způsob, jak má dodané informace převést do požadovaného formátu. Podobně lze doladit model na extrakci údajů z faktur, rozpoznání záměru uživatele, generování strukturovaných reportů nebo konzistentní volání funkcí v AI aplikaci.

Fine-tuning se naopak obvykle nehodí jako náhrada databáze. Pokud potřebujete, aby model znal aktuální ceník, interní směrnice nebo dokumenty, dává větší smysl RAG, který relevantní informace vyhledá a vloží je do kontextu při každém dotazu. Doladěný model si trénovací fakta neukládá jako spolehlivý katalog a může stále vytvářet halucinace AI. V praxi se oba přístupy často kombinují: fine-tuning určuje chování a formát, RAG dodává aktuální znalosti.

Proč je fine-tuning důležitý:

Fine-tuning umožňuje změnit obecný model na specializovaný nástroj bez nákladů na stavbu vlastního modelu od základů. Největší přínos mívá u opakovaných úloh, kde lze jasně popsat správný výsledek a nasbírat dost kvalitních příkladů. Pomáhá také tam, kde se složité instrukce nevejdou pohodlně do promptu nebo model požadovaný formát nedodržuje dostatečně stabilně.

Není to ale automaticky nejlepší první krok. Pro mnoho firem je rozumnější začít dobrým system promptem, několika ukázkami přímo v zadání a měřením výsledků. Fine-tuning přidává přípravu dat, náklady na trénování, správu verzí a potřebu průběžného testování. Špatná nebo jednostranná data mohou model naučit chyby, přehnaně úzké chování nebo nežádoucí předsudky. Kvalita příkladů je proto důležitější než jejich bezhlavé množství.

Zásadní jsou evaluace. Ještě před trénováním je potřeba určit, co znamená lepší výsledek: přesnější kategorie, méně chyb ve formátu, vhodnější tón nebo vyšší úspěšnost konkrétního pracovního kroku. Stejnou testovací sadu je pak vhodné spustit nad základním i doladěným modelem. Bez takového srovnání se snadno utratí peníze za model, který působí specializovaněji, ale skutečný proces nezlepšil.

Časté otázky:

Jaký je rozdíl mezi fine-tuningem a prompt engineeringem?

Prompt engineering mění instrukce a kontext posílané modelu při konkrétním požadavku. Fine-tuning mění parametry nebo přidané adaptéry modelu pomocí trénovacích příkladů. Prompt lze upravit během několika minut a je vhodný jako první volba. Fine-tuning je náročnější, ale u stabilní úlohy může přinést konzistentnější výsledky a zkrátit opakované prompty.

Kolik dat je k fine-tuningu potřeba?

Neexistuje jedno univerzální číslo. Jednoduché a úzce vymezené chování lze někdy zlepšit desítkami či stovkami výborných příkladů, složitější úlohy potřebují podstatně víc. Důležitá je pestrost skutečných situací, správnost odpovědí a samostatná data pro ověření. Malá čistá sada bývá užitečnější než velký soubor nekonzistentních záznamů.

Naučí fine-tuning model nové firemní znalosti?

Může ovlivnit, jak model používá vzory obsažené v datech, ale není spolehlivou cestou k ukládání často se měnících faktů. Pro znalosti, které musí být aktuální a dohledatelné, je vhodnější vyhledávání v externím zdroji a vložení nalezeného obsahu do promptu. Fine-tuning se hodí hlavně pro chování, styl, klasifikaci, strukturu a opakovatelný postup.

Lze fine-tuningem úplně odstranit chyby modelu?

Ne. Doladění může snížit určitý typ chyb, ale může také vytvořit nové nebo model příliš přizpůsobit trénovacím datům. Proto je potřeba testování na neviděných příkladech, průběžný monitoring a u rizikových úloh také lidská kontrola. Fine-tuning je nástroj optimalizace, ne záruka pravdivosti.