Mnoho webů má příliš mnoho tagů na to, aby je bylo možné předat jazykovému modelu s požadavkem na klasifikaci. Simon Willison si všímá, že jeho blog obsahuje 1 856 tagů, což by bylo příliš na jeden dotaz. Doug Turnbull přichází s elegantním řešením: místo klasického výběru z předdefinované sady instruuje model, aby vygeneroval nové, imaginární tagy odpovídající obsahu. Poté se použijí vektorové vnoření k nalezení konkrétních existujících tagů, které jsou sémanticky nejbližší těm, které si model „vymyslel". Turnbull doporučuje v promptu zahrnout příklady struktury tagů, aby model generoval užitečnější odhady. Takový přístup redukuje počet tokenů ve promptu a zároveň umožňuje modelu myslet kreativněji.
Nechte model hádat tagy. Pak je namapujte na existující slovník
Zdroje
- Simon Willison: Don't classify. Hallucinate!
Související články
- 14. 8. 2026 Vícemodální chatboti: jak zvolit správný backend, routing a záložní řešení
- 13. 8. 2026 llm-gemini 0.33: Podpora pro Gemini 3.7 Flash a nové embedding modely
- 3. 8. 2026 David Crawshaw: Vývojářské nástroje musí být open-source
- 30. 6. 2026 Google DeepMind představuje Nano Banana 2 Lite a Gemini Omni Flash