Nastavenia chat modelov
Capability gating
Aplikácia vie o každom modeli, čo natívne podporuje. Prepínače, ktoré model nevie, v paneli vôbec nie sú. Request s nepodporovanou prílohou dostane čistú 400 namiesto cryptic odpovede od poskytovateľa.
Funkcie modelu (hosted tools)
Externé schopnosti, ktoré sa zapínajú v paneli a model ich potom môže počas jednej odpovede zavolať.
web_search
Model si dohľadá čerstvé informácie na webe a uvedie zdroje. Pod prepínačom je dropdown „Zdroj vyhľadávania“ - vyber natívny (model si hľadá sám) alebo externý (Tavily / Brave / Exa). Citácie vidíš ako klikateľné [1] markery v texte a ako číslovaný zoznam pod odpoveďou.
Kedy zapnúť: Aktuálne ceny, najnovšie SW verzie, správy po knowledge cutoff modelu.
Responses API · web_search (native)
v tokenoch
web_search_20260209 (native)
1.75 kr / volanie
Google Search grounding 2.5+ (native)
v cene requestu
web_search tooli sme integrovali tri nezávislé SERP providers, ktoré fungujú na akomkoľvek modeli (vrátane tých bez native podpory). Server beží smart router: news / aktuálne dopyty idú na Brave (nezávislý web index, čerstvé výsledky), research / akademické na Exa (neurónové sémantické vyhľadávanie), všetko ostatné na Tavily (LLM-friendly SERP s plným textom top stránok v jednom calle). Pre Brave server doťahuje top 3 stránky cez HTML scrape, aby mal model rovnaký grounding ako z Tavily / Exa. Výsledky sa vkladajú do user message ako textový blok - model ich vidí a má pokyn citovať [1] [2]. Cena: Tavily $5/1000, Brave $3/1000, Exa $5/1000 (≈ 1 kredit za vyhľadanie). V .env si môžeš povoliť ľubovoľnú podmnožinu (TAVILY_API_KEY, BRAVE_SEARCH_API_KEY, EXA_API_KEY); chýbajúce providers v routeri preskočíme.web_fetch
Model otvorí konkrétny odkaz, ktorý si mu dal v správe, a načíta obsah stránky. Užitočné pri „Zhrň tento článok: https://…“.
Kedy zapnúť: Keď chceš, aby model čítal konkrétnu URL, nielen googlil.
robí to implicitne cez web_search
-
web_fetch_20260209
4.37 kr / volanie
URL context (Gemini 2.5)
v cene requestu
code_execution
Model napíše Python kód a vyhodnotí ho v izolovanom sandbox VM - výstup (čísla, text, grafy) sa zobrazí v odpovedi.
Kedy zapnúť: Matematika, prevody jednotiek, parsovanie CSV/JSON, regex testing, generovanie grafov.
code_interpreter (Responses API)
5.25 kr / relácia
code_execution_20250825
~0.88 kr / volanie
codeExecution (Pro / Flash, nie Lite)
v cene requestu
file_search
RAG nad tvojou vlastnou knižnicou súborov (vector stores). Model sémanticky prehľadá vybrané kolekcie a cituje konkrétne pasáže s názvom súboru.
Kedy zapnúť: Keď chceš odpoveď podloženú vlastnými dokumentmi - zmluvy, manuály, archív článkov.
Responses API · file_search (vector stores)
0.44 kr / volanie
nie je integrované (vlastné RAG)
-
nie je integrované (vlastné RAG)
-
youtube_analyzer
Pre-pass funkcia: server zavolá Gemini 2.5 Flash, ktorý video stiahne, prepíše audio a popíše vizuál. Hlavnému modelu sa pošle textový prepis.
Kedy zapnúť: Keď chceš zhrnúť/analyzovať YouTube video a tvoj obľúbený model (GPT, Claude) nevie YouTube natívne.
Gemini 2.5+ rozumie YouTube natívne
v cene requestu
ide cez Gemini Flash pre-pass
~1–3 kr / 10-min video
ide cez Gemini Flash pre-pass
~1–3 kr / 10-min video
audio_transcriber
Pre-pass funkcia: audio prílohy idú cez OpenAI Whisper a modelu sa pošle iba textový prepis. Umožňuje používať mikrofón a hlasové správy na akomkoľvek modeli.
Kedy zapnúť: Hlasové diktovanie do chatu, prepis nahrávok porady, voice memos.
Whisper v1 (per-second billing)
~1 kr / minúta audia
Gemini 2.x rozumie audio natívne
v tokenoch
ide cez Whisper pre-pass
~1 kr / minúta
Akceptácia vstupov
Tieto prepínače sú opt-out kontrola - model síce modalitu podporuje, ale ty nechceš omylom poslať citlivý súbor. Default: zapnuté pre všetko, čo model vie.
GPT-4o, GPT-4.1, GPT-5.x, o3/o4-mini, Claude 3.5+/4.x, Gemini 1.5+/2.x
GPT-4o+, Claude 4.x, Gemini 2.x
gpt-4o-audio-preview, Gemini 2.x · iné modely cez Whisper pre-pass
Iba Gemini 2.x - do 20 MB inline, väčšie cez Files API
Gemini 2.5+ natívne · iné modely cez analyzer pre-pass
Všetky modely natívne · .txt, .md, .json, .csv, .py, .ts, .sql a ďalšie (limit 5 MB / súbor)
OpenAI natívne · Anthropic + Gemini cez document_extractor pre-pass (1 kr / súbor)
fileData.fileUri = files/<id>. Vidíš to ako chip „Nahrávam do Gemini Files API…“ (typicky 5–20 s pre podcast clip).OpenAI (Responses + Chat Completions) prijíma .docx, .xlsx, .pptx a .rtf natívne cez input_file (vrátane spreadsheet augmentation pre Excel). Anthropic a Gemini ich neprijímajú, takže server spustí pre-pass document_extractor: stiahne súbor, extrahuje text (mammoth pre DOCX, SheetJS pre XLSX, JSZip pre PPTX, regex strip pre RTF) a v messages nahradí blok textovým blokom s Markdownom. Vidíš to ako chip „Extrahujem <názov súboru>“. Cena: 1 kredit za extrahovaný súbor (CPU práca, bez external API). Limit 32 MB / súbor. Starý formát .doc / .xls / .ppt (CFB binary) nie je podporovaný - otvor v Office a ulož ako modernú variantu..txt, .md, .json, .csv, .html, .py, .ts, .sql, .yml a desiatky ďalších rozšírení. Limit je 5 MB / súbor - text expanduje na veľa tokenov (1 MB plain ASCII ~250k tokenov). Anthropic ich dostáva ako document blok s text source (citations zapnuté), Gemini cez fileData s normalizovaným text/plain, OpenAI cez input_file (Responses fetuje cez file_url, Chat Completions inline base64).Knižnica dokumentov (RAG)
Vector stores v OpenAI - vlastné kolekcie dokumentov, v ktorých GPT-5.x / GPT-4.1 / o3-o4 vie sémanticky vyhľadávať.
V paneli nastavení klikni na Spravovať knižnicu dokumentov alebo na ikonu knihy v hlavičke chatu.
Daj mu meno (napr. „Účtovníctvo 2026“) a krátky popis na čo slúži.
Podporované: PDF, DOCX, TXT, MD, HTML, JSON · max 50 MB / súbor. Po uploade chvíľu čaká na indexáciu (status in_progress → completed).
V paneli pridaj store (OpenAI limit: 2 stores na turn) a aktivuj prepínač „Vyhľadávanie v knižnici dokumentov“.
V odpovedi sa objavia citácie typu súbor.pdf - strana 4 pod textom a 12 markery v odseku.
Indexácia
zahrnuté v storage
Storage
prvý GB zadarmo
Query
typicky 1 volanie na turn
Ladenie modelu
Parametre, ktoré ovplyvňujú každú odpoveď. Ladenie (teplota, limit, uvažovanie, strop kontextu) si model pamätá zvlášť. Vlastné inštrukcie sú globálne.
Krátky text, ktorý pošleme modelu na začiatok každej správy. Užitočné na nastavenie štýlu („Odpovedaj v Markdown s nadpismi“) alebo persony („Si senior účtovník, hovor formálne“).
Si expertný slovenský právnik. Odpovedaj v bodoch s odkazmi na konkrétne paragrafy. Keď si niečím neistý, povedz to.
Náhodnosť výberu tokenov. 0 = najdeterministickejšie, 2 = maximum kreativity.
Deterministický
Vyvážený (default)
Kreatívny
Náhodný
Strop na to, koľko tokenov môže model emitovať v jednej odpovedi. 1 token ≈ ~0.75 slova v angličtine, ~0.5 slova v slovenčine.
Krátka odpoveď
Bežná odpoveď
Dlhá analýza
Maximum modelu
Na modeloch s thinking nastavíš zapnutie a silu (effort) alebo rozpočet tokenov. Server už neposiela natvrdo medium/high - berie tvoju hodnotu.
Ukazovateľ odhaduje, koľko histórie + rezervy na odpoveď sa zmestí pred odoslaním. Voliteľný strop oreže staršie správy. Väčšina API nemá parameter „veľkosť okna“ - maximum je dané modelom.
Kredity a účtovanie
100 kreditov = 1 €. Pri registrácii dostávaš 100 kreditov zadarmo. Účtuje sa po dokončení odpovede podľa skutočne použitých tokenov.
Pripočítavajú sa k bázovým token cenám pri zapnutých tool-och.
| Tool | Cena | ~ Kredity |
|---|---|---|
| Anthropic web_search | $10 / 1000 volaní | ~1.75 kr / volanie |
| Anthropic web_fetch | $25 / 1000 volaní | ~4.37 kr / volanie |
| Anthropic code_execution | ~$0.005 / volanie | ~0.88 kr / volanie |
| OpenAI code_interpreter | $0.03 / relácia | ~5.25 kr / relácia |
| OpenAI file_search | $2.50 / 1000 volaní | ~0.44 kr / volanie |
| youtube_analyzer | Gemini Flash tokens × dĺžka videa | ~1–3 kr / 10-min video |
| audio_transcriber (Whisper) | $0.006 / min | ~1 kr / min audio |
Modely a ich schopnosti
Automaticky generované z aktuálneho lib/models.ts. Hlavičky stĺpcov sú prepínače z panela nastavení.
31 modelov
| Model | Vision | Audio | Video | YouTube | web_search | web_fetch | code_exec | file_search | temp | |
|---|---|---|---|---|---|---|---|---|---|---|
GPT-6 Astranew | fix | |||||||||
GPT-5.6 Solbest | fix | |||||||||
GPT-5.6 Terrabalanced | fix | |||||||||
GPT-5.6 Lunacheap | fix | |||||||||
GPT-5.5 Propro | fix | |||||||||
GPT-5.5 | fix | |||||||||
GPT-5.4 Propro | fix | |||||||||
GPT-5.4balanced | fix | |||||||||
GPT-5.4 minifast | fix | |||||||||
GPT-5.4 nanocheap | fix | |||||||||
GPT-5.2 Propro | fix | |||||||||
GPT-5.2balanced | fix | |||||||||
GPT-5.1 | fix | |||||||||
GPT-5 Propro | fix | |||||||||
GPT-5 | fix | |||||||||
GPT-5 minifast | fix | |||||||||
GPT-5 nanocheap | fix | |||||||||
GPT-4.1 | ||||||||||
GPT-4.1 minibalanced | ||||||||||
GPT-4.1 nanocheap | ||||||||||
o3-proreasoning | fix | |||||||||
o3reasoning | fix | |||||||||
o3-minireasoning | fix | |||||||||
o4-minireasoning | fix | |||||||||
GPT-4.5 Previewlegacy | ||||||||||
GPT-4olegacy | ||||||||||
GPT-4o minilegacy | ||||||||||
GPT-4 Turbolegacy | ||||||||||
GPT-4legacy | ||||||||||
GPT-3.5 Turbolegacy | ||||||||||
o1legacy | fix |
11 modelov
| Model | Vision | Audio | Video | YouTube | web_search | web_fetch | code_exec | file_search | temp | |
|---|---|---|---|---|---|---|---|---|---|---|
Claude Fable 5best | fix | |||||||||
Claude Opus 5pro | fix | |||||||||
Claude Opus 4.8pro | fix | |||||||||
Claude Opus 4.7pro | fix | |||||||||
Claude Opus 4.6pro | fix | |||||||||
Claude Opus 4.5 | fix | |||||||||
Claude Opus 4.1legacy | fix | |||||||||
Claude Sonnet 5best | fix | |||||||||
Claude Sonnet 4.6balanced | fix | |||||||||
Claude Sonnet 4.5balanced | fix | |||||||||
Claude Haiku 4.5fast | fix |
9 modelov
| Model | Vision | Audio | Video | YouTube | web_search | web_fetch | code_exec | file_search | temp | |
|---|---|---|---|---|---|---|---|---|---|---|
Gemini 3.1 Propro | ||||||||||
Gemini 3.6 Flashbest | ||||||||||
Gemini 3.5 Flashbalanced | ||||||||||
Gemini 3.5 Flash-Litefast | ||||||||||
Gemini 3 Flashbalanced | ||||||||||
Gemini 3.1 Flash-Lite | ||||||||||
Gemini 2.5 Pro | ||||||||||
Gemini 2.5 Flash | ||||||||||
Gemini 2.5 Flash-Litecheap |
2 modely
| Model | Vision | Audio | Video | YouTube | web_search | web_fetch | code_exec | file_search | temp | |
|---|---|---|---|---|---|---|---|---|---|---|
DeepSeek V4 Propro | ||||||||||
DeepSeek V4 Flashcheap |
6 modelov
| Model | Vision | Audio | Video | YouTube | web_search | web_fetch | code_exec | file_search | temp | |
|---|---|---|---|---|---|---|---|---|---|---|
Grok 4.5best | ||||||||||
Grok 4.3balanced | ||||||||||
Grok Build 0.1fast | ||||||||||
Grok 4.20 Reasoningreasoning | ||||||||||
Grok 4.20fast | ||||||||||
Grok 4.20 Multi-Agentpro |
5 modelov
| Model | Vision | Audio | Video | YouTube | web_search | web_fetch | code_exec | file_search | temp | |
|---|---|---|---|---|---|---|---|---|---|---|
Command A+best | ||||||||||
Command Abalanced | ||||||||||
Command A Reasoningreasoning | ||||||||||
Command A Visionnew | ||||||||||
Command R7Bcheap |
Legenda: ✔ podporuje natívne · - nepodporuje · fix = model prijíma iba default teplotu (slider v paneli je zašednutý). Modality bez natívnej podpory (audio, YouTube) sa dajú obísť pre-pass fallback-om - viď sekciu vyššie.