Kimi K3 je natívne multimodálny model typu Mixture-of-Experts s:
- 2,8 bilióna celkových parametrov,
- 104 miliardami parametrov aktivovaných pri generovaní tokenu,
- 896 expertmi, z ktorých sa vyberá 16,
- kontextom s dĺžkou 1 048 576 tokenov,
- podporou textu, obrazu a podľa dokumentácie API aj videa,
- veľkosťou repozitára približne 1,56 TB.[2][3]
Moonshot AI označuje Kimi K3 ako open-source model. V prísnom význame Open Source Initiative je však presnejší pojem open-weight. Boli zverejnené konečné parametre, kód a dokumentácia, no Kimi K3 používa vlastnú licenciu s dodatočnými podmienkami pre niektoré komerčné použitia. Samotná dostupnosť váh takisto neposkytuje úplnú transparentnosť tréningového procesu a dát požadovanú Open Source AI Definition.[4][5][6]
Hlavný záver: Kimi K3 možno reálne stiahnuť, upravovať, fine-tunovať a hostovať vo vlastnej infraštruktúre, ale bežná firma ho nespustí na jednom GPU serveri. Zverejnenie váh otvára významné výskumné a infraštruktúrne možnosti, pričom rozsah modelu a licenčné podmienky si pred produkčným nasadením vyžadujú dôkladnú analýzu.
Všetky parametre, ceny, licenčné podmienky a informácie o dostupnosti boli overené 27. júla 2026.
TL;DR
| Otázka | Odpoveď |
|---|---|
| Čo sa stalo 27. júla? | Zverejnili sa kompletné váhy, repozitár, licencia a technická správa |
| Bol v ten deň uvedený samotný model? | Nie, model a API boli dostupné už skôr |
| Je Kimi K3 open source? | Moonshot tento pojem používa, presnejšie je open-weight pod vlastnou licenciou |
| Koľko má parametrov? | 2,8 bilióna celkom, 104 miliárd aktívnych |
| Aká je architektúra? | MoE, KDA, Gated MLA, AttnRes a Stable LatentMoE |
| Koľko má expertov? | 896, z ktorých 16 sa vyberá na token, plus 2 zdieľaní experti |
| Aký dlhý je kontext? | 1 048 576 tokenov |
| Aké veľké sú súbory? | Približne 1,56 TB |
| Koľko je hlavných shardov? | 96 súborov Safetensors |
| Dá sa spustiť lokálne? | Technicky áno, ale nie na bežnom počítači alebo jednom GPU |
| Čo odporúča výrobca? | Supernode konfigurácie s najmenej 64 akcelerátormi |
| Je povolené komerčné použitie? | Áno, podľa Kimi K3 License |
| Koľko stojí oficiálne API? | 0,30 USD/MTok cache hit, 3 USD/MTok cache miss, 15 USD/MTok output |
| Dá sa reasoning vypnúť? | Nie |
| Aké úrovne sú dostupné? | low, high, max, predvolené max |
| Sú benchmarky nezávislé? | Nie všetky, časť pochádza od Moonshot AI |
1. Čo presne bolo zverejnené?
Oficiálny repozitár moonshotai/Kimi-K3 na Hugging Face obsahuje:
- kompletné váhy,
- konfiguráciu modelu,
- kód na načítanie a spracovanie vstupov,
- tokenizer a súbory procesora,
- príklady pre Transformers, vLLM a SGLang,
- model card,
- Kimi K3 License.[2]
Oficiálny GitHub repozitár navyše obsahuje:
- kód a dokumentáciu projektu,
- technickú správu
k3_tech_report.pdf, - návody na deployment,
- opis architektúry a evaluácie.[3][7]
Repozitár váh má približne 1,56 TB. Hlavné parametre sú rozdelené do 96 súborov Safetensors, od:
model-00001-of-000096.safetensors
po:
model-00096-of-000096.safetensors
Väčšina shardov má približne 16,6–17 GB.[8]
Nejde o budúci prísľub. Súbory sú už dostupné na stiahnutie.
2. Open source alebo open-weight?
Moonshot AI používa označenia:
- „open model“,
- „open-source model“,
- „Open Frontier Weights“.
Model card na Hugging Face označuje Kimi K3 výslovne ako open-weight.[2]
Čo sú otvorené váhy?
Váhy sú konečné parametre naučené počas tréningu. Ich zverejnenie umožňuje:
- prevádzku mimo infraštruktúry výrobcu,
- fine-tuning,
- tvorbu kvantizácií,
- analýzu správania,
- vlastné inference servery,
- integráciu bez posielania promptov do oficiálneho API.
Neumožňuje automaticky reprodukovať celý proces vývoja.
Prečo OSI rozlišuje open weights a Open Source AI?
Open Source Initiative uvádza, že samotné konečné váhy neposkytujú úplný prístup k:
- dátam alebo dostatočným informáciám o tréningových dátach,
- všetkému kódu na prípravu dát,
- plnej konfigurácii tréningu,
- súčastiam potrebným na reprodukciu podstatne rovnocenného systému.[5][6]
Open Source AI Definition vyžaduje slobodu:
- používať,
- skúmať,
- upravovať,
- zdieľať,
a prístup k preferovanej forme potrebnej na reálnu modifikáciu systému.[6]
Je Kimi K3 License schválená OSI?
Repozitár používa vlastnú Kimi K3 License, nie Apache-2.0, MIT alebo inú štandardnú OSI licenciu.
Licencia udeľuje široké práva:
- používať,
- kopírovať,
- upravovať,
- publikovať,
- distribuovať,
- sublicencovať,
- predávať,
- nasadzovať,
- fine-tunovať,
- vytvárať odvodené diela.[4]
Zároveň obsahuje dodatočné podmienky pre niektoré komerčné subjekty. Najbezpečnejšia formulácia preto znie:
Kimi K3 je open-weight model vydaný pod vlastnou Kimi K3 License.
Model nie je „uzavretý“, no pojem open source tu potrebuje právne a technické upresnenie.
3. Hlavné parametre Kimi K3
| Parameter | Kimi K3 |
|---|---|
| Architektúra | Mixture-of-Experts |
| Celkové parametre | 2,8 bilióna |
| Aktivované parametre | 104 miliárd |
| Počet vrstiev | 93 |
| Dense vrstvy | 1 |
| Attention vrstvy | 69 KDA + 24 Gated MLA |
| Experti | 896 |
| Experti na token | 16 |
| Zdieľaní experti | 2 |
| Slovník | 160 000 |
| Kontext | 1 048 576 tokenov |
| Obrazový enkóder | MoonViT-V2 |
| Parametre vision enkódera | 401 miliónov |
| Váhy | MXFP4 |
| Aktivácie | MXFP8 |
| Modality v model card | text a obraz |
| Ďalšia modalita v API | video |
| Veľkosť repozitára | približne 1,56 TB |
| Safetensors shardy | 96 |
Údaje pochádzajú z oficiálnej model card.[2]
2,8 bilióna neznamená 2,8 bilióna aktívnych parametrov
Kimi K3 je MoE model. Pri generovaní tokenu nepoužíva všetkých expertov.
Router vyberá 16 z 896 expertov a dokumentácia uvádza 104 miliárd aktivovaných parametrov. To zvyšuje kapacitu bez rovnakého výpočtového nákladu ako dense model s 2,8T.
Hardware však stále nemožno porovnať s bežným 100B modelom, pretože všetky váhy musia byť uložené a rozdelené medzi akcelerátory.
4. KDA, AttnRes a Stable LatentMoE
Kimi Delta Attention
KDA je hybridný linear-attention mechanizmus pre dlhé sekvencie.
Model obsahuje:
- 69 KDA vrstiev,
- 24 Gated MLA vrstiev.[2]
Linear attention môže znížiť časť nákladov full attention pri dlhom kontexte, ale milión tokenov tým nie je lacný.
Attention Residuals
AttnRes mení odovzdávanie reprezentácií medzi vrstvami. Podľa Moonshot AI selektívne získava informácie z rôznych hĺbok.[1]
Stable LatentMoE
Stable LatentMoE umožňuje škálovanie na 896 expertov a aktiváciu 16. Moonshot AI uvádza približne 2,5-násobné zlepšenie celkovej efektivity škálovania oproti Kimi K2.[1][2]
Ide o tvrdenie výrobcu, nie záruku 2,5-násobnej rýchlosti, nižšej ceny alebo kvality.
Natívne MXFP4
Kimi K3 bol od supervised fine-tuning trénovaný s ohľadom na kvantizáciu:
MXFP4 pre váhy
MXFP8 pre aktivácie
Cieľom je znížiť pamäťové nároky a uľahčiť deployment.[2] Repozitár má stále približne 1,56 TB.
5. Dá sa Kimi K3 spustiť lokálne?
Áno, ak „lokálne“ znamená veľkú vlastnú infraštruktúru.
Plná verzia nie je určená pre:
- notebook,
- workstation s bežnou GPU,
- jeden server s niekoľkými GPU,
- malý homelab.
Moonshot AI odporúča supernode s najmenej 64 akcelerátormi. Treba zohľadniť:
- váhy,
- KV cache,
- miliónový kontext,
- komunikáciu medzi expertmi,
- expert parallelism,
- rýchle prepojenie zariadení,
- prefix cache,
- rezervu runtime.[1]
Reálna pamäť
Kvantizované váhy zaberajú približne 1,56 TB. Navyše je potrebná pamäť na:
- overhead frameworku,
- cache,
- aktivácie,
- komunikačné buffery,
- operačný systém,
- súbežnosť požiadaviek.
Delenie 1,56 TB pamäťou jednej karty neposkytne produkčnú konfiguráciu.
Odporúčané enginy
Model card uvádza:
- vLLM,
- SGLang,
- TokenSpeed.[2]
Dostupné sú aj príklady Transformers a Docker Model Runner. Príkaz:
vllm serve "moonshotai/Kimi-K3"
neznamená, že model pobeží na ľubovoľnom stroji.
Pre koho má self-hosting zmysel?
- hyperscale poskytovatelia a inference provideri,
- výskumné laboratóriá,
- veľké podniky s AI clustermi,
- organizácie s veľmi citlivými dátami,
- firmy vytvárajúce fine-tunes a kvantizácie,
- poskytovatelia inference vo veľkom meradle.
Pre väčšinu tímov je výhodnejšie oficiálne API.
6. Čo licencia dovoľuje?
Kimi K3 License bezplatne dovoľuje:
- používať,
- kopírovať,
- upravovať,
- spájať,
- publikovať a distribuovať,
- sublicencovať,
- predávať kópie,
- prevádzkovať a nasadzovať,
- fine-tunovať,
- vytvárať odvodené riešenia.[4]
Je nutné zachovať copyright a text licencie.
Podmienka Model as a Service
Licencia definuje Model as a Service ako poskytovanie inference alebo fine-tuningu tretej strane s významnou kontrolou nad vstupmi, parametrami alebo tréningovými dátami.
Ak držiteľ licencie alebo pridružené subjekty:
- prevádzkujú Model as a Service,
- dosahujú spoločne viac ako 20 miliónov USD príjmov v ľubovoľnom súvislom období 12 mesiacov,
musia pred komerčným použitím uzavrieť samostatnú zmluvu s Moonshot AI.[4]
Prahová hodnota sa týka celkových príjmov držiteľa licencie a pridružených subjektov, nie iba Kimi K3.
Povinnosť zobraziť názov Kimi K3
Ak sa model alebo odvodené riešenie používa v komerčnom produkte či službe s:
- viac ako 100 miliónmi mesačne aktívnych používateľov, alebo
- viac ako 20 miliónmi USD mesačných príjmov,
musí byť názov „Kimi K3“ viditeľne zobrazený v používateľskom rozhraní.[4]
Výnimky
Podmienky MaaS a atribúcie neplatia:
- pri čisto internom použití bez sprístupnenia tretím stranám,
- pri oficiálnych produktoch Moonshot AI,
- pri certifikovaných inference partneroch.[4]
Čo musí firma preveriť?
- interné alebo externé použitie,
- mieru kontroly zákazníka,
- príjmy skupiny,
- MAU a príjmové prahy,
- povinnosť atribúcie,
- potrebu samostatnej zmluvy.
Tento článok nie je právne poradenstvo.
7. Čo zverejnené nebolo?
Oficiálne materiály obsahujú:
- konečné váhy,
- časť kódu,
- konfiguráciu architektúry,
- inference a processor kód,
- technický opis,
- výsledky evaluácie.
Nevyplýva z nich zverejnenie kompletného datasetu ani všetkých detailov potrebných na reprodukciu tréningu od nuly.
Kimi K3 je výrazne otvorenejší než uzavreté API, ale neposkytuje úplnú reprodukovateľnosť podľa OSI.[5][6]
8. API a ceny
Identifikátor:
kimi-k3
Oficiálne API je kompatibilné s OpenAI Chat Completions.
Cenník
| Typ tokenu | Cena za milión |
|---|---|
| Input pri cache hit | 0,30 USD |
| Input pri cache miss | 3,00 USD |
| Output | 15,00 USD |
Ceny pochádzajú od Moonshot AI a môžu byť bez daní.[1]
Moonshot AI uvádza viac ako 90 % cache hit pri coding workloadoch. Nie je to záruka pre každého klienta.[1]
Minimálne dobitie
Prístup k API sa odomkne po dobití aspoň 1 USD. Tier a limity závisia od kumulatívnych platieb.[9]
9. Prvé volanie v Pythone
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["MOONSHOT_API_KEY"],
base_url="https://api.moonshot.ai/v1",
)
response = client.chat.completions.create(
model="kimi-k3",
reasoning_effort="high",
max_completion_tokens=8_192,
messages=[
{
"role": "user",
"content": (
"Analyzuj architektúru projektu a priprav "
"bezpečný plán migrácie."
),
}
],
)
message = response.choices[0].message
print(message.content)
cURL
curl https://api.moonshot.ai/v1/chat/completions \
--header "Authorization: Bearer $MOONSHOT_API_KEY" \
--header "Content-Type: application/json" \
--data '{
"model": "kimi-k3",
"reasoning_effort": "high",
"max_completion_tokens": 8192,
"messages": [
{
"role": "user",
"content": "Analyzuj tento problém a navrhni riešenie."
}
]
}'
10. Reasoning je vždy zapnutý
Kimi K3 vždy používa reasoning. Nie je možné ho úplne vypnúť.[9][10]
Úrovne:
low
high
max
Predvolené:
max
Pre bežnú produkčnú prevádzku je vhodné začať s low alebo high.
reasoning_content
Odpoveď môže obsahovať samostatne:
reasoning_content,- konečný
content.
Pri streamingu prichádzajú oddelene.[9][10]
Reasoning by sa nemal automaticky:
- zobrazovať používateľovi,
- neobmedzene ukladať,
- posielať do logov s osobnými dátami,
- považovať za spoľahlivý audit.
Preserved Thinking
V multi-turn konverzáciách a tool callingu musí ďalší request obsahovať:
reasoning_content,content,tool_calls.
Iba konečný content nestačí.[10]
Historický reasoning spotrebúva kontext a je účtovaný.
11. Limity a odlišnosti API
Maximálny output
predvolené: 131 072 tokenov
maximum: 1 048 576 tokenov
Technické maximum nie je automaticky lacné alebo rýchle.
Pevné parametre
temperature = 1.0
top_p = 0.95
n = 1
presence_penalty = 0
frequency_penalty = 0
Dokumentácia odporúča ich neposielať.
Obrázky a video
Verejné URL obrázkov nie sú podporované. Použite:
- base64,
ms://<file-id>.
Dokumentácia ukazuje aj video cez súborový systém Moonshot.[9]
Web search
Oficiálny web search sa aktualizuje a dokumentácia ho aktuálne neodporúča pre produkčné workflow.[9]
12. Miliónový kontext a cache
1 048 576 tokenov
Vhodné pre:
- veľké repozitáre,
- podnikovú dokumentáciu,
- veľa súborov,
- dlhé agentné relácie,
- viacstupňový výskum.
Automatická cache
Prefix cache funguje automaticky. Nie je potrebné ID ani TTL.
Predchádzajúci prompt musí prekročiť 256 tokenov, aby sa pokúsil cache hit.[9]
Udržiavajte stabilný prefix, premennú otázku dajte na koniec a merajte skutočné cache hits.
Milión tokenov nezaručuje perfektnú pamäť, úplný retrieval ani odolnosť voči prompt injection.
13. Tool calling a agenti
Kimi K3 podporuje:
- custom tools,
tool_choice,- vynútené použitie,
- structured output s JSON Schema,
- Partial Mode,
- dynamické definície,
- Formula tools.[9]
Dynamické nástroje
Definíciu možno pridať neskôr do histórie a znížiť tak dĺžku, chyby aj rozsah oprávnení.
Server definíciu za klienta neuchováva. Správa musí zostať v ďalšej histórii.
Structured output
response_format = {
"type": "json_schema",
"json_schema": {
"name": "finding",
"strict": True,
"schema": {
"type": "object",
"properties": {
"severity": {
"type": "string",
"enum": ["low", "medium", "high", "critical"],
},
"summary": {"type": "string"},
},
"required": ["severity", "summary"],
"additionalProperties": False,
},
},
}
Parsujte message.content, nie reasoning_content.[9]
14. Kimi Code a programovanie
Moonshot AI cieli K3 na:
- dlhé coding úlohy,
- veľké repozitáre,
- koordináciu terminálových nástrojov,
- refactoring,
- frontend podľa screenshotov,
- GPU kernels, kompilátory, CAD a návrh čipov.[1][2]
Kimi Code vie:
- čítať a upravovať súbory,
- spúšťať shell,
- vyhľadávať,
- načítavať webové stránky,
- plánovať kroky,
- pracovať cez TUI,
- integrovať sa cez Agent Client Protocol.[11]
Inštalácia
curl -fsSL https://code.kimi.com/kimi-code/install.sh | bash
cd /cesta/k/projektu
kimi
Potom:
/model
a vybrať Kimi K3.
Read-only operácie môžu prebiehať automaticky, zatiaľ čo zmeny a príkazy vyžadujú v štandardnom nastavení potvrdenie.[11]
Sandbox, least privilege, ochrana secrets, review a blokovanie auto-deploymentu sú stále nutné.
15. Ako čítať benchmarky?
Vybrané oficiálne výsledky pri max:
| Benchmark | Kimi K3 |
|---|---|
| GPQA Diamond | 93,5 |
| DeepSWE | 67,5 |
| ProgramBench | 77,8 |
| Terminal-Bench 2.1 | 88,3 |
| FrontierSWE | 81,2 |
| SWE-Marathon | 42,0 |
| BrowseComp | 91,2 |
| MCPMark-Verified | 94,5 |
| OSWorld-Verified | 84,8 |
| AutomationBench | 30,8 |
Jednoduchý rebríček nie je spoľahlivý, pretože sa líšia:
- harnessy,
- reasoning,
- konfigurácie agentov,
- zdroje,
- dátumy leaderboardov,
- počty behov,
- práca s kontextom.
V Agents’ Last Exam používal Kimi K3 Kimi Code, GPT používal Codex a Claude používal Claude Code.[2]
Moonshot AI sám uvádza, že celkový výkon K3 stále zaostáva za Claude Fable 5 a GPT-5.6 Sol.[1]
Firemný POC má obsahovať 50–200 reálnych úloh, rovnaké nástroje, viac behov a cenu za dokončenú úlohu.
16. Multimodalita
Model card potvrdzuje text a obraz, API aj video.[2][9]
Použitie:
- screenshoty,
- opravy UI,
- grafy,
- coding z vizuálnych referencií,
- nahrávky obrazovky,
- motion design a video editing.
Dema výrobcu nie sú zárukou. Testujte čítanie textu, lokalizáciu prvkov, konzistentnosť snímok, cenu a súkromie.
17. Bezpečnosť, súkromie a governance
Výhody self-hostingu
- dáta zostávajú v kontrolovanej infraštruktúre,
- externú telemetriu možno vypnúť,
- vlastné filtre a policy,
- kontrola verzie,
- obmedzená sieť,
- vlastné security testy.
Nové povinnosti
- zabezpečenie clusteru a endpointov,
- tenant isolation,
- monitoring zneužitia,
- validácia generovaného kódu,
- ochrana váh,
- aktualizácie runtime,
- zraniteľnosti vLLM/SGLang,
- governance logov a reasoning,
- limity a circuit breakers.
Použité zdroje neobsahujú nezávislý komplexný bezpečnostný audit Kimi K3. Regulované využitie vyžaduje testy prompt injection, exfiltrácie, jailbreakov, škodlivého kódu, halucinácií, zlomyseľných dokumentov a eskalácie nástrojov.
18. Self-hosting alebo API?
| Kritérium | Self-hosting | Oficiálne API |
|---|---|---|
| Počiatočné náklady | veľmi vysoké | nízke |
| Infraštruktúra | multi-accelerator cluster | bez vlastného clusteru |
| Kontrola dát | najvyššia | podľa podmienok |
| Aktualizácie | vlastná zodpovednosť | spravované |
| Fine-tuning | plná kontrola | podľa ponuky |
| Škálovanie | vlastná zodpovednosť | spravované |
| Cache | vlastná implementácia | automatická |
| Čas nasadenia | dlhý | krátky |
| Licencia | vyžaduje analýzu | výnimky pre oficiálne produkty |
| Malý tím | zvyčajne nevýhodné | zvyčajne lepšie |
API je vhodné pre POC, premenlivú záťaž a rýchlu integráciu. Self-hosting pre prísne dátové požiadavky, existujúci cluster, stabilné vysoké využitie a skúsenosti s distributed inference.
19. Oplatí sa Kimi K3 nasadiť?
Áno, ak:
- potrebujete veľmi veľký self-hostable model,
- máte infraštruktúru,
- skúmate 3T modely,
- budujete inference providera,
- potrebujete multimodalitu a dlhý kontext,
- máte dlhé agentic coding úlohy,
- chcete vlastné fine-tunes a kvantizácie.
Nie nevyhnutne, ak:
- máte iba jeden GPU server,
- jednoduché dotazy vyžadujú nízku latenciu,
- lacnejšie API je dostatočné,
- reasoning musí ísť vypnúť,
- potrebujete Apache alebo MIT,
- vyžadujete úplnú reprodukovateľnosť tréningu,
- nemáte distributed-inference tím.
20. Verdikt
Publikácia plných váh Kimi K3 je významná.
Model ponúka:
- 2,8 bilióna parametrov,
- 104 miliárd aktívnych,
- natívnu multimodalitu,
- miliónový kontext,
- MoE s 896 expertmi,
- zameranie na coding a dlhé agentné úlohy.
Treba oddeliť tri fakty:
- Kimi K3 bol predstavený skôr.
- Váhy a technické materiály vyšli 27. júla.
- Je open-weight pod vlastnou licenciou, nie nesporne Open Source AI podľa OSI.
Pre výskum a inference providerov je vydanie cenné. Pre bežnú firmu sú 1,56 TB a najmenej 64 akcelerátorov infraštruktúrnym projektom.
Odporúčaný postup:
Najprv:
POC cez oficiálne API
Potom:
merať kvalitu, cenu, latenciu a riziko
Až následne:
riešiť self-hosting, licenciu a cluster
21. Checklist pred nasadením
Terminológia a licencia
- Používa sa open-weight.
- Licencia a copyright zostávajú.
- Právne oddelenie vykonalo kontrolu.
- MaaS status je určený.
- Overený limit 20 mil. USD za 12 mesiacov.
- Overený limit 100 mil. MAU.
- Overený limit 20 mil. USD mesačne.
- Atribúcia v UI je určená.
- Interné použitie je zdokumentované.
Infraštruktúra
- Potvrdených 1,56 TB.
- Naplánovaných 96 shardov.
- Integrita overená.
- Vybraný vLLM, SGLang alebo TokenSpeed.
- Dostatok pamäte akcelerátorov.
- Rýchle prepojenie.
- Expert parallelism.
- KV cache vypočítaná.
- Monitoring GPU/siete/pamäte.
- Proces aktualizácie runtime.
API a agent
- Používa sa
kimi-k3. - Zvolený
reasoning_effort. - Reasoning sa nevypína.
- Úplná história
reasoning_content. - Obmedzené
max_completion_tokens. - Pevné sampling parametre sa neposielajú.
- Obrázky base64 alebo
ms://. - Web search nie je kritický.
- Tool calls validované.
- JSON Schema validované.
Bezpečnosť
- Sandbox.
- Least privilege.
- Bez automatického prístupu do produkcie.
- Bez secrets v promptoch a logoch.
- Reasoning sa zbytočne neloguje.
- Prompt injection testovaný.
- Zlomyseľné dokumenty testované.
- Limity ceny, času a toolov.
- Human approval pre deštruktívne akcie.
- Testy a review kódu.
Evaluácia
- Vlastný dataset úloh.
- Najmenej tri modely.
- Rovnaký harness.
- Viac behov.
- Celková cena úlohy.
- Čas ku správnemu výsledku.
- Code review a refactoring.
- Multimodalita.
- Long context.
- Halucinácie a citácie.

