Preskočiť na obsah
Nástroje & modely

Otvorené AI modely vs uzavreté: čo Kimi K3 mení

Kimi K3 zmenšil náskok uzavretých modelov na pár bodov. Pre firmu v EÚ to mení kalkuláciu ceny aj dátovej suverenity.

Juraj BudaiJuraj Budai4 min čítania
Otvorené AI modely vs uzavreté: čo Kimi K3 mení
Otvorené AI modely vs uzavreté: čo Kimi K3 mení

Krátka odpoveď na otázku z titulku: báť sa netreba, ale prehodnotiť výber áno. V debate o tom, ako sú na tom otvorené AI modely oproti uzavretým, sa čínsky open-weight model Kimi K3 od Moonshot AI dostal na dostrel uzavretej špičky. V niektorých úlohách ju prekonáva, v celkovom intelekte za ňou mierne zaostáva. Pre firmu v EÚ to mení kalkuláciu ceny aj kontroly nad dátami, nie však potrebu robiť rozhodnutia s chladnou hlavou.

Moonshot AI predstavila Kimi K3 16. júla 2026 ako vlajkový model s 2,8 bilióna parametrov a kontextovým oknom až 1 milión tokenov. Ide o najväčší open-weightModel, ktorého váhy sú verejne dostupné, takže ho možno spustiť vo vlastnej infraštruktúre. Nemusí byť plne open source v právnom zmysle, licencia môže obmedzovať použitie. model, aký je dnes verejne dostupný.

Ako blízko je Kimi K3 k uzavretej frontier špičke?

Blízko, ale nie na jej úrovni. Na nezávislom Artificial Analysis Intelligence Index v4.1 získala Kimi K3 zhruba 57 bodov a obsadila 3. až 4. miesto spomedzi približne 189 modelov. Fable 5 má 60 bodov, GPT-5.6 Sol 58,9. Rozdiel je pár bodov, nie priepasť.

Sama Moonshot AI priznáva, že v celkovom intelekte Kimi K3 stále zaostáva za Claude Fable 5 aj GPT-5.6 Sol. Zaujímavejší je detail z rebríčka: kde je Google od Gemini 3 Pro z minulého novembra? V novších otvorených benchmarkoch chýba porovnateľný nový frontier model, čo dobre ilustruje aj naša analýza meškania Gemini a lekcie pre firemné AI plány.

Artificial Analysis Intelligence Index v4.1skóre (body), vyššie je lepšie
60 Fable 5 58.9 GPT-5.6 Sol 57.1 Kimi K3 56 Opus 4.8

V čom Kimi K3 uzavreté modely prekonáva a v čom nie?

Rozdelenie je zreteľné. V priamom porovnaní 14 spoločných benchmarkov Fable 5 vyhral 8 testov a Kimi K3 šesť. Fable dominuje v najťažšom softvérovom inžinierstve a vizuálnych evaloch. Kimi K3 vyhráva tam, kde ide o dlhé kódovanie a agentné workflowÚlohy, kde model nielen odpovedá, ale samostatne vykonáva kroky, napríklad ovláda nástroje, prehliadač alebo terminál na dosiahnutie cieľa..

  • Fable 5 vyhráva: FrontierSWE, GDPval-AA, najťažšie reasoning úlohy a celkové UX.
  • Kimi K3 vyhráva: Terminal Bench 2.1, Program Bench (77,8 oproti 76,8 pri Fable), SWE Marathon, SpreadsheetBench 2, BrowseComp (91,2 bodu).
  • Frontend kód: na Arena.ai Frontend Code dosiahla Kimi K3 hodnotu 1679 a obsadila prvé miesto pred Fable 5.

Zhrnutie z viacerých analýz je triezve: Kimi K3 „nerozdrvila Fable 5 a Fable 5 tiež neušla poľu", výsledok je vyrovnaný 8:6. Kto stavia agentné a kódovacie pipeline, mal by to brať vážne. Kto potrebuje najťažší reasoning, uzavretá špička zatiaľ vedie.

Otvorené AI modely vs uzavreté: čo rozhoduje pri výbere pre firmu v EÚ?

Rozhodujú tri veci: cena za úlohu, možnosť hostovať model u seba a jurisdikcia vývojára. Podľa Artificial Analysis bol pri ich evaloch náklad na úlohu 0,94 USD pri Kimi K3 oproti 1,04 USD pri GPT-5.6 a 1,80 USD pri Opus 4.8. Ekonomika hovorí jasne v prospech open-weight.

Rozdiel v cene za token je ešte výraznejší: odhady hovoria o zhruba 40 % nižšej cene než Opus 4.8 a GPT-5.6 Sol a až o 70 % nižšej než Fable 5. Pri veľkých objemoch dopytov je to argument, ktorý sám osebe zaváži.

Kým sa však firma rozhodne medzi vlastnou infraštruktúrou a API poskytovateľa, oplatí sa mať k tomu poriadny podklad. Ak zvažujete práve túto voľbu na úrovni vedenia, náš workshop o investičnom rozhodnutí vyvinúť verzus kúpiť AI prechádza reálne náklady počas celého životného cyklu a končí rozhodovacou maticou pre konkrétny prípad. Nie je pre každého: má zmysel, keď stojíte pred zámerom za stovky tisíc eur, nie pri experimente s jedným chatbotom.

Znamená open-weight automaticky dátovú suverenitu?

Nie. Open-weight umožňuje hostovať model mimo infraštruktúry výrobcu, teda on-premise alebo v cloude v EÚ, s plnou kontrolou nad logmi a telemetriou. To je zásadné pre GDPR a pre firmy, ktoré chcú minimalizovať prenos citlivých dát do USA pod režim ako FISA či CLOUD Act. Suverenita sa tým však nekončí.

Váhy majú byť podľa blogu Vallettasoftware sprístupnené koncom júla. Licenčné texty pre Kimi K3 zatiaľ nie sú zverejnené v úplných detailoch a môžu obmedzovať komerčné nasadenie. K tomu pridajte geopolitiku: čínske firmy môžu byť vystavené tlaku domácich orgánov, podobne ako americké voči USA. Skeptický pohľad na tento rozmer sme rozobrali v článku o tom, čo o riziku čínskych modelov tvrdí CTO Palantiru.

Praktický záver: pri výbere modelu neriešte len benchmark a cenu, ale aj jurisdikciu vývojára, licenčné podmienky a to, či model naozaj beží vo vašej infraštruktúre. Ak si nie ste istí, či vaša plánovaná architektúra tieto riziká pokrýva, externý technický review AI architektúry so zameraním na náklady, škálovanie a compliance vie odhaliť medzery, ktoré interný tím prehliadne.

Čo by som dnes odporučil?

Pragmatický mix. Kimi K3 a ďalšie čínske open-weight modely v triede 1,6 až 2,8 bilióna parametrov, medzi nimi DeepSeek v4 Pro, ktorý Kimi K3 prekonáva, potvrdzujú, že scaling laws stále platia a náskok uzavretej špičky sa scvrkol na pár bodov.

  • Agentné a kódovacie workflow pri veľkom objeme: Kimi K3 dáva zmysel, výkon aj cena hovoria zaň.
  • Najťažší reasoning a profesionálny knowledge work: Fable 5 alebo GPT-5.6 Sol zatiaľ vedú.
  • Citlivé dáta a GDPR: self-hosting open-weight modelu je silný argument, ak si preveríte licenciu a jurisdikciu.

Náskok sa zmenšil, nezmizol. Kto dnes stavia produkčný systém, mal by rátať s tým, že o pár mesiacov bude open-weight ešte bližšie. Viac k ekonomike tohto posunu nájdete v našom rozbore, ako Kimi K3 mení rovnicu ceny.

Časté otázky

Čo znamená open-weight a v čom sa líši od plne otvoreného modelu?

Open-weight znamená, že sú verejne dostupné natrénované váhy modelu, takže si ho firma môže stiahnuť a spustiť na vlastnej infraštruktúre. Nie je to však plný open source: tréningové dáta ani presný postup tréningu Moonshot AI nezverejnila. Získate teda kontrolu nad nasadením a dátami, no nie kompletnú transparentnosť pôvodu.

Oplatí sa firme v EÚ prejsť z uzavretého modelu na Kimi K3?

Závisí od úloh. Ak riešite dlhé kódovanie, agentné workflow alebo prácu s tabuľkami, Kimi K3 v týchto benchmarkoch predbehla Fable 5 a zároveň dáva kontrolu nad dátami. Pri najťažšom softvérovom inžinierstve a náročnom reasoningu zatiaľ vedie uzavretá špička. Prehodnotenie výberu dáva zmysel, unáhlený prechod nie.

Aké riziká má nasadenie čínskeho open-weight modelu?

Hlavné otázky sú pôvod tréningových dát, ktoré Moonshot AI nezverejnila, a súlad s európskymi pravidlami ochrany údajov. Výhodou open-weight prístupu je, že model beží na vašej infraštruktúre, takže dáta nemusia opúšťať EÚ. Netreba paniku, ale dôkladné preverenie architektúry a compliance pred produkčným nasadením.

Ako veľmi zaostáva Kimi K3 v celkovom intelekte za špičkou?

O pár bodov, nie o priepasť. Na Artificial Analysis Intelligence Index v4.1 získala Kimi K3 zhruba 57 bodov, GPT-5.6 Sol 58,9 a Claude Fable 5 60. Obsadila 3. až 4. miesto spomedzi približne 189 modelov. Samotná Moonshot AI priznáva, že v celkovom intelekte za Fable 5 aj GPT-5.6 Sol stále zaostáva.

Načo je dobré kontextové okno 1 milión tokenov?

Umožňuje modelu spracovať naraz veľmi rozsiahly vstup: rozsiahle kódové bázy, dlhé dokumenty alebo viackrokové agentné úlohy bez straty súvislostí. Práve v dlhom kódovaní a agentných workflow Kimi K3 v benchmarkoch ako Terminal Bench 2.1 a SWE Marathon vyhráva. Pre firmy pracujúce s veľkými objemami textu je to praktická výhoda.

Kde je Google Gemini v tomto porovnaní?

V novších otvorených benchmarkoch chýba porovnateľný nový frontier model od Googlu. Posledným referenčným bodom je Gemini 3 Pro z minulého novembra. Táto medzera dobre ilustruje meškanie Googlu v pretekoch a jeho dopad na firemné AI plány, ktorému sme sa venovali v samostatnej analýze.

0 komentárov
Zdieľať

Diskusia

Komentáre sú pred zverejnením moderované.

Zatiaľ tu nie sú žiadne komentáre. Buďte prvý.