AI

Novinky ze světa AI: Kimi K3 přibližuje open-source modely světové špičce

17. srpna 2026

Srpnové novinky ze světa AI ukazují, že otevřené modely dál zrychlují tempo vývoje a v některých úlohách se přibližují nejvýkonnějším uzavřeným systémům. Kimi K3, DeepSeek V4 Flash 0731 a Laguna-S-2.1 cílí především na programování, práci s nástroji a řešení komplexnějších úloh. Zajímavou novinkou je také Colibri, které usnadňuje provoz rozsáhlých modelů na dostupnějším hardwaru. Pokud chcete AI modely provozovat ve vlastní infrastruktuře a mít větší kontrolu nad daty, můžete využít AI GPU server.

Kimi K3 – Moonshot AI

Kimi K3 patří mezi největší otevřené AI modely současnosti a svou velikostí se blíží 3 bilionům parametrů. Využívá architekturu Mixture of Experts (MoE), takže při zpracování požadavku aktivuje jen část parametrů potřebnou pro konkrétní úlohu. Díky tomu dokáže efektivněji pracovat i přes svou mimořádnou velikost. Podporuje také práci s obrazovými vstupy a kontextové okno o velikosti až 1 milion tokenů.

Jeho silnou stránkou je především programování a řešení komplexních úloh, při kterých model postupuje samostatně v několika krocích. Uplatnění nachází například při práci s GPU jádry, CAD návrhy nebo při návrhu čipů.

Výkonem se tak v některých oblastech přibližuje předním uzavřeným modelům. Moonshot AI zároveň zveřejnila váhy modelu i technickou dokumentaci, což umožňuje jeho nasazení a další úpravy ve vlastní infrastruktuře.

Zdroje: Kimi K3 na Hugging Facevideo Kimi K3 is the best open source model evervideo Kimi K3 Just Broke The Economics Of AI.

DeepSeek V4 Flash 0731 – DeepSeek

DeepSeek V4 Flash 0731 navazuje na předchozí model DeepSeek V4 Flash a přináší především optimalizace zaměřené na vyšší výkon a efektivnější provoz. V úlohách spojených s AI agenty dosahuje výsledků srovnatelných s GLM-5.2 a v některých testech jej dokáže překonat. Zároveň je přibližně dvakrát menší, takže má nižší nároky na výpočetní prostředky.

Součástí modelu je také technologie spekulativního dekódování, která pomáhá urychlit generování odpovědí bez výrazného dopadu na jejich kvalitu. Díky licenci MIT lze model využít i v komerčních projektech. DeepSeek V4 Flash 0731 tak představuje zajímavou volbu pro případy, kde je důležitý nejen výkon, ale také rychlost inference a náklady na provoz.

Zdroje: DeepSeek V4 Flash 0731 na Hugging Facevideo DeepSeek V4 Flash GA.

Laguna-S-2.1 – Poolside

Laguna-S-2.1 je model zaměřený především na programování a práci AI agentů se zdrojovým kódem. Celkem obsahuje 118 miliard parametrů, při zpracování úloh však aktivuje pouze přibližně 8 miliard. Podporuje také kontextové okno o velikosti až 1 milion tokenů, takže dokáže pracovat i s rozsáhlými repozitáři a větším množstvím souvisejícího kódu. Kvantizovanou variantu AWQ4 lze provozovat na jediné kartě NVIDIA RTX PRO 6000.

V programovacích benchmarcích dokáže Laguna-S-2.1 konkurovat i podstatně větším modelům. Zajímavá je proto například jako lokálně provozovaný programovací agent, který může analyzovat a upravovat kód přímo ve vlastní infrastruktuře, aniž by bylo nutné zdrojové kódy odesílat externím AI službám. Model je dostupný v několika kvantizovaných variantách a pod licencí OpenMDW-1.1.

Zdroje: Laguna-S-2.1 na Hugging Facevideo Laguna S 2.1.

Qwen 3.8 Max – Alibaba

Qwen 3.8 Max je dosud největším modelem řady Qwen a obsahuje 2,4 bilionu parametrů. Alibaba u této nejvyšší varianty poprvé zpřístupňuje také váhy modelu. Výkonem se řadí mezi nejschopnější otevřené modely současnosti a silné výsledky vykazuje zejména v programování, práci s obrazovými vstupy a řešení dlouhodobějších komplexních úloh.

Schopnost pracovat samostatně po delší dobu Alibaba demonstrovala také na programovacím projektu, na kterém Qwen 3.8 Max pracoval více než deset dní. Model si průběžně plánoval další kroky a navazoval na již dokončenou práci bez nutnosti neustálých zásahů člověka. Právě delší autonomní úlohy ukazují, jak rychle se schopnosti otevřených modelů přibližují nejvýkonnějším uzavřeným systémům.

Zdroje: Qwen 3.8 Max na blogu Qwenvideo Qwen 3.8 Max IS OUT!.

Colibri – JustVugg

Colibri je jednoduchý nástroj napsaný v jazyce C, který umožňuje lokálně spouštět velké AI modely bez závislosti na dalších knihovnách. Jeho hlavní výhodou je práce s diskem, operační pamětí a VRAM, mezi které dokáže rozdělit potřebná data. Jednotlivé části modelu načítá postupně, a umožňuje tak provozovat i modely, které by se celé do dostupné paměti nevešly. Podporuje například GLM-5.2, Kimi K3 nebo DeepSeek V4 Flash.

Tento přístup má ale svou cenu v podobě nižší rychlosti inference, a proto Colibri není ideální pro výkonný produkční provoz. Využití najde především při lokálním testování a experimentování s velmi velkými modely na omezeném hardwaru. Při načítání přitom nemění přesnost ani samotnou architekturu modelu, takže lze pracovat s původní zvolenou variantou bez dodatečných úprav.

Zdroje: Colibri na GitHubuvideo This Tiny Engine Runs Impossibly Big AI Models Locally!.

Bonsai 27B – Prism ML

Bonsai 27B vychází z modelu Qwen3.6 27B a zaměřuje se především na úspornější lokální provoz. Díky výrazné kompresi má podstatně nižší nároky na paměť – ternární varianta zabírá přibližně 5,9 GB, zatímco 1bitová verze pouze 3,9 GB. Model tak lze provozovat i na hardwaru s 8 GB VRAM, případně na některých výkonnějších mobilních zařízeních.

Vyšší míra komprese se částečně promítá do schopností modelu. Podle zveřejněných výsledků si ternární varianta zachovává přibližně 95 % výkonu původního modelu, zatímco 1bitová verze dosahuje zhruba 90 %.

I přes výrazně menší paměťové nároky si Bonsai 27B dobře vede v programování, matematických úlohách a práci s nástroji. Uplatnění tak může najít především tam, kde je prioritou lokální provoz, nízká spotřeba paměti a menší hardwarové nároky.

Zdroje: oznámení Bonsai 27B1bitový Bonsai 27B na Hugging Faceternární Bonsai 27B na Hugging Face.

MiniMax H3 – MiniMax

MiniMax H3 je otevřený model zaměřený na generování videa, který dokáže kombinovat textové pokyny, obrázky, video i zvuk. Vytváří až patnáctisekundová videa v rozlišení 2K se stereofonním zvukem a podporuje také práci s textem a logy přímo ve scéně. Mezi jeho schopnosti patří i přenos pohybu z jednoho videa na jiné.

Model může najít využití například při tvorbě reklamního obsahu, produktových prezentací, materiálů pro e-commerce nebo návrhů uživatelského rozhraní. Plná varianta FP16 vyžaduje přibližně 64 GB VRAM, a lze ji proto provozovat například na NVIDIA RTX PRO 6000.

Úspornější varianty FP8 a FP4 s nižšími paměťovými nároky lze spustit také na NVIDIA GeForce RTX 509032 GB VRAM. Možnost vlastního nasazení zároveň přináší větší kontrolu nad zpracováním dat i samotným procesem generování.

Zdroje: MiniMax H3 na blogu MiniMaxMiniMax H3 na Hugging Facevideo New BEST AI video generator is here!.

Srpnové novinky ukazují, že otevřené AI modely se stávají stále vážnější konkurencí uzavřených řešení. Výrazně se zlepšují v programování, práci s AI agenty i generování multimediálního obsahu a současně umožňují provozovat AI pod větší kontrolou nad daty i infrastrukturou.

Pokud chcete modely provozovat ve vlastním prostředí, můžete využít AI GPU server. Pro rychlejší nasazení bez starostí se správou infrastruktury je k dispozici také pronájem LLM s API.

Mohlo by vás také zajímat

Nejnovější

Napsat komentář

Vaše e-mailová adresa nebude zveřejněna. Vyžadované informace jsou označeny *