Kimi K3 je první otevřený model, který se velikostí blíží 3 bilionům parametrů. Díky architektuře MoE při každém úkolu zapojuje pouze potřebné části, a proto pracuje efektivněji. Model rozumí také obrázkům a zvládne kontext o velikosti až 1 milion tokenů.
Kimi K3 vyniká hlavně v programování a při samostatném řešení složitých úkolů. Dokáže pracovat s GPU jádry, CAD návrhy nebo návrhem čipů. Svými schopnostmi se přibližuje nejlepším uzavřeným modelům. Společnost Moonshot AI navíc zveřejnila váhy modelu i podrobnou technickou zprávu, takže jej můžete spustit a upravovat na vlastní infrastruktuře.
Kimi K3 is the best open source model ever Video představuje hlavní schopnosti modelu Kimi K3 a vysvětluje, proč jde o důležitý krok pro otevřené modely. Zdroj: https://www.youtube.com/watch?v=Q4LoxsIwriA
Kimi K3 Just Broke The Economics Of AI Video porovnává výkon modelu Kimi K3 s náklady na jeho provoz. Zdroj: https://www.youtube.com/watch?v=Xj-QdEUxJkE
Zdroje: Kimi K3 na Hugging Face, video Kimi K3 is the best open source model ever, video Kimi K3 Just Broke The Economics Of AI.
DeepSeek V4 Flash 0731 není nový model vytvořený od nuly. Jde o vylepšenou verzi staršího modelu DeepSeek V4 Flash. Při práci s AI agenty nabízí podobné výsledky jako GLM-5.2 a v některých úkolech je dokonce o něco lepší. Přitom je přibližně dvakrát menší a má nižší nároky na výpočetní výkon.
Model obsahuje také modul pro spekulativní dekódování. Ten zrychluje tvorbu odpovědi, aniž by měnil její kvalitu. Díky licenci MIT můžete model použít také v komerčních projektech. DeepSeek V4 Flash 0731 tak nabízí dobrý poměr mezi výkonem, rychlostí a náklady.
DeepSeek V4 Flash GA IS INCREDIBLE! Powerful, Cheap, & Fast! Video testuje rychlost, cenu a praktické schopnosti modelu DeepSeek V4 Flash. Zdroj: https://www.youtube.com/watch?v=wT42SgaOPK4
Zdroje: DeepSeek V4 Flash 0731 na Hugging Face, video DeepSeek V4 Flash GA.
Laguna-S-2.1 má celkem 118 miliard parametrů, ale při práci používá pouze 8 miliard. Model je určený hlavně pro programovací agenty a zvládne kontext o velikosti 1 milion tokenů. Ve variantě AWQ4 jej spustíte na jediné kartě NVIDIA RTX PRO 6000.
Laguna-S-2.1 v programovacích testech překonává i některé výrazně větší modely. Můžete ji proto použít jako lokálního agenta pro práci s rozsáhlým repozitářem. Zdrojové kódy přitom nemusíte odesílat žádné externí službě. K dispozici je několik kvantizovaných variant a otevřená licence OpenMDW-1.1.
Laguna S 2.1 The BEST LOCAL Model? Video ukazuje, jak si Laguna-S-2.1 vede při použití jako lokální programovací agent. Zdroj: https://www.youtube.com/watch?v=ERCdFgTXNY4
Zdroje: Laguna-S-2.1 na Hugging Face, video Laguna S 2.1.
Qwen 3.8 Max má 2,4 bilionu parametrů. Alibaba u něj poprvé zveřejní váhy nejvyššího modelu řady Qwen. Svými schopnostmi je o něco slabší než Kimi K3, stále však patří mezi nejsilnější otevřené modely. Dobře si vede při programování, práci s obrazem i plnění dlouhých úkolů.
V jedné ukázce pracoval Qwen 3.8 Max na programovacím projektu déle než deset dní bez pomoci člověka. Model průběžně plánoval další kroky a navazoval na předchozí práci. Právě v těchto úkolech se otevřené modely rychle přibližují uzavřeným modelům.
Qwen 3.8 Max IS OUT! Video představuje schopnosti modelu Qwen 3.8 Max a porovnává jej s dalšími velkými otevřenými modely. Zdroj: https://www.youtube.com/watch?v=vmLwsoVRo30
Zdroje: Qwen 3.8 Max na blogu Qwen, video Qwen 3.8 Max IS OUT!.
Otestujte výkon NVIDIA RTX PRO 6000 Blackwell pro vLLM, firemní AI API i více uživatelů současně.
Bez investice do vlastního hardwaru si ověříte, kolik výkonu skutečně dostanete z jednoho GPU.
Colibri je malý nástroj pro spouštění AI modelů, který je napsaný v jazyce C a funguje zcela samostatně bez jakýchkoliv dalších knihoven. Při práci využívá disk, operační paměť i VRAM jako jeden celek. Potřebné části modelu načítá postupně, takže dokáže spustit také velmi velké modely, které by se jinak do paměti nevešly. Podporuje například GLM-5.2, Kimi K3 a DeepSeek V4 Flash.
Nevýhodou je nižší rychlost. Colibri proto není určený pro náročný produkční provoz, ale hodí se pro lokální testování velkých modelů. Nástroj během načítání nemění přesnost modelu ani způsob, jakým vybírá jeho jednotlivé části. Výsledek tak odpovídá variantě, kterou jste si zvolili.
This Tiny Engine Runs Impossibly Big AI Models Locally! Video ukazuje, jak lze pomocí nástroje Colibri spustit velmi velké modely na lokálním hardwaru. Zdroj: https://www.youtube.com/watch?v=3OqZHYNKc9A
Zdroje: Colibri na GitHubu, video This Tiny Engine Runs Impossibly Big AI Models Locally!.
Bonsai 27B vychází z modelu Qwen3.6 27B a má výrazně nižší nároky na paměť. Ternary varianta zabírá přibližně 5,9 GB a 1bitová varianta pouze 3,9 GB. Model proto spustíte i na zařízení s 8 GB VRAM, včetně některých výkonnějších telefonů.
Zmenšení modelu má samozřejmě vliv na jeho schopnosti. Ternární verze si však zachovává přibližně 95 % původní kvality a 1bitová verze kolem 90 %. Model si stále dobře poradí s programováním, matematikou i voláním nástrojů. Bonsai 27B se proto hodí tam, kde je důležitější nízká spotřeba paměti a lokální provoz než maximální výkon.
Zdroje: oznámení Bonsai 27B, 1bitový Bonsai 27B na Hugging Face, ternární Bonsai 27B na Hugging Face.
MiniMax H3 je otevřený model pro tvorbu videa, který pracuje s textem, obrázky, videem i zvukem. Dokáže vytvořit až patnáctisekundové video v rozlišení 2K se stereofonním zvukem. Dobře se drží zadaných pokynů, zvládá text i loga ve videu a umí přenést pohyb z jednoho videa do druhého.
MiniMax H3 se hodí hlavně pro reklamu, e-commerce, produktové prezentace a návrhy uživatelského rozhraní. V plné kvalitě FP16 potřebuje přibližně 64 GB VRAM, takže jej spustíte například na NVIDIA RTX PRO 6000. Menší varianty FP8 a FP4 mohou běžet také na NVIDIA GeForce RTX 5090 s 32 GB VRAM. Otevřená architektura vám navíc dává větší kontrolu nad tvorbou i zpracováním dat.
New BEST AI video generator is here! Video ukazuje kvalitu vytvořených videí, práci se zvukem a další možnosti modelu MiniMax H3. Zdroj: https://www.youtube.com/watch?v=Vpvne2istKg
Zdroje: MiniMax H3 na blogu MiniMax, MiniMax H3 na Hugging Face, video New BEST AI video generator is here!.
Srpnové novinky potvrzují, že otevřené modely už nejsou jen levnější náhradou uzavřených služeb. V programování, práci s AI agenty i tvorbě videa se stále více přibližují nejlepším dostupným modelům. Zároveň vám dávají větší kontrolu nad daty a celým provozem. Pro vlastní nasazení objednejte AI GPU server. Pokud chcete začít rychle a bez správy infrastruktury, využijte Pronájem LLM s API.