← zpět na blog

Newsletter #1: Bitva o otevřené modely

Otevřené AI modely jsou v centru dění: čínské modely útočí na špičku benchmarků a ve Washingtonu se mluví o jejich zákazu.

Vítejte u prvního newsletteru Lokální.AI o otevřených AI modelech!

Možná jste to při letních dovolených nezaznamenali, ale otevřené modely jsou teď centrem pozornosti celého AI světa. Oheň přiživuje to, že velké čínské laby neustávají v publikování modelů, které atakují výkony komerčních modelů z doby před pár měsíci. V USA se proto začlo diskutovat o možném banu otevřených modelů. Proti tomu se ale s nečekanou silou ohradila řada velkých hráčů, včetně většiny velkých AI firem. Celé to doplňuje lehce surreálný incident mezi OpenAI a Hugging Face.

Kromě dění ve světě se v tomto newsletteru dostaneme i k pár lokálním novinkám a představíme si první čtyřku blogpostů na webu Lokální.AI.

Velké čínské otevřené modely jsou na koni.

Čínské laby neustávají ve vydávání modelů, které ohromují AI svět. Právě vydaný Kimi K3 od Moonshot AI překonává předchozí modely jak v počtu parametrů, tak v pozicích na benchmarcích. Jde o mixture-of-experts architekturu s 896 experty, dohromady celkem s 2,8 biliony parametrů (ano, tentokrát je to opravdu česky “bilionů”, ne “miliard”), z nichž je vždy 104 miliard současně aktivních. Na Artificial Analysis Intelligence Indexu se tento model umístil mezi GPT-5.6 Sol a Claude Opus 4.8:

Kimi K3 není z frontier modelů zdaleka jediný. Na zajímavých pozicích v tomto benchmarku sedí i měsíc starý GLM-5.2 a Qwen 3.7 Max. Druhý z této dvojice sice veřejně dostupný není, ale jeho výrobce Alibaba už slíbil, že jeho nástupce Qwen 3.8 Max s 2,4 biliony parametrů (tedy velikostí jen lehce za Kimi K3) brzo dostupný bude.

V současnosti se objevuje zároveň i řada silných modelů “střední třídy”; frontier modely jsou ale tím, co reálně ohrožuje pozici komerčních modelů. Ty největší modely si doma nejspíš nespustíte, ale například Kimi K3 si můžete alespoň osahat přes API: na OpenRouteru ho servíruje sedm poskytovatelů za tři dolary za milion vstupních tokenů.

…a ve Washingtonu zbystřili.

Vzpomínáte, jak byl na začátku června Claude Fable 5 ihned po vydání zablokovaný pro většinu světa americkou vládou, oficiálně kvůli tomu, že představoval bezpečnostní hrozbu? Tak nyní jsme na konci července a výše zmíněný Kimi K3 se v benchmarcích (například v tomto agentním indexu) umisťuje právě po boku Claude Fable 5.

To nemohla americká vláda nechat jen tak bez povšimnutí. Ve Washingtonu se proto začlo diskutovat o kompletním banu otevřených modelů.

Silná protireakce od řady silných hráčů na sebe nenechala dlouho čekat. Ale ještě než se k těmto reakcím dostaneme, lehké intermezzo.

Incident mezi OpenAI a Hugging Face

Rychlá rekapitulace příběhu, který hýbe AI světem, pro případ, že jste o něm ještě neslyšeli z dalších zdrojů.

16. července zveřejnila společnost Hugging Face – tedy hlavní poskytovatel otevřených AI modelů – zprávu o bezpečnostním incidentu v jejich produkční infrastruktuře. Zjistili, že nějaký AI agent provedl řadu podezřelých akcí, a varovali zákazníky před případným zneužitím dat.

K velkému překvapení se k útoku o pět dní později přiznali – chvíle napětí – v OpenAI. Nešlo ale o záměrný kyberútok, byl to spíš vedlejší efekt. V OpenAI vyhodnocovali svůj nový, předprodukční model na agentním benchmarku zaměřeném na hledání zranitelností. Jejich agent dospěl k tomu, že nejjednodušší způsob, jak získat co nejlepší skóre, je cheatovat – konkrétně jít na internet a najít správné odpovědi.

Podobné nepěkné chování agentních modelů zdokumentovali už před rokem například Scale AI nebo NIST. Nové je ale to, že tento model běžel v sandboxu a tedy na rozdíl od předchozích modelů neměl mít přístup k internetu.

Co se tedy stalo? Zní to jako sci-fi hraničící se satirou, ale právě vydaná analýza útoku od Hugging Face to popisuje tak podrobně, že o pravdivosti není pochyb. Agent – nejspíš “nažhavený” z kyberbezpečnostního benchmarku – odhalil zero-day zranitelnost v sandboxu, ve kterém běžel. Tuto zranitelnost se mu podařilo zneužít k získání přístupu k internetu.

Jakmile byl ze sandboxu venku, začal se připojovat na Hugging Face servery a hledal způsob, jak se získal odpovědi k neveřejné testovací sadě. Po několika dnech hackerské činnosti (doporučuji pročíst zmíněnou analýzu, ve které jsou i technické detaily) se mu to nakonec povedlo.

A jak to dopadlo? No, tento AI model utržený ze řetězu si nezačal podmaňovat svět – aspoň zatím. Agent se jednoduše vrátil do svého sandboxu a odevzdal správné odpovědi.

Zdroj: https://devme.me/meme/when-the-benchmark-agent-steals-its-own-answer-key
Zdroj: https://devme.me/meme/when-the-benchmark-agent-steals-its-own-answer-key

Podstatnou roli v tomto příběhu hrají otevřené modely. Když totiž v Hugging Face útok odhalili a pokusili se ho zanalyzovat pomocí AI modelů, tak narazili. Komerční modely byly k tomuto účelu nepoužitelné. Jakmile detekovaly, že mají řešit něco s kyberbezpečnostním útokem (ačkoliv šlo v tomto případě o obranu / analýzu), jednoduše odmítly odpovídat:

V Hugging Face se proto následně rozhodli využít výše zmíněný velký otevřený model GLM-5.2, který spustili na vlastní infrastruktuře. Ten model už jim pomohl útok zanalyzovat.

Otevřený dopis od Microsoftu

Na pozadí všech těchto událostí vyšel 24. července pod hlavičkou Microsoftu otevřený dopis Open Weights and American AI Leadership:

Dopis jasně vystupuje jasně proti omezování otevřených modelů, které by pod rouškou “bezpečnosti” naopak bezpečnost poškozovalo, protože by svazovalo ruce obráncům:

Spoléhat se výhradně na uzavřené modely samo o sobě neznamená větší bezpečnost. I ty mohou být prolomeny, zneužity nebo selhat způsobem, který lidé zvenčí nemají šanci odhalit. Navíc soustředění pokročilých schopností umělé inteligence do malého počtu uzavřených modelů tato rizika ještě zvyšuje. Vzniká jen několik málo kritických bodů selhání, oslabuje se konkurence a klíčová technologie se dostává do rukou několika málo poskytovatelů. Naproti tomu modely s otevřenými vahami umožňují široké komunitě výzkumníků a vývojářů zkoumat jejich chování, odhalovat zranitelnosti, vytvářet ochranná opatření a postupně je dále zlepšovat. [přeloženo z angličtiny]

Dále pak dopis uvádí několik dalších důvodů, proč jsou otevřené modely důležité, z nichž řadu z nich jsme si už popsali zde v úvodním blogpostu.

Z úvodních 25 signatářů tohoto dopisu je jich nyní už přes 200. Zahrnují řadu velkých hráčů (NVIDIA, AMD, Amazon, Meta, …), včetně, trochu překvapivě, i dvou velkých komerčních AI poskytovatelů: OpenAI a Googlu. Chybí třetí z nich – Anthropic. Jeho CEO Dario Amodei zveřejnil své stanovisko zde.

Vzniká aliance pro otevřenou AI

Tři dny po zveřejnění dopisu (27. července) spustila NVIDIA “alianci pro otevřenou a bezpečnou AI” (Open Secure AI Alliance). Aliance má 52 zakládajících členů:

Přestože je zde značný překryv se signatáři dopisu od Microsoftu, pár zásadních jmen zde chybí. Kromě OpenAI a Googlu zde není přítomná ani Meta, ještě donedávna tahoun v oblasti otevřených AI modelů. (Ale i zde se ještě může rozložení sil změnit.)

Deklarovaným cílem aliance je vyvíjet a sdílet otevřené modely, agentní frameworky a bezpečnostní nástroje, které je možné zkoumat, upravovat a spouštět na vlastní infrastruktuře. Tisková zpráva cituje několik konkrétních příkladů, jak členové aliance k tomuto cíli přispívají: například Hugging Face přispívá formátem Safetensors pro bezpečné ukládání vah, NVIDIA dodává otevřené modely a data a Microsoft dodává nástroj na orchestraci agentů.

Zatím jde ale především o tiskovou zprávu – uvidíme, co přinese budoucnost.

Projekt české AI Gigafactory získal vládní podporu

Na závěr ještě jedna novinka z domova. Naše vláda schválila 22. června podporu projektu AI Gigafactory CZ, kterým se Česko uchází o jednu z evropských AI gigatováren. V první fázi jde o závazek 2,5 miliardy z české strany, který EU zrcadlí stejnou částkou, celková investice by měla vycházet až na desítky miliard korun. Stavět se má na Zbraslavi, kde už ČRA budují největší tuzemské datacentrum.

Jak se píše v původní zprávě o projektu:

Pokud uspějeme, vystřelí nás projekt na špičku mezinárodní AI scény a získáme tím strategickou AI infrastrukturu, na které jsme schopni trénovat ty nejvýkonnější AI modely a provozovat je u nás v České republice,“ říká vládní zmocněnec pro AI a náměstek ministra Jan Kavalírek.

Minulý měsíc navíc ČRA podepsaly memorandum se španělskou Multiverse Computing, která do projektu může dodat softwarovou vrstvu a vložit další až 1,2 miliardy korun.

Zatím je všechno na papíře, ale dostatečná výpočetní kapacita je pro provoz otevřených modelů lokálně zásadní, takže držme palce!

Podcast: Lukáš Kačena o AI v českém kontextu

Jako bonus si můžete poslechnout podcast od FocusOn, ve kterém vládní zmocněnec pro AI Lukáš Kačena hovoří o AI v českém kontextu.

Zdůrazňuje, že ohledně AI je potřeba začít méně mluvit a víc konat, a varuje před přílišnou závislostí na externích dodavatelích AI modelů.

Blog Lokální.AI jede!

Na webu Lokální.AI najdete prvních pár blogpostů:

Na základě posledního článku se na webu také nově objevila kalkulačka, kde si můžete spočítat, který jazykový model z Hugging Face se vám vejde do VRAM:

VRAM kalkulačka

Tento newsletter byl odeslaný e-mailem přihlášeným odběratelům. Novinky i blogposty se také průběžně objevují i na našem Discordu.