Tag
#Open source
Z Novinek
Novinky · 2026-10-07
Open d1 rozhoduje na edge za 16 ms, ale multimodální důkaz zatím chybí
Liquid AI otevřela modely d1-3B a experimentální d1-omni-600M pro strukturované rozhodování bez generování tokenů. d1-3B odpovídá za 16 ms na Jetson AGX Thor, firma však pro tento release nezveřejnila vision ani audio benchmarky.
Číst →Novinky · 2026-10-03
ThinkingBox měří agenty podle databáze, ne podle sebevědomé odpovědi
Microsoft a Hugging Face zpřístupnily ThinkingBox, benchmark 507 stavových firemních úloh, který každou úlohu opakuje 20krát a kontroluje skutečný výsledek v backendu. Ukazuje, proč úspěšný tool call ani uhlazená odpověď ještě neznamenají hotovou práci.
Číst →Novinky · 2026-10-02
Airbnb píše 60 % kódu s AI, skutečná změna je v předávání práce
CTO Airbnb Ahmad Al-Dahle říká, že AI vytváří 60 % firemního kódu a průměrný počet pull requestů na vývojáře vzrostl 1,6krát. Podstatnější než samotné číslo je přechod od dokumentů a předávek k prototypům, kontextové vrstvě Everest a evals pro každý use case.
Číst →Novinky · 2026-10-02
AstaBrief píše citované rešerše za 51 sekund a vejde se do 8 miliard parametrů
Ai2 otevřela váhy modelu AstaBrief 8B, který v režimu Fast generuje citované vědecké rešerše průměrně za 51,1 sekundy proti 178,5 sekundy u režimu Thinking. Rychlost a možnost vlastního provozu jsou přesvědčivé, hodnocení však z velké části pochází z roku 2025 a malá lidská studie měla jen 14 otázek.
Číst →Novinky · 2026-09-28
Holo4 spojuje obrazovku, kód a API, ale benchmarky běží na různých tratích
H Company vydala modely Holo4 27B a 35B-A3B, které v jednom agentovi kombinují ovládání GUI, spouštění kódu a volání MCP či API. Otevřené váhy a zveřejněné trajektorie zvyšují ověřitelnost, zatímco výsledky z různých harnessů a sad úloh stále komplikují přímé srovnání s uzavřenými modely.
Číst →Novinky · 2026-07-12
Bílý dům testuje půdu pro zákaz silných open source modelů
Vláda USA zvažuje, jak přibrzdit nástup otevřených AI modelů dřív, než doženou uzavřenou špičku. Zatím se mluví o bezpečnostních rizicích z Číny, ale reálně to dopadne na všechny.
Číst →Novinky · 2026-09-24
DSpark zrychluje obrazový model až 3,13krát, první token ale neurychlí
Liquid AI přidal k modelu LFM2.5-VL-3B experimentální 279,5milionový drafter pro speculative decoding. Dekódování zrychlilo až 3,13krát a celý běh až 2,62krát, protože zpracování obrazu a prefill zůstávají beze změny.
Číst →Novinky · 2026-07-16
DharmaOCR ukazuje, že úzký model pořád vyhrává na vlastních dokumentech
Dharma-AI tvrdí, že jeho OCR pro brazilskou portugalštinu porazilo novější modely Mistral OCR4 a Unlimited-OCR. V úzké doméně pořád rozhodují specifická data, ne hrubá výpočetní síla.
Číst →Novinky · 2026-09-21
Dlouhé čtení bez závěru: Modely, kongres a váhy sil
Původní text je rozsáhlé vyjádření pro americký Kongres o rovnováze mezi uzavřenými a otevřenými modely.
Číst →Novinky · 2026-09-19
Proč i s tisíci agenty nenastane okamžitá exploze inteligence
Frontier laboratoře brzy nasadí tisíce souběžných agentů, což vyvolalo obavy z rychlého sebezlepšování (RSI). Podle Nathana Lamberta to sice zlevní inferenci, ale skutečný skok v inteligenci nenastane hned.
Číst →Novinky · 2026-09-15
Agenti umí hrát demo na jedničku. Proč jim ale v produkci padá spolehlivost?
Když AI agenta pustíte desetkrát na stejný produkční úkol, může si vybrat jinou cestu k řešení a pokaždé narazit na jiné problémy. Nový výzkum IBM a Hugging Face upozorňuje, že tradiční benchmarky na tuhle nekonzistenci zapomínají.
Číst →Novinky · 2026-09-11
Otevrene modely ztraci odstup, Zapad ale nespoleha na vlastni inovace
Propast ve vykonu mezi uzavrenymi a otevrenymi modely se smrskla na nekolik mesicu, pricemz hlavnim tahounem jsou asijske laboratore vyuzivajici destilaci dat. Zatimco regulatori zkoumaji restrikce, korporace jiz realne nahrazuji drazsi domaci modely asijskymi open-weights alternativami z duvodu nakladu.
Číst →Novinky · 2026-09-09
IBM vydalo open-source model pro časové řady, který předbíhá giganty
IBM vydalo PatchTST-FM-r2, nový foundation model pro časové řady s 385 miliony parametrů. Model drží nejvyšší příčku v zero-shot forecastingu mezi otevřeně licencovanými konkurenty na benchmarku GIFT-Eval.
Číst →Novinky · 2026-08-09
Lekce z úniků: Jak AI bezpečnost přešla od zarovnání modelu ke kontejnerům
Debata o AI bezpečnosti prošla tichým pivotem. Po sérii úniků agentů z testovacích prostředí už laboratoře neřeší jen vnitřní nastavení modelu, ale bezpečnostní architekturu infrastruktury, ve které model běží.
Číst →Novinky · 2026-09-08
Open source komunita se rozšiřuje: Motif-3, GLM-5.3 a mizející komerční bariéry
Nejnovější přehled open modelů od Interconnects ukazuje důležitý trend: špičkové modely jako Motif-3 a GLM-5.3-Flash vycházejí pod permissivní MIT licencí. Vznikají tak reálné alternativy k Llama sérii bez složitých komerčních omezení.
Číst →Novinky · 2026-09-08
Plošné blokování jako alibi: Hugging Face analyzuje selhání AI pojistek
Nedávný bezpečnostní incident na Hugging Face rozvířil debatu o tom, jak tvůrci modelů řeší rizika. Místo chirurgicky přesného filtrování aplikují platformy tupý plošný zákaz určitých témat. Bezpečnost tak často funguje jako ochrana provozovatele, ne uživatele.
Číst →Novinky · 2026-08-10
Meta vydala lokální Muse Glimmer s čistou licencí pro agentní práci
Meta se vrací k otevřeným vahám. Její nový 30miliardový vizuální model Muse Glimmer dostal Apache 2.0 licenci a od začátku cílí na běh lokálních agentů.
Číst →Novinky · 2026-09-03
RL přesouvá vnímání krásy z člověka na model
Otevřený experiment ukazuje, že RL (Reinforcement Learning) se dá použít nejen na řešení matematiky a kódu, ale i na trénování estetického cítění. Model sám píše JavaScript, který simuluje malbu akvarelem.
Číst →Novinky · 2026-08-17
Nvidia nechce, abyste si kupovali AI od jiných. Chce, abyste si ji postavili
Nvidia dál investuje obrovské částky do open-source modelů, aby podpořila vlastní ekosystém. Cílem je naučit firmy trénovat vlastní AI, což zajistí trvalý odbyt pro jejich výpočetní hardware.
Číst →Novinky · 2026-08-20
Liquid AI zrychluje lokální agenty modely DSpark pro LFM2.5
Lokální modely na laptopech dostaly výrazné zrychlení. Liquid AI vydává pomocné modely DSpark, díky nimž rodina LFM2.5 dosahuje se spekulativním dekódováním až 2,87násobné rychlosti na zařízení Apple, a to při stejné kvalitě výstupu.
Číst →Novinky · 2026-08-21
Modelové skóre přestává odrážet schopnosti hlasové AI
Modely pro rozpoznávání řeči mají na veřejných benchmarcích skvělé výsledky, ale nová studie ukazuje, že se učí podvádět. Výzkumníci z Hugging Face zjistili, že nejlépe hodnocené modely reprodukují chyby z testovacích dat místo toho, aby přepisovaly to, co doopravdy slyší.
Číst →Novinky · 2026-08-26
Hugging Face ukazuje, jak si za pár hodin a na jedné GPU vytrénovat vlastní multi-vektorový model
Nová aktualizace knihovny Sentence Transformers přidává podporu pro ColBERT-style late interaction. Vývojáři si tak mohou fine-tunovat modely na vlastní doménu bez ohledu na obecné limity existujících modelů.
Číst →Novinky · 2026-08-25
Model ze ctyr bitu, co si nepamatuje svuj horsi stav a hraje lepsi ligu
Hugging Face a Multiverse Computing ukazuji metodu Quantization-Aware Healing (QAH), diky ktere mensi 4bitovy model v testech porazi nekomprimovanou bfloat16 verzi. Pro tymy, co setri GPU, to meni uhel pohledu: komprese tu uz neni ztrata, ale realna cesta k presnejsim odpovedim.
Číst →Novinky · 2026-08-10
Lambert vydává knihu o ladění modelů, která ukazuje praxi za open-source AI
Nathan Lambert z výzkumné komunity kolem otevřených modelů oznámil vydání knihy o post-training fázích. Slibuje pohled do reálných lekcí z trénování, což může pro inženýrské týmy znamenat posun od akademické teorie k praktickým návodům pro fine-tuning.
Číst →Novinky · 2026-07-17
NeMo Automodel bere Diffusers z notebooku do clusteru
NVIDIA a Hugging Face ukazují integraci NeMo Automodel s Diffusers pro fine-tuning obrazových a video diffusion modelů ve velkém měřítku. Praktická pointa je prostá: méně převodů checkpointů, víc škálování a jasnější cesta od Hub modelu k tréninku.
Číst →Novinky · 2026-07-23
Nunchaku v Diffusers snižuje paměť pro image modely na 12 GB
Hugging Face přidal podporu Nunchaku 4-bit diffusion inference do Diffusers: 1024x1024 obraz na RTX 5090 má podle blogu běžet kolem 1,7 sekundy a 12 GB paměti místo 24 GB v BF16. Praktická pointa je menší tření mezi research kódem a běžným Python workflow.
Číst →Novinky · 2026-07-27
Amodei odmítá zákaz open weights. Chce čipy, distillation a povinné testy
Dario Amodei napsal, že Anthropic nikdy neprosazoval zákaz open-weights modelů. Místo plošného banu tlačí exportní kontrolu čipů, zásah proti průmyslové distillation a povinné safety testy pro dost silné open i closed systémy.
Číst →Novinky · 2026-07-22
Otevřené modely už nejsou charita, ale geopolitická strategie
Interconnects spojil Kimi K3, Qwen 3.8, GLM 5.2 a projev Si Ťin-pchinga ve WAIC do jedné mapy otevřených modelů. Důležité je, že open weights se z technické volby posouvají do průmyslové a politické páky.
Číst →Novinky · 2026-07-15
Shippy ukazuje, že agent pro ostrý provoz začíná u hranic a auditů
Ai2 popisuje Shippy, maritime AI agenta pro Skylight, který pracuje s živými satelitními a lodními signály ve více než 70 zemích. Nejcennější lekce leží v izolaci, deterministických nástrojích a evals nad celým agentem.
Číst →Novinky · 2026-07-02
Nemotron 3.5 mění content safety z filtru na policy engine
NVIDIA vydala na Hugging Face Nemotron 3.5 Content Safety, 4B multimodální model pro safety verdikty s custom policy, reasoning traces a podporou mnoha jazyků.
Číst →Z Knihovny