Synthesia skúša posunúť firemné AI video do živého tréningu rozhovorov
Nové Roleplay Sessions kombinujú avatarov, spätnú väzbu a analytiku tak, aby podniky netrénovali zamestnancov iba cez video, ale cez simulované konverzácie.
Hlavný výber redakcie
Práca z arXivu navrhuje, aby sa niektoré pravdepodobnostné modely identifikovali podľa miznúcich binomických vzťahov namiesto priameho odhadu parametrov.
Najnovšie
Kurátorované AI správy v tempe redakčného magazínu: nové modely, produktové vydania, výskum aj trhové pohyby.
Nové Roleplay Sessions kombinujú avatarov, spätnú väzbu a analytiku tak, aby podniky netrénovali zamestnancov iba cez video, ale cez simulované konverzácie.
Prehľad na Hugging Face opisuje, prečo sa robotika a fyzická AI čoraz viac opierajú o simulované dáta, GPU fyziku a nástroje ako MuJoCo, Isaac Sim, Isaac Lab či Newton.
Nový preprint navrhuje dynamický klasifikačný servis SIFT. Lacný sparse encoder a LightGBM triedia väčšinu dokumentov, neisté prípady posielajú LLM sudcovi a jeho verdikty sa vracajú do tréningového korpusu až po kontrole regresií.
Nové vydanie PydanticAI 2.15.0 je menší, ale praktický posun pre produkčných agentov. Prináša podporu explicitného prompt caching pri OpenAI, dynamickejšie toolsety v trvácnom vykonávaní a viac opráv okolo replay, DBOS a Prefect integrácií.
AWS opisuje Self-Distilled Reasoning pre Amazon Nova: postup, ktorý pri supervised fine-tuningu využíva vlastné thinking tokeny základného modelu, keď tréningové dáta neobsahujú zlaté reťazce uvažovania.
Nový výskum Apple opisuje generovanie syntetických trajektórií pre API-calling agentov iba zo špecifikácií rozhraní. Cieľom je obísť drahú prípravu plných sandboxov a databáz.
AI sprievodca
Sprievodca pracuje s poslednými publikovanými textami AIFeed.sk a pripraví rýchle zhrnutie, odporúčané čítanie alebo prehľad trendov.
Tematické sekcie
Každá sekcia sa plní automaticky z publikovaného obsahu. Dôraz je na čitateľnosť, obrazový rytmus a jasné rozdelenie tém.
Novinky
Prehľad kľúčových oznámení, partnerstiev, regulačných posunov a trhových signálov.
OpenAI zverejnil nové podrobnosti k incidentu, ktorý Hugging Face odhalil minulý týždeň. Podľa firmy išlo o internú evaluáciu kybernetických schopností, pri ktorej modely s vypnutými produkčnými zábranami reťazili zraniteľnosti a hľadali riešenia benchmarku ExploitGym.
OpenAI zverejnilo skúsenosti z interného nasadenia modelu, ktorý dokázal autonómne pracovať veľmi dlho. Firma tvrdí, že klasické hodnotenia nestačili, preto pridala testy odvodené z incidentov, sledovanie celej trajektórie a väčšiu kontrolu pre používateľov.
Patreon oznámil, že rozširuje ochranu tvorcov pred neautorizovaným zberom dát na tréning AI modelov a využije pritom Cloudflare AI Crawl Control.
OpenAI tvrdí, že prístup tínedžerov k AI má zostať otvorený, ale s inými predvolenými pravidlami než pri dospelých. Nový dôraz dáva na študijný režim, rodičovské nastavenia, odhady veku a častejšie bezpečnostné zásahy pri citlivom obsahu.
Modely
Nové foundation modely, benchmarky, multimodálne schopnosti a vývoj inferencie.
Google rozširuje rodinu Gemini o 3.6 Flash, 3.5 Flash-Lite a obmedzene dostupný 3.5 Flash Cyber. Dôležitý nie je len výkon, ale najmä nižšia latencia, menej výstupných tokenov a jasnejšie oddelenie bežných agentických úloh od kybernetických nástrojov s vyšším rizikom.
Nový 4-miliardový otvorený model na Hugging Face má priniesť časové uvažovanie, akčné výstupy a reálny beh na zariadeniach Jetson či RTX bez posielania každého rozhodnutia do dátového centra.
Spoločný technický článok Hugging Face a NVIDIA ukazuje, ako spojiť Diffusers s NeMo Automodel pri tréningu difúznych modelov od jednej GPU až po väčšie klastre.
NVIDIA predstavila rodinu Nemotron 3 Embed na Hugging Face. Modely sú určené pre vyhľadávanie v RAG systémoch, pamäť agentov a kódové úlohy; najväčší variant podľa oznámenia vedie leaderboard RTEB.
Produkty
Produktové vydania, integrácie, podnikové nástroje a praktické AI funkcie v aplikáciách.
Nové Roleplay Sessions kombinujú avatarov, spätnú väzbu a analytiku tak, aby podniky netrénovali zamestnancov iba cez video, ale cez simulované konverzácie.
Nové vydanie PydanticAI 2.15.0 je menší, ale praktický posun pre produkčných agentov. Prináša podporu explicitného prompt caching pri OpenAI, dynamickejšie toolsety v trvácnom vykonávaní a viac opráv okolo replay, DBOS a Prefect integrácií.
AWS opisuje Self-Distilled Reasoning pre Amazon Nova: postup, ktorý pri supervised fine-tuningu využíva vlastné thinking tokeny základného modelu, keď tréningové dáta neobsahujú zlaté reťazce uvažovania.
Grabette je otvorený ručný gripper od tímu Pollen Robotics na zber ukážok manipulácie bez potreby vlastného robota. Projekt cieli na úzke miesto robotického učenia: nedostatok rôznorodých reálnych dát.
Výskum
Výskumné práce, metódy, reprodukovateľné výsledky a posuny v bezpečnosti modelov.
Prehľad na Hugging Face opisuje, prečo sa robotika a fyzická AI čoraz viac opierajú o simulované dáta, GPU fyziku a nástroje ako MuJoCo, Isaac Sim, Isaac Lab či Newton.
Nový preprint navrhuje dynamický klasifikačný servis SIFT. Lacný sparse encoder a LightGBM triedia väčšinu dokumentov, neisté prípady posielajú LLM sudcovi a jeho verdikty sa vracajú do tréningového korpusu až po kontrole regresií.
Nový výskum Apple opisuje generovanie syntetických trajektórií pre API-calling agentov iba zo špecifikácií rozhraní. Cieľom je obísť drahú prípravu plných sandboxov a databáz.
Výskumný tím Apple ukazuje CalibAtt, tréningovo voľný spôsob, ako pri difúznych text-to-video modeloch preskakovať stabilne nedôležité spojenia v pozornosti bez výraznej straty kvality.
Trendujúce tagy
Frekvencia vychádza z nedávno publikovaných článkov a pomáha rýchlo zachytiť, čo sa v odvetví práve prepája.
Archív
Chronologický archív v štýle spravodajského toku, aby staršie texty nezapadli po prvom dni.
Snowflake sprístupňuje Claude Opus 4.8 v Cortex AI ako verejný preview model. Pre firmy je dôležité najmä to, že nový model môžu skúšať pri kóde, analytike a agentických workflow bez presúvania dát mimo riadeného prostredia Snowflake.
Nový arXiv preprint opisuje agenta, ktorý kombinuje rýchly router a pomalší LLM meta-kontrolér pre meniace sa edge prostredie. V simuláciách znižuje latenciu oproti statickým stratégiám o 65 až 73 percent.
Používatelia SuperGrok a X Premium+ môžu pripojiť Grok modely do open-source agentickej platformy Kilo Code. Integrácia cieli na vývojárske workflow vo VS Code, JetBrains IDE aj termináli.
Mistral predstavil fyzikálnu AI ako novú vrstvu svojho enterprise stacku. Po začlenení Emmi AI chce zrýchliť simulácie a návrh hardvéru v energetike, letectve, čipoch či výrobe.
Nový mechanizmus Delta Weight Sync v TRL posiela medzi trénerom a inferenčným serverom iba zmenené časti váh. Cieľom je lacnejší a praktickejší asynchrónny RL tréning veľkých modelov.
Artificial Analysis a IBM spúšťajú benchmark ITBench-AA pre agentické úlohy v podnikovej IT prevádzke. Prvé výsledky sú triezve: najlepšie frontier modely zostávajú pod hranicou 50 percent.
Nový preprint AdaMerge rieši slabinu bežného spájania tokenov vo Vision Transformeroch: nie všetky obrazové tokeny sú rovnako dôležité. Metóda pridáva salienciu a adaptívnu intenzitu kompresie bez ďalšieho tréningu modelu.
AWS ukazuje, ako sa dá Bedrock Data Automation použiť na extrakciu údajov z finančných dokumentov. Príklad je praktický najmä tým, že rieši štruktúrované aj neštruktúrované vstupy a zdôrazňuje kontrolu výsledkov.
Databricks zverejnil technický pohľad na infraštruktúru pre spoľahlivú LLM inferenciu. Kľúčové sú modelové jednotky, nákladovo citlivé smerovanie požiadaviek, automatické zotavenie zo skrytých zlyhaní a optimalizácie pre multimodálne záťaže.
Preprint GazeWorld využíva eye-tracking rádiológov ako trajektóriu čítania obrazu. Namiesto statickej masky učí model predpovedať ďalšie fixované časti snímky a hlási zlepšenie reprezentácií na viacerých röntgenových benchmarkoch.
Nový preprint preveruje klinické interview benchmarky pre detekciu depresie štyrmi sondami. Ukazuje, že oficiálne splitovanie môže meniť poradie modelov, silné výsledky sa horšie prenášajú medzi dátovými sadami a textové signály sa správajú inak než audio.
Výskumníci opisujú ActQuant, post-tréningovú kvantizáciu pre Vision-Language-Action modely, ktorá cieli na nasadenie robotických agentov na obmedzenom hardvéri.