Synthesia skúša posunúť firemné AI video do živého tréningu rozhovorov
Nové Roleplay Sessions kombinujú avatarov, spätnú väzbu a analytiku tak, aby podniky netrénovali zamestnancov iba cez video, ale cez simulované konverzácie.
Hlavný výber redakcie
Práca z arXivu navrhuje, aby sa niektoré pravdepodobnostné modely identifikovali podľa miznúcich binomických vzťahov namiesto priameho odhadu parametrov.
Najnovšie
Kurátorované AI správy v tempe redakčného magazínu: nové modely, produktové vydania, výskum aj trhové pohyby.
Nové Roleplay Sessions kombinujú avatarov, spätnú väzbu a analytiku tak, aby podniky netrénovali zamestnancov iba cez video, ale cez simulované konverzácie.
Prehľad na Hugging Face opisuje, prečo sa robotika a fyzická AI čoraz viac opierajú o simulované dáta, GPU fyziku a nástroje ako MuJoCo, Isaac Sim, Isaac Lab či Newton.
Nový preprint navrhuje dynamický klasifikačný servis SIFT. Lacný sparse encoder a LightGBM triedia väčšinu dokumentov, neisté prípady posielajú LLM sudcovi a jeho verdikty sa vracajú do tréningového korpusu až po kontrole regresií.
Nové vydanie PydanticAI 2.15.0 je menší, ale praktický posun pre produkčných agentov. Prináša podporu explicitného prompt caching pri OpenAI, dynamickejšie toolsety v trvácnom vykonávaní a viac opráv okolo replay, DBOS a Prefect integrácií.
AWS opisuje Self-Distilled Reasoning pre Amazon Nova: postup, ktorý pri supervised fine-tuningu využíva vlastné thinking tokeny základného modelu, keď tréningové dáta neobsahujú zlaté reťazce uvažovania.
Nový výskum Apple opisuje generovanie syntetických trajektórií pre API-calling agentov iba zo špecifikácií rozhraní. Cieľom je obísť drahú prípravu plných sandboxov a databáz.
AI sprievodca
Sprievodca pracuje s poslednými publikovanými textami AIFeed.sk a pripraví rýchle zhrnutie, odporúčané čítanie alebo prehľad trendov.
Tematické sekcie
Každá sekcia sa plní automaticky z publikovaného obsahu. Dôraz je na čitateľnosť, obrazový rytmus a jasné rozdelenie tém.
Novinky
Prehľad kľúčových oznámení, partnerstiev, regulačných posunov a trhových signálov.
OpenAI zverejnil nové podrobnosti k incidentu, ktorý Hugging Face odhalil minulý týždeň. Podľa firmy išlo o internú evaluáciu kybernetických schopností, pri ktorej modely s vypnutými produkčnými zábranami reťazili zraniteľnosti a hľadali riešenia benchmarku ExploitGym.
OpenAI zverejnilo skúsenosti z interného nasadenia modelu, ktorý dokázal autonómne pracovať veľmi dlho. Firma tvrdí, že klasické hodnotenia nestačili, preto pridala testy odvodené z incidentov, sledovanie celej trajektórie a väčšiu kontrolu pre používateľov.
Patreon oznámil, že rozširuje ochranu tvorcov pred neautorizovaným zberom dát na tréning AI modelov a využije pritom Cloudflare AI Crawl Control.
OpenAI tvrdí, že prístup tínedžerov k AI má zostať otvorený, ale s inými predvolenými pravidlami než pri dospelých. Nový dôraz dáva na študijný režim, rodičovské nastavenia, odhady veku a častejšie bezpečnostné zásahy pri citlivom obsahu.
Modely
Nové foundation modely, benchmarky, multimodálne schopnosti a vývoj inferencie.
Google rozširuje rodinu Gemini o 3.6 Flash, 3.5 Flash-Lite a obmedzene dostupný 3.5 Flash Cyber. Dôležitý nie je len výkon, ale najmä nižšia latencia, menej výstupných tokenov a jasnejšie oddelenie bežných agentických úloh od kybernetických nástrojov s vyšším rizikom.
Nový 4-miliardový otvorený model na Hugging Face má priniesť časové uvažovanie, akčné výstupy a reálny beh na zariadeniach Jetson či RTX bez posielania každého rozhodnutia do dátového centra.
Spoločný technický článok Hugging Face a NVIDIA ukazuje, ako spojiť Diffusers s NeMo Automodel pri tréningu difúznych modelov od jednej GPU až po väčšie klastre.
NVIDIA predstavila rodinu Nemotron 3 Embed na Hugging Face. Modely sú určené pre vyhľadávanie v RAG systémoch, pamäť agentov a kódové úlohy; najväčší variant podľa oznámenia vedie leaderboard RTEB.
Produkty
Produktové vydania, integrácie, podnikové nástroje a praktické AI funkcie v aplikáciách.
Nové Roleplay Sessions kombinujú avatarov, spätnú väzbu a analytiku tak, aby podniky netrénovali zamestnancov iba cez video, ale cez simulované konverzácie.
Nové vydanie PydanticAI 2.15.0 je menší, ale praktický posun pre produkčných agentov. Prináša podporu explicitného prompt caching pri OpenAI, dynamickejšie toolsety v trvácnom vykonávaní a viac opráv okolo replay, DBOS a Prefect integrácií.
AWS opisuje Self-Distilled Reasoning pre Amazon Nova: postup, ktorý pri supervised fine-tuningu využíva vlastné thinking tokeny základného modelu, keď tréningové dáta neobsahujú zlaté reťazce uvažovania.
Grabette je otvorený ručný gripper od tímu Pollen Robotics na zber ukážok manipulácie bez potreby vlastného robota. Projekt cieli na úzke miesto robotického učenia: nedostatok rôznorodých reálnych dát.
Výskum
Výskumné práce, metódy, reprodukovateľné výsledky a posuny v bezpečnosti modelov.
Prehľad na Hugging Face opisuje, prečo sa robotika a fyzická AI čoraz viac opierajú o simulované dáta, GPU fyziku a nástroje ako MuJoCo, Isaac Sim, Isaac Lab či Newton.
Nový preprint navrhuje dynamický klasifikačný servis SIFT. Lacný sparse encoder a LightGBM triedia väčšinu dokumentov, neisté prípady posielajú LLM sudcovi a jeho verdikty sa vracajú do tréningového korpusu až po kontrole regresií.
Nový výskum Apple opisuje generovanie syntetických trajektórií pre API-calling agentov iba zo špecifikácií rozhraní. Cieľom je obísť drahú prípravu plných sandboxov a databáz.
Výskumný tím Apple ukazuje CalibAtt, tréningovo voľný spôsob, ako pri difúznych text-to-video modeloch preskakovať stabilne nedôležité spojenia v pozornosti bez výraznej straty kvality.
Trendujúce tagy
Frekvencia vychádza z nedávno publikovaných článkov a pomáha rýchlo zachytiť, čo sa v odvetví práve prepája.
Archív
Chronologický archív v štýle spravodajského toku, aby staršie texty nezapadli po prvom dni.
Databricks opisuje nový technický smer pre dátových agentov. Namiesto jedného veľkého modelu stavia Genie na špecializovanom hľadaní znalostí, paralelnom uvažovaní a multi-LLM orchestrace, čo má v interných testoch posunúť úspešnosť z 32 na viac ako 90 percent.
Výskumníci z Apple tvrdia, že pri multi-cieľovom dolaďovaní jazykových modelov nestačí maximalizovať priemernú odmenu. Ich metóda RVPO má obmedziť situácie, v ktorých model exceluje v jednej metrike, ale zlyháva v bezpečnosti, formáte alebo pri volaní nástrojov.
Nezávislý tím METR súhlasí s tým, že aktuálne modely Anthropicu zrejme nepredstavujú vysoké riziko plnej automatizácie výskumu a vývoja. Zároveň však tvrdí, že samotný februárový risk report firmy tento záver nedokazuje dostatočne presvedčivo.
OpenAI prvýkrát detailnejšie opisuje, ako interne riadi kódujúceho agenta Codex. Namiesto voľného prístupu stavia na sandboxe, jemnom dávkovaní oprávnení, obmedzenej sieti a auditných stopách priamo na úrovni agentických akcií.
Nové vydanie PydanticAI rozširuje riadenie volania nástrojov, zavádza presnejšie eventy pre output tools a opravuje správanie pri rušení agentov, čo má dopad najmä na stabilitu produkčných workflowov.
Databricks a Superhuman opisujú presun z vlastného vLLM stacku na riadenú inferenčnú vrstvu, ktorá má zvládnuť špičky nad 200-tisíc požiadaviek za sekundu, sub-sekundové P99 a vyššiu efektivitu na H100 GPU.
Apple predstavil metódu HeadsUp, ktorá z veľkých viacpohľadových záznamov skladá 3D hlavy pomocou gaussovskej reprezentácie a cieli na lepší pomer kvality, škálovateľnosti a výpočtu.
Projekt CyberSecQwen-4B tvrdí, že obranná kyberbezpečnosť potrebuje skôr malé špecializované a lokálne spustiteľné modely než ďalší univerzálny frontier systém v cloude.
Výskumníci z BAIR opisujú posun od dlhého lineárneho reťazca uvažovania k adaptívnemu paralelnému riešeniu, ktoré má znižovať latenciu aj chaos v kontexte.
Nový paper FinAgent-RAG tvrdí, že pri finančných dokumentoch nestačí jednorazové vyhľadanie a odpoveď. Autori stavajú na opakovanom dohľadávaní, písaní vykonateľného kódu pre aritmetiku a smerovaní výpočtu podľa náročnosti otázky.
Nový projekt MedQA ukazuje, že menší klinický model Qwen3-1.7B sa dá rozumne doladiť na AMD MI300X cez ROCm bez CUDA závislostí, s LoRA a päťminútovým tréningom na vzorke MedMCQA.
Nový arXiv paper navrhuje AdaGATE, tréningovo nenáročný kontrolér pre multi-hop RAG, ktorý sa snaží opravovať chýbajúce prepojenia medzi dôkazmi namiesto slepého rozširovania kontextu.