Synthesia skúša posunúť firemné AI video do živého tréningu rozhovorov
Nové Roleplay Sessions kombinujú avatarov, spätnú väzbu a analytiku tak, aby podniky netrénovali zamestnancov iba cez video, ale cez simulované konverzácie.
Hlavný výber redakcie
Práca z arXivu navrhuje, aby sa niektoré pravdepodobnostné modely identifikovali podľa miznúcich binomických vzťahov namiesto priameho odhadu parametrov.
Najnovšie
Kurátorované AI správy v tempe redakčného magazínu: nové modely, produktové vydania, výskum aj trhové pohyby.
Nové Roleplay Sessions kombinujú avatarov, spätnú väzbu a analytiku tak, aby podniky netrénovali zamestnancov iba cez video, ale cez simulované konverzácie.
Prehľad na Hugging Face opisuje, prečo sa robotika a fyzická AI čoraz viac opierajú o simulované dáta, GPU fyziku a nástroje ako MuJoCo, Isaac Sim, Isaac Lab či Newton.
Nový preprint navrhuje dynamický klasifikačný servis SIFT. Lacný sparse encoder a LightGBM triedia väčšinu dokumentov, neisté prípady posielajú LLM sudcovi a jeho verdikty sa vracajú do tréningového korpusu až po kontrole regresií.
Nové vydanie PydanticAI 2.15.0 je menší, ale praktický posun pre produkčných agentov. Prináša podporu explicitného prompt caching pri OpenAI, dynamickejšie toolsety v trvácnom vykonávaní a viac opráv okolo replay, DBOS a Prefect integrácií.
AWS opisuje Self-Distilled Reasoning pre Amazon Nova: postup, ktorý pri supervised fine-tuningu využíva vlastné thinking tokeny základného modelu, keď tréningové dáta neobsahujú zlaté reťazce uvažovania.
Nový výskum Apple opisuje generovanie syntetických trajektórií pre API-calling agentov iba zo špecifikácií rozhraní. Cieľom je obísť drahú prípravu plných sandboxov a databáz.
AI sprievodca
Sprievodca pracuje s poslednými publikovanými textami AIFeed.sk a pripraví rýchle zhrnutie, odporúčané čítanie alebo prehľad trendov.
Tematické sekcie
Každá sekcia sa plní automaticky z publikovaného obsahu. Dôraz je na čitateľnosť, obrazový rytmus a jasné rozdelenie tém.
Novinky
Prehľad kľúčových oznámení, partnerstiev, regulačných posunov a trhových signálov.
OpenAI zverejnil nové podrobnosti k incidentu, ktorý Hugging Face odhalil minulý týždeň. Podľa firmy išlo o internú evaluáciu kybernetických schopností, pri ktorej modely s vypnutými produkčnými zábranami reťazili zraniteľnosti a hľadali riešenia benchmarku ExploitGym.
OpenAI zverejnilo skúsenosti z interného nasadenia modelu, ktorý dokázal autonómne pracovať veľmi dlho. Firma tvrdí, že klasické hodnotenia nestačili, preto pridala testy odvodené z incidentov, sledovanie celej trajektórie a väčšiu kontrolu pre používateľov.
Patreon oznámil, že rozširuje ochranu tvorcov pred neautorizovaným zberom dát na tréning AI modelov a využije pritom Cloudflare AI Crawl Control.
OpenAI tvrdí, že prístup tínedžerov k AI má zostať otvorený, ale s inými predvolenými pravidlami než pri dospelých. Nový dôraz dáva na študijný režim, rodičovské nastavenia, odhady veku a častejšie bezpečnostné zásahy pri citlivom obsahu.
Modely
Nové foundation modely, benchmarky, multimodálne schopnosti a vývoj inferencie.
Google rozširuje rodinu Gemini o 3.6 Flash, 3.5 Flash-Lite a obmedzene dostupný 3.5 Flash Cyber. Dôležitý nie je len výkon, ale najmä nižšia latencia, menej výstupných tokenov a jasnejšie oddelenie bežných agentických úloh od kybernetických nástrojov s vyšším rizikom.
Nový 4-miliardový otvorený model na Hugging Face má priniesť časové uvažovanie, akčné výstupy a reálny beh na zariadeniach Jetson či RTX bez posielania každého rozhodnutia do dátového centra.
Spoločný technický článok Hugging Face a NVIDIA ukazuje, ako spojiť Diffusers s NeMo Automodel pri tréningu difúznych modelov od jednej GPU až po väčšie klastre.
NVIDIA predstavila rodinu Nemotron 3 Embed na Hugging Face. Modely sú určené pre vyhľadávanie v RAG systémoch, pamäť agentov a kódové úlohy; najväčší variant podľa oznámenia vedie leaderboard RTEB.
Produkty
Produktové vydania, integrácie, podnikové nástroje a praktické AI funkcie v aplikáciách.
Nové Roleplay Sessions kombinujú avatarov, spätnú väzbu a analytiku tak, aby podniky netrénovali zamestnancov iba cez video, ale cez simulované konverzácie.
Nové vydanie PydanticAI 2.15.0 je menší, ale praktický posun pre produkčných agentov. Prináša podporu explicitného prompt caching pri OpenAI, dynamickejšie toolsety v trvácnom vykonávaní a viac opráv okolo replay, DBOS a Prefect integrácií.
AWS opisuje Self-Distilled Reasoning pre Amazon Nova: postup, ktorý pri supervised fine-tuningu využíva vlastné thinking tokeny základného modelu, keď tréningové dáta neobsahujú zlaté reťazce uvažovania.
Grabette je otvorený ručný gripper od tímu Pollen Robotics na zber ukážok manipulácie bez potreby vlastného robota. Projekt cieli na úzke miesto robotického učenia: nedostatok rôznorodých reálnych dát.
Výskum
Výskumné práce, metódy, reprodukovateľné výsledky a posuny v bezpečnosti modelov.
Prehľad na Hugging Face opisuje, prečo sa robotika a fyzická AI čoraz viac opierajú o simulované dáta, GPU fyziku a nástroje ako MuJoCo, Isaac Sim, Isaac Lab či Newton.
Nový preprint navrhuje dynamický klasifikačný servis SIFT. Lacný sparse encoder a LightGBM triedia väčšinu dokumentov, neisté prípady posielajú LLM sudcovi a jeho verdikty sa vracajú do tréningového korpusu až po kontrole regresií.
Nový výskum Apple opisuje generovanie syntetických trajektórií pre API-calling agentov iba zo špecifikácií rozhraní. Cieľom je obísť drahú prípravu plných sandboxov a databáz.
Výskumný tím Apple ukazuje CalibAtt, tréningovo voľný spôsob, ako pri difúznych text-to-video modeloch preskakovať stabilne nedôležité spojenia v pozornosti bez výraznej straty kvality.
Trendujúce tagy
Frekvencia vychádza z nedávno publikovaných článkov a pomáha rýchlo zachytiť, čo sa v odvetví práve prepája.
Archív
Chronologický archív v štýle spravodajského toku, aby staršie texty nezapadli po prvom dni.
Nový benchmark ABRA neposudzuje len to, či model vie odpovedať na otázku k obrázku, ale či sa dokáže orientovať v reálnom rádiologickom prostredí, prepínať série, hýbať sa po rezoch a vytvoriť štruktúrovaný výstup, aký by mal zmysel aj mimo laboratória.
AWS sprístupnilo natívny Claude Platform priamo cez AWS účet, IAM a Marketplace billing. Novinka mení spôsob, akým môžu firmy nakupovať a auditovať nástroje Anthropicu, hoci samotné spracovanie dát ostáva mimo bezpečnostnej hranice AWS.
Nový príklad z AWS stavia retrieval nad technickými dokumentmi tak, aby systém nehľadal len v OCR texte, ale aj v kresbách, schémach a grafoch. V praxi to naznačuje, kam sa môže posunúť priemyselný RAG pri dokumentácii, kde podstatná informácia nebýva v odseku, ale v obrázku.
Výskumníci navrhujú model, ktorý z lineárnych záznamov workflow odhaľuje skryté závislosti medzi krokmi. Namiesto predstavy, že každý krok musí nasledovať presne po inom, hľadajú latentné čiastočné poradie vhodnejšie pre agentov aj automatizované procesy.
Nový paper A2RD rieši slabinu dlhých generovaných videí: model po čase stráca dej, objekty aj kontinuitu. Autori spájajú multimodálnu pamäť, segmentové generovanie a priebežné samoopravovanie priamo počas inferencie.
Google spúšťa novú AI verziu Google Finance v Európe. Sľubuje odpovede na investičné otázky, detailnejšie grafy, živé prepisy výsledkov a lokálny jazykový servis, čo môže zmeniť, ako retail pracuje s finančnými dátami.
OpenAI spúšťa samostatnú deployment jednotku DeployCo, do ktorej má prísť aj tím Tomoro. Firma tým priznáva, že ďalší boj o trh nebude len o modeli, ale o tom, kto vie AI zaviesť do reálnych firemných procesov.
Projekt MachinaCheck ukazuje praktický priemyselný use case pre multi-agentové AI. Z CAD súboru má v priebehu desiatok sekúnd vyrobiť posudok, či sa diel dá vyrobiť, aké nástroje chýbajú a kde sú technologické riziká.
SAP sa dohodlo na kúpe Prior Labs a avizuje investíciu vyše miliardy eur počas štyroch rokov. Stávka mieri na tabular foundation models, teda modely navrhnuté priamo pre tabuľkové podnikové dáta, nie iba pre text.
SAP oznámilo dohodu o kúpe Dremia. Cieľom je poskladať Business Data Cloud a HANA Cloud tak, aby mali agenti jednotný, otvorený a riadený prístup k SAP aj non-SAP dátam bez drahých presunov a prepisov formátov.
Luma sprístupnila API pre Uni-1.1, teda model, ktorý spája jazykové uvažovanie a generovanie obrazu v jednom behu. Firma tvrdí, že tým znižuje latenciu aj cenu a súčasne zlepšuje prácu s viacobmedzovými zadaniami.
AllenAI zverejnilo EMO, mixture-of-experts model navrhnutý tak, aby sa jeho experti prirodzene usporiadali do využiteľných skupín. Cieľom nie je len vyšší výkon, ale aj to, aby bolo možné spúšťať menší výsek expertov bez dramatického prepadu kvality.