Synthesia skúša posunúť firemné AI video do živého tréningu rozhovorov
Nové Roleplay Sessions kombinujú avatarov, spätnú väzbu a analytiku tak, aby podniky netrénovali zamestnancov iba cez video, ale cez simulované konverzácie.
Hlavný výber redakcie
Práca z arXivu navrhuje, aby sa niektoré pravdepodobnostné modely identifikovali podľa miznúcich binomických vzťahov namiesto priameho odhadu parametrov.
Najnovšie
Kurátorované AI správy v tempe redakčného magazínu: nové modely, produktové vydania, výskum aj trhové pohyby.
Nové Roleplay Sessions kombinujú avatarov, spätnú väzbu a analytiku tak, aby podniky netrénovali zamestnancov iba cez video, ale cez simulované konverzácie.
Prehľad na Hugging Face opisuje, prečo sa robotika a fyzická AI čoraz viac opierajú o simulované dáta, GPU fyziku a nástroje ako MuJoCo, Isaac Sim, Isaac Lab či Newton.
Nový preprint navrhuje dynamický klasifikačný servis SIFT. Lacný sparse encoder a LightGBM triedia väčšinu dokumentov, neisté prípady posielajú LLM sudcovi a jeho verdikty sa vracajú do tréningového korpusu až po kontrole regresií.
Nové vydanie PydanticAI 2.15.0 je menší, ale praktický posun pre produkčných agentov. Prináša podporu explicitného prompt caching pri OpenAI, dynamickejšie toolsety v trvácnom vykonávaní a viac opráv okolo replay, DBOS a Prefect integrácií.
AWS opisuje Self-Distilled Reasoning pre Amazon Nova: postup, ktorý pri supervised fine-tuningu využíva vlastné thinking tokeny základného modelu, keď tréningové dáta neobsahujú zlaté reťazce uvažovania.
Nový výskum Apple opisuje generovanie syntetických trajektórií pre API-calling agentov iba zo špecifikácií rozhraní. Cieľom je obísť drahú prípravu plných sandboxov a databáz.
AI sprievodca
Sprievodca pracuje s poslednými publikovanými textami AIFeed.sk a pripraví rýchle zhrnutie, odporúčané čítanie alebo prehľad trendov.
Tematické sekcie
Každá sekcia sa plní automaticky z publikovaného obsahu. Dôraz je na čitateľnosť, obrazový rytmus a jasné rozdelenie tém.
Novinky
Prehľad kľúčových oznámení, partnerstiev, regulačných posunov a trhových signálov.
OpenAI zverejnil nové podrobnosti k incidentu, ktorý Hugging Face odhalil minulý týždeň. Podľa firmy išlo o internú evaluáciu kybernetických schopností, pri ktorej modely s vypnutými produkčnými zábranami reťazili zraniteľnosti a hľadali riešenia benchmarku ExploitGym.
OpenAI zverejnilo skúsenosti z interného nasadenia modelu, ktorý dokázal autonómne pracovať veľmi dlho. Firma tvrdí, že klasické hodnotenia nestačili, preto pridala testy odvodené z incidentov, sledovanie celej trajektórie a väčšiu kontrolu pre používateľov.
Patreon oznámil, že rozširuje ochranu tvorcov pred neautorizovaným zberom dát na tréning AI modelov a využije pritom Cloudflare AI Crawl Control.
OpenAI tvrdí, že prístup tínedžerov k AI má zostať otvorený, ale s inými predvolenými pravidlami než pri dospelých. Nový dôraz dáva na študijný režim, rodičovské nastavenia, odhady veku a častejšie bezpečnostné zásahy pri citlivom obsahu.
Modely
Nové foundation modely, benchmarky, multimodálne schopnosti a vývoj inferencie.
Google rozširuje rodinu Gemini o 3.6 Flash, 3.5 Flash-Lite a obmedzene dostupný 3.5 Flash Cyber. Dôležitý nie je len výkon, ale najmä nižšia latencia, menej výstupných tokenov a jasnejšie oddelenie bežných agentických úloh od kybernetických nástrojov s vyšším rizikom.
Nový 4-miliardový otvorený model na Hugging Face má priniesť časové uvažovanie, akčné výstupy a reálny beh na zariadeniach Jetson či RTX bez posielania každého rozhodnutia do dátového centra.
Spoločný technický článok Hugging Face a NVIDIA ukazuje, ako spojiť Diffusers s NeMo Automodel pri tréningu difúznych modelov od jednej GPU až po väčšie klastre.
NVIDIA predstavila rodinu Nemotron 3 Embed na Hugging Face. Modely sú určené pre vyhľadávanie v RAG systémoch, pamäť agentov a kódové úlohy; najväčší variant podľa oznámenia vedie leaderboard RTEB.
Produkty
Produktové vydania, integrácie, podnikové nástroje a praktické AI funkcie v aplikáciách.
Nové Roleplay Sessions kombinujú avatarov, spätnú väzbu a analytiku tak, aby podniky netrénovali zamestnancov iba cez video, ale cez simulované konverzácie.
Nové vydanie PydanticAI 2.15.0 je menší, ale praktický posun pre produkčných agentov. Prináša podporu explicitného prompt caching pri OpenAI, dynamickejšie toolsety v trvácnom vykonávaní a viac opráv okolo replay, DBOS a Prefect integrácií.
AWS opisuje Self-Distilled Reasoning pre Amazon Nova: postup, ktorý pri supervised fine-tuningu využíva vlastné thinking tokeny základného modelu, keď tréningové dáta neobsahujú zlaté reťazce uvažovania.
Grabette je otvorený ručný gripper od tímu Pollen Robotics na zber ukážok manipulácie bez potreby vlastného robota. Projekt cieli na úzke miesto robotického učenia: nedostatok rôznorodých reálnych dát.
Výskum
Výskumné práce, metódy, reprodukovateľné výsledky a posuny v bezpečnosti modelov.
Prehľad na Hugging Face opisuje, prečo sa robotika a fyzická AI čoraz viac opierajú o simulované dáta, GPU fyziku a nástroje ako MuJoCo, Isaac Sim, Isaac Lab či Newton.
Nový preprint navrhuje dynamický klasifikačný servis SIFT. Lacný sparse encoder a LightGBM triedia väčšinu dokumentov, neisté prípady posielajú LLM sudcovi a jeho verdikty sa vracajú do tréningového korpusu až po kontrole regresií.
Nový výskum Apple opisuje generovanie syntetických trajektórií pre API-calling agentov iba zo špecifikácií rozhraní. Cieľom je obísť drahú prípravu plných sandboxov a databáz.
Výskumný tím Apple ukazuje CalibAtt, tréningovo voľný spôsob, ako pri difúznych text-to-video modeloch preskakovať stabilne nedôležité spojenia v pozornosti bez výraznej straty kvality.
Trendujúce tagy
Frekvencia vychádza z nedávno publikovaných článkov a pomáha rýchlo zachytiť, čo sa v odvetví práve prepája.
Archív
Chronologický archív v štýle spravodajského toku, aby staršie texty nezapadli po prvom dni.
OpenAI popisuje, ako dostalo Codex na Windows z režimu takmer neobmedzených povolení k modelu, ktorý vie bežať s kontrolovaným zápisom, čítaním aj sieťou bez toho, aby vývojára tlačil do režimu Full Access.
Preprint AESOP upozorňuje na nový typ útoku proti zloženým inference pipeline. Namiesto lámana jedného modelu cieli na výber vykonávacej cesty a podľa autorov vie prudko nafúknuť výpočtové náklady aj latenciu celého systému.
Nový preprint ξ-DPO tvrdí, že pri direct preference optimization vie nahradiť ťažko čitateľnú margin schému interpretovateľnejším pomerovým cieľom. Pre tímy, ktoré dolaďujú modely na ľudských preferenciách, to môže znamenať menej slepého skúšania a ľahšie prenositeľné nastavenia.
AWS opisuje, ako na SageMakeri sledovať výpočtovú stopu pri doladovaní jazykových modelov, aby firmy vedeli, či sa pri tréningu nepribližujú k hraniciam nových povinností podľa európskeho AI Actu.
Amazon opisuje interný systém, v ktorom jeho finančné tímy používajú Bedrock, znalostné bázy a priebežné sledovanie behov na prípravu odpovedí pre regulátorov. Dôležité nie je len to, že do procesu vstúpila generatívna AI, ale aj to, ako sa rieši dohľadateľnosť, práca s dokumentmi a viacotáčkový kontext.
AWS pridáva do svojho IDP Acceleratoru viacdokumentové objavovanie schém. Nová vrstva má sama zhlukovať neznáme typy dokumentov a pripraviť polia na extrakciu, čím skracuje najpomalšiu časť nasadzovania dokumentovej AI vo firmách.
Nový arXiv paper navrhuje tréningový rámec, v ktorom si jazykový model počas posilňovaného učenia pýta cielenú pomoc od troch špecializovaných agentov. Autori tvrdia, že takto vie zlepšiť matematické, vedecké aj programátorské úlohy bez toho, aby po tréningu na pomocníkov ďalej spoliehal.
Nový paper navrhuje Sem-ECE, spôsob merania kalibrácie pri otvorenom otázkovaní. Namiesto sebahodnotenia modelu sleduje, ako často sa pri vzorkovaní vracia k rovnakému významu odpovede.
Apple ukazuje, že pri titulkovaní obrázkov nestačí tlačiť len na dĺžku a detail. BalCapRL kombinuje viac cieľov naraz, aby multimodálne modely menej halucinovali a písali použiteľnejšie popisy.
Výskumníci na arXive navrhujú AM-PPI, prístup pre monitoring klinickej AI po nasadení, ktorý kombinuje viac prediktorov rôznej ceny a presnosti. Cieľom je znížiť potrebu drahého ručného označovania bez toho, aby sa oslabila štatistická spoľahlivosť dohľadu.
Mastra pridáva integráciu s Temporalom, vďaka ktorej majú workflowy získať trvácny stav, retry mechanizmy a plánovanie dlhých behov. Pre agentické stacky je to dôležitý posun od demo orchestrace k infra, ktorá prežije reštarty aj viacdňové úlohy.
OpenAI po ôsmich týždňoch zhrnulo súťaž Parameter Golf a ukazuje, že malé, prísne obmedzené benchmarky už neslúžia len na zábavu. Stávajú sa lakmusovým papierikom pre kvalitu experimentovania, kompresie modelov aj práce AI kódovacích agentov.