Synthesia skúša posunúť firemné AI video do živého tréningu rozhovorov
Nové Roleplay Sessions kombinujú avatarov, spätnú väzbu a analytiku tak, aby podniky netrénovali zamestnancov iba cez video, ale cez simulované konverzácie.
Hlavný výber redakcie
Práca z arXivu navrhuje, aby sa niektoré pravdepodobnostné modely identifikovali podľa miznúcich binomických vzťahov namiesto priameho odhadu parametrov.
Najnovšie
Kurátorované AI správy v tempe redakčného magazínu: nové modely, produktové vydania, výskum aj trhové pohyby.
Nové Roleplay Sessions kombinujú avatarov, spätnú väzbu a analytiku tak, aby podniky netrénovali zamestnancov iba cez video, ale cez simulované konverzácie.
Prehľad na Hugging Face opisuje, prečo sa robotika a fyzická AI čoraz viac opierajú o simulované dáta, GPU fyziku a nástroje ako MuJoCo, Isaac Sim, Isaac Lab či Newton.
Nový preprint navrhuje dynamický klasifikačný servis SIFT. Lacný sparse encoder a LightGBM triedia väčšinu dokumentov, neisté prípady posielajú LLM sudcovi a jeho verdikty sa vracajú do tréningového korpusu až po kontrole regresií.
Nové vydanie PydanticAI 2.15.0 je menší, ale praktický posun pre produkčných agentov. Prináša podporu explicitného prompt caching pri OpenAI, dynamickejšie toolsety v trvácnom vykonávaní a viac opráv okolo replay, DBOS a Prefect integrácií.
AWS opisuje Self-Distilled Reasoning pre Amazon Nova: postup, ktorý pri supervised fine-tuningu využíva vlastné thinking tokeny základného modelu, keď tréningové dáta neobsahujú zlaté reťazce uvažovania.
Nový výskum Apple opisuje generovanie syntetických trajektórií pre API-calling agentov iba zo špecifikácií rozhraní. Cieľom je obísť drahú prípravu plných sandboxov a databáz.
AI sprievodca
Sprievodca pracuje s poslednými publikovanými textami AIFeed.sk a pripraví rýchle zhrnutie, odporúčané čítanie alebo prehľad trendov.
Tematické sekcie
Každá sekcia sa plní automaticky z publikovaného obsahu. Dôraz je na čitateľnosť, obrazový rytmus a jasné rozdelenie tém.
Novinky
Prehľad kľúčových oznámení, partnerstiev, regulačných posunov a trhových signálov.
OpenAI zverejnil nové podrobnosti k incidentu, ktorý Hugging Face odhalil minulý týždeň. Podľa firmy išlo o internú evaluáciu kybernetických schopností, pri ktorej modely s vypnutými produkčnými zábranami reťazili zraniteľnosti a hľadali riešenia benchmarku ExploitGym.
OpenAI zverejnilo skúsenosti z interného nasadenia modelu, ktorý dokázal autonómne pracovať veľmi dlho. Firma tvrdí, že klasické hodnotenia nestačili, preto pridala testy odvodené z incidentov, sledovanie celej trajektórie a väčšiu kontrolu pre používateľov.
Patreon oznámil, že rozširuje ochranu tvorcov pred neautorizovaným zberom dát na tréning AI modelov a využije pritom Cloudflare AI Crawl Control.
OpenAI tvrdí, že prístup tínedžerov k AI má zostať otvorený, ale s inými predvolenými pravidlami než pri dospelých. Nový dôraz dáva na študijný režim, rodičovské nastavenia, odhady veku a častejšie bezpečnostné zásahy pri citlivom obsahu.
Modely
Nové foundation modely, benchmarky, multimodálne schopnosti a vývoj inferencie.
Google rozširuje rodinu Gemini o 3.6 Flash, 3.5 Flash-Lite a obmedzene dostupný 3.5 Flash Cyber. Dôležitý nie je len výkon, ale najmä nižšia latencia, menej výstupných tokenov a jasnejšie oddelenie bežných agentických úloh od kybernetických nástrojov s vyšším rizikom.
Nový 4-miliardový otvorený model na Hugging Face má priniesť časové uvažovanie, akčné výstupy a reálny beh na zariadeniach Jetson či RTX bez posielania každého rozhodnutia do dátového centra.
Spoločný technický článok Hugging Face a NVIDIA ukazuje, ako spojiť Diffusers s NeMo Automodel pri tréningu difúznych modelov od jednej GPU až po väčšie klastre.
NVIDIA predstavila rodinu Nemotron 3 Embed na Hugging Face. Modely sú určené pre vyhľadávanie v RAG systémoch, pamäť agentov a kódové úlohy; najväčší variant podľa oznámenia vedie leaderboard RTEB.
Produkty
Produktové vydania, integrácie, podnikové nástroje a praktické AI funkcie v aplikáciách.
Nové Roleplay Sessions kombinujú avatarov, spätnú väzbu a analytiku tak, aby podniky netrénovali zamestnancov iba cez video, ale cez simulované konverzácie.
Nové vydanie PydanticAI 2.15.0 je menší, ale praktický posun pre produkčných agentov. Prináša podporu explicitného prompt caching pri OpenAI, dynamickejšie toolsety v trvácnom vykonávaní a viac opráv okolo replay, DBOS a Prefect integrácií.
AWS opisuje Self-Distilled Reasoning pre Amazon Nova: postup, ktorý pri supervised fine-tuningu využíva vlastné thinking tokeny základného modelu, keď tréningové dáta neobsahujú zlaté reťazce uvažovania.
Grabette je otvorený ručný gripper od tímu Pollen Robotics na zber ukážok manipulácie bez potreby vlastného robota. Projekt cieli na úzke miesto robotického učenia: nedostatok rôznorodých reálnych dát.
Výskum
Výskumné práce, metódy, reprodukovateľné výsledky a posuny v bezpečnosti modelov.
Prehľad na Hugging Face opisuje, prečo sa robotika a fyzická AI čoraz viac opierajú o simulované dáta, GPU fyziku a nástroje ako MuJoCo, Isaac Sim, Isaac Lab či Newton.
Nový preprint navrhuje dynamický klasifikačný servis SIFT. Lacný sparse encoder a LightGBM triedia väčšinu dokumentov, neisté prípady posielajú LLM sudcovi a jeho verdikty sa vracajú do tréningového korpusu až po kontrole regresií.
Nový výskum Apple opisuje generovanie syntetických trajektórií pre API-calling agentov iba zo špecifikácií rozhraní. Cieľom je obísť drahú prípravu plných sandboxov a databáz.
Výskumný tím Apple ukazuje CalibAtt, tréningovo voľný spôsob, ako pri difúznych text-to-video modeloch preskakovať stabilne nedôležité spojenia v pozornosti bez výraznej straty kvality.
Trendujúce tagy
Frekvencia vychádza z nedávno publikovaných článkov a pomáha rýchlo zachytiť, čo sa v odvetví práve prepája.
Archív
Chronologický archív v štýle spravodajského toku, aby staršie texty nezapadli po prvom dni.
Nový arXiv benchmark InteractBind posúva hodnotenie modelov pre proteín-ligand väzby od jednoduchého skóre k lokalizácii väzbových miest a typov interakcií.
Spoluzakladateľ Anthropic Chris Olah vystúpil pri predstavení encykliky pápeža Leva XIV. o umelej inteligencii. Firma tým posúva diskusiu o bezpečnosti AI mimo technických kruhov.
OpenAI uzatvoril prvé mediálne partnerstvo v Brazílii. Správy Folha de S.Paulo a UOL sa majú zobrazovať v ChatGPT s uvedením zdroja a odkazmi späť na vydavateľov.
Preprint katalogizuje textové a rečové dáta, modely a benchmarky pre dve západoafrické jazyky. Ukazuje, že aj pri desiatkach miliónov hovoriacich zostáva praktická infraštruktúra pre NLP nerovnomerná a krehká.
Výskumníci pripravili reprodukovateľný Universal Dependencies štýl pipeline pre grécke parlamentné texty v katharevouse. Spája OCR rekonštrukciu, LLM asistovanú anotáciu, validáciu a pevné benchmarky.
Preprint Asymmetric Scaling Laws from Sparse Features opisuje model, v ktorom testovaciu chybu určujú zriedkavé vlastnosti nevidené v trénovacích dátach. Výsledkom sú odlišné škálovacie exponenty pred a po prahu interpolácie.
Nový výskumný návrh z arXivu ukazuje, ako využiť smerovacie váhy v agentických a zložených AI systémoch na lacnú hierarchickú atribúciu. BOHM nenahrádza SHAP vo všetkom, ale rieši praktický problém, keď jednotlivé komponenty nie sú dostupné na opakované testovanie.
OpenAI opisuje dôkaz k Erdősovmu problému jednotkových vzdialeností ako míľnik pre AI v matematike. Dôležité je nielen tvrdenie o výsledku, ale aj to, ako bude komunita overovať autonómne nájdené dôkazy.
PydanticAI vydal verzie 1.102.0 a 2.0.0b3 s bezpečnostnou opravou pre špecifický prípad URL validácie. Riziko sa týka aplikácií, ktoré explicitne povolia sťahovanie lokálnych URL cez force_download='allow-local' a bežia v sieťach s NAT64 alebo ISATAP.
OpenAI zverejnila prípadovú štúdiu Virgin Atlantic. Letecká spoločnosť podľa nej použila Codex pri revízii mobilnej aplikácie, dosiahla takmer úplné unit testy a pri produkčnom spustení nemala P1 chyby. Zaujímavé je najmä to, ako sa kódovací agent presúva z vývojárskeho nástroja do širšieho dodávkového procesu.
Databricks rozšíril automatické ukladanie opakovaných častí promptov aj na otvorené modely vo svojich Foundation Model API. Pri produkčnom nasadení GPT-OSS uvádza 2,5-násobný nárast priepustnosti a trojnásobne nižšiu mediánovú latenciu bez nutnosti manuálnej konfigurácie.
Anthropic zverejnil prvú aktualizáciu Project Glasswing. Tvrdí, že približne päťdesiat partnerov s modelom Claude Mythos Preview našlo vyše desaťtisíc vysoko alebo kriticky závažných zraniteľností v dôležitom softvéri, pričom úzkym miestom už nie je hľadanie chýb, ale ich overovanie a bezpečné zverejňovanie.