Apple skúša trénovať API agentov bez hotového prostredia
Nový výskum Apple opisuje generovanie syntetických trajektórií pre API-calling agentov iba zo špecifikácií rozhraní. Cieľom je obísť drahú prípravu plných sandboxov a databáz.
Hlavný výber redakcie
AWS opisuje Self-Distilled Reasoning pre Amazon Nova: postup, ktorý pri supervised fine-tuningu využíva vlastné thinking tokeny základného modelu, keď tréningové dáta neobsahujú zlaté reťazce uvažovania.
Najnovšie
Kurátorované AI správy v tempe redakčného magazínu: nové modely, produktové vydania, výskum aj trhové pohyby.
Nový výskum Apple opisuje generovanie syntetických trajektórií pre API-calling agentov iba zo špecifikácií rozhraní. Cieľom je obísť drahú prípravu plných sandboxov a databáz.
Výskumný tím Apple ukazuje CalibAtt, tréningovo voľný spôsob, ako pri difúznych text-to-video modeloch preskakovať stabilne nedôležité spojenia v pozornosti bez výraznej straty kvality.
Preprint RA-FR navrhuje, aby systémy na vyhľadávanie tvárí nevracali pevný Top-k zoznam, ale adaptívnu množinu s explicitnou hranicou rizika. Téma je technicky zaujímavá aj citlivá z pohľadu nasadenia v dohľade.
Nový preprint opisuje obranu pre fotorealistické 3D tvárové avatary. Namiesto úprav jednej fotografie pridáva do 3D reprezentácie jemnú vrstvu, ktorá má meniť interpretáciu modelov pri zachovaní identity.
Grabette je otvorený ručný gripper od tímu Pollen Robotics na zber ukážok manipulácie bez potreby vlastného robota. Projekt cieli na úzke miesto robotického učenia: nedostatok rôznorodých reálnych dát.
Nové vydanie PydanticAI prináša podporu nastavenia reasoning_effort pre Mistral a nahrádza staršie wrapper-agenty schopnosťami pre Temporal, DBOS a Prefect. Ide o malú, ale dôležitú zmenu pre tímy, ktoré chcú agentov prevádzkovať spoľahlivo v produkčných workflow.
AI sprievodca
Sprievodca pracuje s poslednými publikovanými textami AIFeed.sk a pripraví rýchle zhrnutie, odporúčané čítanie alebo prehľad trendov.
Tematické sekcie
Každá sekcia sa plní automaticky z publikovaného obsahu. Dôraz je na čitateľnosť, obrazový rytmus a jasné rozdelenie tém.
Novinky
Prehľad kľúčových oznámení, partnerstiev, regulačných posunov a trhových signálov.
OpenAI zverejnilo skúsenosti z interného nasadenia modelu, ktorý dokázal autonómne pracovať veľmi dlho. Firma tvrdí, že klasické hodnotenia nestačili, preto pridala testy odvodené z incidentov, sledovanie celej trajektórie a väčšiu kontrolu pre používateľov.
Patreon oznámil, že rozširuje ochranu tvorcov pred neautorizovaným zberom dát na tréning AI modelov a využije pritom Cloudflare AI Crawl Control.
OpenAI tvrdí, že prístup tínedžerov k AI má zostať otvorený, ale s inými predvolenými pravidlami než pri dospelých. Nový dôraz dáva na študijný režim, rodičovské nastavenia, odhady veku a častejšie bezpečnostné zásahy pri citlivom obsahu.
Hugging Face zverejnil bezpečnostný incident, pri ktorom autonómny agent zneužil spracovanie datasetov. Firma tvrdí, že verejné modely ani Spaces neboli pozmenené, no rotuje prístupy a sprísňuje ochranu.
Modely
Nové foundation modely, benchmarky, multimodálne schopnosti a vývoj inferencie.
Nový 4-miliardový otvorený model na Hugging Face má priniesť časové uvažovanie, akčné výstupy a reálny beh na zariadeniach Jetson či RTX bez posielania každého rozhodnutia do dátového centra.
Spoločný technický článok Hugging Face a NVIDIA ukazuje, ako spojiť Diffusers s NeMo Automodel pri tréningu difúznych modelov od jednej GPU až po väčšie klastre.
NVIDIA predstavila rodinu Nemotron 3 Embed na Hugging Face. Modely sú určené pre vyhľadávanie v RAG systémoch, pamäť agentov a kódové úlohy; najväčší variant podľa oznámenia vedie leaderboard RTEB.
Databricks oznámil day-zero dostupnosť open-weights modelu Inkling v prostredí svojej platformy. Téma je menej o jednom ďalšom modeli v katalógu a viac o tom, ako sa nové modely pripájajú k dátam, oprávneniam a agentickým pracovným tokom v podniku.
Produkty
Produktové vydania, integrácie, podnikové nástroje a praktické AI funkcie v aplikáciách.
Grabette je otvorený ručný gripper od tímu Pollen Robotics na zber ukážok manipulácie bez potreby vlastného robota. Projekt cieli na úzke miesto robotického učenia: nedostatok rôznorodých reálnych dát.
Nové vydanie PydanticAI prináša podporu nastavenia reasoning_effort pre Mistral a nahrádza staršie wrapper-agenty schopnosťami pre Temporal, DBOS a Prefect. Ide o malú, ale dôležitú zmenu pre tímy, ktoré chcú agentov prevádzkovať spoľahlivo v produkčných workflow.
AWS vydal bootloader, ktorý umožňuje komunitné alebo vlastné inštalácie operačného systému na fyzických DeepRacer autách. Zdanlivo úzka novinka predlžuje životnosť výučbového hardvéru a dáva robotickým tímom viac kontroly nad softvérovým stackom.
AWS a Couchbase opisujú produkčný návrh, v ktorom vývojársky asistent pre databázy používa Claude cez Bedrock, súkromné VPC spojenie a krížové smerovanie medzi regiónmi.
Výskum
Výskumné práce, metódy, reprodukovateľné výsledky a posuny v bezpečnosti modelov.
Nový výskum Apple opisuje generovanie syntetických trajektórií pre API-calling agentov iba zo špecifikácií rozhraní. Cieľom je obísť drahú prípravu plných sandboxov a databáz.
Výskumný tím Apple ukazuje CalibAtt, tréningovo voľný spôsob, ako pri difúznych text-to-video modeloch preskakovať stabilne nedôležité spojenia v pozornosti bez výraznej straty kvality.
Preprint RA-FR navrhuje, aby systémy na vyhľadávanie tvárí nevracali pevný Top-k zoznam, ale adaptívnu množinu s explicitnou hranicou rizika. Téma je technicky zaujímavá aj citlivá z pohľadu nasadenia v dohľade.
Nový preprint opisuje obranu pre fotorealistické 3D tvárové avatary. Namiesto úprav jednej fotografie pridáva do 3D reprezentácie jemnú vrstvu, ktorá má meniť interpretáciu modelov pri zachovaní identity.
Trendujúce tagy
Frekvencia vychádza z nedávno publikovaných článkov a pomáha rýchlo zachytiť, čo sa v odvetví práve prepája.
Archív
Chronologický archív v štýle spravodajského toku, aby staršie texty nezapadli po prvom dni.
OpenAI investuje 150 miliónov dolárov do programu pre konzultačných, integračných a technologických partnerov. Cieľom je zrýchliť bezpečné zavádzanie modelov, agentov a nástrojov do veľkých organizácií.
Omnigent je open-source meta-harness, ktorý má z jedného rozhrania spájať Claude Code, Codex, vlastných agentov a tímovú spoluprácu. Databricks tým pomenúva nový problém: firmy už nemajú jedného agenta, ale veľa agentických nástrojov bez spoločnej kontroly.
Nové vydanie inference stacku SGLang pridáva podporu ďalších autoregresívnych aj difúznych modelov a posúva Spec V2 do produkčnej roly. Pre tímy, ktoré obsluhujú veľké modely vo vlastnej infraštruktúre, je dôležitá najmä nižšia réžia schedulera a jednotnejšia cesta pre EAGLE, MTP a tree drafting.
Nový open-source balík olmo-eval cieli na hodnotenie modelov počas ich vývoja, nie až po finálnom vydaní. Pre tímy okolo otvorených modelov je to signál, že evals sa posúvajú bližšie k samotnému tréningu.
Nový technický postup AWS spája Amazon Quick s Webex MCP servermi. Ukazuje, ako môže agent pripraviť podklady pred poradou, vyhľadať nedoriešené úlohy a po stretnutí pripraviť follow-up.
Výskumníci navrhujú sledovať elementové veľkosti váh v transformeroch cez dvojparametrové Weibullovo rozdelenie. Cieľom je jemnejšie zachytiť tréningovú dynamiku, vrstvy a komponenty, ktoré pri agregovaných metrikách splývajú.
Nový arXiv preprint predstavuje AfriSUD, kolekciu syntakticky anotovaných dát pre deväť afrických jazykov. Práca je dôležitá pre hodnotenie NLP modelov mimo jazykov, ktoré dominujú dnešným benchmarkom.
Nová práca upozorňuje, že detektory lží pre veľké jazykové modely sa nedajú hodnotiť iba na modeloch, ktoré sa naoko správajú nepravdivo. Autori preto navrhujú testbedy, kde je najprv overené, čomu model skutočne verí.
Štúdia na arXiv opisuje štruktúrovaný systém modulov, ktorý má pred mediáciou pomôcť stranám pomenovať preferencie, pripraviť odpovede a zhrnúť pozície bez toho, aby nahrádzal samotného mediátora.
Nový konverzačný nástroj Ask DoorDash má používateľom umožniť opísať chuť, príležitosť alebo nahrať fotografiu a dostať sa rýchlejšie k reštaurácii, potravinám či rezervácii.
Nový preprint ukazuje dvojstupňový postup, v ktorom sa model so štandardnou pozornosťou prevedie na sliding-window attention a následne doladí posilňovaným učením pre matematické úlohy.
Nové vydania Pydantic AI prinášajú opravu bezpečnostného problému, pri ktorom mohol klient cez providerMetadata podstrčiť UploadedFile odkaz a prinútiť server čítať súbory pod vlastnými oprávneniami.
Vyhľadávanie
Rýchla interná navigácia cez plnotextové vyhľadávanie nad publikovaným archívom.