Apple skúša trénovať API agentov bez hotového prostredia
Nový výskum Apple opisuje generovanie syntetických trajektórií pre API-calling agentov iba zo špecifikácií rozhraní. Cieľom je obísť drahú prípravu plných sandboxov a databáz.
Hlavný výber redakcie
AWS opisuje Self-Distilled Reasoning pre Amazon Nova: postup, ktorý pri supervised fine-tuningu využíva vlastné thinking tokeny základného modelu, keď tréningové dáta neobsahujú zlaté reťazce uvažovania.
Najnovšie
Kurátorované AI správy v tempe redakčného magazínu: nové modely, produktové vydania, výskum aj trhové pohyby.
Nový výskum Apple opisuje generovanie syntetických trajektórií pre API-calling agentov iba zo špecifikácií rozhraní. Cieľom je obísť drahú prípravu plných sandboxov a databáz.
Výskumný tím Apple ukazuje CalibAtt, tréningovo voľný spôsob, ako pri difúznych text-to-video modeloch preskakovať stabilne nedôležité spojenia v pozornosti bez výraznej straty kvality.
Preprint RA-FR navrhuje, aby systémy na vyhľadávanie tvárí nevracali pevný Top-k zoznam, ale adaptívnu množinu s explicitnou hranicou rizika. Téma je technicky zaujímavá aj citlivá z pohľadu nasadenia v dohľade.
Nový preprint opisuje obranu pre fotorealistické 3D tvárové avatary. Namiesto úprav jednej fotografie pridáva do 3D reprezentácie jemnú vrstvu, ktorá má meniť interpretáciu modelov pri zachovaní identity.
Grabette je otvorený ručný gripper od tímu Pollen Robotics na zber ukážok manipulácie bez potreby vlastného robota. Projekt cieli na úzke miesto robotického učenia: nedostatok rôznorodých reálnych dát.
Nové vydanie PydanticAI prináša podporu nastavenia reasoning_effort pre Mistral a nahrádza staršie wrapper-agenty schopnosťami pre Temporal, DBOS a Prefect. Ide o malú, ale dôležitú zmenu pre tímy, ktoré chcú agentov prevádzkovať spoľahlivo v produkčných workflow.
AI sprievodca
Sprievodca pracuje s poslednými publikovanými textami AIFeed.sk a pripraví rýchle zhrnutie, odporúčané čítanie alebo prehľad trendov.
Tematické sekcie
Každá sekcia sa plní automaticky z publikovaného obsahu. Dôraz je na čitateľnosť, obrazový rytmus a jasné rozdelenie tém.
Novinky
Prehľad kľúčových oznámení, partnerstiev, regulačných posunov a trhových signálov.
OpenAI zverejnilo skúsenosti z interného nasadenia modelu, ktorý dokázal autonómne pracovať veľmi dlho. Firma tvrdí, že klasické hodnotenia nestačili, preto pridala testy odvodené z incidentov, sledovanie celej trajektórie a väčšiu kontrolu pre používateľov.
Patreon oznámil, že rozširuje ochranu tvorcov pred neautorizovaným zberom dát na tréning AI modelov a využije pritom Cloudflare AI Crawl Control.
OpenAI tvrdí, že prístup tínedžerov k AI má zostať otvorený, ale s inými predvolenými pravidlami než pri dospelých. Nový dôraz dáva na študijný režim, rodičovské nastavenia, odhady veku a častejšie bezpečnostné zásahy pri citlivom obsahu.
Hugging Face zverejnil bezpečnostný incident, pri ktorom autonómny agent zneužil spracovanie datasetov. Firma tvrdí, že verejné modely ani Spaces neboli pozmenené, no rotuje prístupy a sprísňuje ochranu.
Modely
Nové foundation modely, benchmarky, multimodálne schopnosti a vývoj inferencie.
Nový 4-miliardový otvorený model na Hugging Face má priniesť časové uvažovanie, akčné výstupy a reálny beh na zariadeniach Jetson či RTX bez posielania každého rozhodnutia do dátového centra.
Spoločný technický článok Hugging Face a NVIDIA ukazuje, ako spojiť Diffusers s NeMo Automodel pri tréningu difúznych modelov od jednej GPU až po väčšie klastre.
NVIDIA predstavila rodinu Nemotron 3 Embed na Hugging Face. Modely sú určené pre vyhľadávanie v RAG systémoch, pamäť agentov a kódové úlohy; najväčší variant podľa oznámenia vedie leaderboard RTEB.
Databricks oznámil day-zero dostupnosť open-weights modelu Inkling v prostredí svojej platformy. Téma je menej o jednom ďalšom modeli v katalógu a viac o tom, ako sa nové modely pripájajú k dátam, oprávneniam a agentickým pracovným tokom v podniku.
Produkty
Produktové vydania, integrácie, podnikové nástroje a praktické AI funkcie v aplikáciách.
Grabette je otvorený ručný gripper od tímu Pollen Robotics na zber ukážok manipulácie bez potreby vlastného robota. Projekt cieli na úzke miesto robotického učenia: nedostatok rôznorodých reálnych dát.
Nové vydanie PydanticAI prináša podporu nastavenia reasoning_effort pre Mistral a nahrádza staršie wrapper-agenty schopnosťami pre Temporal, DBOS a Prefect. Ide o malú, ale dôležitú zmenu pre tímy, ktoré chcú agentov prevádzkovať spoľahlivo v produkčných workflow.
AWS vydal bootloader, ktorý umožňuje komunitné alebo vlastné inštalácie operačného systému na fyzických DeepRacer autách. Zdanlivo úzka novinka predlžuje životnosť výučbového hardvéru a dáva robotickým tímom viac kontroly nad softvérovým stackom.
AWS a Couchbase opisujú produkčný návrh, v ktorom vývojársky asistent pre databázy používa Claude cez Bedrock, súkromné VPC spojenie a krížové smerovanie medzi regiónmi.
Výskum
Výskumné práce, metódy, reprodukovateľné výsledky a posuny v bezpečnosti modelov.
Nový výskum Apple opisuje generovanie syntetických trajektórií pre API-calling agentov iba zo špecifikácií rozhraní. Cieľom je obísť drahú prípravu plných sandboxov a databáz.
Výskumný tím Apple ukazuje CalibAtt, tréningovo voľný spôsob, ako pri difúznych text-to-video modeloch preskakovať stabilne nedôležité spojenia v pozornosti bez výraznej straty kvality.
Preprint RA-FR navrhuje, aby systémy na vyhľadávanie tvárí nevracali pevný Top-k zoznam, ale adaptívnu množinu s explicitnou hranicou rizika. Téma je technicky zaujímavá aj citlivá z pohľadu nasadenia v dohľade.
Nový preprint opisuje obranu pre fotorealistické 3D tvárové avatary. Namiesto úprav jednej fotografie pridáva do 3D reprezentácie jemnú vrstvu, ktorá má meniť interpretáciu modelov pri zachovaní identity.
Trendujúce tagy
Frekvencia vychádza z nedávno publikovaných článkov a pomáha rýchlo zachytiť, čo sa v odvetví práve prepája.
Archív
Chronologický archív v štýle spravodajského toku, aby staršie texty nezapadli po prvom dni.
Nové vydanie PydanticAI 1.91.0 prináša podporu volieb pre OpenAI gpt-image-2, nové modely deepseek-v4-flash a deepseek-v4-pro a zároveň opravuje viacero chýb, ktoré zasahovali eval datasety, mapovanie odpovedí aj prehrávanie MCP histórie pri volaní nástrojov.
Cerebras spustil private preview funkcie Multi-LoRA pre Cerebras Inference. Firmy môžu obsluhovať viac LoRA adaptérov nad jedným základným modelom a prepínať ich po jednotlivých požiadavkách, čo má zjednodušiť nasadenie špecializovaných agentov aj znížiť náklady na podnikovú inferenciu.
Singular Bank v Madride nasadil interného asistenta Singularity postaveného na ChatGPT a Codexe. Podľa OpenAI systém analyzuje portfóliá v reálnom čase, pripraví podklady na stretnutie za menej než minútu a bankárom má denne ušetriť 60 až 90 minút práce.
Apple Machine Learning Research predstavilo benchmark SFI-Bench, ktorý testuje, či multimodálne modely chápu nielen polohu objektov, ale aj ich funkciu. Nový video set s viac než 1700 otázkami má odhaliť, ako ďaleko sú dnešné MLLM od prakticky použiteľnej priestorovej inteligencie pre agentov a robotiku.
ServiceNow na Hugging Face rozobralo migráciu z vLLM V0 na V1 pri RL tréningu modelov a ukázalo, že kľúčové nie sú len nové optimalizačné schémy, ale najmä korektné logproby, runtime defaulty a správa váh počas behu.
AWS zverejnil detailný prípad Tomofunu, ktorý presúva detekciu správania domácich zvierat z GPU na čipy Inferentia2. Zaujímavý nie je len nižší účet za inferenciu, ale aj vzor, ako sa vision-language modely môžu s minimom zmien presúvať na špecializovaný hardvér mimo klasických GPU fariem.
Výskumníci z Karlsruhe Institute of Technology, Helmholtz Institute Ulm a TU Munich opisujú workflow, v ktorom AI agent riadi výber ďalších experimentov pri vývoji sodíkovo-iónových článkov. Cieľom je skrátiť testovanie a zároveň nestratiť kvalitu výsledku.
Hugging Face mení pravidlá svojho Open ASR Leaderboardu. Nové kvalitné, ale neverejné testovacie datasety majú obmedziť takzvané benchmaxxing a lepšie odlíšiť modely, ktoré zvládajú reálnu konverzačnú reč, prízvuky a menej sterilné podmienky.
OpenAI zverejnila špecifikáciu MRC, vlastného sieťového protokolu pre veľké tréningové klastre. Cieľom je znížiť výpadky, rozložiť prevádzku medzi viac ciest a škálovať infraštruktúru pre frontier modely s menšou energetickou aj prevádzkovou režiou.
Open-source serving framework SGLang vydal verziu 0.5.11, ktorá kombinuje prechod na CUDA 13 a Torch 2.11 s agresívnejšími infra optimalizáciami pre speculative decoding, prefix cache aj disaggregated deploymenty.
Apple Machine Learning Research ukazuje, že tlak na lacnejší serving nemusí ísť len cez kvantizáciu či skracovanie kontextu. Nová práca skúša zmenšiť KV cache po hĺbke siete a zachovať pritom výkon aj priepustnosť.
OpenAI pri GPT-5.5 Instant nespravilo len bežný produktový refresh. V system card po prvý raz označuje instantný model za vysoko schopný v kybernetike aj bio rizikách a pridáva prísnejšie ochrany.
Vyhľadávanie
Rýchla interná navigácia cez plnotextové vyhľadávanie nad publikovaným archívom.