Od redakcie: AI sa 24. augusta posúvala od modelov k infraštruktúre, agentom a suverenite
Denný prehľad 24. augusta: efektívnejšie video uvažovanie od Apple, nové smerovanie inferencie, spravovaný Ray na AWS aj veľká dohoda Mistralu o suverénnej AI.
Tag
Všetky publikované články, v ktorých sa téma AI agenti objavuje ako dôležitý kontext. Aktuálne 68 textov v archíve.
Denný prehľad 24. augusta: efektívnejšie video uvažovanie od Apple, nové smerovanie inferencie, spravovaný Ray na AWS aj veľká dohoda Mistralu o suverénnej AI.
Hodnotenie verejných bezpečnostných plánov piatich veľkých AI laboratórií odhalilo medzeru medzi testovaním rizík a pripravenosťou na incident po nasadení modelu.
Denný prehľad 19. augusta: Apple skúmal ľudské správanie modelov, Google rozšíril AI učenie a AWS ukázalo presnejšie vyhľadávanie aj produkčný multiagentový systém.
Experiment s reálnym robotom ukazuje, že nejednoznačný pokyn nemusí vždy vyžadovať otázku človeku. Systém v 36 pokusoch striedal nové pozorovanie, spresnenie zámeru a výber objektu; výsledky sú sľubné, no zatiaľ pochádzajú iba z deviatich stolových scenárov.
Cursor potvrdil dokončenie akvizície spoločnosťou SpaceX. Nový vlastník mu má poskytnúť rozsiahlu GPU infraštruktúru na tréning a prevádzku modelov, no firmy zatiaľ nezverejnili konkrétne kapacity, integračný plán ani zmeny pre podnikových zákazníkov.
Cloudflare Gateway dokáže identifikovať kontrolovanú MCP prevádzku, priradiť ju k používateľom a serverom a obmedziť priame spojenia mimo firemného portálu. Sieťová detekcia však nerieši lokálne servery, autorizáciu nástrojov ani bezpečnosť argumentov sama osebe.
Nový technický postup AWS rozoberá kompozitné odmeny pre viac-krokové reinforcement fine-tuning úlohy. Upozorňuje, že aj zdanlivo zdravý tréning môže ignorovať kľúčovú zložku odmeny, ak medzi odpoveďami nevytvára merateľný rozdiel.
AWS opísalo, ako posielať telemetriu AI agentov z lokálnej infraštruktúry a iných cloudov do AgentCore Observability cez OpenTelemetry, ADOT, CloudWatch a IAM. Postup bol prakticky overený v simulovanom on-premises prostredí a v Google Cloud Shell; podporu Azure AWS uvádza ako možnosť rovnakej architektúry, nie ako samostatne zdokumentovaný test.
Komunitný experiment Hugging Face vytvoril 6 816 verejných reprodukčných záznamov k 2 226 prácam z ICML 2026. Agenti pomohli odhaliť konkrétne chyby, no protichodné verdikty, omyly v samotných auditoch a nutnosť ľudskej kontroly vylučujú jednoduché čítanie výsledkov ako rebríčka kvality konferencie.
Rozšírenia Amazon Quick sprístupňujú prácu s podnikovými dátami a agentické úpravy priamo vo Worde, Exceli, PowerPointe a Outlooku. Nasadenie však vyžaduje kontrolu oprávnení, dátových tokov, kvality výstupov a pravidiel pre používanie AI.
Referenčná architektúra AWS spája Amazon Bedrock AgentCore Browser so Strands Agents, Playwrightom a kontrolou človekom pred citlivými úkonmi. Ide o technický vzor pre systémy bez vhodného API, nie o nezávisle overený dôkaz vyššej spoľahlivosti oproti klasickej RPA.
Aktualizovaná verzia benchmarku ukazuje zlepšenie východiskového svetového modelu v 63 zo 64 behov agentov Codex-5.4 a Claude Opus 4.6. Nové kontroly zahŕňajú scenárové testy, porovnanie s automatickým ladením, opakovanie s ďalšími seedmi a audit možného obchádzania metrík; stále však nejde o dôkaz plne autonómnej vedy.