MosaicLeaks upozorňuje, že výskumné agenty môžu prezradiť tajomstvá cez vyhľadávanie
ServiceNow a Hugging Face opisujú benchmark, v ktorom agenti skladajú odpovede z verejných aj súkromných dát. Únik môže vzniknúť už v postupnosti externých dopytov.
Tag
Všetky publikované články, v ktorých sa téma AI agenti objavuje ako dôležitý kontext. Aktuálne 84 textov v archíve.
ServiceNow a Hugging Face opisujú benchmark, v ktorom agenti skladajú odpovede z verejných aj súkromných dát. Únik môže vzniknúť už v postupnosti externých dopytov.
Cloudflare rozširuje svoju agentickú infraštruktúru z vlastného harnessu Project Think na všeobecnú runtime vrstvu. Prvým frameworkom, ktorý ju využíva, je Flue.
Snowflake sa pripája k špecifikácii Agentic Resource Discovery. Cieľom je, aby firmy vedeli agentov, MCP servery a nástroje vyhľadávať cez štandardný katalóg namiesto ručného prepájania každej integrácie.
Snowflake AIM zjednocuje SnowConvert AI, Snowpark Migration Accelerator a Datometry do platformy, ktorá má firmám pomôcť presúvať a modernizovať dátové systémy s podporou agentického plánovania, testovania a validácie.
AWS ukazuje rozšírenie Strands Evals, ktoré nemá iba skórovať agentov, ale vyhľadať konkrétne zlyhania v stopách behu, zoradiť ich podľa príčinnosti a navrhnúť opravy v promptoch alebo definíciách nástrojov.
Omnigent je open-source meta-harness, ktorý má z jedného rozhrania spájať Claude Code, Codex, vlastných agentov a tímovú spoluprácu. Databricks tým pomenúva nový problém: firmy už nemajú jedného agenta, ale veľa agentických nástrojov bez spoločnej kontroly.
AWS predstavuje open-source nástroj Agent-EvalKit, ktorý má presunúť hodnotenie agentov priamo do vývojového prostredia a sledovať nielen výslednú odpoveď, ale aj nástroje, dáta a kroky počas behu.
Nový príspevok Hugging Face opisuje praktický experiment, v ktorom agent spojil dva verejné Spaces a vytvoril 3D galériu Paríža. Pointa nie je samotná demo stránka, ale myšlienka, že multimediálne nástroje sa môžu stať stavebnými blokmi pre agentov.
Nový preprint hodnotí všeobecných kódovacích agentov na optogenetickom výskumnom potrubí s veľkými dátami. Výsledok je triezvy: agenti zvládajú niektoré samostatné kroky, ale zlyhávajú pri end-to-end vedeckom úsudku.
Snowflake vybral LGND AI ako víťaza Startup Challenge 2026. Startup stavia Large Earth Models nad obrovskými archívmi satelitných a leteckých snímok, aby sa fyzický svet dal vyhľadávať a používať v AI aplikáciách a agentoch.
Preprint TimeClaw navrhuje harness pre všeobecných LLM agentov, ktorí majú analyzovať časové rady v kontexte reálnych workflowov. Namiesto čisto textového uvažovania pridáva vykonateľné temporálne nástroje, pamäť a opakovateľné analytické rutiny.
Nový preprint Curation-Bench testuje, či môžu všeobecní kódovací agenti automatizovať opakovaný cyklus výberu a úprav tréningových dát. Výsledok je povzbudivý, ale ukazuje aj jasnú hranicu: bez metodického lešenia agenti skôr ladia lokálne varianty než robia výskum.