Stanford HAI upozorňuje, že kódovací agenti zatiaľ zlyhávajú pri tímovej práci
Stanford HAI opisuje benchmark CooperBench, v ktorom dvojice kódovacích agentov často dopadli horšie než jeden agent pracujúci sám.
Tag
Všetky publikované články, v ktorých sa téma multiagentové systémy objavuje ako dôležitý kontext. Aktuálne 2 textov v archíve.
Stanford HAI opisuje benchmark CooperBench, v ktorom dvojice kódovacích agentov často dopadli horšie než jeden agent pracujúci sám.
Hugging Face publikoval technický field report z hackathonu, v ktorom päť agentov nad 3B modelom Qwen2.5 obchoduje v malej simulačnej ekonomike. Zaujímavý nie je marketingový efekt, ale praktické ponaučenia: malé modely sú lacné na veľa opakovaných rozhodnutí, no potrebujú prísne obmedzenia, opravy výstupu a dobre navrhnuté prostredie.