aifeed.skAI Feed

Tag

#LLM inferencia

Všetky publikované články, v ktorých sa téma LLM inferencia objavuje ako dôležitý kontext. Aktuálne 5 textov v archíve.

Apple zmapoval, kedy difúzne jazykové modely strácajú výhodu paralelného generovania
Výskum5 min čítania4 zdroje

Apple zmapoval, kedy difúzne jazykové modely strácajú výhodu paralelného generovania

Analýza Apple a univerzitných partnerov ukazuje, že paralelné generovanie tokenov samo osebe nezaručuje rýchlejšiu ani lacnejšiu inferenciu. Difúzne jazykové modely narážajú pri dlhom kontexte na opakované výpočty a pri dávkovom spracovaní zatiaľ lepšie škálujú autoregresívne modely; rozhodujúce bude zníženie počtu vzorkovacích krokov.

ARBITRAGE zrýchľuje matematické uvažovanie LLM až dvojnásobne, zatiaľ však iba v testoch
Výskum5 min čítania5 zdrojov

ARBITRAGE zrýchľuje matematické uvažovanie LLM až dvojnásobne, zatiaľ však iba v testoch

Výskumníci z UC Berkeley, Apple, ICSI a LBNL navrhli router, ktorý pri každom kroku odhaduje, či sa oplatí zapojiť výkonnejší jazykový model. Na matematických benchmarkoch hlásia až približne dvojnásobné zníženie latencie pri porovnateľnej presnosti, no výsledky pochádzajú z preprintu, vybraných otvorených modelov a kontrolovaného hardvéru.