
K-Search prenáša optimalizácie CUDA na Apple Silicon a zrýchľuje lokálnu AI
Výskumníci z UC Berkeley a IBM ukázali, že znalosti z optimalizácie jadier CUDA možno systematicky preložiť do natívnych stratégií pre MLX. K-Search sa na Apple Silicon priblížil výkonu ručne ladeného attention jadra a pri Mamba SSM výrazne zrýchlil úvodné spracovanie kontextu.