Apple navrhuje zámok, ktorý sťažuje dolaďovanie otvorených jazykových modelov
Metóda DLR-Lock prestavuje vrstvy modelu tak, aby zachovala inferenciu, no výrazne zvýšila pamäťové a optimalizačné nároky pri ďalšom trénovaní.
Tag
Všetky publikované články, v ktorých sa téma bezpečnosť modelov objavuje ako dôležitý kontext. Aktuálne 2 textov v archíve.
Metóda DLR-Lock prestavuje vrstvy modelu tak, aby zachovala inferenciu, no výrazne zvýšila pamäťové a optimalizačné nároky pri ďalšom trénovaní.
Nová práca na arXive navrhuje geometrický rámec na identifikáciu a úpravu konkrétnych pamäťových stôp v modeloch. Tvrdí, že niektoré naučené znalosti možno skladať alebo mazať lineárnymi operáciami bez opakovaného tréningu.