Jeden základní model, několik adaptérů: zachovejte nasazení bez opakování základu
LoRA je malá jen do chvíle, než způsob balení zopakuje velký základní model pětkrát. Pokud k sobě základ a adaptéry skutečně patří, otázka ukládání nezní „který soubor mohu stlačit?“, ale „který vztah budu muset později obnovit?“
Vzor opakovaného základu
Samostatné složky nasazení se běžně vytvářejí, protože se snadno kopírují nebo předávají: jedna složka na adaptér, přičemž každá obsahuje potřebný základní model. Jednotlivým složkám se snadno rozumí, ale knihovna je nákladná, když se tentýž základ objevuje v každém nasazení.
Užitečnou jednotkou je související rodina. Základ, adaptéry a verze nasazení uchovávejte pohromadě, pokud jejich vztah dokážete vyjádřit jednou větou. Nemíchejte nesouvisející modely jen proto, že se nacházejí na stejném disku.
Místně praktické, ale tytéž bajty se mohou v souvisejících vydáních opakovat.
Co patří do jedné rodiny?
- jeden základní kontrolní bod s LoRAs nebo adaptéry, které jsou pro něj určeny;
- úzce související samostatná nasazení, která tento základ opakují; nebo
- dokončené revize z jediného modelového projektu s jasným účelem obnovení.
Neslučujte každý kontrolní bod, každou LoRA ani každý formát modelu do obřího archivu. Archiv má nejasnosti snižovat, ne přidávat. Pokud nedokážete vysvětlit, proč soubor do rodiny patří, ponechte jej odděleně.
Co změřený výsledek skutečně ukazuje
Kontrolovaný příklad pěti nasazení modelů a adaptérů v Tensor Archive naměřil 907.3 MB při nezávislém uložení každého nasazení a 261.6 MB jako jednu související rodinu: o 71.2% méně fyzického úložiště. Smyslem čísla je vzor opakovaného základu, nikoli univerzální tvrzení o adaptérech.
Čtěte rozsah, nejen procento. Bylo použito pět souvisejících samostatných nasazení a obnovení byla přesná. Jednotlivý adaptér, složka bez sdílených dat nebo knihovna nesouvisejících modelů mohou mít zcela jiný výsledek.
Bezpečný způsob otestování vzoru
- Vyberte základ a pouze adaptéry, které s ním skutečně souvisejí.
- Použijte Add model family → Local folder a spusťte Analyse source.
- Před archivací zkontrolujte výsledek; zde skutečná rodina dokazuje, že sem patří.
- Archivujte, spusťte Verify a poté obnovte samostatnou kopii.
- Než ručně odstraníte starou pracovní kopii, otestujte obnovenou verzi v pracovním postupu, který ji potřebuje.
Ukládání a transformaci udržujte oddělené
To není důvod ke konverzi každého souboru ani ke změně vah modelu. Tensor Archive není kvantizátor ani převodník modelů; je místním archivem souvisejících verzí, u nichž záleží na přesném obnovení. Není-li balíček jasný, před seskupením zjistěte, co soubor LoRA obsahuje. Rozdíl mezi ukládáním a transformací vysvětluje článek SafeTensors: ukládání versus kvantizace.
Je-li vztah skutečný, postup je jednoduchý: analyzovat, archivovat, ověřit, obnovit a poté ručně zvolit, co odstranit. Stáhněte Tensor Archive a spusťte tento test s jednou rodinou.
Zdroje
- LoRA: Low-Rank Adaptation of Large Language Models – proč jsou adaptéry samostatnými aktualizacemi základu s nízkou hodností.
- Souhrn benchmarku Tensor Archive – pracovní zátěž pěti nasazení a doklady přesného obnovení.