Ett basismodel, flere adaptere: Behold distribusjoner uten å gjenta basisen

En LoRA er liten bare til pakkingen gjentar et stort basismodel fem ganger. Når basisen og adapterne virkelig hører sammen, er lagringsspørsmålet ikke «hvilken fil kan jeg presse sammen?», men «hvilket forhold må jeg kunne gjenopprette senere?»

Ett basismodel koblet til flere små adapterversjoner som én beslektet familie.
En liten adapter er fortsatt avhengig av en basis. Gjentatte, selvstendige distribusjoner kan gjenta denne basisen mange ganger.

Mønsteret med gjentatt basis

Det er vanlig å lage selvstendige distribusjonsmapper fordi de er praktiske å kopiere eller overlevere: én mappe per adapter, hver med basismodellen den trenger. Mappene er lette å forstå hver for seg, men biblioteket blir kostbart når den samme basisen finnes i hver distribusjon.

Den nyttige enheten er den beslektede familien. Behold basisen, adapterne og distribusjonsversjonene sammen når du kan forklare forholdet i én setning. Ikke bland uvedkommende modeller bare fordi de tilfeldigvis bruker samme disk.

Før: selvstendige mapper Basismodell kopiert inn i hver distribusjon

Praktisk lokalt, men de samme bytene kan forekomme gjentatte ganger på tvers av beslektede utgaver.

Etter: én beslektet familie Én basis, tydelige adapterversjoner
Basis-checkpoint Adapter A Adapter B Adapter C

Hva hører hjemme i én familie?

Ikke slå sammen hvert checkpoint, hver LoRA eller hvert modellformat i et gigantisk arkiv. Et arkiv bør redusere tvetydighet, ikke øke den. Hvis du ikke kan forklare hvorfor en fil hører til familien, bør du holde den adskilt.

Hva det målte resultatet faktisk viser

Det kontrollerte eksemplet med fem modell- og adapterdistribusjoner fra Tensor Archive målte 907.3 MB når hver distribusjon ble lagret for seg, og 261.6 MB som én beslektet familie: 71.2% mindre fysisk lagring. Poenget med tallet er mønsteret med gjentatt basis, ikke en universell påstand om adaptere.

Les omfanget, ikke bare prosentandelen. Fem beslektede, selvstendige distribusjoner ble brukt, og gjenopprettingene var nøyaktige. En enkelt adapter, en mappe uten delte data eller et bibliotek med uvedkommende modeller kan gi et helt annet resultat.

En trygg måte å teste mønsteret på

  1. Velg basisen og bare adapterne som faktisk hører sammen med den.
  2. Bruk Add model family → Local folder, og kjør Analyse source.
  3. Gå gjennom resultatet før arkivering. Her må en reell familie vise at den hører hjemme.
  4. Arkiver familien, kjør Verify, og gjenopprett deretter en separat kopi.
  5. Test den gjenopprettede versjonen i arbeidsflyten som trenger den, før du manuelt fjerner en gammel arbeidskopi.

Hold lagring og transformasjon adskilt

Dette er ingen grunn til å konvertere alle filer eller endre modellvekter. Tensor Archive er ikke en quantizer eller modellkonverterer. Det er et lokalt arkiv for beslektede versjoner der nøyaktig gjenoppretting er viktig. Hvis pakken er uklar, bør du undersøke hva en LoRA-fil inneholder før du grupperer den. Les SafeTensors-lagring kontra kvantisering for skillet mellom lagring og transformasjon.

Når forholdet er reelt, er arbeidsflyten enkel: analyser, arkiver, verifiser, gjenopprett og velg deretter manuelt hva som skal fjernes. Last ned Tensor Archive for å kjøre denne testen med én familie.

Kilder

Behold modellen. Frigjør plass på arbeidsdisken.Gratis nedlasting ↓