Tensor Wiki · respostas técnicas diretas

Encontre o ficheiro.
Depois decida.

Explicações resumidas e com fontes para as perguntas que surgem normalmente cinco minutos antes de alguém eliminar a pasta de modelos errada.

Factos operacionais primeiroAfirmações dependentes da versão com fontesLimites em linguagem clara
Um mapa moderno de caminhos que liga pastas locais de modelos, caches, formatos e localizações de execução.

Consulte a Wiki

Comece pelo armazenamento que consegue ver.

Estas páginas ajudam a localizar e compreender os dados locais existentes. Não lhe dizem que elimine uma cache ou arquivo antes de saber o que depende do mesmo.

LoRA

O que é LoRA em AI? Explicação da Low-Rank Adaptation

Veja por que um pequeno adaptador aprendido pode orientar um modelo base congelado — e por que esse adaptador continua a depender da base.

Formato

O que é GGUF? Tensores, metadados e quantização

Compreenda o contentor orientado para inferência utilizado pelo llama.cpp sem presumir que todos os GGUF estão quantizados.

Formato

GGUF vs. SafeTensors: escolha de acordo com o fluxo de trabalho

Compare a finalidade de execução, o empacotamento, os metadados e os limites da conversão em vez de tratar as extensões como níveis de qualidade.

Artefactos

Checkpoint vs. LoRA: estado completo ou atualização de adaptador?

Saiba o que pode ser carregado como modelo principal, o que exige uma base e que artefactos relacionados tornam a recuperação completa.

LoRA

O que é um ficheiro LoRA?

Inspecione os pesos do adaptador, o empacotamento SafeTensors, a configuração complementar e a dependência exata do modelo base.

Memória cache

Alterar o diretório da cache do Hugging Face

Escolha HF_HOME ou HF_HUB_CACHE, migre os snapshots existentes e comprove o novo caminho antes de limpar.

Execução

Alterar o diretório de modelos do Ollama: mover e verificar em segurança

Defina OLLAMA_MODELS no macOS, Linux ou Windows e conserve o armazenamento antigo até um modelo conhecido passar por um reinício.

Execução

Pasta de modelos do ComfyUI: caminhos nativos e adicionais

Coloque os checkpoints e as LoRAs nas pastas nativas certas ou ligue uma biblioteca externa partilhada de modelos sem criar outra cópia.

Memória cache

Onde fica o diretório da cache do Hugging Face?

Encontre a localização da cache do Hugging Face, inspecione as substituições e distinga um snapshot de cache de uma biblioteca de modelos intencional.

Execução

Localização dos modelos do Ollama: onde são armazenados?

Encontre o diretório de modelos do Ollama, verifique OLLAMA_MODELS e evite mover às cegas uma pasta de execução ativa.

Treino

LoRA vs. QLoRA: o que muda e o que permanece?

Compare QLoRA vs. LoRA ao decidir o que representa um artefacto de treino e o que tem de continuar reproduzível.

Formato

O que é um ficheiro SafeTensors?

Compreenda o formato de ficheiro SafeTensors, o significado de «seguro» e por que uma extensão não constitui uma política completa de conservação ou confiança.

Execução

Localização dos modelos do LM Studio: onde armazena o LM Studio os modelos?

Utilize o inventário de modelos e o processo de importação do próprio LM Studio antes de alterar o armazenamento local de modelos.