Executar modelos de IA localmente é ótimo para privacidade e experimentação, mas cada modelo é grande. Experimente alguns tamanhos e variantes de vários modelos e você poderá facilmente ter 50 GB ou mais de pesos que esqueceu.
Cada ferramenta mantém seu próprio armazenamento e cada uma possui uma maneira adequada de remover modelos. Usá-lo evita quebrar modelos que você deseja manter.
Ollama
Ollama armazena modelos em ~/.ollama/models. Os dados do modelo são divididos em camadas compartilhadas ("blobs"), para que diferentes modelos possam compartilhar partes. É por isso que você deve remover modelos por meio de Ollama em vez de excluir arquivos blob diretamente.
Veja o que você tem:
ollama list
Lista cada modelo com seu tamanho e quando foi modificado pela última vez.
Remover um modelo:
ollama rm llama3:70b
Substitua llama3:70b pelo nome mostrado por ollama list. Ollama remove camadas que não são mais usadas por nenhum modelo restante.
Verifique o tamanho total:
du -sh ~/.ollama/models
Hugging Face
Bibliotecas como transformers e diffusers baixam modelos no cache Hugging Face, por padrão ~/.cache/huggingface/hub. A ferramenta de linha de comando Hugging Face pode mostrar e limpar este cache:
huggingface-cli scan-cache
Isso lista cada modelo, conjunto de dados e revisão em cache com seu tamanho. Para escolher o que excluir interativamente:
huggingface-cli delete-cache
Versões mais recentes da ferramenta também fornecem esses comandos no comando hf; execute hf --help para verificar. Se você definir um local personalizado com as variáveis de ambiente HF_HOME ou HF_HUB_CACHE, o cache estará lá.
LM Studio
Abra LM Studio e vá para My Models. Cada modelo baixado é listado com seu tamanho. Use o menu ao lado de um modelo para excluí-lo ou revele sua pasta no Finder para verificar onde seus modelos estão armazenados.
Outros lugares onde os modelos se escondem
- Ambientes virtuais Python às vezes contêm arquivos de modelo baixados em pastas de projeto.
- Aplicativos de geração de imagens geralmente mantêm checkpoints e LoRAs em suas próprias pastas dentro de
~/Library/Application Supportou em uma pasta que você escolheu durante a configuração. - Contêineres Docker executando servidores de modelo podem manter os modelos dentro da imagem de disco do Docker. Consulte limpar caches de desenvolvedor.
Decida o que manter
Antes de excluir, considere quanto tempo um modelo levou para ser baixado, se você usa uma versão quantizada específica e se você o personalizou (por exemplo, um Modelfile do Ollama). Baixar novamente um modelo grande pode demorar muito em uma conexão mais lenta.
Perguntas frequentes
Onde o Ollama armazena modelos em um Mac?
Em ~/.ollama/models por padrão, a menos que você tenha definido a variável de ambiente OLLAMA_MODELS para outro local.
Posso excluir arquivos em ~/.ollama/models/blobs diretamente?
Não é recomendado. Os blobs são compartilhados entre modelos, portanto, excluí-los manualmente pode quebrar os modelos que você deseja manter. Use ollama rm em vez disso.
Onde está o cache Hugging Face em um Mac?
Por padrão em ~/.cache/huggingface/hub. Use o comando de varredura de cache CLI Hugging Face para ver o que há nele.
Quer que façamos isso por você?
spacerecover lista os modelos Ollama e Hugging Face um por um com seus tamanhos, explica que eles precisarão ser baixados novamente e recomenda removê-los por meio da própria ferramenta para que as camadas compartilhadas nunca sejam quebradas.