MacDesenvolvedores2 min de leitura

Como encontrar e remover modelos locais de IA em um Mac (Ollama, Hugging Face, LM Studio)

Cada modelo de IA local pode ter vários gigabytes. Aqui é onde Ollama, Hugging Face e LM Studio os armazenam em um Mac e como remover aqueles que você não usa mais.

Atualizado · Escrito pela equipe spacerecover

Executar modelos de IA localmente é ótimo para privacidade e experimentação, mas cada modelo é grande. Experimente alguns tamanhos e variantes de vários modelos e você poderá facilmente ter 50 GB ou mais de pesos que esqueceu.

Cada ferramenta mantém seu próprio armazenamento e cada uma possui uma maneira adequada de remover modelos. Usá-lo evita quebrar modelos que você deseja manter.

Ollama

Ollama armazena modelos em ~/.ollama/models. Os dados do modelo são divididos em camadas compartilhadas ("blobs"), para que diferentes modelos possam compartilhar partes. É por isso que você deve remover modelos por meio de Ollama em vez de excluir arquivos blob diretamente.

Veja o que você tem:

ollama list

Lista cada modelo com seu tamanho e quando foi modificado pela última vez.

Remover um modelo:

ollama rm llama3:70b

Substitua llama3:70b pelo nome mostrado por ollama list. Ollama remove camadas que não são mais usadas por nenhum modelo restante.

Verifique o tamanho total:

du -sh ~/.ollama/models

Hugging Face

Bibliotecas como transformers e diffusers baixam modelos no cache Hugging Face, por padrão ~/.cache/huggingface/hub. A ferramenta de linha de comando Hugging Face pode mostrar e limpar este cache:

huggingface-cli scan-cache

Isso lista cada modelo, conjunto de dados e revisão em cache com seu tamanho. Para escolher o que excluir interativamente:

huggingface-cli delete-cache

Versões mais recentes da ferramenta também fornecem esses comandos no comando hf; execute hf --help para verificar. Se você definir um local personalizado com as variáveis ​​de ambiente HF_HOME ou HF_HUB_CACHE, o cache estará lá.

LM Studio

Abra LM Studio e vá para My Models. Cada modelo baixado é listado com seu tamanho. Use o menu ao lado de um modelo para excluí-lo ou revele sua pasta no Finder para verificar onde seus modelos estão armazenados.

Outros lugares onde os modelos se escondem

  • Ambientes virtuais Python às vezes contêm arquivos de modelo baixados em pastas de projeto.
  • Aplicativos de geração de imagens geralmente mantêm checkpoints e LoRAs em suas próprias pastas dentro de ~/Library/Application Support ou em uma pasta que você escolheu durante a configuração.
  • Contêineres Docker executando servidores de modelo podem manter os modelos dentro da imagem de disco do Docker. Consulte limpar caches de desenvolvedor.

Decida o que manter

Antes de excluir, considere quanto tempo um modelo levou para ser baixado, se você usa uma versão quantizada específica e se você o personalizou (por exemplo, um Modelfile do Ollama). Baixar novamente um modelo grande pode demorar muito em uma conexão mais lenta.

Perguntas frequentes

Onde o Ollama armazena modelos em um Mac?

Em ~/.ollama/models por padrão, a menos que você tenha definido a variável de ambiente OLLAMA_MODELS para outro local.

Posso excluir arquivos em ~/.ollama/models/blobs diretamente?

Não é recomendado. Os blobs são compartilhados entre modelos, portanto, excluí-los manualmente pode quebrar os modelos que você deseja manter. Use ollama rm em vez disso.

Onde está o cache Hugging Face em um Mac?

Por padrão em ~/.cache/huggingface/hub. Use o comando de varredura de cache CLI Hugging Face para ver o que há nele.

Quer que façamos isso por você?

spacerecover lista os modelos Ollama e Hugging Face um por um com seus tamanhos, explica que eles precisarão ser baixados novamente e recomenda removê-los por meio da própria ferramenta para que as camadas compartilhadas nunca sejam quebradas.

Fontes e leituras adicionais

CONTINUE