Ollama
Ollama and contributors · Chat para desktop, CLI e API local para executar e gerenciar modelos de IA compatíveis, com requisitos de hardware específicos por modelo e serviços opcionais na nuvem.
Descrição
Ollama oferece um aplicativo de chat para desktop, ferramentas de linha de comando e uma API local para executar e gerenciar modelos de IA compatíveis. Desenvolvedores e pessoas que exploram IA local podem usá-lo para conversar, prototipar aplicativos com modelos e conectar ferramentas de programação compatíveis. Este cask instala Ollama.app e o executável ollama incluído, em vez da distribuição separada que contém apenas o binário.
Recursos
- Converse com modelos compatíveis pelo aplicativo de desktop ou pela linha de comando.
- Baixe, liste, execute e gerencie variantes de modelos da biblioteca Ollama.
- Use modelos compatíveis de visão, embeddings, chamada de ferramentas ou decisão, conforme os recursos de cada modelo.
- Integre aplicativos pela API REST local e pelas bibliotecas oficiais de Python/JavaScript.
- Crie configurações de modelos com Modelfiles e importe formatos de modelo compatíveis.
- Conecte agentes de programação externos compatíveis por integrações de inicialização documentadas; esses agentes continuam sendo produtos separados.
Instalação e primeiros passos
Instale brew install --cask ollama-app ou baixe o pacote oficial para macOS e coloque Ollama.app em Applications. Inicie o aplicativo, selecione um modelo adequado e envie um prompt. O cask vincula o comando ollama incluído ao diretório bin do Homebrew. O aplicativo independente pode oferecer a criação de um link da CLI em /usr/local/bin, caso ele não exista. Usuários da CLI podem executar ollama para escolher um modelo ou integração, ou ollama run <model> para um modelo específico. O download inicial de modelos exige acesso à rede e espaço adicional em disco. As bibliotecas de Python e JavaScript são integrações opcionais, não necessárias para iniciar o aplicativo para Mac empacotado.
Requisitos do sistema e hardware
A documentação oficial para Mac e o cask atual exigem macOS Sonoma14 ou posterior. Macs com chips da série M da Apple são compatíveis com execução em CPU e GPU; Macs Intel x86 usam execução em CPU, de acordo com os requisitos oficiais para Mac. A partir da versão 0.40.0, o MLX é usado automaticamente em Apple Silicon para arquiteturas de modelo compatíveis com esse ambiente de execução; isso não significa que todos os modelos sejam executados com MLX. O desempenho, a memória e a aceleração disponível dependem do tamanho do modelo, do comprimento do contexto e do hardware. Não foi confirmado um mínimo único de RAM para todos os modelos. Os arquivos de modelo podem ocupar dezenas a centenas de GB. O arquivo do aplicativo tem 206,260,689 bytes, sem contar os modelos baixados e o armazenamento da instalação.
Plataformas, dependências e conflitos
Ollama oferece opções oficiais de instalação para macOS, Windows e Linux, além de uma imagem oficial do Docker. Este cask é o pacote de desktop para macOS; os requisitos de instalação e GPU para Linux ou Windows são diferentes. Os clientes móveis de terceiros listados pelo projeto são integrações, não uma versão móvel oficial deste aplicativo. O cask não declara dependências adicionais de fórmula e informa explicitamente que há conflito com ollama-binary. Uma fórmula separada do Homebrew, um executável instalado manualmente ou outro servidor em execução também podem entrar em conflito com o PATH ou com a porta do serviço local; verifique a instalação selecionada, em vez de iniciar servidores duplicados. A API normalmente usa localhost:11434. Uma integração local precisa de um servidor em execução e de um modelo compatível com a operação solicitada.
Modelos, privacidade e limpeza
A execução local de modelos e a execução opcional na nuvem são fluxos de trabalho diferentes. Um modelo na nuvem selecionado exige acesso à rede e o cumprimento dos termos aplicáveis da conta e do serviço; não presuma que todos os prompts permanecem no dispositivo apenas porque o cliente está instalado localmente. Os modelos baixados têm licenças e condições de uso próprias, independentes da licença de software do Ollama. Depois que os arquivos necessários estiverem presentes, o uso de modelos locais pode continuar sem novos downloads, conforme os recursos utilizados. O comando opcional Homebrew zap exclui ~/.ollama, que contém modelos e configurações, além de dados de suporte do aplicativo, preferências e caches. Preserve primeiro os dados necessários; a remoção dos modelos pode exigir novos downloads grandes.
Contas, custos e licença
O software-fonte do Ollama é licenciado sob MIT. A execução local não exige uma assinatura paga do Ollama, mas usa seus próprios recursos computacionais e modelos licenciados separadamente. Modelos e serviços opcionais na nuvem exigem o respectivo login e podem ter limites de plano ou de uso; consulte a documentação oficial atual sobre a nuvem para verificar os direitos de uso e os preços. Agentes integrados e provedores terceirizados mantêm suas próprias taxas e contas. A instalação não concede direitos irrestritos sobre todos os modelos da biblioteca.
Referências oficiais
Novidades Novidades da versão 0.40.2 8 de out. · Editoria OpenNavo · Tradução por IA
- ModelosModelos antigos atualizam em segundo plano no primeiro uso.
- CLIollama list deixa de duplicar modelos atualizados.