Ollama é uma plataforma de código aberto para executar modelos de linguagem grandes (LLMs) localmente, sem depender de serviços em nuvem.
Configuração e gerenciamento de LLMs locais
Ollama foi criado para baixar, executar e gerenciar modelos de IA no seu próprio dispositivo, com suporte para GPUs NVIDIA e AMD.
Execute LLMs offline após a instalação
Suporte para modelos como Llama 3.2, Mistral e Phi-4
Configure parâmetros de modelo usando Modelfile
API para desenvolvedores integrar modelos locais em aplicativos
Gerenciamento de versões de modelos
Suporte multimodal (texto e imagens)
Em 2024, Ollama passou de 130.000 downloads no GitHub.
Noções básicas de instalação
Ollama funciona como aplicativo de desktop no macOS e Linux, com uma versão de prévia para Windows.
Baixe o instalador em https://ollama.com/
Instale Ollama no seu computador
Abra um terminal
Baixe um modelo com ollama pull <model>
Inicie com ollama run
Digite prompts para obter respostas
Ollama é gratuito para uso, sem necessidade de assinatura ou pagamento. Ele oferece suporte ao inglês, e o comportamento em outros idiomas pode ser ajustado nas configurações.

