Saltar para o conteúdo

Ligar Ollama local

  1. Instala Ollama e consulta a documentação oficial.
  2. Escolhe um modelo com ferramentas na biblioteca. Descarrega-o, por exemplo com ollama pull llama3.1, se esse modelo continuar disponível. Esta sugestão existe no runtime; confirma compatibilidade e recursos no teu dispositivo.
  3. Mantém o serviço Ollama ativo. Usa ollama serve apenas se ainda não existir um servidor a correr.
  4. Confirma o nome exato instalado com ollama list.
  1. Seleciona Ollama (local) em Settings → Modelo LLM.
  2. Introduz o identificador instalado, incluindo a tag quando necessária.
  3. Usa http://localhost:11434/v1/chat/completions para o serviço na porta predefinida. Ajusta host/porta apenas se o teu servidor usar outros valores. O runtime normaliza endpoints Ollama para o percurso compatível com OpenAI.
  4. Deixa a chave vazia: Ollama é a única opção do menu que não exige chave.
  5. Guarda e testa a ligação. Testa primeiro texto; modelos apenas de texto não aceitam screenshots.

Confirma serviço ativo, porta, nome do modelo, memória disponível, firewall e permissões de origem. Um modelo que conversa bem pode não conseguir executar ferramentas com fiabilidade. Verifica o relatório de capacidades em vez de assumir que o servidor garante suporte.

A inferência neste endpoint fica no computador, mas a extensão pode fazer consultas auxiliares a catálogos públicos e taxas de câmbio. Não é uma promessa de funcionamento completamente offline. Consulta Privacidade.