Ollama
AtivoExecute modelos de IA localmente — o motor de inferência de código aberto com 176K estrelas no GitHub
The default choice for local LLM inference — and for good reason. 176K GitHub stars, 9M+ users, MIT license, one-command setup. Runs on any hardware from Raspberry Pi 5 to dual H100s, with a model catalog spanning 4,500+ open-weight options. The OpenAI-compatible API with streaming, tool calling, structured outputs, and embeddings means no vendor lock-in — swap from Ollama to OpenAI (or vice versa) by changing one URL. Ollama Cloud (Pro $20/mo, Max $100/mo) extends the same surface to managed inference. The recent $65M raise confirms sustained investment. For any developer who wants to run AI locally — whether for privacy, cost control, or offline use — Ollama is where you start.
Each inference request is a stateless REST API call — no carried AI context between requests
É adequada para ti?
Bom para
- Desenvolvimento de IA local-first — executa mais de 4.500 modelos no teu próprio hardware sem custos de API
- Cargas de trabalho sensíveis à privacidade — toda a inferência fica na tua infraestrutura, nunca sai da máquina
- IA com custos controlados — custo fixo de hardware substitui a faturação por token; ponto de equilíbrio a ~200 $/mês de gastos com API
- Ambientes offline/isolados — sem necessidade de internet após o pull do modelo
- Integração com toolchain de desenvolvimento — API compatível com OpenAI funciona com LangChain, LlamaIndex, Hermes Agent, Continue.dev
Não recomendado para
- Acesso a modelos de ponta — só pode executar modelos open-weight; sem GPT-5.6, Claude ou Gemini via Ollama
- Equipas sem hardware GPU — executar modelos 70B+ em CPU é impraticável (<1 tok/s)
- Inferência gerida sem operações — existem planos Cloud mas o produto local requer gestão de hardware
A nossa experiência
Preços
Código aberto- Executa qualquer modelo open-weight compatível no teu próprio hardware
- Sem limites de utilização, sem chaves de API, os dados nunca saem da tua máquina
- Quota diária para experimentação
- Mesma superfície de API do runtime local
- Catálogo completo de modelos open-weight
- Limites de taxa por minuto mais elevados
- Executa 10 modelos cloud em simultâneo
- 5x mais utilização do que o Pro
Ainda sem alterações de veredicto
O relógio começa a contar no primeiro dia: as alterações aparecem aqui à medida que o nosso veredicto evolui.
Fontes
- Ollama — official website07/2026
- Ollama — GitHub repository07/2026
- TechCrunch — Ollama raises $65M Series B, grows to nearly 9M users07/2026
- Pooya Golchian — Ollama Cloud Pricing 202607/2026
- Thunder Compute — What is Ollama: Run AI Models Locally (July 2026)07/2026
- Kunal Ganglani — Best Local LLMs in 2026: Models, Hardware & Setup Guide07/2026
- DanubeData — Run Ollama on a VPS: Self-Host Local LLMs in Europe (2026)07/2026
Registo de verificação
- Perfil— Sem alterações
Importado no lançamento
- Preços— Sem alterações
Importado no lançamento