Ollama logo

Ollama

Activo

Ejecuta modelos de IA localmente — el motor de inferencia de código abierto con 176K estrellas en GitHub

Recomendado

The default choice for local LLM inference — and for good reason. 176K GitHub stars, 9M+ users, MIT license, one-command setup. Runs on any hardware from Raspberry Pi 5 to dual H100s, with a model catalog spanning 4,500+ open-weight options. The OpenAI-compatible API with streaming, tool calling, structured outputs, and embeddings means no vendor lock-in — swap from Ollama to OpenAI (or vice versa) by changing one URL. Ollama Cloud (Pro $20/mo, Max $100/mo) extends the same surface to managed inference. The recent $65M raise confirms sustained investment. For any developer who wants to run AI locally — whether for privacy, cost control, or offline use — Ollama is where you start.

Con IA

Each inference request is a stateless REST API call — no carried AI context between requests

¿Es adecuada para ti?

Bueno para

  • Desarrollo de IA local-first: ejecuta más de 4500 modelos en tu propio hardware sin costes de API
  • Cargas de trabajo sensibles a la privacidad: toda la inferencia se queda en tu infraestructura, nunca sale de la máquina
  • IA con coste controlado: el coste fijo del hardware sustituye la facturación por token; punto de equilibrio en ~$200/mes de gasto en API
  • Entornos sin conexión o aislados: no se necesita internet tras la descarga del modelo
  • Integración con cadena de herramientas de desarrollo: API compatible con OpenAI funciona con LangChain, LlamaIndex, Hermes Agent, Continue.dev

No recomendado para

  • Acceso a modelos de frontera: solo puede ejecutar modelos de pesos abiertos; sin GPT-5.6, Claude ni Gemini a través de Ollama
  • Equipos sin hardware GPU: ejecutar modelos de más de 70B en CPU no es viable (<1 tok/s)
  • Servicio gestionado zero-ops: existen planes Cloud, pero el producto local requiere gestión de hardware

Nuestra experiencia

We haven't tested Ollama ourselves. This profile is based on public documentation, user reviews, and community feedback.

Precios

Código abierto
Local (Free)Free
  • Run any compatible open-weight model on your own hardware
  • No usage limits, no API keys, no data leaves your machine
Cloud FreeFree
  • Daily quota for experimentation
  • Same API surface as local runtime
Pro$20/mo
  • Full open-weight catalog
  • Higher per-minute rate limits
  • Run 3 cloud models at a time
  • 50x more cloud usage than Free
  • Upload and share private models
Max$100/mo
  • Run 10 cloud models at a time
  • 5x more usage than Pro
  • New sign-ups paused for capacity
Team$25/seat/mo (5-seat minimum)
  • High performance, up to 2x more than model gateways
  • Zero data retention and logging
  • Shared billing and administration
  • Priority support
  • SSO (coming soon)
Ver precios completos

Aún no hay cambios de veredicto

El reloj corre desde el primer día: los cambios aparecerán aquí a medida que evolucione nuestro veredicto.

Registro de verificación

  • Precios— Actualizado

    Agente automatizado

    New Team plan: $25/seat/mo (5-seat minimum), includes shared billing, priority support. Pro $20/mo and Max $100/mo unchanged. Max sign-ups paused for capacity.

  • Precios— Sin cambios

    Agente automatizado

  • Perfil— Sin cambios

    Importado en el lanzamiento

  • Precios— Sin cambios

    Importado en el lanzamiento

Cómo evaluamos