⚡
  • HOME
  • NEWS
  • SERVICES
  • ARCHITECTURE
  • TECH STACK
  • PORTFOLIO
  • ABOUT
  • CONTACT
HOMENEWSSERVICESARCHITECTURETECH STACKPORTFOLIOABOUTCONTACT
© 2026 Miodrag Gromilić. All rights reserved.
HOMENEWSSERVICESTECH STACKPORTFOLIOCONTACTABOUTFAQs
Back to Skills
Ollama

Ollama

Since 2023Run open-source LLMs locally

Run open-source LLMs locally — private inference, development, and when data can't leave the server.

Overview

Ollama transformed local AI work. Running Llama 3, Mistral, CodeLlama on my hardware — zero API costs, complete privacy, offline capability. Docker-like pull-and-run interface. For dev/testing before cloud APIs, sensitive data processing, self-hosted AI services.

Use Cases

  • Local AI dev
  • private inference
  • cost-free experiments
  • self-hosted AI
  • offline capability
  • model evaluation

Advantages

  • Free and open-source
  • complete privacy
  • Docker-like UX
  • dozens of models
  • fast inference
  • OpenAI-compatible API

Considerations

  • GPU needed for best performance
  • model quality varies
  • limited to local memory
  • no managed infra

Works Great With

LangChainPythonDockerLlamaMistralChromaDBLM Studio

Related Technologies

OpenAI
Since 2020
Claude
Since 2023
LM Studio
Since 2023
Llama
Since 2023
Mistral
Since 2023
Groq
Since 2023
Back to Skills CONTACT