IAIniciante
LLM local com Ollama: instalação, API e quantização
Rode um LLM local com Ollama: instale, chame pela API HTTP, entenda quantização e memória necessária e saiba quando local compensa mais que uma API.
12 de agosto de 20268 min de leitura
Conteúdo
Código que roda, números reais e o trade-off explícito de quando não usar. Filtre por categoria, nível ou tag.
Rode um LLM local com Ollama: instale, chame pela API HTTP, entenda quantização e memória necessária e saiba quando local compensa mais que uma API.
Aprenda engenharia de prompt para produção: estrutura em blocos, exemplos, saída em JSON validada, conjunto de testes e versionamento do prompt.