Ollama
Rodar modelo aberto na própria máquina com um comando — e o release ritmado.
Ollama
2 fontes oficiais monitoradas · última atualização em 25/08/2026
Novidades recentes
19 atualizações
- Releases·oficial·novo
v0.33.0 — integração com o Claude Desktop e nova aba de aplicativos
Passa a ligar e desligar modelos individuais do Ollama para uso no Claude direto pela barra de menu. Os modelos disponíveis aparecem dentro do Claude; os de nuvem só com login feito. Nova visão de Apps gerencia integrações com comandos copiáveis. Cache melhorado e correção de travamento com clientes que cancelam prefills longos.
traduzido por IA · claude-opus-5
original: “v0.33.0”
- Releases·oficial·
v0.33.0-rc2 — corrige sobreposição na barra de título
Evita a sobreposição da barra de título na tela de Apps.
traduzido por IA · claude-opus-5
original: “v0.33.0-rc2”
- Releases·oficial·
v0.33.0-rc1 — assinatura do endpoint de recomendação
Passa a assinar o endpoint de recomendação de modelos.
traduzido por IA · claude-opus-5
original: “v0.33.0-rc1”
- Releases·oficial·
v0.33.0-rc0 — gerenciamento de modelos do Claude
Adiciona o gerenciamento de modelos do Claude no aplicativo.
traduzido por IA · claude-opus-5
original: “v0.33.0-rc0”
- Modelos·oficial·
v0.32.15 — novo onboarding no desktop e tempo até o primeiro token pela metade
Novo fluxo de boas-vindas no desktop na primeira execução. Passa a cachear os metadados do modelo entre requisições, cortando o tempo até o primeiro token quase pela metade (de ~995 ms para ~524 ms nos testes). Corrige travamento do chat e do generate após erro do parser no meio do streaming. Mensagens de sistema do Qwen 3.8 agora são normalizadas.
traduzido por IA · claude-opus-5
original: “v0.32.15”
- Releases·oficial·
v0.32.15-rc2 — fluxo de boas-vindas no desktop
Adiciona o fluxo de boas-vindas do aplicativo desktop.
traduzido por IA · claude-opus-5
original: “v0.32.15-rc2”
- Releases·oficial·
v0.32.15-rc1 — patch temporário do MLX no build Docker
Encaminha o patch temporário do MLX para os estágios do Docker.
traduzido por IA · claude-opus-5
original: “v0.32.15-rc1: ci: plumb temporary MLX patch through to docker stages (#17874)”
- Releases·oficial·
v0.32.15-rc0 — atualização do MLX
Carrega temporariamente a correção ml-explore/mlx-c#127.
traduzido por IA · claude-opus-5
original: “v0.32.15-rc0: mlx update (#17850)”
- Releases·oficial·
v0.32.14 — transcodificação de WebP e mensagens de sistema do Qwen
Passa a transcodificar imagens WebP para os renderizadores do llama-server e a tolerar mensagens de sistema fora da primeira posição no Qwen.
traduzido por IA · claude-opus-5
original: “v0.32.14”
- Releases·oficial·
v0.32.14-rc0 — atualização do MLX
Atualização do MLX.
traduzido por IA · claude-opus-5
original: “v0.32.14-rc0”
- Modelos·oficial·
NVIDIA Nemotron 3.5 Lightning chega ao Ollama
O NVIDIA Nemotron 3.5 Lightning já está disponível no Ollama. É um modelo aberto de 30 bilhões de parâmetros (3B ativos), feito para agentes que ficam rodando continuamente.
traduzido por IA · claude-opus-5
original: “NVIDIA Nemotron 3.5 Lightning”
- Modelos·oficial·
Muse Glimmer, do Meta Superintelligence Labs, já está disponível
O Muse Glimmer, primeiro modelo aberto lançado pelo Meta Superintelligence Labs, já está disponível. É um modelo multimodal de 30B.
traduzido por IA · claude-opus-5
original: “Muse Glimmer from Meta Superintelligence Labs is now available”
- Outros·oficial·
Ollama: all aboard open models
Serving 8.9 million developers, Ollama has raised $88M from Benchmark, Theory Ventures, 8VC, Y Combinator, and many incredible angel investors.
data informada pela fonte; encontrada pelo radar em 25 de ago. de 2026
- Outros·oficial·
Faster Gemma 4 on MLX with multi-token prediction
Gemma 4 is now significantly faster in Ollama 0.31 on Apple Silicon via multi-token prediction (MTP), powered by MLX. Performance is now up to 90% faster when used with coding agents, as measured using the Aider polyglot benchmark.
data informada pela fonte; encontrada pelo radar em 25 de ago. de 2026
- Features·oficial·
Ollama's highest performance on Apple Silicon yet with MLX
Ollama's MLX engine has been updated to deliver its highest performance on Apple Silicon yet. Models output higher quality responses, respond faster, and use less memory.
data informada pela fonte; encontrada pelo radar em 25 de ago. de 2026
- Modelos·oficial·
Melhor desempenho e suporte a modelos GGUF
O Ollama 0.30 chega com melhor desempenho e compatibilidade com modelos GGUF via llama.cpp, complementando o motor MLX do Ollama em chips Apple.
traduzido por IA · claude-opus-5
original: “Improved performance and model support with GGUF”
data informada pela fonte; encontrada pelo radar em 25 de ago. de 2026
- Outros·oficial·
NVIDIA Nemotron 3 Ultra
NVIDIA Nemotron 3 Ultra is built for high-throughput reasoning and long-running agent workflows.
data informada pela fonte; encontrada pelo radar em 25 de ago. de 2026
- Outros·oficial·
OpenJarvis: a local-first personal AI is now available to run with Ollama
OpenJarvis v1.0 is now available: an open-source framework for building personal AI agents that run on your own hardware, with Ollama support built-in.
data informada pela fonte; encontrada pelo radar em 25 de ago. de 2026
- Features·oficial·
Ollama is now powered by MLX on Apple Silicon in preview
Today, we're previewing the fastest way to run Ollama on Apple silicon, powered by MLX, Apple's machine learning framework.
data informada pela fonte; encontrada pelo radar em 25 de ago. de 2026
Fontes monitoradas
O radar lê estes endereços automaticamente. A ordem é a de prioridade: se a primeira falhar, as seguintes continuam entregando.
- 1. https://ollama.com/blog/rss.xml (rss)
- 2. https://github.com/ollama/ollama/releases.atom (github-releases)