Ollama
Rodar modelo aberto na própria máquina com um comando — e o release ritmado.
Ollama
2 fontes oficiais monitoradas · última atualização em 05/09/2026
Novidades recentes
35 atualizações
- Releases·oficial·
v0.34.0
Use Ollama models in ChatGPT Desktop Ollama models can now be used directly in ChatGPT Desktop, so you can keep your existing workflow while running open models. Setup is available from the Ollama app on MacOS. This release also improves structured output performance on Apple Silicon, adds support for OpenAI-compatible client tool search and response compaction, and makes images work correctly…
- Releases·oficial·
v0.34.0-rc0
app: add Ollama to ChatGPT Desktop (#18236)
- Releases·oficial·
Ollama v0.33.3: gemma4 aceita imagem e áudio no motor MLX
O gemma4 passou a suportar imagens e áudio no motor MLX. A versão também reporta tokens de prompt em cache, respeita os parâmetros padrão definidos no GGUF e atualiza MLX, MLX-C e llama.cpp.
traduzido por IA · claude-opus-5
original: “v0.33.3”
- Releases·oficial·
Ollama v0.33.3-rc2: gemma4 aceita entrada de imagem e áudio
Importações safetensors do gemma4 servidas pelo motor MLX passam a responder a conversas com imagem e áudio. As imagens passam pelas duas arquiteturas de visão e o áudio também é suportado.
traduzido por IA · claude-opus-5
original: “v0.33.3-rc2: gemma4: image and audio input support”
- Releases·oficial·
Ollama v0.33.3-rc1 atualiza o llama.cpp
Atualização da versão do llama.cpp para a build b10760.
traduzido por IA · claude-opus-5
original: “v0.33.3-rc1”
- Releases·oficial·
Ollama v0.33.3-rc0 atualiza o llama.cpp para a build b10729
Atualização do llama.cpp para a build b10729, com regeneração do patch de compatibilidade — o upstream removeu a leitura load_data_for de tensor inteiro.
traduzido por IA · claude-opus-5
original: “v0.33.3-rc0: llama.cpp: version bump b10729 (#18160)”
- Preços·oficial·
Ollama adota preço transparente por token
Os planos Pro, Max e Team do Ollama passam a usar precificação por token, padrão do mercado, com uso incluso em todos os planos.
traduzido por IA · claude-opus-5
original: “Ollama's transparent pricing”
- Releases·oficial·
v0.33.2
What's Changed Ollama's app now follows the system appearance again, restoring dark mode support Fixed the macOS app to properly hand off to an already-running instance instead of starting a second one The Claude Desktop proxy no longer interrupts in-flight requests when the model catalog updates Full Changelog: v0.33.1...v0.33.2
- Releases·oficial·
v0.33.2-rc1
app: list account cloud models for Claude (#18077)
- Releases·oficial·
v0.33.2-rc0
app: synchronize macOS app handoff (#18056)
- Modelos·oficial·
Ollama v0.33.1 adiciona suporte ao Qwen3.8 Flash Next no MLX
Suporte ao Qwen3.8 Flash Next no MLX, patches de compatibilidade idempotentes no cmake, saída estruturada no mlxrunner e correção de timeouts da GPU Metal ao carregar modelos de armazenamento lento.
traduzido por IA · claude-opus-5
original: “v0.33.1”
- Releases·oficial·
v0.33.1-rc1: linux: fix llama.cpp docker build (#18040)
Build context was missing the new cmake common utility.
- Modelos·oficial·
Ollama v0.33.1-rc0 adiciona suporte ao Qwen3.8 Flash Next no MLX
Adiciona suporte ao Qwen3.8 Flash Next no motor MLX, com ajustes vindos da revisão de código.
traduzido por IA · claude-opus-5
original: “v0.33.1-rc0: MLX: Qwen3.8 Flash Next support (#18032)”
- Releases·oficial·
v0.33.0
What's Changed Claude Desktop Developers can now easily configure Claude Desktop to seamlessly work with Ollama as a third-party gateway provider. Improved caching Fixed a hang where agent clients that cancel long prefills Prefill restore points are now trustworthy by construction: a cancelled prefill keeps every restore point it crossed, so retries resume where they stopped instead of restarting…
- Releases·oficial·
v0.33.0-rc4
proxy: preserve string content during image fallback (#18002)
- Releases·oficial·
v0.33.0 — integração com o Claude Desktop e nova aba de aplicativos
Passa a ligar e desligar modelos individuais do Ollama para uso no Claude direto pela barra de menu. Os modelos disponíveis aparecem dentro do Claude; os de nuvem só com login feito. Nova visão de Apps gerencia integrações com comandos copiáveis. Cache melhorado e correção de travamento com clientes que cancelam prefills longos.
traduzido por IA · claude-opus-5
original: “v0.33.0-rc3”
- Produtos·oficial·
Claude Desktop support with Ollama
Claude Desktop can now be configured to work with Ollama as a third-party gateway provider, making it possible to use open models in Claude.
- Releases·oficial·
v0.33.0-rc2 — corrige sobreposição na barra de título
Evita a sobreposição da barra de título na tela de Apps.
traduzido por IA · claude-opus-5
original: “v0.33.0-rc2”
- Releases·oficial·
v0.33.0-rc1 — assinatura do endpoint de recomendação
Passa a assinar o endpoint de recomendação de modelos.
traduzido por IA · claude-opus-5
original: “v0.33.0-rc1”
- Releases·oficial·
v0.33.0-rc0 — gerenciamento de modelos do Claude
Adiciona o gerenciamento de modelos do Claude no aplicativo.
traduzido por IA · claude-opus-5
original: “v0.33.0-rc0”
- Modelos·oficial·
v0.32.15 — novo onboarding no desktop e tempo até o primeiro token pela metade
Novo fluxo de boas-vindas no desktop na primeira execução. Passa a cachear os metadados do modelo entre requisições, cortando o tempo até o primeiro token quase pela metade (de ~995 ms para ~524 ms nos testes). Corrige travamento do chat e do generate após erro do parser no meio do streaming. Mensagens de sistema do Qwen 3.8 agora são normalizadas.
traduzido por IA · claude-opus-5
original: “v0.32.15”
- Releases·oficial·
v0.32.15-rc2 — fluxo de boas-vindas no desktop
Adiciona o fluxo de boas-vindas do aplicativo desktop.
traduzido por IA · claude-opus-5
original: “v0.32.15-rc2”
- Releases·oficial·
v0.32.15-rc1 — patch temporário do MLX no build Docker
Encaminha o patch temporário do MLX para os estágios do Docker.
traduzido por IA · claude-opus-5
original: “v0.32.15-rc1: ci: plumb temporary MLX patch through to docker stages (#17874)”
- Releases·oficial·
v0.32.15-rc0 — atualização do MLX
Carrega temporariamente a correção ml-explore/mlx-c#127.
traduzido por IA · claude-opus-5
original: “v0.32.15-rc0: mlx update (#17850)”
- Releases·oficial·
v0.32.14 — transcodificação de WebP e mensagens de sistema do Qwen
Passa a transcodificar imagens WebP para os renderizadores do llama-server e a tolerar mensagens de sistema fora da primeira posição no Qwen.
traduzido por IA · claude-opus-5
original: “v0.32.14”
- Releases·oficial·
v0.32.14-rc0 — atualização do MLX
Atualização do MLX.
traduzido por IA · claude-opus-5
original: “v0.32.14-rc0”
- Modelos·oficial·
NVIDIA Nemotron 3.5 Lightning chega ao Ollama
O NVIDIA Nemotron 3.5 Lightning já está disponível no Ollama. É um modelo aberto de 30 bilhões de parâmetros (3B ativos), feito para agentes que ficam rodando continuamente.
traduzido por IA · claude-opus-5
original: “NVIDIA Nemotron 3.5 Lightning”
- Modelos·oficial·
Muse Glimmer, do Meta Superintelligence Labs, já está disponível
O Muse Glimmer, primeiro modelo aberto lançado pelo Meta Superintelligence Labs, já está disponível. É um modelo multimodal de 30B.
traduzido por IA · claude-opus-5
original: “Muse Glimmer from Meta Superintelligence Labs is now available”
- Outros·oficial·
Ollama: all aboard open models
Serving 8.9 million developers, Ollama has raised $88M from Benchmark, Theory Ventures, 8VC, Y Combinator, and many incredible angel investors.
data informada pela fonte; encontrada pelo radar em 06 de set. de 2026
- Outros·oficial·
Faster Gemma 4 on MLX with multi-token prediction
Gemma 4 is now significantly faster in Ollama 0.31 on Apple Silicon via multi-token prediction (MTP), powered by MLX. Performance is now up to 90% faster when used with coding agents, as measured using the Aider polyglot benchmark.
data informada pela fonte; encontrada pelo radar em 06 de set. de 2026
- Features·oficial·
Ollama's highest performance on Apple Silicon yet with MLX
Ollama's MLX engine has been updated to deliver its highest performance on Apple Silicon yet. Models output higher quality responses, respond faster, and use less memory.
data informada pela fonte; encontrada pelo radar em 06 de set. de 2026
- Modelos·oficial·
Melhor desempenho e suporte a modelos GGUF
O Ollama 0.30 chega com melhor desempenho e compatibilidade com modelos GGUF via llama.cpp, complementando o motor MLX do Ollama em chips Apple.
traduzido por IA · claude-opus-5
original: “Improved performance and model support with GGUF”
data informada pela fonte; encontrada pelo radar em 06 de set. de 2026
- Outros·oficial·
NVIDIA Nemotron 3 Ultra
NVIDIA Nemotron 3 Ultra is built for high-throughput reasoning and long-running agent workflows.
data informada pela fonte; encontrada pelo radar em 06 de set. de 2026
- Outros·oficial·
OpenJarvis: a local-first personal AI is now available to run with Ollama
OpenJarvis v1.0 is now available: an open-source framework for building personal AI agents that run on your own hardware, with Ollama support built-in.
data informada pela fonte; encontrada pelo radar em 06 de set. de 2026
- Features·oficial·
Ollama is now powered by MLX on Apple Silicon in preview
Today, we're previewing the fastest way to run Ollama on Apple silicon, powered by MLX, Apple's machine learning framework.
data informada pela fonte; encontrada pelo radar em 06 de set. de 2026
Fontes monitoradas
O radar lê estes endereços automaticamente. A ordem é a de prioridade: se a primeira falhar, as seguintes continuam entregando.
- 1. https://ollama.com/blog/rss.xml (rss)
- 2. https://github.com/ollama/ollama/releases.atom (github-releases)