Ollama

Rodar modelo aberto na própria máquina com um comando — e o release ritmado.

Ollama

2 fontes oficiais monitoradas · última atualização em 05/09/2026

Novidades recentes

35 atualizações

  1. Releases·oficial·

    v0.34.0

    Use Ollama models in ChatGPT Desktop Ollama models can now be used directly in ChatGPT Desktop, so you can keep your existing workflow while running open models. Setup is available from the Ollama app on MacOS. This release also improves structured output performance on Apple Silicon, adds support for OpenAI-compatible client tool search and response compaction, and makes images work correctly…

  2. Releases·oficial·

    v0.34.0-rc0

    app: add Ollama to ChatGPT Desktop (#18236)

  3. Releases·oficial·

    Ollama v0.33.3: gemma4 aceita imagem e áudio no motor MLX

    O gemma4 passou a suportar imagens e áudio no motor MLX. A versão também reporta tokens de prompt em cache, respeita os parâmetros padrão definidos no GGUF e atualiza MLX, MLX-C e llama.cpp.

    traduzido por IA · claude-opus-5

    original: “v0.33.3

  4. Releases·oficial·

    Ollama v0.33.3-rc2: gemma4 aceita entrada de imagem e áudio

    Importações safetensors do gemma4 servidas pelo motor MLX passam a responder a conversas com imagem e áudio. As imagens passam pelas duas arquiteturas de visão e o áudio também é suportado.

    traduzido por IA · claude-opus-5

    original: “v0.33.3-rc2: gemma4: image and audio input support

  5. Releases·oficial·

    Ollama v0.33.3-rc1 atualiza o llama.cpp

    Atualização da versão do llama.cpp para a build b10760.

    traduzido por IA · claude-opus-5

    original: “v0.33.3-rc1

  6. Releases·oficial·

    Ollama v0.33.3-rc0 atualiza o llama.cpp para a build b10729

    Atualização do llama.cpp para a build b10729, com regeneração do patch de compatibilidade — o upstream removeu a leitura load_data_for de tensor inteiro.

    traduzido por IA · claude-opus-5

    original: “v0.33.3-rc0: llama.cpp: version bump b10729 (#18160)

  7. Preços·oficial·

    Ollama adota preço transparente por token

    Os planos Pro, Max e Team do Ollama passam a usar precificação por token, padrão do mercado, com uso incluso em todos os planos.

    traduzido por IA · claude-opus-5

    original: “Ollama's transparent pricing

  8. Releases·oficial·

    v0.33.2

    What's Changed Ollama's app now follows the system appearance again, restoring dark mode support Fixed the macOS app to properly hand off to an already-running instance instead of starting a second one The Claude Desktop proxy no longer interrupts in-flight requests when the model catalog updates Full Changelog: v0.33.1...v0.33.2

  9. Releases·oficial·

    v0.33.2-rc1

    app: list account cloud models for Claude (#18077)

  10. Releases·oficial·

    v0.33.2-rc0

    app: synchronize macOS app handoff (#18056)

  11. Modelos·oficial·

    Ollama v0.33.1 adiciona suporte ao Qwen3.8 Flash Next no MLX

    Suporte ao Qwen3.8 Flash Next no MLX, patches de compatibilidade idempotentes no cmake, saída estruturada no mlxrunner e correção de timeouts da GPU Metal ao carregar modelos de armazenamento lento.

    traduzido por IA · claude-opus-5

    original: “v0.33.1

  12. Releases·oficial·

    v0.33.1-rc1: linux: fix llama.cpp docker build (#18040)

    Build context was missing the new cmake common utility.

  13. Modelos·oficial·

    Ollama v0.33.1-rc0 adiciona suporte ao Qwen3.8 Flash Next no MLX

    Adiciona suporte ao Qwen3.8 Flash Next no motor MLX, com ajustes vindos da revisão de código.

    traduzido por IA · claude-opus-5

    original: “v0.33.1-rc0: MLX: Qwen3.8 Flash Next support (#18032)

  14. Releases·oficial·

    v0.33.0

    What's Changed Claude Desktop Developers can now easily configure Claude Desktop to seamlessly work with Ollama as a third-party gateway provider. Improved caching Fixed a hang where agent clients that cancel long prefills Prefill restore points are now trustworthy by construction: a cancelled prefill keeps every restore point it crossed, so retries resume where they stopped instead of restarting…

  15. Releases·oficial·

    v0.33.0-rc4

    proxy: preserve string content during image fallback (#18002)

  16. Releases·oficial·

    v0.33.0 — integração com o Claude Desktop e nova aba de aplicativos

    Passa a ligar e desligar modelos individuais do Ollama para uso no Claude direto pela barra de menu. Os modelos disponíveis aparecem dentro do Claude; os de nuvem só com login feito. Nova visão de Apps gerencia integrações com comandos copiáveis. Cache melhorado e correção de travamento com clientes que cancelam prefills longos.

    traduzido por IA · claude-opus-5

    original: “v0.33.0-rc3

  17. Produtos·oficial·

    Claude Desktop support with Ollama

    Claude Desktop can now be configured to work with Ollama as a third-party gateway provider, making it possible to use open models in Claude.

  18. Releases·oficial·

    v0.33.0-rc2 — corrige sobreposição na barra de título

    Evita a sobreposição da barra de título na tela de Apps.

    traduzido por IA · claude-opus-5

    original: “v0.33.0-rc2

  19. Releases·oficial·

    v0.33.0-rc1 — assinatura do endpoint de recomendação

    Passa a assinar o endpoint de recomendação de modelos.

    traduzido por IA · claude-opus-5

    original: “v0.33.0-rc1

  20. Releases·oficial·

    v0.33.0-rc0 — gerenciamento de modelos do Claude

    Adiciona o gerenciamento de modelos do Claude no aplicativo.

    traduzido por IA · claude-opus-5

    original: “v0.33.0-rc0

  21. Modelos·oficial·

    v0.32.15 — novo onboarding no desktop e tempo até o primeiro token pela metade

    Novo fluxo de boas-vindas no desktop na primeira execução. Passa a cachear os metadados do modelo entre requisições, cortando o tempo até o primeiro token quase pela metade (de ~995 ms para ~524 ms nos testes). Corrige travamento do chat e do generate após erro do parser no meio do streaming. Mensagens de sistema do Qwen 3.8 agora são normalizadas.

    traduzido por IA · claude-opus-5

    original: “v0.32.15

  22. Releases·oficial·

    v0.32.15-rc2 — fluxo de boas-vindas no desktop

    Adiciona o fluxo de boas-vindas do aplicativo desktop.

    traduzido por IA · claude-opus-5

    original: “v0.32.15-rc2

  23. Releases·oficial·

    v0.32.15-rc1 — patch temporário do MLX no build Docker

    Encaminha o patch temporário do MLX para os estágios do Docker.

    traduzido por IA · claude-opus-5

    original: “v0.32.15-rc1: ci: plumb temporary MLX patch through to docker stages (#17874)

  24. Releases·oficial·

    v0.32.15-rc0 — atualização do MLX

    Carrega temporariamente a correção ml-explore/mlx-c#127.

    traduzido por IA · claude-opus-5

    original: “v0.32.15-rc0: mlx update (#17850)

  25. Releases·oficial·

    v0.32.14 — transcodificação de WebP e mensagens de sistema do Qwen

    Passa a transcodificar imagens WebP para os renderizadores do llama-server e a tolerar mensagens de sistema fora da primeira posição no Qwen.

    traduzido por IA · claude-opus-5

    original: “v0.32.14

  26. Releases·oficial·

    v0.32.14-rc0 — atualização do MLX

    Atualização do MLX.

    traduzido por IA · claude-opus-5

    original: “v0.32.14-rc0

  27. Modelos·oficial·

    NVIDIA Nemotron 3.5 Lightning chega ao Ollama

    O NVIDIA Nemotron 3.5 Lightning já está disponível no Ollama. É um modelo aberto de 30 bilhões de parâmetros (3B ativos), feito para agentes que ficam rodando continuamente.

    traduzido por IA · claude-opus-5

    original: “NVIDIA Nemotron 3.5 Lightning

  28. Modelos·oficial·

    Muse Glimmer, do Meta Superintelligence Labs, já está disponível

    O Muse Glimmer, primeiro modelo aberto lançado pelo Meta Superintelligence Labs, já está disponível. É um modelo multimodal de 30B.

    traduzido por IA · claude-opus-5

    original: “Muse Glimmer from Meta Superintelligence Labs is now available

  29. Outros·oficial·

    Ollama: all aboard open models

    Serving 8.9 million developers, Ollama has raised $88M from Benchmark, Theory Ventures, 8VC, Y Combinator, and many incredible angel investors.

    data informada pela fonte; encontrada pelo radar em 06 de set. de 2026

  30. Outros·oficial·

    Faster Gemma 4 on MLX with multi-token prediction

    Gemma 4 is now significantly faster in Ollama 0.31 on Apple Silicon via multi-token prediction (MTP), powered by MLX. Performance is now up to 90% faster when used with coding agents, as measured using the Aider polyglot benchmark.

    data informada pela fonte; encontrada pelo radar em 06 de set. de 2026

  31. Features·oficial·

    Ollama's highest performance on Apple Silicon yet with MLX

    Ollama's MLX engine has been updated to deliver its highest performance on Apple Silicon yet. Models output higher quality responses, respond faster, and use less memory.

    data informada pela fonte; encontrada pelo radar em 06 de set. de 2026

  32. Modelos·oficial·

    Melhor desempenho e suporte a modelos GGUF

    O Ollama 0.30 chega com melhor desempenho e compatibilidade com modelos GGUF via llama.cpp, complementando o motor MLX do Ollama em chips Apple.

    traduzido por IA · claude-opus-5

    original: “Improved performance and model support with GGUF

    data informada pela fonte; encontrada pelo radar em 06 de set. de 2026

  33. Outros·oficial·

    NVIDIA Nemotron 3 Ultra

    NVIDIA Nemotron 3 Ultra is built for high-throughput reasoning and long-running agent workflows.

    data informada pela fonte; encontrada pelo radar em 06 de set. de 2026

  34. Outros·oficial·

    OpenJarvis: a local-first personal AI is now available to run with Ollama

    OpenJarvis v1.0 is now available: an open-source framework for building personal AI agents that run on your own hardware, with Ollama support built-in.

    data informada pela fonte; encontrada pelo radar em 06 de set. de 2026

  35. Features·oficial·

    Ollama is now powered by MLX on Apple Silicon in preview

    Today, we're previewing the fastest way to run Ollama on Apple silicon, powered by MLX, Apple's machine learning framework.

    data informada pela fonte; encontrada pelo radar em 06 de set. de 2026

Fontes monitoradas

O radar lê estes endereços automaticamente. A ordem é a de prioridade: se a primeira falhar, as seguintes continuam entregando.

← Voltar ao radar