AI-ML
Ollama v0.17.1
RESUMEN
What's Changed Nemotron architecture support in Ollama's engine MLX engine now has improved memory usage Ollama's app will now allow models that support tools to use web search capabilities Improved LFM2 and LFM2.5 models in Ollama's engine * `ollama create` will no longer default to
Descripción Detallada
What's Changed Nemotron architecture support in Ollama's engine MLX engine now has improved memory usage Ollama's app will now allow models that support tools to use web search capabilities Improved LFM2 and LFM2.5 models in Ollama's engine `ollama create` will no longer default to affine quantization for unquantized models when using the MLX engine Added configuration for disabling automatic update downloading Full Changelog:
Ollama v0.17.1 añade soporte para Nemotron y mejora el uso de memoria del motor MLX.
- Soporte para arquitectura Nemotron en el motor de Ollama.
- Mejoras en el uso de memoria del motor MLX.
- La app de Ollama ahora permite búsqueda web en modelos que soportan herramientas.
- Mejoras en los modelos LFM2 y LFM2.5.
A quién le importa
Todos los que usen Ollama y sus modelos.
Generado por IA · puede contener errores
Releases Relacionados
AI-ML
Ollama v0.32.5
## What's Changed * Fixed an MLX Metal bug that could reduce output quality for NVFP4 models, particularly Laguna. **Full Changelog**: https://github.com/ollama/ollama/compare/v0.32.4...v0.32.5
AI-ML
Ollama v0.32.4
## What's Changed - Support Laguna on Apple GPUs via the MLX engine - Quantize draft-model output heads at the requested type when creating speculative-decoding drafts. - Fixed Qwen3 MoE decoding for differently-quantized experts, plus faster packed gate/up projection (~4–9% on M5 Max). **Full
AI-ML