AI-ML
Ollama v0.20.0
RESUMEN
Gemma 4 Effective 2B (E2B) ``` ollama run gemma4:e2b ``` Effective 4B (E4B) ``` ollama run gemma4:e4b ``` **26B (Mixture of Experts mod
Descripción Detallada
Gemma 4 Effective 2B (E2B) ``` ollama run gemma4:e2b ``` Effective 4B (E4B) ``` ollama run gemma4:e4b ``` 26B (Mixture of Experts model with 4B active parameters) ``` ollama run gemma4:26b ``` 31B (Dense) ``` ollama run gemma4:31b ``` What's Changed docs: update pi docs by @ParthSareen in mlx: respect tokenizer addbostoken setting in pipeline by @dhiltgen in * tokenizer: add SentencePiece-style BPE support by @dhiltgen in Full Changelog:
Nueva versión de Ollama con mejoras en documentación y soporte de tokenización.
- Actualización de la documentación de pi.
- El pipeline ahora respeta la configuración de add_bos_token del tokenizador.
- Se añade soporte de BPE estilo SentencePiece.
A quién le importa
Todos los que usan Ollama y están interesados en mejoras de documentación y tokenización.
Generado por IA · puede contener errores
Releases Relacionados
AI-ML
Ollama v0.32.5
## What's Changed * Fixed an MLX Metal bug that could reduce output quality for NVFP4 models, particularly Laguna. **Full Changelog**: https://github.com/ollama/ollama/compare/v0.32.4...v0.32.5
AI-ML
Ollama v0.32.4
## What's Changed - Support Laguna on Apple GPUs via the MLX engine - Quantize draft-model output heads at the requested type when creating speculative-decoding drafts. - Fixed Qwen3 MoE decoding for differently-quantized experts, plus faster packed gate/up projection (~4–9% on M5 Max). **Full
AI-ML