Hugging Face Transformers
Also known as: transformers library
1stories this week
2last 30 days
21all time
Timeline
- Oct 6, 2026 · Open-source release · 1 sourcehuggingface/transformers v5.19.0: Release v5.19.0EmbeddingGemma 2 is a multimodal embedding model from Google built on the Gemma 4 architecture.
- Sep 30, 2026 · Open-source release · 1 sourcehuggingface/transformers v5.18.0: Release 5.18.0Nemotron 3 Diarization is an open-weight streaming speaker diarization model designed to determine "who spoke when" in real-world audio.
- Sep 9, 2026 · Open-source release · 1 sourcehuggingface/transformers v5.17.0: Release 5.17.0Hy4-Preview is a 780B-parameter mixture-of-experts language model that activates 49B parameters per
- Aug 26, 2026 · Open-source release · 1 sourcehuggingface/transformers v5.16.1: Release v5.16.1This is a special release as we include GLM! (and a few small fixes)
- Aug 26, 2026 · Open-source release · 1 sourcehuggingface/transformers v5.16.0: Release: v5.16.0Qwen4-Exp builds on Qwen3.5's hybrid text and multimodal architecture with three key components: GatedResidual (GR), Qwen Sparse Attention (QSA), and Per-Layer Embedding (PLE).
- Aug 19, 2026 · Open-source release · 1 sourcehuggingface/transformers v5.15.1: Patch release: v5.15.1This patch most notably solves a few issues with DFlash and MTP candidate generators, as well as an issue where images could sometimes not be processed on accelerator if using Lanczos filter.
- Aug 10, 2026 · Open-source release · 1 sourcehuggingface/transformers v5.15.0: Release: v5.15.0Muse Glimmer, released today, is Meta’s new multimodal model, especially designed for agentic use cases.
- Jul 16, 2026 · Open-source release · 1 sourcehuggingface/transformers v5.14.1: Patch release: v5.14.1This patch solves a few issues which appeared when integrating Inkling model, most notably an issue affecting models using EncoderDecoderCache during assisted generation.
- Jul 15, 2026 · Open-source release · 1 sourcehuggingface/transformers v5.14.0: Release v5.14.0Inkling is a general-purpose multimodal model that accepts text, image and audio inputs and
- Jul 11, 2026 · Open-source release · 1 sourcehuggingface/transformers v5.13.1: Patch release v5.13.1This patch is focused on enabling transformers for the latest release of vllm!
- Jul 3, 2026 · Open-source release · 1 sourcehuggingface/transformers v5.13.0: Release v5.13.0Kimi K2.5 is an open-source, native multimodal agentic model that advances practical capabilities in long-horizon coding, coding-driven design, proactive autonomous execution, and swarm-based task orchestration.
- Jun 15, 2026 · Open-source release · 1 sourcehuggingface/transformers v5.12.1: Patch release v5.12.1Updated the lower bound for PEFT and a fix for auto tokenizer to properly resolve the mistral tokenizer (when mistral-common is installed).
- Jun 15, 2026 · Open-source release · 1 sourcehuggingface/transformers v5.10.3: Patch release v5.10.4A few fixes needed for vLLM to sync with transformers :hugs:
- Jun 12, 2026 · Open-source release · 1 sourcehuggingface/transformers v5.12.0: Release v5.12.0MiniMax-M3-VL is the vision-language member of the MiniMax-M3 family that pairs a CLIP-style vision tower with 3D rotary position embeddings with the MiniMax-M3 text backbone.
- Jun 10, 2026 · Open-source release · 1 sourcehuggingface/transformers v5.11.0: Release v5.11.0DiffusionGemma is engineered to reduce the sequential bottlenecks of standard causal language models by employing an encoder-decoder architecture specifically optimized for inference speed.
- Jun 9, 2026 · Model release · 1 sourceIntroducing Gemma 4 12B: a unified, encoder-free multimodal modelIntroducing Gemma 4 12B: a unified, encoder-free multimodal model
- Jun 4, 2026 · Open-source release · 1 sourcehuggingface/transformers v5.10.2: Patch release v5.10.2There was a big bug in the model conversion of models related to clip, this affected models like sam3 and others.
- Jun 3, 2026 · Open-source release · 1 sourcehuggingface/transformers v5.10.1: Release v5.10.1Sorry everyone, this happens when we rush a release!!!
- May 20, 2026 · Open-source release · 1 sourcehuggingface/transformers v5.9.0: Release v5.9.0Command A+ is a Mixture-of-Experts (MoE) language model from Cohere that features a hybrid attention pattern combining sliding window and full attention layers.
- May 13, 2026 · Open-source release · 1 sourcehuggingface/transformers v5.8.1: Patch release v5.8.1This release is mainly to fix the Deepseek V4 integration!!!
- May 5, 2026 · Open-source release · 1 sourcehuggingface/transformers v5.8.0: Release 5.8.0DeepSeek-V4 is the next-generation MoE (Mixture of Experts) language model from DeepSeek that introduces several architectural innovations over DeepSeek-V3.