# Transformers Release Notes (Hugging Face)

> 30 Updates, 1 aktive Quellen, zuletzt aktualisiert am 6. Oktober 2026.

Quelle: [Seite](https://updatefeed.de/updates/huggingface/transformers) · Feed: [RSS](https://updatefeed.de/feed/huggingface/transformers/feed.rss)

Hersteller: [Hugging Face](https://updatefeed.de/updates/huggingface.md)

## Oktober 2026

### Transformers v5.19.0: EmbeddingGemma2, Router-Logits als Breaking Change

6. Oktober 2026 · Version 5.19.0

Transformers v5.19.0 ergänzt das multimodale Embedding-Modell EmbeddingGemma2, das Text, Bilder, Audio und Video in einen gemeinsamen 768-dimensionalen Vektorraum abbildet, und gibt bei allen MoE-Modellen mit Router-Logits diese nun bei output_router_logits=True zurück, was ein Breaking Change ist.

[Originalquelle](https://github.com/huggingface/transformers/releases/tag/v5.19.0)

## September 2026

### Transformers 5.18.0: Nemotron 3 Diarization und NemotronH Omni

30. September 2026 · Version 5.18.0

Transformers 5.18.0 ergänzt unter anderem die neuen Modelle Nemotron 3 Diarization für Streaming-Sprecherdiarisierung mit bis zu acht Sprechern sowie NemotronH Omni von NVIDIA.

[Originalquelle](https://github.com/huggingface/transformers/releases/tag/v5.18.0)

### Transformers 5.17.0: neues Modell HYV4 (Hy4-Preview)

9. September 2026 · Version 5.17.0

Transformers 5.17.0 ergänzt das neue Modell HYV4 (Hy4-Preview), ein Mixture-of-Experts-Sprachmodell mit 780B Parametern, 49B aktiven Parametern pro Token und 1M Tokens Kontextfenster.

[Originalquelle](https://github.com/huggingface/transformers/releases/tag/v5.17.0)

## August 2026

### Transformers 5.16.1: GLM-5.3-Flash und kleine Fixes

26. August 2026 · Version 5.16.1

Transformers v5.16.1 unterstützt nun GLM-5.3-Flash, ein nativ multimodales Modell der GLM-5-Reihe, und enthält kleine Fixes zur Rückwärtskompatibilität bei TP sowie ein angepinntes hf-Kernel aus Sicherheitsgründen.

[Originalquelle](https://github.com/huggingface/transformers/releases/tag/v5.16.1)

### Transformers 5.16.0: neues Modell Qwen4-Exp

26. August 2026 · Version 5.16.0

Transformers v5.16.0 ergänzt das neue Modell Qwen4-Exp, das auf der Qwen3.5-Architektur aufbaut und lineare mit sparsamer Attention kombiniert.

[Originalquelle](https://github.com/huggingface/transformers/releases/tag/v5.16.0)

### Transformers 5.15.1: Fixes für DFlash, MTP, Gemma4 und Lanczos

19. August 2026 · Version 5.15.1

Transformers 5.15.1 behebt Probleme mit DFlash- und MTP-Candidate-Generatoren, einen Gerätekonflikt bei Gemma4-Videos sowie Fehler bei der Bildverarbeitung auf Beschleunigern mit Lanczos-Filter, indem auf bicubic ausgewichen wird.

[Originalquelle](https://github.com/huggingface/transformers/releases/tag/v5.15.1)

### Transformers 5.15.0: Muse Glimmer, GraniteMoeSWA und weitere Modelle

10. August 2026 · Version 5.15.0

Transformers v5.15.0 ergänzt neue Modelle, darunter Metas multimodales Muse Glimmer mit 30B Parametern unter Apache-2.0-Lizenz sowie GraniteMoeSWA, GraniteSWA und A.X-K1/A.X-K2.

[Originalquelle](https://github.com/huggingface/transformers/releases/tag/v5.15.0)

## Juli 2026

### Transformers 5.14.1: Fixes für Inkling, FP8-Kernels und deepgemm

16. Juli 2026 · Version 5.14.1

Transformers 5.14.1 behebt Probleme bei der Inkling-Integration, darunter Fehler bei assistierter Generierung mit EncoderDecoderCache und beim sdpa-Prefill mit position_bias, und enthält zudem Fixes für FP8-Kernels und deepgemm auf mehreren Geräten.

[Originalquelle](https://github.com/huggingface/transformers/releases/tag/v5.14.1)

### Transformers 5.14.0: Inkling, TIPSv2 und TIPSv2 DPT

15. Juli 2026 · Version 5.14.0

Transformers v5.14.0 ergänzt neue Modelle, darunter das multimodale Inkling von Thinking Machines mit 975B Parametern (41B aktiv) sowie TIPSv2 und TIPSv2 DPT.

[Originalquelle](https://github.com/huggingface/transformers/releases/tag/v5.14.0)

### Transformers 5.13.1: Kompatibilität mit der neuesten vllm-Version

11. Juli 2026 · Version 5.13.1

Transformers 5.13.1 sorgt für Kompatibilität mit der neuesten vllm-Version, indem Handhabung von Legacy-Layer-Typen, Custom Code und str-Schlüsseln in _LazyAutoMapping.register korrigiert wird.

[Originalquelle](https://github.com/huggingface/transformers/releases/tag/v5.13.1)

### Transformers 5.13.0: Neue Modelle, darunter Kimi K2.5 bis K2.7

3. Juli 2026 · Version 5.13.0

Transformers 5.13.0 fügt unter anderem die Architektur für Kimi K2.5 hinzu, die auch von K2.6 und K2.7 genutzt wird, sowie weitere neue Modelle wie MiMo-V2-Flash.

[Originalquelle](https://github.com/huggingface/transformers/releases/tag/v5.13.0)

## Juni 2026

### Transformers 5.12.1: PEFT-Untergrenze und Mistral-Tokenizer-Fix

15. Juni 2026 · Version 5.12.1

Das Patch-Release 5.12.1 hebt die Untergrenze für PEFT an und behebt einen Fehler, durch den der Auto-Tokenizer den Mistral-Tokenizer bei installiertem mistral-common nicht korrekt auflöste.

[Originalquelle](https://github.com/huggingface/transformers/releases/tag/v5.12.1)

### Transformers 5.10.4 (Version 5.10.3): Fixes für vLLM-Synchronisation

15. Juni 2026 · Version 5.10.3

Das Patch-Release enthält mehrere Korrekturen für die Synchronisation mit vLLM, darunter Fixes für InternVL-Modelle, Token-IDs im ProcessorMixin, Offsets in der Verarbeitung, die PEFT-Untergrenze und den Mistral-Backend; auf PyPI erscheint es als 5.10.4, da 5.10.3 nicht existiert.

[Originalquelle](https://github.com/huggingface/transformers/releases/tag/v5.10.3)

### Transformers 5.12.0: Neues Modell MiniMax-M3-VL und weitere Ergänzungen

12. Juni 2026 · Version 5.12.0

Transformers 5.12.0 fügt das Vision-Language-Modell MiniMax-M3-VL hinzu und aktualisiert die Dokumentation und Tests für PP-OCRv6.

[Originalquelle](https://github.com/huggingface/transformers/releases/tag/v5.12.0)

### Transformers 5.11.0: Neue Modelle DiffusionGemma und DeepSeek-V3.2

10. Juni 2026 · Version 5.11.0

Transformers 5.11.0 ergänzt DiffusionGemma, das Text blockweise per Diffusionssampler für schnellere Generierung erzeugt, sowie DeepSeek-V3.2.

[Originalquelle](https://github.com/huggingface/transformers/releases/tag/v5.11.0)

### Transformers 5.10.2: Korrektur der Modellkonvertierung für CLIP-Modelle

4. Juni 2026 · Version 5.10.2

Das Patch-Release 5.10.2 behebt einen gravierenden Fehler bei der Konvertierung von CLIP-bezogenen Modellen wie sam3, weshalb ein Update empfohlen wird.

[Originalquelle](https://github.com/huggingface/transformers/releases/tag/v5.10.2)

### Transformers 5.10.1: Gemma 4 Unified und Gemma 4 MTP, 5.10.0 zurückgezogen

3. Juni 2026 · Version 5.10.1

Version 5.10.1 ersetzt das zurückgezogene 5.10.0, das auf einem beschädigten Branch veröffentlicht wurde, und fügt Gemma 4 12B Unified, ein encoderfreies multimodales Modell, sowie Gemma 4 MTP hinzu.

[Originalquelle](https://github.com/huggingface/transformers/releases/tag/v5.10.1)

## Mai 2026

### Transformers 5.9.0: Neue Modelle Cohere2Moe, Parakeet tdt und HRM-Text

20. Mai 2026 · Version 5.9.0

Transformers 5.9.0 fügt neue Modelle hinzu, darunter das MoE-Modell Cohere2Moe (Command A+), Parakeet tdt und das autoregressive HRM-Text.

[Originalquelle](https://github.com/huggingface/transformers/releases/tag/v5.9.0)

### Transformers 5.8.1: Fix der DeepSeek-V4-Integration

13. Mai 2026 · Version 5.8.1

Das Patch-Release 5.8.1 korrigiert hauptsächlich die DeepSeek-V4-Integration und behebt zudem einen falschen WeightConverter-Regex-Treffer bei shared_experts sowie einen fatal_error-Fall im ContinuousBatchingManager.

[Originalquelle](https://github.com/huggingface/transformers/releases/tag/v5.8.1)

### Transformers 5.8.0: DeepSeek-V4 und Gemma 4 Assistant

5. Mai 2026 · Version 5.8.0

Transformers 5.8.0 fügt DeepSeek-V4 (Flash, Pro und Base-Varianten) sowie Gemma 4 Assistant als neue Modelle hinzu.

[Originalquelle](https://github.com/huggingface/transformers/releases/tag/v5.8.0)

Weitere Einträge: [Seite 2](https://updatefeed.de/updates/huggingface/transformers.md?seite=2)
