# Unsloth Release Notes

> 14 Updates, 1 aktive Quellen, zuletzt aktualisiert am 1. Oktober 2026.

Quelle: [Seite](https://updatefeed.de/updates/unsloth) · Feed: [RSS](https://updatefeed.de/feed/unsloth/feed.rss)

## Oktober 2026

### Unsloth: Command Palette und Desktop-UI/UX-Verbesserungen

1. Oktober 2026

Unsloth Desktop erhält eine Command Palette (Cmd/Ctrl+P), teilbare GGUF-Run-Einstellungen, klarere Fehlermeldungen, bis zu 4,1x schnellere Laya-Entscheidungen sowie speicherschonenderes 4-Bit-LoRA-Training für NVFP4-, INT4- und MXFP4-Checkpoints.

[Originalquelle](https://unsloth.ai/docs/new/changelog#command-palette--desktop-ui-ux)

## September 2026

### Unsloth: Laya Decision Models und neue Library

28. September 2026

Unsloth unterstützt jetzt Decision Models wie Laya, bietet eine neue Library für Chats, Bilder, Videos und Dokumente, einen Skills Editor, einen Document Viewer, ModelScope-Downloads, Verbesserungen für Apple Silicon sowie rund 4,5x schnellere Bild- und Videogenerierung.

[Originalquelle](https://unsloth.ai/docs/new/changelog#laya-decision-models--library)

### Unsloth: Qwen-Image-2.1 und benutzerdefinierte Skills

22. September 2026

Unsloth kann nun Qwen-Image-2.1 lokal ausführen und bringt benutzerdefinierte Agent Skills, flüssigere Reasoning-Blöcke mit 60 FPS, einfachere Chat- und Projektverwaltung, zuverlässigeres Training sowie bessere Linux- und AMD-Unterstützung.

[Originalquelle](https://unsloth.ai/docs/new/changelog#qwen-image-2.1--skills)

### Unsloth: Docker, Multi-User und AMD-Unterstützung

17. September 2026

Unsloth bringt ein aktualisiertes Docker-Image mit NVIDIA- und AMD-Unterstützung, Multi-User-Konten mit Isolation, INT8/FP8-Bilddiffusion, ARM64-Windows-CUDA-Support, RDNA1/RDNA2-Support sowie Verbesserungen bei GRPO, Chat und Inferenz.

[Originalquelle](https://unsloth.ai/docs/new/changelog#docker--multiuser--amd-support)

### Unsloth: Qwen3.8-Flash und GLM-5.3 bis zu 2x schneller

2. September 2026

Qwen3.8-Flash-Next und GLM-5.3-Flash laufen dank Faster Decoding und MTP, das jetzt standardmäßig aktiv ist, bis zu 2x schneller, außerdem enthält das Release über 170 Verbesserungen bei Training, Chat, Hardware-Support, APIs und Performance.

[Originalquelle](https://unsloth.ai/docs/new/changelog#id-2x-faster-qwen3.8-flash--glm-5.3)

## August 2026

### Unsloth: Qwen3.8-Flash-Next und GLM-5.3 lokal ausführbar

27. August 2026

Qwen3.8-Flash-Next, GLM-5.3-Flash und GLM-5.3 lassen sich nun lokal in Unsloth ausführen, dazu kommen bis zu 5x schnelleres RAM-Offloading, zuverlässigere Auto Compaction, Speicherschätzungen vor dem Laden, JSONL-Chat-Export und über 100 weitere Verbesserungen.

[Originalquelle](https://unsloth.ai/docs/new/changelog#qwen3.8-flash-next--glm-5.3)

### Unsloth: Auto Compaction und LAN-Zugriff

20. August 2026

Mit v0.1.801-beta führt Unsloth experimentelle Auto Compaction für lange Chats, Remote- und LAN-Zugriff als Preview, schnelleren Chat, Unterstützung für eigene llama.cpp-Builds, zusätzliche Inferenz-Schalter und Unsloth Dynamic v3.0 ein.

[Originalquelle](https://unsloth.ai/docs/new/changelog#auto-compaction--lan-access)

### Unsloth: Qwen3.8 lokal und weitere Neuerungen

14. August 2026

Qwen3.8-27B und Qwen3.8-2.4T laufen jetzt lokal in Unsloth (Qwen3.8-27B auch mit Fine-Tuning), dazu kommen zusätzliche llama-server-Argumente, Tool Calling für externe Provider, Codex-Login, schnellere FP8- und GGUF-Inferenz sowie behobene Bypass-Berechtigungen.

[Originalquelle](https://unsloth.ai/docs/new/changelog#qwen3.8)

### Unsloth Desktop: Open-Source-App für Mac, Windows und Linux

11. August 2026

Unsloth Desktop ist erschienen, eine Open-Source-App für Mac, Windows und Linux zum lokalen Ausführen und Trainieren von Modellen, mit Unterstützung für MLX, GGUF, Bild-, Video- und Audiomodelle, Websuche, Deep Research, RAG, MCP und OpenAI-kompatibler API.

[Originalquelle](https://unsloth.ai/docs/new/changelog#introducing-unsloth-desktop)

### Meta Muse Glimmer lokal in Unsloth ausführen und feintunen

10. August 2026

Meta Muse Glimmer, ein dichtes 30B-Modell unter Apache-2.0-Lizenz, lässt sich in Unsloth mit etwa 20GB RAM/VRAM lokal ausführen und mit 20GB VRAM feintunen.

[Originalquelle](https://unsloth.ai/docs/new/changelog#meta-muse-glimmer-is-here)

## Juli 2026

### Kimi K3, Deep Research und paralleler Chat in Unsloth

29. Juli 2026

Unsloth kann Kimi K3 mit Dynamic GGUFs lokal ausführen, mehrere Chats parallel generieren lassen und bietet einen neuen Deep-Research-Modus sowie besseren AMD- und Intel-GPU-Support, DoRA-Training und diverse Fixes.

[Originalquelle](https://unsloth.ai/docs/new/changelog#kimi-k3--deep-research--parallel-chat)

### AMD-Support: Training und Inferenz auf AMD-GPUs

20. Juli 2026

Unsloth ermöglicht jetzt lokales Training und lokale Inferenz auf AMD-GPUs unter Windows, WSL und Linux mit bis zu 2x Geschwindigkeit und 70% weniger VRAM, außerdem kamen im Juli-Update RDNA2-, Gorgon-Halo- und Vulkan-Support sowie Verbesserungen bei Erkennung und Installation hinzu.

[Originalquelle](https://unsloth.ai/docs/new/changelog#amd-support-is-here)

### Personalisierung, NVFP4 und neue Anzeigesprachen

15. Juli 2026

Unsloth bietet nun anpassbare Farbpaletten und Schriften, sieben neue Anzeigesprachen, einen Voice-Tab, eine vierstufige Tool-Call-Berechtigungsauswahl, GPU-beschleunigte Intel-Inferenz über Vulkan, Support für Inkling und erweiterte Dynamic-NVFP4-Quants.

[Originalquelle](https://unsloth.ai/docs/new/changelog#personalization-nvfp4-languages)

### DeepSeek-V4 und NVFP4 in Unsloth

7. Juli 2026

Unsloth unterstützt nun DeepSeek-V4-Flash, exportiert NVFP4-, FP8- und imatrix-GGUFs, kann als llama-swap-artiges API-System dienen, bietet Japanisch und brasilianisches Portugiesisch und macht GRPO 1,3x sowie MoE-Training 3–5x schneller.

[Originalquelle](https://unsloth.ai/docs/new/changelog#deepseek-v4--nvfp4)
