# Rapid-MLX Release Notes

> 32 Updates, 1 aktive Quellen, zuletzt aktualisiert am 7. Oktober 2026.

Quelle: [Seite](https://updatefeed.de/updates/rapid-mlx) · Feed: [RSS](https://updatefeed.de/feed/rapid-mlx/feed.rss)

## Oktober 2026

### Rapid-MLX 0.15.7: Embeddings und zuverlässigerer Agent-Setup

7. Oktober 2026 · Version 0.15.7

Rapid-MLX 0.15.7 liefert über `/v1/embeddings` native Text- und Code-Embeddings mit EmbeddingGemma 2 (768 Dimensionen, 8192-Token-Limit), verbessert die Einrichtung von Continue, Cline und Qwen Code und bringt Fixes für Prompt-Wiederverwendung sowie MTP-Scheduling.

[Originalquelle](https://github.com/raullenchai/Rapid-MLX/releases/tag/v0.15.7)

### Rapid-MLX 0.15.7: Embeddings und zuverlässigerer Agent-Setup

7. Oktober 2026 · Version 0.15.7

Rapid-MLX 0.15.7 liefert über `/v1/embeddings` native Text- und Code-Embeddings mit EmbeddingGemma 2 (768 Dimensionen, 8192-Token-Limit), verbessert die Einrichtung von Continue, Cline und Qwen Code und bringt Fixes für Prompt-Wiederverwendung sowie MTP-Scheduling.

[Originalquelle](https://github.com/raullenchai/Rapid-MLX/releases/tag/rapid-mac-v0.15.7)

### Rapid-MLX 0.15.6: Interaktive Startoberfläche, PFlash standardmäßig aus

4. Oktober 2026 · Version 0.15.6

Rapid-MLX 0.15.6 öffnet beim Start von `rapid-mlx` im Terminal eine interaktive Startoberfläche, deaktiviert die PFlash-Prompt-Kompression standardmäßig für alle Aliase (nur per `--pflash auto` oder `--pflash always` aktivierbar) und verbessert Modell-Setup, Cache-Wiederverwendung, Speicherfreigabe und BYOM-Diagnose.

[Originalquelle](https://github.com/raullenchai/Rapid-MLX/releases/tag/v0.15.6)

### Rapid-MLX 0.15.6: Neue Startoberfläche, gruppierte Hilfe, schnellere Speicherfreigabe

4. Oktober 2026 · Version 0.15.6

Rapid-MLX 0.15.6 bringt eine interaktive Startoberfläche für `rapid-mlx`, eine nach Aufgaben gruppierte `--help`, PFlash standardmäßig aus, System One mit Clef und Clef-Flash, optionale BYOM-Telemetrie sowie schnellere Freigabe von KV-Zuständen und Metal-Speicher.

[Originalquelle](https://github.com/raullenchai/Rapid-MLX/releases/tag/rapid-mac-v0.15.6)

### Version 0.15.5: Computer-Use im Hintergrund, schnelleres MTP, Modellprüfung vor Download

3. Oktober 2026 · Version 0.15.5

Rapid-MLX 0.15.5 ermöglicht experimentelle Computer-Use-Eingaben für geeignete Aktionen im Hintergrund, reduziert den Host-Synchronisierungsaufwand bei akzeptierten MTP-Drafts und prüft eigene Modelle schon vor dem Download.

[Originalquelle](https://github.com/raullenchai/Rapid-MLX/releases/tag/v0.15.5)

### Rapid-MLX 0.15.5 (Mac): Modell-Entladen im Chat, Background-Computer-Use, --context-length

3. Oktober 2026 · Version 0.15.5

Rapid-MLX 0.15.5 macht das Entladen von Modellen im Chat besser erreichbar, bietet Background-first Computer Use, schnelleres kontinuierliches MTP-Decoding für Qwen und GLM, sicherere Modellimporte und eine neue `--context-length`-Option.

[Originalquelle](https://github.com/raullenchai/Rapid-MLX/releases/tag/rapid-mac-v0.15.5)

### Version 0.15.4: Beschleunigungsprofile für Qwen3.8 27B und GLM-5.3 Flash

2. Oktober 2026 · Version 0.15.4

Rapid-MLX 0.15.4 führt experimentelle, eng qualifizierte Beschleunigungsprofile für Qwen3.8 27B (`qwen3.8-27b-tensorfold`) und GLM-5.3 Flash auf 256-GB-Macs ein und bringt Share Compute in die Desktop-App.

[Originalquelle](https://github.com/raullenchai/Rapid-MLX/releases/tag/v0.15.4)

### Rapid-MLX 0.15.4 (Mac): neue Profile, Share Compute und GLM-Chat-Fixes

2. Oktober 2026 · Version 0.15.4

Rapid-MLX 0.15.4 ergänzt experimentelle beschleunigte Profile für Qwen3.8 27B und GLM-5.3 Flash, Share Compute im Desktop sowie Kernel für hohe Parallelität und behebt Desktop-Chat-Probleme mit dem GLM-TensorFold-Profil.

[Originalquelle](https://github.com/raullenchai/Rapid-MLX/releases/tag/rapid-mac-v0.15.4)

## September 2026

### Version 0.15.3: Überwachtes Computer Use für lokale Mac-Aufgaben

30. September 2026 · Version 0.15.3

Rapid-MLX 0.15.3 bringt experimentelles, überwachtes Computer Use für lokale Mac-Aufgaben mit Freigabe kritischer Aktionen und eine dokumentierte API für eigene Clients sowie verbesserte Ersteinrichtung und Fehlerbehebung beim Start.

[Originalquelle](https://github.com/raullenchai/Rapid-MLX/releases/tag/v0.15.3)

### Rapid-MLX Desktop 0.15.3: Computer Use mit Planungsmodell und /v1/cua-API

30. September 2026 · Version 0.15.3

Rapid-MLX Desktop 0.15.3 fügt aufgabenorientiertes Computer Use mit Auswahl eines Planungsmodells, Hinweisen zu Mac-Berechtigungen, der authentifizierten lokalen `/v1/cua`-API und anonymen Zählungen zur Ersteinrichtung hinzu.

[Originalquelle](https://github.com/raullenchai/Rapid-MLX/releases/tag/rapid-mac-v0.15.3)

### Version 0.15.2: Automatische Portwahl, neue Modelle, klarere Startfehler

25. September 2026 · Version 0.15.2

Rapid-MLX 0.15.2 zeigt im Desktop die Verbindungsdaten des lokalen Servers zuerst an, wählt bei belegtem Port 8000 automatisch einen freien Port, unterstützt weitere Modelle wie GLM-5.3 Flash und Laya und liefert klarere Ursachen bei Startfehlern.

[Originalquelle](https://github.com/raullenchai/Rapid-MLX/releases/tag/v0.15.2)

### Rapid-MLX 0.15.2 (Mac): Agent-Verbindung, GLM-5.3-Reasoning, Absturzdiagnosen

25. September 2026 · Version 0.15.2

Rapid-MLX 0.15.2 ergänzt eine übersichtliche Agent-Verbindungseinrichtung, weitere lokale Modelle, Reasoning-Steuerung für GLM-5.3, dauerhafte Absturzdiagnosen, automatische Portsuche bei `rapid-mlx serve` und installierbare optionale Extras direkt aus der Fehlermeldung.

[Originalquelle](https://github.com/raullenchai/Rapid-MLX/releases/tag/rapid-mac-v0.15.2)

### Version 0.15.1: Bessere Diagnose bei fehlgeschlagenen Erststarts

24. September 2026 · Version 0.15.1

Rapid-MLX 0.15.1 macht fehlgeschlagene Erststarts besser diagnostizierbar, indem fehlende optionale Extras mit exaktem `pip install`-Befehl genannt werden, `Ready:` erst nach gebundenem Port erscheint und zusätzliche anonyme Startstatus-Telemetrie erfasst wird.

[Originalquelle](https://github.com/raullenchai/Rapid-MLX/releases/tag/v0.15.1)

### Rapid-MLX 0.15.1 (Mac): Startfehler sichtbar, Ready erst nach Port-Bindung

24. September 2026 · Version 0.15.1

Rapid-MLX 0.15.1 zeigt im Desktop den tatsächlichen Startfehler bei fehlenden optionalen Laufzeiten an, gibt `Ready:` erst nach dem Binden des Ports aus, meldet `model_served` einheitlich in allen Serving-Lanes und ergänzt geschlossene Startstatus-Telemetrie.

[Originalquelle](https://github.com/raullenchai/Rapid-MLX/releases/tag/rapid-mac-v0.15.1)

### Version 0.15.0: Telemetrie-Kontrolle, Qwen-Image 2.1, geringere Leerlauf-CPU-Last

22. September 2026 · Version 0.15.0

Rapid-MLX 0.15.0 führt datenschutzfreundliche Telemetrie mit lokalen Steuerungsmöglichkeiten (`rapid-mlx telemetry off`), Bildgenerierung und -bearbeitung mit Qwen-Image 2.1 sowie ein neues High-End-Modell ein und senkt die Leerlauf-CPU-Last im Desktop.

[Originalquelle](https://github.com/raullenchai/Rapid-MLX/releases/tag/v0.15.0)

### Rapid-MLX 0.15.0 (Mac): Telemetrie v2, Qwen-Image 2.1, rapid-mlx feedback

22. September 2026 · Version 0.15.0

Rapid-MLX 0.15.0 bringt Telemetrie v2 mit sichtbaren Kontrollen, einen eigenen Qwen-Image-2.1-Pfad für Text-zu-Bild und Img2img, explizites Gemma 4 Assistant-Sidecar-MTP, den Befehl `rapid-mlx feedback` und `mimo-v2.6-flash-4bit` in der Modellauswahl.

[Originalquelle](https://github.com/raullenchai/Rapid-MLX/releases/tag/rapid-mac-v0.15.0)

### Version 0.14.3: Schnellere multimodale Folgefragen und Community Benchmark

18. September 2026 · Version 0.14.3

Rapid-MLX 0.14.3 beschleunigt Folgefragen in multimodalen Unterhaltungen deutlich (z. B. 54,8 % niedrigere TTFT beim zweiten Durchgang), erweitert Personal Intelligence um begrenzte lokale Arbeit, bringt einen vollständigen Community Benchmark im Desktop und unterstützt Bonsai-2-Hadamard-Modellpakete.

[Originalquelle](https://github.com/raullenchai/Rapid-MLX/releases/tag/v0.14.3)

### Rapid-MLX 0.14.3 (Mac): Personal Intelligence mit lokalem Dateizugriff

18. September 2026 · Version 0.14.3

Rapid-MLX 0.14.3 erlaubt Personal Intelligence den begrenzten Zugriff auf lokale Dateien und Code mit Freigabe pro Aktion, bietet einen vollständigen Community Benchmark im Desktop, startet Folgefragen zum selben Bild schneller und behebt das DMG-Installationsfenster unter betroffenen macOS-Versionen.

[Originalquelle](https://github.com/raullenchai/Rapid-MLX/releases/tag/rapid-mac-v0.14.3)

### Version 0.14.2: Deutlich schnellere Modelle und Agent Mode im Desktop

15. September 2026 · Version 0.14.2

Rapid-MLX 0.14.2 beschleunigt lokale Modelle deutlich (z. B. DeepSeek V4.1 Flash 2,02×, Qwen3.6 35B mit nativem MTP +57,1 %), führt einen freigabebasierten Agent Mode im Desktop ein und unterstützt experimentell K2 Horizon 7B.

[Originalquelle](https://github.com/raullenchai/Rapid-MLX/releases/tag/v0.14.2)

### Rapid-MLX 0.14.2 (Mac): Agent Mode, K2 Horizon 7B, DeepSeek V4.1 Flash

15. September 2026 · Version 0.14.2

Rapid-MLX 0.14.2 ergänzt den experimentellen Agent Mode in Desktop und Server, experimentelle Unterstützung für K2 Horizon 7B und DeepSeek V4.1 Flash auf 256-GB-Macs, einen Hinweis auf Änderungen nach einem Update und beseitigt mehrere Re-Prefill- und Tool-Loop-Probleme im Desktop-Chat.

[Originalquelle](https://github.com/raullenchai/Rapid-MLX/releases/tag/rapid-mac-v0.14.2)

Weitere Einträge: [Seite 2](https://updatefeed.de/updates/rapid-mlx.md?seite=2)
