# Fireworks AI Release Notes (Seite 4)

> 79 Updates, 1 aktive Quellen, zuletzt aktualisiert am 7. Oktober 2026.

Quelle: [Seite](https://updatefeed.de/updates/fireworks-ai) · Feed: [RSS](https://updatefeed.de/feed/fireworks-ai/feed.rss)

## Ohne Datum

### Deployment Tags und Änderungen an der Annotation-API

Datum unbekannt

firectl 1.8.3 bringt die Befehle deployment tag set, unset und list, und die REST-API verlangt für kundenverwaltete Annotation-Keys nun das Präfix custom/, sonst folgt HTTP 403, während Lesezugriffe für normale Nutzer nur custom/*-Einträge zurückgeben.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Neues Trainingsmodell: GLM 5.3

Datum unbekannt · Version 5.3

GLM 5.3 steht für LoRA-Training auf der Dedicated Training API mit bis zu 204K Kontext zur Verfügung und ist für komplexes Coding und langfristige Agenten gedacht.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Serverless-Ratenlimits skalieren nach Modellgröße

Datum unbekannt

Die adaptiven Ratenlimit-Obergrenzen bei Serverless richten sich nun nach der Modellgrößenstufe: kleine Modelle erhalten höhere, mittlere mittlere und große Modelle niedrigere Obergrenzen.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Neue Serverless-Training-Modelle: DeepSeek V4 Flash 0731, Qwen 3.8 27B, Muse Glimmer 30B

Datum unbekannt · Version 3.8

DeepSeek V4 Flash 0731 (bis 262K Kontext), Qwen 3.8 27B und Muse Glimmer 30B (je bis 128K Kontext) sind jetzt für LoRA-Workloads im gemeinsamen Serverless-Training-Pool verfügbar.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Serverless-Abkündigung mehrerer Modelle zum 27. August 2026

Datum unbekannt

MiniMax M2.7, GPT OSS 20B, Kimi K2.6 Turbo/Fast, Kimi K2.7 Code Fast und DeepSeek V4 Pro werden ab dem 27. August 2026 auf Serverless abgekündigt, wobei Migrationsempfehlungen wie MiniMax M3, GPT OSS 120B oder DeepSeek V4 Pro (0813) genannt werden.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Serverless Training: Qwen 3.5 9B und Qwen 3.6 27B abgekündigt

Datum unbekannt · Version 3.5

Qwen 3.5 9B und Qwen 3.6 27B werden ab dem 26. August 2026 im Serverless Training abgekündigt, Workloads sollen auf Qwen 3.8 27B migriert werden.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Serverless-Abkündigung: DeepSeek V4 Flash

Datum unbekannt

DeepSeek V4 Flash wird auf Serverless abgekündigt, die empfohlene Migration führt zu DeepSeek V4 Flash (0731).

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Serverless-Abkündigung: Kimi K2.5 und Qwen 3.6 Plus

Datum unbekannt · Version 3.6

Kimi K2.5 und Qwen 3.6 Plus werden auf Serverless abgekündigt, empfohlen wird der Wechsel zu Kimi K2.6 bzw. Qwen 3.7 Plus.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Serverless-Abkündigung: MiniMax M2.5

Datum unbekannt

MiniMax M2.5 wird auf Serverless abgekündigt, empfohlen wird die Migration zu MiniMax M2.7.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Neues Modell: GLM 5.2

Datum unbekannt · Version 5.2

GLM 5.2 ist ab sofort in der Model Library verfügbar.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Neue Modelle: Kimi K2.7 Code, MiniMax M3, Qwen 3.7 Plus

Datum unbekannt · Version 3.7

Kimi K2.7 Code, MiniMax M3 und Qwen 3.7 Plus sind jetzt in der Model Library verfügbar.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Audio-Inferenz und Bildgenerierung abgekündigt

Datum unbekannt

Audio-Inferenz und Bildgenerierung werden abgekündigt.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Video- und Audio-Modelle, AWS-S3-Training und JIT-Provisioning für SSO

Datum unbekannt

Multimodale Modelle wie Qwen3 Omni und Molmo2 verarbeiten nun Video- und Audio-Eingaben über die Chat Completions API, Trainingsdatasets können in eigenen AWS-S3-Buckets liegen, und Enterprise-SSO unterstützt Just-In-Time-Nutzerprovisionierung.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Warm-Start-Training für RFT und Azure-Federated-Identity für Modell-Uploads

Datum unbekannt

Reinforcement-Fine-Tuning-Jobs lassen sich per --warm-start-from aus SFT-Checkpoints starten, und Modell-Uploads aus Azure Blob Storage unterstützen alternativ zu SAS-Tokens die Azure-AD-Federated-Identity-Authentifizierung.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Playground-Kategorien, neue Nutzerrollen und Fine-Tuning-Verbesserungen

Datum unbekannt

Der Playground erhält Kategorie-Tabs (LLM, Image, TTS, STT), es gibt die neuen Rollen Contributor und Inference, und Fine-Tuning-Jobs lassen sich stoppen, fortsetzen und klonen, außerdem können Output-Datasets und Rollout-Logs von RFT-Jobs heruntergeladen werden.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Reasoning-Guide, Prompt-Caching-Updates und neue Modelle

Datum unbekannt

Es gibt einen neuen Reasoning-Guide, gecachte Prompt-Tokens kosten auf Serverless 50 % weniger, Session-Affinity-Routing ist per user-Feld oder x-session-affinity-Header möglich, und Devstral Small 2 24B Instruct 2512 sowie NVIDIA Nemotron Nano 3 30B A3B sind in der Model Library verfügbar.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### DeepSeek V3.2 serverless, Cached-Token-Preise und neue Modelle

Datum unbekannt

DeepSeek V3.2 ist serverless verfügbar, Model Library und Modellseiten zeigen Preise für gecachte und nicht gecachte Input-Tokens, das Evaluations-Dashboard erhält Statusspalte und Schnellfilter, und DeepSeek V3.2 sowie drei Ministral-3-Modelle (14B, 8B, 3B Instruct 2512) sind in der Model Library verfügbar.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Audit Logs, Dataset-Download und gewichtetes Training für Reinforcement Fine-Tuning

Datum unbekannt

Die Web-App bietet nun eine Audit-Logs-Seite mit Suche und Filter sowie den Download von Datasets, Reinforcement Fine-Tuning unterstützt Gewichtung pro Beispiel, KAT Coder ist neu in der Model Library und die Konsolen-Seitenleiste wurde neu gegliedert.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Evaluator-Verbesserungen, Kimi K2 Thinking serverless und neue API-Endpunkte

Datum unbekannt

Evaluatoren lassen sich über GitHub-Vorlagen erstellen und in einer sortierbaren Tabelle anzeigen, Kimi K2 Thinking ist serverless verfügbar, KAT Dev 32B und 72B Exp sind neue Modelle, es gibt Dokumentation zu W&B und MLflow, und neue REST-API-Endpunkte verwalten Reinforcement Fine-Tuning Steps und Deployments.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)
