# Fireworks AI Release Notes

> 79 Updates, 1 aktive Quellen, zuletzt aktualisiert am 7. Oktober 2026.

Quelle: [Seite](https://updatefeed.de/updates/fireworks-ai) · Feed: [RSS](https://updatefeed.de/feed/fireworks-ai/feed.rss)

## Oktober 2026

### Verdoppelte Serverless-Rate-Limits für Small-Modelle

7. Oktober 2026

Die adaptiven Rate-Limit-Obergrenzen für Small-Serverless-Modelle (unter 600B Parameter) wurden auf 216M Total Prompt TPM, 54M Uncached Prompt TPM und 2,16M Generated TPM verdoppelt, während Medium und Large unverändert bleiben.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Höhere Serverless-Rate-Limits für Small-Modelle

2. Oktober 2026

Die Rate-Limit-Obergrenzen der Small-Stufe wurden auf 108M Total Prompt TPM, 27M Uncached Prompt TPM und 1,08M Generated TPM erhöht, und die Stufe umfasst nun Modelle mit weniger als 600B Parametern.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Neue Serverless-Preise für DeepSeek V4.1 Flash ab 1. Oktober 2026

1. Oktober 2026

Ab dem 1. Oktober 2026 um 00:00 UTC ändern sich die Serverless-Preise für DeepSeek V4.1 Flash, etwa Standard-Output von 0,66 auf 1,20 US-Dollar pro 1M Tokens, während Dedicated Deployments und Reserved Throughput unberührt bleiben.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Managed RFT pausiert, RL über die Training API

1. Oktober 2026

Managed Reinforcement Fine-Tuning (RFT) nimmt keine neuen Jobs mehr an, bestehende Modelle laufen weiter, und 70 nur darüber trainierbare Modelle lassen sich nicht mehr fine-tunen; als Alternative wird RL über die Training API empfohlen, Managed SFT und DPO bleiben unberührt.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Serverless-Preisänderung für DeepSeek V4.1 Flash

1. Oktober 2026

Ab 1. Oktober 2026 um 00:00 UTC steigen die Serverless-Preise für DeepSeek V4.1 Flash im Standard-Tarif auf $0.30 / $0.006 / $1.20 und im Priority-Tarif auf $0.375 / $0.0075 / $1.50 pro 1M Tokens, dedizierte Deployments und Reserved Throughput sind nicht betroffen.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

## September 2026

### Neues Trainingsmodell: DeepSeek V4.1 Flash

28. September 2026

DeepSeek V4.1 Flash ist jetzt für LoRA-Training auf der Dedicated Training API mit bis zu 262K Kontext verfügbar, SFT wird unterstützt und RL-Support folgt bald.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Serverless-Abkündigung: DeepSeek V4 Pro (0813), V4 Flash (0731) und weitere

26. September 2026

Die angekündigte Abschaltung mehrerer Modelle, darunter DeepSeek V4 Pro (0813), DeepSeek V4 Flash (0731) und Kimi K2.6, ist auf Public Serverless in Kraft getreten, dedizierte Deployments bleiben unberührt, und es werden Migrationsziele wie DeepSeek V4.1 Flash empfohlen.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Neues Serverless-Training-Modell: GLM 5.3 Flash

22. September 2026

GLM 5.3 Flash ist jetzt für LoRA-Workloads im gemeinsamen Serverless-Training-Pool mit bis zu 200K Kontext sowie Text- und Vision-Eingaben verfügbar.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Neues Serverless-Training-Modell: GLM 5.3

16. September 2026

GLM 5.3 ist jetzt für LoRA-Workloads im gemeinsamen Serverless-Training-Pool mit bis zu 262K Kontext verfügbar, ohne Kapazitätsreservierung und mit Abrechnung pro Token.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Neue Deployment-Optionen: deploymentShape "default" und acceptShapelessRisk

16. September 2026

Beim Erstellen von Deployments lässt sich per `deploymentShape: "default"` eine validierte Shape automatisch wählen oder per `acceptShapelessRisk=true` ausdrücklich ohne Shape erstellen, wobei die Shape-Pflicht künftig durchgesetzt werden soll.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Neues Trainingsmodell: GLM 5.3 Flash

13. September 2026

GLM 5.3 Flash ist jetzt für LoRA-Training auf der Dedicated Training API einschließlich Vision-Training mit bis zu 262K Kontext verfügbar.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Ankündigung: Serverless-Abkündigung älterer DeepSeek-, GLM-, Muse- und Kimi-Modelle

12. September 2026

Mehrere ältere Serverless-Modelle werden am 25. September 2026 abgeschaltet, sodass Nutzer vorher auf empfohlene Nachfolger wie DeepSeek V4.1 Flash oder GLM 5.3 migrieren müssen, während dedizierte Deployments unberührt bleiben.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Neuer Trainingskosten-Schätzer

9. September 2026

Ein neuer Trainingskosten-Schätzer hilft, die Kosten eines Trainingsjobs vor dem Start abzuschätzen, wobei die Schätzungen keine verbindlichen Angebote sind.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Deployment-Tags und Änderungen an der Annotation-API

8. September 2026

firectl 1.8.3 bietet Befehle zum Setzen, Entfernen und Auflisten von Deployment-Tags, während die REST-API für kundenverwaltete Annotationen das Präfix `custom/` verlangt, bloße Schlüssel mit HTTP 403 ablehnt und beim Lesen nur `custom/*`-Einträge zurückgibt.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Neues Trainingsmodell: GLM 5.3

7. September 2026

GLM 5.3 ist jetzt für LoRA-Training auf der Dedicated Training API mit bis zu 204K Kontext verfügbar und für komplexes Coding und langfristige Agenten gedacht.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Serverless-Rate-Limit-Obergrenzen skalieren nach Modellgröße

1. September 2026

Die adaptiven Serverless-Rate-Limit-Obergrenzen richten sich jetzt nach der Modellgrößenstufe, wobei kleinere Modelle höhere und große Modelle niedrigere Obergrenzen erhalten.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

## August 2026

### Neue Serverless-Training-Modelle: DeepSeek V4 Flash 0731, Qwen 3.8 27B, Muse Glimmer 30B

30. August 2026

DeepSeek V4 Flash 0731 (bis 262K Kontext), Qwen 3.8 27B und Muse Glimmer 30B (je bis 128K Kontext) sind jetzt für LoRA-Workloads im gemeinsamen Serverless-Training-Pool verfügbar.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Serverless-Abkündigung: MiniMax M2.7, GPT OSS 20B, Kimi- und DeepSeek-Modelle

27. August 2026

MiniMax M2.7, GPT OSS 20B, Kimi K2.6 Turbo/Fast, Kimi K2.7 Code Fast und DeepSeek V4 Pro sind ab dem 27. August 2026 auf Serverless abgekündigt, und es werden jeweils Ersatzmodelle zur Migration empfohlen.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Serverless-Training-Abkündigung: Qwen 3.5 9B und Qwen 3.6 27B

26. August 2026

Qwen 3.5 9B und Qwen 3.6 27B sind ab dem 26. August 2026 im Serverless Training abgekündigt, und Workloads sollen auf Qwen 3.8 27B migriert werden.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Serverless-Abkündigung: DeepSeek V4 Flash

14. August 2026

DeepSeek V4 Flash ist auf Serverless abgekündigt, und Nutzer sollen auf DeepSeek V4 Flash (0731) migrieren.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

Weitere Einträge: [Seite 2](https://updatefeed.de/updates/fireworks-ai.md?seite=2)
