# fal Release Notes

> 7 Updates, 1 aktive Quellen, zuletzt aktualisiert am 14. September 2026.

Quelle: [Seite](https://updatefeed.de/updates/falai) · Feed: [RSS](https://updatefeed.de/feed/falai/feed.rss)

## September 2026

### Abrechnungs-Header für WebSocket-Endpunkte bei fal

14. September 2026

Geteilte WebSocket-Endpunkte können Abrechnungsinformationen jetzt über die Header x-fal-billable-units bzw. x-fal-billable-units-webhook in der 101-Upgrade-Antwort angeben, wobei die Gesamtzahl bei Bedarf per POST /requests/billable-units/{request_id} gemeldet wird und Sitzungen ohne Header weiterhin nach Dauer abgerechnet werden.

[Originalquelle](https://docs.fal.ai/changelog)

### Zwischen App-Endpunkten im Dashboard-Playground wechseln

9. September 2026

Im App-Dashboard bereitgestellter Serverless-Apps gibt es unter Testing > Playground nun einen Bereich, in dem sich die Endpunkte einer App über ein generiertes Eingabeformular direkt testen lassen.

[Originalquelle](https://docs.fal.ai/changelog)

## August 2026

### Platform MCP Server für fal

17. August 2026

Der neue Platform API MCP-Server unter https://api.fal.ai/v1/mcp/platform ermöglicht es MCP-kompatiblen KI-Assistenten, mit 15 schreibgeschützten Tools das fal-Konto zu analysieren und etwa fehlgeschlagene Requests zu debuggen.

[Originalquelle](https://docs.fal.ai/changelog)

### Neue Serverless-Observability-APIs bei fal

17. August 2026

Neue Serverless-Observability-APIs liefern programmatischen Zugriff auf Apps mit Live-Status, Ereignisverlauf, Revisionen und Runner-Historie, also auf Daten, die bisher im Dashboard sichtbar waren.

[Originalquelle](https://docs.fal.ai/changelog)

### GPU Utilization in der Runner-Telemetrie

4. August 2026

Die Runner-Telemetrie enthält jetzt ein eigenes Diagramm zur GPU Utilization neben CPU, Arbeitsspeicher und VRAM, sodass sich speicher- und rechenlastige Runner besser unterscheiden lassen.

[Originalquelle](https://docs.fal.ai/changelog)

### Deploy-Nachrichten und Annotationen für Revisionen

3. August 2026

Beim Deployen lassen sich jeder Revision nun eine Nachricht und eigene Annotationen per --message und --annotation (bzw. im Python SDK) mitgeben, die auf der Versions-Seite im Dashboard und über die revisions API abrufbar sind.

[Originalquelle](https://docs.fal.ai/changelog)

## Juli 2026

### Retry-Konfiguration auf App-Ebene mit retry_config

8. Juli 2026

Mit der neuen Deployment-Option retry_config können Apps beim Deployen ein Standard-Retry-Budget pro Fehlerbedingung festlegen, das für alle queue-basierten Requests gilt und per X-Fal-Retry-Config-Header überschrieben werden kann.

[Originalquelle](https://docs.fal.ai/changelog)
