# Fish Audio Release Notes

> 15 Updates, 1 aktive Quellen, zuletzt aktualisiert am 5. Oktober 2026.

Quelle: [Seite](https://updatefeed.de/updates/fish-audio) · Feed: [RSS](https://updatefeed.de/feed/fish-audio/feed.rss)

## Oktober 2026

### Drama 3 Preview

5. Oktober 2026

Fish Audio bietet mit Drama 3 Preview (Modell-ID `drama-3-preview`) ein Text-to-Speech-Vorschaumodell, das sich per natürlicher Sprache nach Tonfall, Tempo und Charakter steuern lässt, wobei sich Verhalten und Verfügbarkeit während der Preview ändern können.

[Originalquelle](https://docs.fish.audio/developer-guide/getting-started/changelog#drama-3-preview)

### Transcribe 1 Pro

5. Oktober 2026

Fish Audio führt das Speech-to-Text-Modell Transcribe 1 Pro (`transcribe-1-pro` auf `POST /v1/asr`) für kurze Clips und lange Aufnahmen ein, dessen Transkripte Sprechermarker, Sprecherwechsel sowie Emotions- und Vokalereignis-Hinweise enthalten können.

[Originalquelle](https://docs.fish.audio/developer-guide/getting-started/changelog#transcribe-1-pro)

### Fish Audio S2.1 Pro

5. Oktober 2026

Fish Audio S2.1 Pro (`s2.1-pro`) ist ein Produktions-Text-to-Speech-Modell, das gegenüber S2-Pro bei Qualität, Latenz und Durchsatz verbessert ist und 83 Sprachen unterstützt, während `s2.1-pro-free` bis zum 30. November 2026 unter Fair-Use-Grenzen und ohne TTFA- und DPA-Garantien kostenlos nutzbar ist.

[Originalquelle](https://docs.fish.audio/developer-guide/getting-started/changelog#fish-audio-s2-1-pro)

## März 2026

### Fish Audio S2 mit Emotions-Tags und Multi-Speaker-Dialogen

10. März 2026

Fish Audio S2 ist ein Text-to-Speech-Modell mit Emotions- und paralinguistischen Hinweisen per [Klammer]-Syntax, Multi-Speaker-Dialogen und über 80 Sprachen, das in der API mit der Modell-ID `s2-pro` genutzt wird, während S1 weiter unterstützt wird.

[Originalquelle](https://docs.fish.audio/developer-guide/getting-started/changelog#fish-audio-s2)

## November 2025

### Fish Audio S1 und Umbenennung von Fish Speech

10. November 2025

Fish Speech heißt nun Fish Audio und das Modell S1 (4B Parameter) steht im Playground bereit, S1-mini (0,5B) ist Open Source auf Hugging Face, beide bieten 64+ emotionale Ausdrücke und mehrsprachige Unterstützung.

[Originalquelle](https://docs.fish.audio/developer-guide/getting-started/changelog#fish-audio-s1)

## September 2025

### Version 1.5.1

14. September 2025 · Version 1.5.1

Version 1.5.1 behebt kritische PyTorch-Sicherheitseinstellungen, beschleunigt die Inferenz deutlich, ergänzt ONNX-Export und verbesserte Textverarbeitung für Arabisch und Hebräisch und behebt Fehler bei Apple Silicon (MPS).

[Originalquelle](https://docs.fish.audio/developer-guide/getting-started/changelog#v1-5-1)

### Version 1.5.0

14. September 2025 · Version 1.5.0

Version 1.5.0 führt die v1.5-Modellarchitektur, besseres Dataset-Handling und Bearer-Token-Authentifizierung für APIs ein und ergänzt Caching von Referenzaudio per Hash, bessere Apple-Silicon-Unterstützung sowie Base64-Referenzdaten im JSON-Format.

[Originalquelle](https://docs.fish.audio/developer-guide/getting-started/changelog#v1-5-0)

### Version 1.4.3

14. September 2025 · Version 1.4.3

Version 1.4.3 führt Fish Agent für Konversations-KI mit Streaming und Echtzeit-Interaktion ein, ergänzt koreanische Dokumentation, behebt Probleme mit nicht-englischer Sprache und verbessert WebUI-Streaming sowie PyTorch-Kompatibilität.

[Originalquelle](https://docs.fish.audio/developer-guide/getting-started/changelog#v1-4-3)

### Version 1.4.2

14. September 2025 · Version 1.4.2

Version 1.4.2 aktualisiert vor allem die Dokumentation (v1.4, macOS, Übersetzungen), verbessert Docker-Unterstützung und JSON-Handling der API, ergänzt Audioauswahl in der WebUI und behebt Stabilitätsprobleme wie Cache-Handling und Backend-Leistung.

[Originalquelle](https://docs.fish.audio/developer-guide/getting-started/changelog#v1-4-2)

### Version 1.4.1

14. September 2025 · Version 1.4.1

Version 1.4.1 optimiert Docker und Multi-Plattform-Builds, aktualisiert PyTorch, ersetzt das Audio-Backend sox für bessere Leistung, erweitert die CI/CD-Pipeline um buildx und behebt Docker-Probleme.

[Originalquelle](https://docs.fish.audio/developer-guide/getting-started/changelog#v1-4-1)

### Version 1.4.0

14. September 2025 · Version 1.4.0

Version 1.4.0 bringt eine neue VQGAN-Architektur für bessere Audioqualität und schnellere Inferenz, eine überarbeitete WebUI mit besserem Sprachwechsel, japanische Dokumentation und eine Korrektur beim Inferenz-Warmup.

[Originalquelle](https://docs.fish.audio/developer-guide/getting-started/changelog#v1-4-0)

### Version 1.2.1

14. September 2025 · Version 1.2.1

Version 1.2.1 ersetzt Whisper durch SenseVoice für bessere ASR, bringt native Apple-Silicon-Unterstützung, brasilianisch-portugiesische Lokalisierung, Audio-Streaming und CPU-Inferenz-Verbesserungen, fixiert PyTorch auf 2.3.1 gegen Geschwindigkeitsprobleme und gleicht die API mit der offiziellen Closed-Source-Version an.

[Originalquelle](https://docs.fish.audio/developer-guide/getting-started/changelog#v1-2-1)

### Version 1.2

14. September 2025 · Version 1.2

Version 1.2 führt ein Auto-Reranking-System, zweisprachige Unterstützung und Modellquantisierung ein, ersetzt Whisper durch Faster Whisper für mehr Geschwindigkeit, ergänzt japanische Dokumentation und verbessert Stabilität und Inferenzleistung.

[Originalquelle](https://docs.fish.audio/developer-guide/getting-started/changelog#v1-2)

### Version 1.1.2

14. September 2025 · Version 1.1.2

Version 1.1.2 ergänzt chinesische Textnormalisierung und einen Download-Button für Streaming-Audio in der WebUI, behebt Probleme beim LoRA-Merging und verbessert die Firefly-Leistung.

[Originalquelle](https://docs.fish.audio/developer-guide/getting-started/changelog#v1-1-2)

### Version 1.1.1 mit Breaking Changes und Lizenzwechsel

14. September 2025 · Version 1.1.1

Version 1.1.1 ersetzt zibai durch uvicorn als API-Server, führt einen neuen Text-Splitter mit bytebasierter Längenberechnung ein und wechselt die Lizenz zu CC-BY-NC-SA 4.0, außerdem gibt es Apple-Silicon-(MPS)-Unterstützung, Windows-Ein-Klick-Installation, automatischen Modell-Download mit Fortsetzung und eine verbesserte WebUI.

[Originalquelle](https://docs.fish.audio/developer-guide/getting-started/changelog#v1-1-1)
