# Moondream Release Notes

> 6 Updates, 1 aktive Quellen, zuletzt aktualisiert am 29. September 2026.

Quelle: [Seite](https://updatefeed.de/updates/moondream) · Feed: [RSS](https://updatefeed.de/feed/moondream/feed.rss)

## September 2026

### Photon erreicht über 400 tok/s mit Qwen3.5-27B

29. September 2026

Photon führt Qwen3.5-27B auf einer einzelnen B200 mit über 400 Tokens pro Sekunde aus, wobei FP8 und DFlash Speculative Verification nun Teil des Megakernel-Compilers sind.

[Originalquelle](https://moondream.ai/blog/photon-2-6-qwen-400-tokens-per-second)

### Photon unterstützt jetzt Sprachausgabe

24. September 2026

Qwen3-TTS und Kokoro sind jetzt in Photon verfügbar und bieten bis zu 70 % geringere Startlatenz bei der Sprachausgabe als vLLM-Omni.

[Originalquelle](https://moondream.ai/blog/photon-can-now-speak)

### Moondream Parakeet Redux und Parakeet Ultra vorgestellt

22. September 2026

Moondream veröffentlicht mit Parakeet Redux und Parakeet Ultra Speech-to-Text-Modelle für lokale Transkription in 25 Sprachen auf CPUs und GPUs.

[Originalquelle](https://moondream.ai/blog/introducing-parakeet-redux-and-ultra)

### Photon 2.2: Fünf neue NVIDIA-GPUs von Ampere bis Blackwell

9. September 2026 · Version 2.2

Photon 2.2 unterstützt fünf weitere NVIDIA-GPUs von Ampere bis Blackwell, wobei Parakeet den 3,1- bis 4,8-fachen Durchsatz von NeMo erreicht und Qwen3-ASR vLLM in 23 von 24 getesteten Konfigurationen schlägt.

[Originalquelle](https://moondream.ai/blog/photon-2-2-five-new-nvidia-gpus-ampere-to-blackwell)

### Photon 2.1: Spracherkennung auf H100 und B200, bis zu 3,1× schneller

1. September 2026 · Version 2.1

Photon 2.1 ergänzt automatische Spracherkennung für Whisper, Qwen3-ASR und Parakeet, die in jedem vergleichbaren Test die jeweilige Referenz-Engine schlägt, und bringt den gesamten Modellkatalog auf NVIDIA B200.

[Originalquelle](https://moondream.ai/blog/photon-2-1-speech-recognition)

## August 2026

### Photon 2.0: Inferenz-Engine für Physical AI

3. August 2026 · Version 2.0

Photon 2.0 kompiliert Modelle zu GPU-Programmen, die auf Chip und Aufgabe optimiert sind, unterstützt zunächst Moondream, Qwen und Gemma auf NVIDIA H100 und gewinnt jeden vergleichbaren Durchsatztest gegen vLLM und SGLang.

[Originalquelle](https://moondream.ai/blog/photon-2-launch)
