Zum Inhalt springen

Moondream Release Notes

6 Einträge aus 1 Quelle. Zuletzt aktualisiert:

Folge Moondream, um die Release Notes in deinen Feed zu holen.

Angaben zum Datum

Datum aus der Quelle.

Erstmals gesehen am .

Moondream

Photon erreicht über 400 tok/s mit Qwen3.5-27B

Photon führt Qwen3.5-27B auf einer einzelnen B200 mit über 400 Tokens pro Sekunde aus, wobei FP8 und DFlash Speculative Verification nun Teil des Megakernel-Compilers sind.

Product Update

September 29, 2026

400 tok/s with Qwen3.5

Photon runs Qwen3.5-27B at over 400 tokens per second on one B200. FP8 and DFlash speculative verification are now part of our megakernel compiler.

Read more

](/blog/photon-2-6-qwen-400-tokens-per-second)[

Originalquelle(öffnet in neuem Tab)Problem melden

Angaben zum Datum

Datum aus der Quelle.

Erstmals gesehen am .

Moondream

Photon unterstützt jetzt Sprachausgabe

Qwen3-TTS und Kokoro sind jetzt in Photon verfügbar und bieten bis zu 70 % geringere Startlatenz bei der Sprachausgabe als vLLM-Omni.

Product Update

September 24, 2026

Photon can now speak

Up to 70% lower speech startup latency than vLLM-Omni. Qwen3-TTS and Kokoro are now available in Photon.

Read more

](/blog/photon-can-now-speak)[

Originalquelle(öffnet in neuem Tab)Problem melden

Angaben zum Datum

Datum aus der Quelle.

Erstmals gesehen am .

Moondream

Moondream Parakeet Redux und Parakeet Ultra vorgestellt

Moondream veröffentlicht mit Parakeet Redux und Parakeet Ultra Speech-to-Text-Modelle für lokale Transkription in 25 Sprachen auf CPUs und GPUs.

Model Release

September 22, 2026

Introducing Moondream Parakeet Redux and Parakeet Ultra

Meet Moondream Parakeet Redux and Parakeet Ultra: speech-to-text models for local transcription in 25 languages, on CPUs and GPUs.

Read more

](/blog/introducing-parakeet-redux-and-ultra)[

Originalquelle(öffnet in neuem Tab)Problem melden

Angaben zum Datum

Datum aus der Quelle.

Erstmals gesehen am .

Moondream

Photon 2.2: Fünf neue NVIDIA-GPUs von Ampere bis Blackwell

Photon 2.2 unterstützt fünf weitere NVIDIA-GPUs von Ampere bis Blackwell, wobei Parakeet den 3,1- bis 4,8-fachen Durchsatz von NeMo erreicht und Qwen3-ASR vLLM in 23 von 24 getesteten Konfigurationen schlägt.

Announcement

September 9, 2026

Photon 2.2: Five New NVIDIA GPUs, Ampere to Blackwell

Photon 2.2 adds five NVIDIA GPUs, Ampere to Blackwell. Parakeet runs 3.1x to 4.8x NeMo's throughput. Qwen3-ASR beats vLLM in 23 of 24 benchmarked configurations.

Read more

](/blog/photon-2-2-five-new-nvidia-gpus-ampere-to-blackwell)[

Originalquelle(öffnet in neuem Tab)Problem melden

Angaben zum Datum

Datum aus der Quelle.

Erstmals gesehen am .

Moondream

Photon 2.1: Spracherkennung auf H100 und B200, bis zu 3,1× schneller

Photon 2.1 ergänzt automatische Spracherkennung für Whisper, Qwen3-ASR und Parakeet, die in jedem vergleichbaren Test die jeweilige Referenz-Engine schlägt, und bringt den gesamten Modellkatalog auf NVIDIA B200.

Announcement

September 1, 2026

Photon 2.1: Speech Recognition on H100 and B200, Up to 3.1× Faster

Photon 2.1 adds automatic speech recognition for Whisper, Qwen3-ASR, and Parakeet, beating each model's reference engine in every matched test, and brings the full model catalog to NVIDIA B200.

Read more

](/blog/photon-2-1-speech-recognition)[

Originalquelle(öffnet in neuem Tab)Problem melden

Angaben zum Datum

Datum aus der Quelle.

Erstmals gesehen am .

Moondream

Photon 2.0: Inferenz-Engine für Physical AI

Photon 2.0 kompiliert Modelle zu GPU-Programmen, die auf Chip und Aufgabe optimiert sind, unterstützt zunächst Moondream, Qwen und Gemma auf NVIDIA H100 und gewinnt jeden vergleichbaren Durchsatztest gegen vLLM und SGLang.

Announcement

August 3, 2026

Photon 2.0: Inference engine for Physical AI

Photon compiles models into GPU programs optimized for the chip and the job. The first release supports Moondream, Qwen, and Gemma on NVIDIA H100, and wins every matched throughput test against vLLM and SGLang.

Read more

](/blog/photon-2-launch)[

Originalquelle(öffnet in neuem Tab)Problem melden