# AI/ML Infrastructure: Release Notes

> Plattformen und Dienste, auf denen KI-Modelle trainiert, betrieben und bereitgestellt werden. 11 Hersteller, 592 Updates. Quelle: [AI/ML Infrastructure](https://updatefeed.de/updates/kategorien/ai-ml-infrastructure)

## Hersteller

- [BentoML](https://updatefeed.de/updates/bentoml.md): 30 Updates
- [Cohere](https://updatefeed.de/updates/cohere.md): 65 Updates
- [CoreWeave](https://updatefeed.de/updates/coreweave.md): 19 Updates
- [Fireworks AI](https://updatefeed.de/updates/fireworks-ai.md): 79 Updates
- [Google](https://updatefeed.de/updates/google.md): 108 Updates
- [Hugging Face](https://updatefeed.de/updates/huggingface.md): 65 Updates
- [mem0](https://updatefeed.de/updates/mem0.md): 30 Updates
- [Modal](https://updatefeed.de/updates/modal.md): 1 Update
- [Runpod](https://updatefeed.de/updates/runpod.md): 40 Updates
- [Together AI](https://updatefeed.de/updates/together-ai.md): 139 Updates
- [Unsloth](https://updatefeed.de/updates/unsloth.md): 16 Updates

## Oktober 2026

### Verdoppelte Serverless-Rate-Limits für Small-Modelle

7. Oktober 2026 · Fireworks AI

Die adaptiven Rate-Limit-Obergrenzen für Small-Serverless-Modelle (unter 600B Parameter) wurden auf 216M Total Prompt TPM, 54M Uncached Prompt TPM und 2,16M Generated TPM verdoppelt, während Medium und Large unverändert bleiben.

[Originalquelle](https://docs.fireworks.ai/updates/changelog)

### Firebase Apple SDK und JavaScript SDK v13.0.0 verfügbar

7. Oktober 2026 · Google: Firebase

Das Firebase Apple SDK (v13.0.0) und das Firebase JavaScript SDK (v13.0.0) stehen nun zur Verfügung.

[Originalquelle](https://firebase.google.com/support/releases)

### Unsloth: Eigene Decision-Modelle trainieren

7. Oktober 2026 · Unsloth

In Unsloth lassen sich beliebige Text- oder Vision-LLMs zu Jev-style Decision-Modellen trainieren, testen, exportieren und bereitstellen, wobei die Genauigkeit von 30 % auf 80 % steigt, außerdem gibt es native ComfyUI-Modelle, Diffusion-Verbesserungen mit INT8 ConvRot, einen besseren Browser in Desktop sowie Sandboxing mit Bwrap (Linux), Seatbelt (Mac) und MXC (Windows).

[Originalquelle](https://unsloth.ai/docs/new/changelog#train-your-own-decision-model)

### Unsloth: EmbeddingGemma 2 und Browser neben dem Chat

7. Oktober 2026 · Unsloth

Unsloth erhält einen integrierten Browser neben dem Chat für Dateien, Webseiten und vom Modell erzeugtes HTML sowie Unterstützung für EmbeddingGemma 2, neue Audio-Seiten mit über 70 GGUF-Modellen, speicherärmeres Training, mehrere gleichzeitig geladene Modelle, optionale vLLM- und SGLang-Engines, eine Sandbox mit Settings-Tab samt Colab- und Docker-Support und eine Live-Vorschau bei Bild- und Videogenerierung.

[Originalquelle](https://unsloth.ai/docs/new/changelog#embeddinggemma-2--browser)

### Flash in öffentlicher Beta: Python-Funktionen auf Cloud-GPUs ausführen

7. Oktober 2026 · Runpod

Flash ist jetzt in der öffentlichen Beta und ist ein Python SDK, mit dem sich Funktionen per Decorator `@Endpoint` auf Runpod Serverless GPUs ausführen lassen, inklusive Auto-Scaling, automatischer Dependency-Installation und Flash apps.

[Originalquelle](https://docs.runpod.io/release-notes)

### Flash: Deployments in mehreren Datacentern

7. Oktober 2026 · Runpod

Flash unterstützt jetzt das gleichzeitige Deployen von Endpoints in mehrere Datacenter, wobei sich zudem Network Volumes pro Datacenter anhängen lassen.

[Originalquelle](https://docs.runpod.io/release-notes)

### Neue Public Endpoints und erweiterte Beispiele

7. Oktober 2026 · Runpod

Runpod erweitert die Public Endpoints um neue Modelle wie SORA 2, Kling, WAN 2.6, Seedream 4.0, Qwen3 32B, IBM Granite 4.0 und Chatterbox Turbo und ergänzt eine Vercel-AI-SDK-Integration, einen Leitfaden für KI-Coding-Tools sowie neue Tutorials.

[Originalquelle](https://docs.runpod.io/release-notes)

### GitHub-Release-Rollback allgemein verfügbar, Load-Balancing-Repos in Beta

7. Oktober 2026 · Runpod

Serverless-Endpoints lassen sich per GitHub-Release-Rollback über die Konsole auf einen früheren Build zurücksetzen, und im Hub sind Load-Balancing-Endpoints (Beta) per `"endpointType": "LB"` in der hub.json verfügbar.

[Originalquelle](https://docs.runpod.io/release-notes)

### Pod migration in Beta und neue Serverless-Entwicklungsleitfäden

7. Oktober 2026 · Runpod

Mit Pod migration (Beta) lässt sich ein gestoppter Pod, dessen GPU belegt ist, samt Daten auf eine neue Maschine mit gleichen Spezifikationen verschieben, außerdem gibt es neue Leitfäden zum Entwickeln, Testen und Debuggen von Serverless-Endpoints.

[Originalquelle](https://docs.runpod.io/release-notes)

### Slurm Clusters GA, Cached models in Beta, neue Public Endpoints

7. Oktober 2026 · Runpod

Slurm Clusters sind allgemein verfügbar, Cached models starten als Beta, um Modell-Downloadzeiten beim Worker-Start zu vermeiden, und mit WAN 2.5 und Nano Banana kommen neue Public Endpoints hinzu.

[Originalquelle](https://docs.runpod.io/release-notes)

### Hub-Revenue-Sharing startet, Pods-Oberfläche überarbeitet

7. Oktober 2026 · Runpod

Wer im Runpod Hub veröffentlicht, kann über monatliche Stufen bis zu 7 % des Compute-Umsatzes als automatisch gutgeschriebene Credits verdienen, und die Pods-Oberfläche wurde modernisiert.

[Originalquelle](https://docs.runpod.io/release-notes)

### Public Endpoints eingeführt, Slurm Clusters in Beta

7. Oktober 2026 · Runpod

Public Endpoints bieten per API-Aufruf und integriertem Playground Zugriff auf KI-Modelle wie Qwen Image Edit, Flux Kontext, Cogito 671B und Minimax Speech, und Slurm Clusters (Beta) ermöglichen Multi-Node-Cluster mit Slurm-Scheduling.

[Originalquelle](https://docs.runpod.io/release-notes)

### S3-kompatibler Speicher und überarbeitetes Empfehlungsprogramm

7. Oktober 2026 · Runpod

Network Volumes lassen sich nun über eine S3-kompatible API mit AWS S3 CLI oder Boto3 ohne Compute nutzen, und das Empfehlungsprogramm erhält neue Prämien, Stufen und übersichtlichere Dashboards.

[Originalquelle](https://docs.runpod.io/release-notes)

### Port-Labeling, Preissenkungen, Runpod Hub und Tetra-Betatest

7. Oktober 2026 · Runpod

Exponierte Ports lassen sich benennen, einige beliebte GPU-SKUs sind günstiger, der Runpod Hub bietet einen Katalog mit One-Click-Endpoints und Templates, und die Python-Bibliothek Tetra startet per `@remote()`-Decorator als Betatest.

[Originalquelle](https://docs.runpod.io/release-notes)

### GitHub-Login, RTX 5090 und erweitertes Global Networking

7. Oktober 2026 · Runpod

Die Anmeldung per GitHub ist möglich, RTX 5090 GPUs sind verfügbar und Global Networking wird auf weitere Rechenzentren ausgeweitet.

[Originalquelle](https://docs.runpod.io/release-notes)

### Enterprise-Funktionen, REST API GA, Instant Clusters in Beta, APAC-Erweiterung

7. Oktober 2026 · Runpod

Network Volumes funktionieren nun auf CPU Pods, Runpod erhält SOC 2 Type I, die REST API ist allgemein verfügbar, Instant Clusters und Bare Metal kommen hinzu, und die neue Region AP-JP-1 in Fukushima startet.

[Originalquelle](https://docs.runpod.io/release-notes)

### REST API in Beta und GitHub-Integration für Serverless allgemein verfügbar

7. Oktober 2026 · Runpod

Die REST API für Pods, Endpoints und Volumes startet als Beta, die GitHub-Integration für Serverless-Deployments ist allgemein verfügbar, und Runpod hat einen Vollzeit-Community-Manager eingestellt.

[Originalquelle](https://docs.runpod.io/release-notes)

### Neue Hardware und Serverless-Upgrades für LLMs

7. Oktober 2026 · Runpod

CPU Pods v2 bieten Docker-Runtime-Parität mit GPU Pods samt Network-Volume-Unterstützung, NVIDIA H200 GPUs sind verfügbar, und Serverless bietet mehr GPUs pro Worker, neue Quick-Deploy-Runtimes und einfachere Modellauswahl.

[Originalquelle](https://docs.runpod.io/release-notes)

### Global Networking erweitert, GitHub-Deployments in Beta

7. Oktober 2026 · Runpod

Global Networking steht in vier weiteren Rechenzentren bereit, Serverless-Endpoints lassen sich per GitHub-Integration (Beta) direkt aus Repos deployen, und es gibt Scoped API Keys sowie Passkey-Anmeldung.

[Originalquelle](https://docs.runpod.io/release-notes)

### Speichererweiterung und privates Networking zwischen Rechenzentren

7. Oktober 2026 · Runpod

Network Volumes sind jetzt in US-GA-2 verfügbar, und Global Networking bietet privates Networking zwischen Rechenzentren mit internem DNS.

[Originalquelle](https://docs.runpod.io/release-notes)

Weitere Einträge: [Seite 2](https://updatefeed.de/updates/kategorien/ai-ml-infrastructure.md?seite=2)
