# liteLLM Release Notes

> 16 Updates, 1 aktive Quellen, zuletzt aktualisiert am 7. Oktober 2026.

Quelle: [Seite](https://updatefeed.de/updates/litellm) · Feed: [RSS](https://updatefeed.de/feed/litellm/feed.rss)

## Oktober 2026

### Day-0-Support für Claude Haiku 5.5 in LiteLLM

7. Oktober 2026 · Version 5.5

LiteLLM unterstützt Claude Haiku 5.5 ab Tag 0 über Anthropic, Bedrock, Gemini Enterprise Agent Platform und Azure im LiteLLM AI Gateway, mit Preisen ab $0.10 / MTok Input für Prompts bis 100K Tokens.

[Originalquelle](https://docs.litellm.ai/blog/claude-haiku-5-5)

### Day-0-Support für Nano Banana 2.1 in LiteLLM

6. Oktober 2026 · Version 2.1

LiteLLM unterstützt `gemini-nano-banana-2.1` ab Tag 0 über Google AI Studio und die Gemini Enterprise Agent Platform für Bildgenerierung, Bildbearbeitung und Chat Completions und ersetzt damit Nano Banana 2, das am 29. Oktober 2026 abgeschaltet wird.

[Originalquelle](https://docs.litellm.ai/blog/nano_banana_2_1)

### Time to first byte bei langen Prompts um 94 % gesenkt

3. Oktober 2026

LiteLLM überspringt die Token-Zählung der optionalen `prompt_caching`-Routingprüfung bei nur einem gesunden Deployment, wodurch die mediane Time to first byte im lokalen 440k-Token-Benchmark von 553 ms auf 35 ms sinkt.

[Originalquelle](https://docs.litellm.ai/blog/long-prompt-latency)

### Auto Router unterstützt selbst gehostete Klassifizierer Laya und Nimble

2. Oktober 2026

Der LiteLLM Auto Router unterstützt jetzt Laya und Bespoke Nimble als selbst gehostete Klassifizierer, die auf eigener Infrastruktur entscheiden, welches Completion-Modell eine Anfrage bearbeitet.

[Originalquelle](https://docs.litellm.ai/blog/laya-nimble-classifiers)

### LiteLLM Lens startet

1. Oktober 2026

LiteLLM stellt Lens vor, eine Ebene am Gateway, die aus den Traces von Agenten Erkenntnisse gewinnt und an die Agenten zurückspielt, damit diese sich verbessern.

[Originalquelle](https://docs.litellm.ai/blog/litellm-lens-launch)

### Redis-Roundtrips pro Request um 64 % reduziert

1. Oktober 2026

Ein Request an den LiteLLM-Proxy benötigt im Beispielszenario nur noch 8 statt 22 Redis-Roundtrips (5 vor und 3 nach dem Modellaufruf) bei gleichen Prüfungen und Schreibvorgängen.

[Originalquelle](https://docs.litellm.ai/blog/redis-request-pipelines)

## September 2026

### LiteLLM-Usage-Seite etwa 120x schneller

30. September 2026

Die Usage-Seite lädt 30-Tage-Summen bei 5.000 API-Keys nun in 3,2 Sekunden statt in über sechs Minuten, weil Postgres die Aggregation übernimmt und der Browser weniger Daten lädt.

[Originalquelle](https://docs.litellm.ai/blog/usage-page-bounded-loading)

### Day-0-Support für GPT-6.1 Sol in LiteLLM

29. September 2026

LiteLLM unterstützt GPT-6.1 Sol ab Tag 0 über das AI Gateway mit der üblichen OpenAI-Konfiguration, zum Preis von $2 Input und $10 Output pro 1M Tokens bei auf $0.10 halbiertem Cached Input.

[Originalquelle](https://docs.litellm.ai/blog/gpt_6_1_sol)

### Day-0-Support für Claude Sonnet 5.5 in LiteLLM

28. September 2026 · Version 5.5

LiteLLM unterstützt Claude Sonnet 5.5 ab Tag 0 über Anthropic, Bedrock, Gemini Enterprise Agent Platform und Azure zum gleichen Preis wie Sonnet 5 ($2 / MTok Input, $10 / MTok Output).

[Originalquelle](https://docs.litellm.ai/blog/claude_sonnet_5_5)

### LiteLLM ROI Calculator vorgestellt

26. September 2026

Der neue LiteLLM ROI Calculator setzt die Ausgaben pro Nutzer aus dem Gateway mit dem geschätzten Aufwand gemergter GitHub-Pull-Requests ins Verhältnis und zeigt die Kosten pro geschätzter Engineering-Stunde.

[Originalquelle](https://docs.litellm.ai/blog/litellm-roi-calculator)

### LiteAgents: Agent-Harnesses per Feld wechseln

25. September 2026

LiteAgents erlaubt es, den Agent-Harness (Deep Agents, Pydantic AI, Claude Agent SDK, Codex oder OpenCode) über ein Profilfeld zu wechseln, ohne Tools, MCP-Verbindungen, Modellkonfiguration oder Client-Code umzuschreiben.

[Originalquelle](https://docs.litellm.ai/blog/liteagents-sdk)

### September-Townhall: 583 Bugfixes, OCR auf Rust, 83,5 % Coverage

24. September 2026

Der Town-Hall-Rückblick nennt 52 Sicherheitsfixes, den Start-Abbruch von LiteLLM bei fehlendem oder Standard-Master-Key, OCR standardmäßig auf Rust und eine Testabdeckung über dem 80-%-Ziel.

[Originalquelle](https://docs.litellm.ai/blog/september-townhall-updates)

### Day-0-Support für Gemini 3.8 Flash TTS und Flash-Lite TTS

23. September 2026 · Version 3.8

LiteLLM unterstützt `gemini-3.8-flash-tts` und `gemini-3.8-flash-lite-tts` ab Tag 0 über `/v1/audio/speech` auf Google AI Studio und ersetzt damit die 3.1-Flash-TTS-Preview.

[Originalquelle](https://docs.litellm.ai/blog/gemini_3_8_flash_tts)

### LiteAdmin MCP vorgestellt

23. September 2026

LiteAdmin MCP verbindet MCP-Clients oder eigene Agenten mit der Management-API des Gateways, um Virtual Keys, Modell-Deployments, Teams, Budgets und Nutzung zu verwalten.

[Originalquelle](https://docs.litellm.ai/blog/litellm-admin-mcp)

### Day-0-Support für GPT-6 Sol und GPT-6 Luna

22. September 2026

LiteLLM unterstützt GPT-6 Sol ($2 Input / $10 Output pro 1M Tokens) und GPT-6 Luna ($0.10 / $0.50) ab Tag 0 über das AI Gateway mit der üblichen OpenAI-Konfiguration.

[Originalquelle](https://docs.litellm.ai/blog/gpt_6_sol_luna)

### Day-0-Support für Claude Opus 5.5 in LiteLLM

22. September 2026 · Version 5.5

LiteLLM unterstützt Claude Opus 5.5 ab Tag 0 über Anthropic, Bedrock, Gemini Enterprise Agent Platform und Azure, mit $4 / MTok Input und $20 / MTok Output und damit 20 % günstiger als Opus 5.

[Originalquelle](https://docs.litellm.ai/blog/claude_opus_5_5)
