feat(container): update image ghcr.io/berriai/litellm (v1.102.1 ➔ v1.103.0) #2226

Merged
GiorgioAresu merged 1 commit from renovate/ghcr.io-berriai-litellm-1.x into main 2026-09-29 08:45:40 +02:00
Collaborator

This PR contains the following updates:

Package Update Change
ghcr.io/berriai/litellm (source) minor v1.102.1 → v1.103.0

⚠️ Warning

Some dependencies could not be looked up. Check the Dependency Dashboard for more information.


Release Notes

BerriAI/litellm (ghcr.io/berriai/litellm)

v1.103.0

Compare Source

Verify Docker Image Signature

All LiteLLM Docker images are signed with cosign. Every release is signed with the same key introduced in commit 0112e53.

Verify using the pinned commit hash (recommended):

A commit hash is cryptographically immutable, so this is the strongest way to ensure you are using the original signing key:

cosign verify \
  --key https://raw.githubusercontent.com/BerriAI/litellm/0112e53046018d726492c814b3644b7d376029d0/cosign.pub \
  ghcr.io/berriai/litellm:v1.103.0

Verify using the release tag (convenience):

Tags are protected in this repository and resolve to the same key. This option is easier to read but relies on tag protection rules:

cosign verify \
  --key https://raw.githubusercontent.com/BerriAI/litellm/v1.103.0/cosign.pub \
  ghcr.io/berriai/litellm:v1.103.0

Expected output:

The following checks were performed on each of these signatures:
  - The cosign claims were validated
  - The signatures were verified against the specified public key

What's Changed

New Contributors

Full Changelog: https://github.com/BerriAI/litellm/compare/v1.102.0...v1.103.0


Configuration

📅 Schedule: (in timezone Europe/Rome)

  • Branch creation
    • At any time (no schedule defined)
  • Automerge
    • At any time (no schedule defined)

🚦 Automerge: Disabled by config. Please merge this manually once you are satisfied.

♻ Rebasing: Whenever PR becomes conflicted, or you tick the rebase/retry checkbox.

🔕 Ignore: Close this PR and you won't be reminded about this update again.


  • If you want to rebase/retry this PR, check this box

This PR has been generated by Mend Renovate CLI.

This PR contains the following updates: | Package | Update | Change | |---|---|---| | [ghcr.io/berriai/litellm](https://images.chainguard.dev/directory/image/wolfi-base/overview) ([source](https://github.com/BerriAI/litellm)) | minor | `v1.102.1` → `v1.103.0` | --- > ⚠️ **Warning** > > Some dependencies could not be looked up. Check the [Dependency Dashboard](issues/6) for more information. --- ### Release Notes <details> <summary>BerriAI/litellm (ghcr.io/berriai/litellm)</summary> ### [`v1.103.0`](https://github.com/BerriAI/litellm/releases/tag/v1.103.0) [Compare Source](https://github.com/BerriAI/litellm/compare/v1.102.1...v1.103.0) #### Verify Docker Image Signature All LiteLLM Docker images are signed with [cosign](https://docs.sigstore.dev/cosign/overview/). Every release is signed with the same key introduced in [commit `0112e53`](https://github.com/BerriAI/litellm/commit/0112e53046018d726492c814b3644b7d376029d0). **Verify using the pinned commit hash (recommended):** A commit hash is cryptographically immutable, so this is the strongest way to ensure you are using the original signing key: ```bash cosign verify \ --key https://raw.githubusercontent.com/BerriAI/litellm/0112e53046018d726492c814b3644b7d376029d0/cosign.pub \ ghcr.io/berriai/litellm:v1.103.0 ``` **Verify using the release tag (convenience):** Tags are protected in this repository and resolve to the same key. This option is easier to read but relies on tag protection rules: ```bash cosign verify \ --key https://raw.githubusercontent.com/BerriAI/litellm/v1.103.0/cosign.pub \ ghcr.io/berriai/litellm:v1.103.0 ``` Expected output: ``` The following checks were performed on each of these signatures: - The cosign claims were validated - The signatures were verified against the specified public key ``` *** #### What's Changed - fix(responses): translate the reasoning object into a chat-completion reasoning effort by [@&#8203;joshgarnett](https://github.com/joshgarnett) in [#&#8203;36363](https://github.com/BerriAI/litellm/pull/36363) - fix(proxy): bound tool and guardrail index create\_many by the spend-log statement budgets by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40561](https://github.com/BerriAI/litellm/pull/40561) - fix(mcp): require admission for delegated OAuth by [@&#8203;joshua-berri](https://github.com/joshua-berri) in [#&#8203;40923](https://github.com/BerriAI/litellm/pull/40923) - fix(logging): log one bounded summary for a burst of timed-out LoggingWorker callbacks by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40912](https://github.com/BerriAI/litellm/pull/40912) - fix(fireworks): resolve short model names to long cost map keys by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40929](https://github.com/BerriAI/litellm/pull/40929) - ci: remove main branch source guard by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;40172](https://github.com/BerriAI/litellm/pull/40172) - chore(ci): promote internal staging to main by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;40942](https://github.com/BerriAI/litellm/pull/40942) - fix(spend\_logs): store litellm\_call\_id and match it in request\_id lookups by [@&#8203;mateo-berri](https://github.com/mateo-berri) in [#&#8203;39068](https://github.com/BerriAI/litellm/pull/39068) - fix(auth): refresh lite login session token grants from the live user and team rows by [@&#8203;ryan-crabbe-berri](https://github.com/ryan-crabbe-berri) in [#&#8203;40657](https://github.com/BerriAI/litellm/pull/40657) - feat(bedrock): support file delete and list for S3-backed managed files by [@&#8203;mateo-berri](https://github.com/mateo-berri) in [#&#8203;39836](https://github.com/BerriAI/litellm/pull/39836) - fix(proxy): gate the webhook test alert on proxy admins by [@&#8203;ryan-crabbe-berri](https://github.com/ryan-crabbe-berri) in [#&#8203;40814](https://github.com/BerriAI/litellm/pull/40814) - fix(ui): hide admin write-form tabs on the models page from view-only admins by [@&#8203;mateo-berri](https://github.com/mateo-berri) in [#&#8203;38867](https://github.com/BerriAI/litellm/pull/38867) - fix(anthropic-adapter): surface mid-stream provider errors as Anthropic error events by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;33352](https://github.com/BerriAI/litellm/pull/33352) - docs(github): add an Affected release section to the PR template by [@&#8203;mateo-berri](https://github.com/mateo-berri) in [#&#8203;40618](https://github.com/BerriAI/litellm/pull/40618) - docs(e2e): ban unit tests under tests/e2e by [@&#8203;yassin-berriai](https://github.com/yassin-berriai) in [#&#8203;33852](https://github.com/BerriAI/litellm/pull/33852) - fix(router): preserve Azure Entra ID params in reusable credentials by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40889](https://github.com/BerriAI/litellm/pull/40889) - docs(user endpoints): remove unsupported soft\_budget param from user docstrings by [@&#8203;shivamrawat1](https://github.com/shivamrawat1) in [#&#8203;36585](https://github.com/BerriAI/litellm/pull/36585) - feat(friendli): auto-sync Friendli model metadata into price registry by [@&#8203;Lee-Si-Yoon](https://github.com/Lee-Si-Yoon) in [#&#8203;35918](https://github.com/BerriAI/litellm/pull/35918) - build(deps): bump smol-toml to 1.8.0 to clear GHSA-7w5x-hrqm-74c2 in osv-scan by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40478](https://github.com/BerriAI/litellm/pull/40478) - fix(bedrock\_mantle): price GovCloud regions from the regional cost row and accept region-prefixed model names by [@&#8203;mateo-berri](https://github.com/mateo-berri) in [#&#8203;39846](https://github.com/BerriAI/litellm/pull/39846) - chore(ci): remerge internal staging by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;40943](https://github.com/BerriAI/litellm/pull/40943) - test(auth): freeze the cache clock in auth prefetch tests by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40996](https://github.com/BerriAI/litellm/pull/40996) - feat(jwt): allow virtual\_key\_claim\_field per issuer by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40927](https://github.com/BerriAI/litellm/pull/40927) - fix(cost): bill cached realtime audio tokens at the audio cache-read rate by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40627](https://github.com/BerriAI/litellm/pull/40627) - perf(logging): skip correlation contextvar stamping when request\_correlation\_in\_logs is off by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41054](https://github.com/BerriAI/litellm/pull/41054) - feat(pricing): add azure gpt-chat-latest rates and drop retired friendliai llama-3.1 entries by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40976](https://github.com/BerriAI/litellm/pull/40976) - build(deps): re-suppress GHSA-h7x2-h6g9-p789 in osv-scan on main, mlflow still has no fixed release by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41104](https://github.com/BerriAI/litellm/pull/41104) - fix(otel): cap per-index OpenInference message attributes span-wide by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40562](https://github.com/BerriAI/litellm/pull/40562) - feat(proxy): add general\_settings.allowed\_file\_extensions for /v1/files uploads by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41106](https://github.com/BerriAI/litellm/pull/41106) - fix(proxy): forward provider request id headers on mapped error responses by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40925](https://github.com/BerriAI/litellm/pull/40925) - fix(router): name the all-deployments-in-cooldown error on 429 responses by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40995](https://github.com/BerriAI/litellm/pull/40995) - fix(ui): show the team alias on the model info page and in its raw JSON by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40992](https://github.com/BerriAI/litellm/pull/40992) - feat(proxy): honor LITELLM\_DISABLE\_ACCESS\_LOG\_PATHS to drop noisy uvicorn access log lines by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41096](https://github.com/BerriAI/litellm/pull/41096) - fix(prometheus): label pre-call rate limit failures with the resolved api\_provider by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41059](https://github.com/BerriAI/litellm/pull/41059) - perf(proxy): serialize /model/info listing once with orjson by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41114](https://github.com/BerriAI/litellm/pull/41114) - fix(utils): stop wrapper\_async submitting the sync success handler twice by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41115](https://github.com/BerriAI/litellm/pull/41115) - fix(redis): log a timeout streak once per interval instead of one line per cache call by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40817](https://github.com/BerriAI/litellm/pull/40817) - fix(router): record flat retry attempts and cap retries from attempted\_retries by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40930](https://github.com/BerriAI/litellm/pull/40930) - refactor(prometheus): source PROXY\_LLM\_PROVIDER\_FALLBACK from litellm.constants by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41118](https://github.com/BerriAI/litellm/pull/41118) - fix(proxy): hide default credentials login hint when UI\_PASSWORD is set by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41107](https://github.com/BerriAI/litellm/pull/41107) - fix(cli): show routed models and session stats for LLM API keys by [@&#8203;tin-berri](https://github.com/tin-berri) in [#&#8203;41116](https://github.com/BerriAI/litellm/pull/41116) - fix(bedrock/realtime): propagate deferred Nova Sonic stream failures to the router by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41064](https://github.com/BerriAI/litellm/pull/41064) - fix(proxy): keep org admins' own team memberships in other orgs visible on team list by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41086](https://github.com/BerriAI/litellm/pull/41086) - feat(model\_info): provider-scoped fill\_missing\_for\_providers backfill from fallback generalization rules by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41093](https://github.com/BerriAI/litellm/pull/41093) - fix(auth): load team membership once per request and skip prisma on an L1 hit by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41102](https://github.com/BerriAI/litellm/pull/41102) - refactor(harness): expand independent trace coverage by [@&#8203;yujonglee-berri](https://github.com/yujonglee-berri) in [#&#8203;41120](https://github.com/BerriAI/litellm/pull/41120) - fix(proxy): release max\_parallel\_requests slot when a realtime session ends without LLM callbacks by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41113](https://github.com/BerriAI/litellm/pull/41113) - fix(router): cool down team deployments on 429 when a sibling serves the same public model by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40991](https://github.com/BerriAI/litellm/pull/40991) - fix(ui): move tags typed into key metadata JSON into the Tags field by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41023](https://github.com/BerriAI/litellm/pull/41023) - fix(ui): let team admins grant a team all proxy models by [@&#8203;ryan-crabbe-berri](https://github.com/ryan-crabbe-berri) in [#&#8203;40196](https://github.com/BerriAI/litellm/pull/40196) - chore(lint): graduate 12 rules from the strict-gate ratchet by [@&#8203;HUAHAODIA](https://github.com/HUAHAODIA) in [#&#8203;41048](https://github.com/BerriAI/litellm/pull/41048) - test: add dedicated CircleCI integration contract foundation by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41066](https://github.com/BerriAI/litellm/pull/41066) - fix(utils): keep litellm params out of provider request bodies by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41018](https://github.com/BerriAI/litellm/pull/41018) - fix(openai): keep extra\_headers out of the chat request body on the httpx handler path by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41141](https://github.com/BerriAI/litellm/pull/41141) - test: cover persisted updates and warmed authorization policies by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41070](https://github.com/BerriAI/litellm/pull/41070) - fix(proxy): resolve x-litellm-call-id from response metadata when routes omit call\_id by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41056](https://github.com/BerriAI/litellm/pull/41056) - chore(prices): sync Vertex AI prices: 14 models by [@&#8203;berriai-litellm-provider-info-sync](https://github.com/berriai-litellm-provider-info-sync)\[bot] in [#&#8203;40955](https://github.com/BerriAI/litellm/pull/40955) - ci(codeql): exclude noisy Python quality queries by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41142](https://github.com/BerriAI/litellm/pull/41142) - feat(proxy): predict prompt-cache costs across deployments by [@&#8203;tin-berri](https://github.com/tin-berri) in [#&#8203;40877](https://github.com/BerriAI/litellm/pull/40877) - fix(prompt\_security): keep polling file sanitization through non-terminal statuses by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41131](https://github.com/BerriAI/litellm/pull/41131) - fix(health): skip background health check DB writes when the latest-row read fails by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41145](https://github.com/BerriAI/litellm/pull/41145) - feat(model\_armor): logging\_only mode scans completed streams after delivery by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40702](https://github.com/BerriAI/litellm/pull/40702) - fix(bedrock guardrails): derive contextual grounding source and query from plain messages by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41132](https://github.com/BerriAI/litellm/pull/41132) - fix(cli): drop enum.StrEnum so the CLI imports on Python 3.10 by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41046](https://github.com/BerriAI/litellm/pull/41046) - fix(responses): route mid-stream error events through exception\_type so content\_policy\_fallbacks fire by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40988](https://github.com/BerriAI/litellm/pull/40988) - fix(cost): bill gemini-embedding-2 per token and stop double charging audio by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41157](https://github.com/BerriAI/litellm/pull/41157) - test: bind management E2E callers and isolate JWT actors by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;40892](https://github.com/BerriAI/litellm/pull/40892) - fix(headroom): protect cache\_control-marked rows anywhere in history by [@&#8203;rad-p44](https://github.com/rad-p44) in [#&#8203;40315](https://github.com/BerriAI/litellm/pull/40315) - test: add strict stateless provider replay identity by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41149](https://github.com/BerriAI/litellm/pull/41149) - fix(ci): test checked-out model pricing in unit jobs by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41181](https://github.com/BerriAI/litellm/pull/41181) - fix(guardrails): write per-message guardrail rewrites back onto Responses input items by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40939](https://github.com/BerriAI/litellm/pull/40939) - fix(proxy): log the provider usage on deferred /v1/messages calls and price cache writes without a creation rate by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41172](https://github.com/BerriAI/litellm/pull/41172) - fix(guardrails): record not\_run evaluation when scoping leaves nothing to scan by [@&#8203;yucheng-berri](https://github.com/yucheng-berri) in [#&#8203;39050](https://github.com/BerriAI/litellm/pull/39050) - fix(responses): preserve provider affinity by [@&#8203;AaronHowell](https://github.com/AaronHowell) in [#&#8203;40228](https://github.com/BerriAI/litellm/pull/40228) - fix(sdk): keep body and proxy headers on BadRequestError mapped from a litellm\_proxy 400 by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40994](https://github.com/BerriAI/litellm/pull/40994) - fix(responses): hoist Codex additional\_tools input items into the chat bridge tools by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40989](https://github.com/BerriAI/litellm/pull/40989) - fix(router): honor team and key provider weights by [@&#8203;tin-berri](https://github.com/tin-berri) in [#&#8203;41072](https://github.com/BerriAI/litellm/pull/41072) - test(e2e): verify streamed answers and tool continuation by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41194](https://github.com/BerriAI/litellm/pull/41194) - fix(cli): label router costs and simplify the routed-model header by [@&#8203;tin-berri](https://github.com/tin-berri) in [#&#8203;41186](https://github.com/BerriAI/litellm/pull/41186) - test(spend): reconcile concurrent requests and daily activity by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41188](https://github.com/BerriAI/litellm/pull/41188) - fix(guardrails): scan the Anthropic top-level system prompt and tool\_use arguments by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40984](https://github.com/BerriAI/litellm/pull/40984) - fix(router): count num\_retries\_per\_request across fallback hops by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41191](https://github.com/BerriAI/litellm/pull/41191) - fix(bedrock): grant rerank, retrieve, agent, and agentcore actions in the web identity session policy by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41168](https://github.com/BerriAI/litellm/pull/41168) - fix(vertex-live): bill Gemini Live sessions end to end (internal copy of [#&#8203;37075](https://github.com/BerriAI/litellm/issues/37075)) by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40915](https://github.com/BerriAI/litellm/pull/40915) - fix(health): resolve litellm\_credential\_name in realtime health checks by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41173](https://github.com/BerriAI/litellm/pull/41173) - feat(proxy): unified custom\_key\_policy hook for key generate, update and regenerate by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40921](https://github.com/BerriAI/litellm/pull/40921) - fix(proxy): enforce custom\_key\_update policy on /key/regenerate by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40695](https://github.com/BerriAI/litellm/pull/40695) - fix(router): preserve session model choice within each complexity tier by [@&#8203;tin-berri](https://github.com/tin-berri) in [#&#8203;41174](https://github.com/BerriAI/litellm/pull/41174) - test(pricing): let synced GovCloud Bedrock rows cite the AWS price list by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41263](https://github.com/BerriAI/litellm/pull/41263) - docs(github): ask for interactive coding-tool proof in the PR template by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41257](https://github.com/BerriAI/litellm/pull/41257) - feat(proxy): add POST /management/v1/users/bulk for batched user and team membership creation by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41028](https://github.com/BerriAI/litellm/pull/41028) - fix(credentials): answer 409 on a credential name collision, make Terraform adoption opt-in by [@&#8203;ryan-crabbe-berri](https://github.com/ryan-crabbe-berri) in [#&#8203;40917](https://github.com/BerriAI/litellm/pull/40917) - feat(proxy): add POST /management/v1/users/bulk\_delete and POST /management/v1/teams/{team\_id}/members/bulk\_delete by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41039](https://github.com/BerriAI/litellm/pull/41039) - fix(proxy): list directly assigned team models in model access errors by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41256](https://github.com/BerriAI/litellm/pull/41256) - feat(auto-router): allow opted-in team members to manage their routers by [@&#8203;tin-berri](https://github.com/tin-berri) in [#&#8203;41175](https://github.com/BerriAI/litellm/pull/41175) - build(rust-bridge): add typed \_native stub and validate it with mypy.stubtest by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41180](https://github.com/BerriAI/litellm/pull/41180) - feat(guardrails): add new upstream presidio pii entities including german set by [@&#8203;MvdB](https://github.com/MvdB) in [#&#8203;36775](https://github.com/BerriAI/litellm/pull/36775) - fix(responses): filter bridged kwargs like the native Responses path by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41144](https://github.com/BerriAI/litellm/pull/41144) - test(e2e): cover the reliability retry, cooldown, fallback, and routing-strategy cells by [@&#8203;mateo-berri](https://github.com/mateo-berri) in [#&#8203;39857](https://github.com/BerriAI/litellm/pull/39857) - fix(anthropic): add the per-turn-control beta when a message carries output\_config by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41189](https://github.com/BerriAI/litellm/pull/41189) - fix(router): bind per-request routing\_strategy override selectors to the request's callbacks by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41178](https://github.com/BerriAI/litellm/pull/41178) - feat(proxy): bind JWT claims to registered agents via agent\_id\_jwt\_field by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40904](https://github.com/BerriAI/litellm/pull/40904) - fix(proxy): enforce organization budgets when max\_budget is 0 by [@&#8203;yassin-berriai](https://github.com/yassin-berriai) in [#&#8203;41271](https://github.com/BerriAI/litellm/pull/41271) - fix(alerting): send llm\_exceptions Slack alert for 5xx HTTPException and ProxyException by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41125](https://github.com/BerriAI/litellm/pull/41125) - fix(headroom): protect the cached prefix through the last cache\_control breakpoint by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41161](https://github.com/BerriAI/litellm/pull/41161) - fix(utils): cache custom HuggingFace tokenizers across /utils/token\_counter requests by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41216](https://github.com/BerriAI/litellm/pull/41216) - fix(router): keep weighted routing when a deployment id equals a model\_name by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41156](https://github.com/BerriAI/litellm/pull/41156) - feat(router): add capability classifier as Fuse foundation by [@&#8203;tin-berri](https://github.com/tin-berri) in [#&#8203;41270](https://github.com/BerriAI/litellm/pull/41270) - fix(proxy): keep access-group raw SQL writes on the writer while writer\_unavailable is stale by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41283](https://github.com/BerriAI/litellm/pull/41283) - fix(prometheus): count 401 auth failures in litellm\_proxy\_failed\_requests\_metric by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41170](https://github.com/BerriAI/litellm/pull/41170) - test: drop tests that pin vendor facts and add the CLAUDE.md rule by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41269](https://github.com/BerriAI/litellm/pull/41269) - fix(proxy): run the remaining inline token counts off the event loop by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40262](https://github.com/BerriAI/litellm/pull/40262) - fix(proxy): log blocked streaming guardrail responses as failures, not success by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40191](https://github.com/BerriAI/litellm/pull/40191) - feat(proxy): add tpd\_limit (tokens per day) for batch submissions by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40997](https://github.com/BerriAI/litellm/pull/40997) - fix(proxy): reconcile budget reservation before enqueuing spend to the DB by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40310](https://github.com/BerriAI/litellm/pull/40310) - fix(xai): stop sending web\_search\_options to xAI's retired Live Search path by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;38278](https://github.com/BerriAI/litellm/pull/38278) - feat(terraform): add tpm\_limit, rpm\_limit, budget\_duration, allowed\_models to litellm\_team\_member\_add by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;38682](https://github.com/BerriAI/litellm/pull/38682) - fix(rerank): bill Vertex search\_units from input records and give every rerank response a unique id by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;35180](https://github.com/BerriAI/litellm/pull/35180) - fix(router): stop counting caller-set timeout 408s toward deployment cooldown by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41230](https://github.com/BerriAI/litellm/pull/41230) - feat(router): add Fuse V2 classifier after capability forecasting by [@&#8203;tin-berri](https://github.com/tin-berri) in [#&#8203;41272](https://github.com/BerriAI/litellm/pull/41272) - fix(proxy): keep client User-Agent on auth failure spend logs by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41291](https://github.com/BerriAI/litellm/pull/41291) - fix(proxy): reset budgets by decrementing pre-reset spend instead of zeroing rows by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41279](https://github.com/BerriAI/litellm/pull/41279) - fix(xai): honor nested web\_search filters on the xAI Responses API by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;38268](https://github.com/BerriAI/litellm/pull/38268) - fix(router): stop registering a caller-supplied credential as a router deployment by [@&#8203;yassin-berriai](https://github.com/yassin-berriai) in [#&#8203;41289](https://github.com/BerriAI/litellm/pull/41289) - fix(router): accept custom\_provider\_map providers before the first completion call by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41300](https://github.com/BerriAI/litellm/pull/41300) - fix(proxy): return 400 instead of 500 for lone surrogate escapes in request body by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41297](https://github.com/BerriAI/litellm/pull/41297) - fix(langsmith): keep events appended during an in-flight flush instead of clearing them by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41288](https://github.com/BerriAI/litellm/pull/41288) - fix(logging): track spend for streams a deployment hook converted to non-streaming by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41171](https://github.com/BerriAI/litellm/pull/41171) - fix(bedrock): sanitize client tool\_call ids to Bedrock toolUseId constraints by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40872](https://github.com/BerriAI/litellm/pull/40872) - fix(passthrough): attribute Vertex passthrough successes to the resolved router deployment by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41307](https://github.com/BerriAI/litellm/pull/41307) - feat(ui): persist Models table search, filters, sort and page in the URL by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41296](https://github.com/BerriAI/litellm/pull/41296) - fix(jwt-auth): scope JWT key mappings by issuer to prevent cross-issuer collisions by [@&#8203;yassin-berriai](https://github.com/yassin-berriai) in [#&#8203;41281](https://github.com/BerriAI/litellm/pull/41281) - feat(openai): add openai\_system\_messages\_first to put system messages first for prompt caching by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41304](https://github.com/BerriAI/litellm/pull/41304) - feat(ui): add custom request headers to the API Playground by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41309](https://github.com/BerriAI/litellm/pull/41309) - feat(cli): sync Codex /model picker from proxy /v1/models in lite codex by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40476](https://github.com/BerriAI/litellm/pull/40476) - chore: bump litellm-enterprise 0.1.67 -> 0.1.68, litellm-proxy-extras 0.4.97 -> 0.4.98, litellm 1.102.0 -> 1.103.0 by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41321](https://github.com/BerriAI/litellm/pull/41321) - feat: add aihubmix provider pricing entries by [@&#8203;IToSSc](https://github.com/IToSSc) in [#&#8203;41179](https://github.com/BerriAI/litellm/pull/41179) - feat(auto-router): add per-model Fast mode toggle by [@&#8203;tin-berri](https://github.com/tin-berri) in [#&#8203;41282](https://github.com/BerriAI/litellm/pull/41282) - fix(proxy): include litellm\_call\_id in LLM API exception logs by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41205](https://github.com/BerriAI/litellm/pull/41205) - fix(proxy): keep yaml pass-through endpoints visible to auth after db overlay by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41303](https://github.com/BerriAI/litellm/pull/41303) - fix(proxy): resolve router\_settings.model\_group\_alias before key/team model auth by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41308](https://github.com/BerriAI/litellm/pull/41308) - fix(ui): block usage export and flag the range when a spend page fails by [@&#8203;ryan-crabbe-berri](https://github.com/ryan-crabbe-berri) in [#&#8203;41294](https://github.com/BerriAI/litellm/pull/41294) - fix(vertex\_ai): bill Gemini Omni Interactions usage and Veo sampleCount on passthrough by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41322](https://github.com/BerriAI/litellm/pull/41322) - fix(proxy): honor LITELLM\_LOG for uvicorn and proxy extras loggers by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41306](https://github.com/BerriAI/litellm/pull/41306) - fix(cost): price native Responses WebSocket turns at their returned service\_tier by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41318](https://github.com/BerriAI/litellm/pull/41318) - fix(proxy): key model rpm/tpm override takes precedence over team model limit by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41302](https://github.com/BerriAI/litellm/pull/41302) - fix(proxy): track per-member organization spend by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41255](https://github.com/BerriAI/litellm/pull/41255) - feat(proxy): add /nvidia\_nim passthrough route for NIM object detection and OCR /v1/infer by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41316](https://github.com/BerriAI/litellm/pull/41316) - feat(model\_info): add provider-neutral Gemini 2.5+ chat baseline fallback generalization by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41320](https://github.com/BerriAI/litellm/pull/41320) - fix(spend): sum multi-round session duration in logs UI by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;35388](https://github.com/BerriAI/litellm/pull/35388) - feat(router): limit unlicensed Capability and Fuse v2 routers to one each by [@&#8203;tin-berri](https://github.com/tin-berri) in [#&#8203;41326](https://github.com/BerriAI/litellm/pull/41326) - fix(guardrails): resolve caller identity from metadata buckets in custom code guardrail by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41126](https://github.com/BerriAI/litellm/pull/41126) - fix(e2e): onboard dashboard users through invitations by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41319](https://github.com/BerriAI/litellm/pull/41319) - feat(guardrails): add Microsoft Agent 365 MCP tool-call guardrail by [@&#8203;yucheng-berri](https://github.com/yucheng-berri) in [#&#8203;38241](https://github.com/BerriAI/litellm/pull/38241) - test: drop remaining tests that pin cost-map vendor facts by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41298](https://github.com/BerriAI/litellm/pull/41298) - feat(ui): show average response time per model in usage model activity by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41313](https://github.com/BerriAI/litellm/pull/41313) - fix(proxy): preserve Anthropic pricing modifiers in router savings by [@&#8203;tin-berri](https://github.com/tin-berri) in [#&#8203;41341](https://github.com/BerriAI/litellm/pull/41341) - feat(guardrails): support pre\_call and during\_call modes for llm\_as\_a\_judge by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41128](https://github.com/BerriAI/litellm/pull/41128) - fix(gemini): propagate the provider's modelVersion to the response model by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41338](https://github.com/BerriAI/litellm/pull/41338) - fix(fireworks-ai): bill cache-write, reasoning and audio tokens via the shared cost calculator by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41339](https://github.com/BerriAI/litellm/pull/41339) - feat(guardrails): singulr v2 API contract with logging\_only, pre\_mcp\_call and post\_mcp\_call by [@&#8203;yucheng-berri](https://github.com/yucheng-berri) in [#&#8203;41329](https://github.com/BerriAI/litellm/pull/41329) - ci(image-scan): ignore zlib CVE-2026-85091 until Wolfi ships the fix by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41353](https://github.com/BerriAI/litellm/pull/41353) - feat(e2e): reuse exact provider responses for 24 hours by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41346](https://github.com/BerriAI/litellm/pull/41346) - fix(xai): keep 'instructions' on the xAI Responses API so system messages survive web search by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;38254](https://github.com/BerriAI/litellm/pull/38254) - feat(ui): configure capability and Fuse v2 classifiers by [@&#8203;tin-berri](https://github.com/tin-berri) in [#&#8203;41315](https://github.com/BerriAI/litellm/pull/41315) - fix(anthropic): tolerate message\_delta events without usage when streaming by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41336](https://github.com/BerriAI/litellm/pull/41336) - test(router): ignore deployment-selection logs in the fallback log assertion by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41358](https://github.com/BerriAI/litellm/pull/41358) - test(proxy): assert budget resets decrement the cleared spend by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41359](https://github.com/BerriAI/litellm/pull/41359) - fix(e2e): expect models filters to persist after reload by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41348](https://github.com/BerriAI/litellm/pull/41348) - fix(e2e): record cookie-setting provider responses and keep prompt-caching tests live by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41366](https://github.com/BerriAI/litellm/pull/41366) - fix(responses): recount tokens when a streamed response completes without usage by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41337](https://github.com/BerriAI/litellm/pull/41337) - fix(ui): simplify Capability and Fuse advanced routing options by [@&#8203;tin-berri](https://github.com/tin-berri) in [#&#8203;41371](https://github.com/BerriAI/litellm/pull/41371) - fix(mcp): authorize JWT OAuth credential persistence by [@&#8203;joshua-berri](https://github.com/joshua-berri) in [#&#8203;41314](https://github.com/BerriAI/litellm/pull/41314) - feat(router): stream shadow traffic and fan out silent\_model to multiple targets by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41368](https://github.com/BerriAI/litellm/pull/41368) - perf(content\_filter): scan a bounded window per streamed chunk by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41407](https://github.com/BerriAI/litellm/pull/41407) - fix(proxy): hide model allowlist from client-facing model access denied errors by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41310](https://github.com/BerriAI/litellm/pull/41310) - feat(http): opt-in outbound HTTP/2 for httpx clients by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41268](https://github.com/BerriAI/litellm/pull/41268) - refactor(rust): remove gateway, config, router, realtime, and Rust trace-parity instrumentation by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41432](https://github.com/BerriAI/litellm/pull/41432) - fix(guardrails): don't add post\_call output scan for MCP-only Presidio modes by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40571](https://github.com/BerriAI/litellm/pull/40571) - chore(prices): sync Azure, Azure AI, Gemini, OpenAI, Bedrock, Together AI, Fireworks and Vertex prices: 278 models, 59 new, 30 deprecated by [@&#8203;berriai-litellm-provider-info-sync](https://github.com/berriai-litellm-provider-info-sync)\[bot] in [#&#8203;41154](https://github.com/BerriAI/litellm/pull/41154) - fix(rag): forward retrieval\_filter from retrieval\_config to vector store search by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;34427](https://github.com/BerriAI/litellm/pull/34427) - refactor(rust): extract auth and cache crates by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41464](https://github.com/BerriAI/litellm/pull/41464) - fix(proxy): default litellm\_trace\_id to the OTel server span trace id by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41386](https://github.com/BerriAI/litellm/pull/41386) - chore(codeowners): add ryan and kerry as owners of the cost map by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41333](https://github.com/BerriAI/litellm/pull/41333) - fix(responses): guard empty-choices chunks in the Responses API streaming bridge by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;34455](https://github.com/BerriAI/litellm/pull/34455) - chore(prices): sync Google Gemini prices: 22 models by [@&#8203;berriai-litellm-provider-info-sync](https://github.com/berriai-litellm-provider-info-sync)\[bot] in [#&#8203;41457](https://github.com/BerriAI/litellm/pull/41457) - fix(bedrock): forward userContext in Knowledge Base Retrieve requests by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41475](https://github.com/BerriAI/litellm/pull/41475) - ci(rust): split rust jobs, use nextest and Swatinem/rust-cache by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41480](https://github.com/BerriAI/litellm/pull/41480) - fix(fireworks\_ai): flatten dict-form reasoning\_effort to its effort string by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41335](https://github.com/BerriAI/litellm/pull/41335) - fix(proxy): never forward the LiteLLM virtual key to Anthropic on the /anthropic passthrough by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41340](https://github.com/BerriAI/litellm/pull/41340) - fix(proxy): rename AWS Secrets Manager secret when key alias changes by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41468](https://github.com/BerriAI/litellm/pull/41468) - feat(otel): promote nested request metadata keys to litellm.metadata.\* span attributes by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41462](https://github.com/BerriAI/litellm/pull/41462) - fix(proxy): sync AWS Secrets Manager on body-less key regenerate and key alias changes by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41458](https://github.com/BerriAI/litellm/pull/41458) - fix(http\_handler): keep a handler alive while a response it issued is still reading by [@&#8203;max-sixty](https://github.com/max-sixty) in [#&#8203;34829](https://github.com/BerriAI/litellm/pull/34829) - fix(bedrock): make prompt caching work on the Nova InvokeModel route by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41343](https://github.com/BerriAI/litellm/pull/41343) - ci(migrations): flag defaulted ADD COLUMN on request-log tables by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41460](https://github.com/BerriAI/litellm/pull/41460) - feat(prometheus): add customer (end\_user) budget gauges by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41472](https://github.com/BerriAI/litellm/pull/41472) - fix(otel): drop None metric and event attributes before OTLP export by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;36815](https://github.com/BerriAI/litellm/pull/36815) - fix(anthropic): carry the served model from message\_start onto stream chunks by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41446](https://github.com/BerriAI/litellm/pull/41446) - fix(models): rolling registry audit: Gemini latest aliases, Nova cache pricing, OpenRouter/Together sync, Mistral GLM 5.3, Azure snapshots, Grok caching by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41112](https://github.com/BerriAI/litellm/pull/41112) - fix(router): count TPM/RPM usage before building rate-limit headers by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41474](https://github.com/BerriAI/litellm/pull/41474) - feat(guardrails): release buffered stream chunks after each passing scan by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41425](https://github.com/BerriAI/litellm/pull/41425) - fix!: re-check budget on router fallback targets by [@&#8203;runjivu](https://github.com/runjivu) in [#&#8203;41379](https://github.com/BerriAI/litellm/pull/41379) - refactor(ocr): move file preparation from the python bridge into litellm-core by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41489](https://github.com/BerriAI/litellm/pull/41489) - feat(s3): add s3\_log\_prompts\_only option to log prompts without responses by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41327](https://github.com/BerriAI/litellm/pull/41327) - feat(team): team-level model\_max\_budget with key-level overrides by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41330](https://github.com/BerriAI/litellm/pull/41330) - feat(keys): filter /key/list by active, expired, revoked or deleted status and serve deleted keys from /key/info by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41311](https://github.com/BerriAI/litellm/pull/41311) - feat(proxy): expose lifetime total\_spend on virtual keys by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41403](https://github.com/BerriAI/litellm/pull/41403) - fix(proxy): release completed max-parallel slots promptly by [@&#8203;elifozdamar](https://github.com/elifozdamar) in [#&#8203;40843](https://github.com/BerriAI/litellm/pull/40843) - feat(ui): accept ssh clone urls when registering a skill by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;35418](https://github.com/BerriAI/litellm/pull/35418) - fix(prices): dedupe Nova cache\_read\_input\_token\_cost keys left by a text merge by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41496](https://github.com/BerriAI/litellm/pull/41496) - fix(otel): propagate W3C trace context on HTTP and WebSocket passthrough by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40669](https://github.com/BerriAI/litellm/pull/40669) - fix(proxy): remove duplicate user budget hook that 429'd zero-cost models by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41345](https://github.com/BerriAI/litellm/pull/41345) - test(logging): pick this test's own records out of the shared log batch by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41487](https://github.com/BerriAI/litellm/pull/41487) - test(together\_ai): move request-shape checks to the mapped file, drop the live ones by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41360](https://github.com/BerriAI/litellm/pull/41360) - feat(ui): shared URL-state layer for tables and tabs by [@&#8203;ryan-crabbe-berri](https://github.com/ryan-crabbe-berri) in [#&#8203;41331](https://github.com/BerriAI/litellm/pull/41331) - feat(e2e): make the provider cache reusable across builds and mount Bedrock behind it by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41402](https://github.com/BerriAI/litellm/pull/41402) - fix(mcp): fail closed on missing upstream credentials by [@&#8203;joshua-berri](https://github.com/joshua-berri) in [#&#8203;41364](https://github.com/BerriAI/litellm/pull/41364) - feat(rust): scaffold Redis cache crate by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41501](https://github.com/BerriAI/litellm/pull/41501) - fix(dashscope): forward reasoning\_effort to the provider by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;37506](https://github.com/BerriAI/litellm/pull/37506) - fix(proxy): carry litellm\_call\_id through endpoint specific error logs and failure responses by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41356](https://github.com/BerriAI/litellm/pull/41356) - fix(proxy): retry rate-limit fallbacks from a pristine request snapshot by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40596](https://github.com/BerriAI/litellm/pull/40596) - fix(gemini): map minimal thinking to low for Gemini 3.7 and 3.8 Flash by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41201](https://github.com/BerriAI/litellm/pull/41201) - fix(proxy): stop forwarding LiteLLM credential headers on Bedrock agent-runtime passthrough by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41504](https://github.com/BerriAI/litellm/pull/41504) - fix(streaming): estimate interrupted Anthropic stream usage from reasoning\_content by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41503](https://github.com/BerriAI/litellm/pull/41503) - fix(azure\_ai): route Responses API to native /openai/v1/responses for Foundry Models by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;33856](https://github.com/BerriAI/litellm/pull/33856) - fix(proxy): show all model groups to proxy admins in /model\_group/info by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41094](https://github.com/BerriAI/litellm/pull/41094) - feat(proxy): let proxy admins choose which team fields team admins may edit by [@&#8203;ryan-crabbe-berri](https://github.com/ryan-crabbe-berri) in [#&#8203;39996](https://github.com/BerriAI/litellm/pull/39996) - fix(bedrock): neutralize orphaned tool blocks instead of raising or injecting a dummy tool (internal copy of [#&#8203;31400](https://github.com/BerriAI/litellm/issues/31400)) by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41513](https://github.com/BerriAI/litellm/pull/41513) - feat(ui): persist organizations and projects list, detail tab and key table state in the URL by [@&#8203;ryan-crabbe-berri](https://github.com/ryan-crabbe-berri) in [#&#8203;41445](https://github.com/BerriAI/litellm/pull/41445) - fix(bedrock\_mantle): accept and forward verbosity on gpt-5.x chat completions by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41509](https://github.com/BerriAI/litellm/pull/41509) - test: cover database transactions and persisted accounting by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41073](https://github.com/BerriAI/litellm/pull/41073) - test: provider wire contracts, streaming and recovery by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41075](https://github.com/BerriAI/litellm/pull/41075) - fix(mcp): count admin static headers as api\_key credential slots by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41514](https://github.com/BerriAI/litellm/pull/41514) - ci: auto-merge provider-info-sync PRs when CI, Greptile and Bugbot are clean by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41494](https://github.com/BerriAI/litellm/pull/41494) - feat(rust): add standalone framing crate by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41500](https://github.com/BerriAI/litellm/pull/41500) - fix(proxy): enforce tag budgets for tags added by guardrails by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40842](https://github.com/BerriAI/litellm/pull/40842) - fix(utils): run post-call deployment hook on converted chat streams by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41495](https://github.com/BerriAI/litellm/pull/41495) - fix(e2e): bind provider-cache recordings to the deployment's test, not the serving process by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41520](https://github.com/BerriAI/litellm/pull/41520) - test: add extension and browser integration contracts by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41078](https://github.com/BerriAI/litellm/pull/41078) - fix(logging): scan each log record once and collapse base64 payloads before the secret regex by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40934](https://github.com/BerriAI/litellm/pull/40934) - fix(spend\_tracking): attribute router-rejected requests to the model group provider by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41507](https://github.com/BerriAI/litellm/pull/41507) - feat(router): discover token limits for hosted OpenAI-compatible models by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41508](https://github.com/BerriAI/litellm/pull/41508) - feat(proxy): let team admins edit rpm\_limit and max\_budget when enabled by [@&#8203;ryan-crabbe-berri](https://github.com/ryan-crabbe-berri) in [#&#8203;41525](https://github.com/BerriAI/litellm/pull/41525) - fix(otel): fit per-index OpenInference messages to the span's remaining attribute budget by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41498](https://github.com/BerriAI/litellm/pull/41498) - test(aws): verify rotated secret value by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41524](https://github.com/BerriAI/litellm/pull/41524) - test(e2e): read a deleted key back as deleted, not as a 404 by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41551](https://github.com/BerriAI/litellm/pull/41551) - fix(otel v2): map the caller's Langfuse user, session and tags onto the root and generation spans by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41140](https://github.com/BerriAI/litellm/pull/41140) - test: fix seven tests left stale by [#&#8203;41311](https://github.com/BerriAI/litellm/issues/41311), [#&#8203;41337](https://github.com/BerriAI/litellm/issues/41337), [#&#8203;39996](https://github.com/BerriAI/litellm/issues/39996), [#&#8203;41310](https://github.com/BerriAI/litellm/issues/41310), [#&#8203;41289](https://github.com/BerriAI/litellm/issues/41289) and [#&#8203;41315](https://github.com/BerriAI/litellm/issues/41315) by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41527](https://github.com/BerriAI/litellm/pull/41527) - test(budgets): cover management null handling by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41563](https://github.com/BerriAI/litellm/pull/41563) - test(e2e): drop the auto-router select "opens below" spec by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41568](https://github.com/BerriAI/litellm/pull/41568) - fix(guardrails): stream Prompt Security post\_call redactions in incremental\_diff mode by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41558](https://github.com/BerriAI/litellm/pull/41558) - fix(guardrails): give post-call scans the scoped request conversation and tools by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41220](https://github.com/BerriAI/litellm/pull/41220) - feat(openrouter): add stealth/union-alpha to the model cost map by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41576](https://github.com/BerriAI/litellm/pull/41576) - test(management): cover project authorization lifecycle by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41573](https://github.com/BerriAI/litellm/pull/41573) - feat(rust): map Anthropic Messages transformations by [@&#8203;yujonglee-berri](https://github.com/yujonglee-berri) in [#&#8203;41531](https://github.com/BerriAI/litellm/pull/41531) - fix(e2e): clear the three standing errors in the scheduled Buildkite suite by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41616](https://github.com/BerriAI/litellm/pull/41616) - refactor(rust\_bridge): declarative route catalog and shared runtime selection by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41479](https://github.com/BerriAI/litellm/pull/41479) - fix(mock\_completion): keep the resolved provider so router custom pricing resolves for azure\_ai deployments by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41623](https://github.com/BerriAI/litellm/pull/41623) - fix(mcp): restrict health discovery to virtual key grants by [@&#8203;joshua-berri](https://github.com/joshua-berri) in [#&#8203;41609](https://github.com/BerriAI/litellm/pull/41609) - fix(mcp): preserve request-selected guardrails during tool execution by [@&#8203;joshua-berri](https://github.com/joshua-berri) in [#&#8203;41619](https://github.com/BerriAI/litellm/pull/41619) - refactor(ocr): mirror Python provider layout and preserve tests by [@&#8203;yujonglee-berri](https://github.com/yujonglee-berri) in [#&#8203;41550](https://github.com/BerriAI/litellm/pull/41550) - test(fireworks\_ai): stop pinning vision support on minimax-m3 by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41627](https://github.com/BerriAI/litellm/pull/41627) - perf(spend\_tracking): index LiteLLM\_SpendLogs by (api\_key, startTime) by [@&#8203;etiennechabert](https://github.com/etiennechabert) in [#&#8203;37983](https://github.com/BerriAI/litellm/pull/37983) - fix(proxy): reject non-string model with 400 and log its spend as unknown-model by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41633](https://github.com/BerriAI/litellm/pull/41633) - test(together\_ai): stop pinning successor deprecation status by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41635](https://github.com/BerriAI/litellm/pull/41635) - chore(prices): sync Together AI prices: 6 models, 6 deprecated \[sync failed: Google Gemini] by [@&#8203;berriai-litellm-provider-info-sync](https://github.com/berriai-litellm-provider-info-sync)\[bot] in [#&#8203;41570](https://github.com/BerriAI/litellm/pull/41570) - fix(budgets): page end-user cache invalidation after a budget reset by [@&#8203;ryan-crabbe-berri](https://github.com/ryan-crabbe-berri) in [#&#8203;41488](https://github.com/BerriAI/litellm/pull/41488) - chore: bump litellm-proxy-extras 0.4.98 -> 0.4.99 by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41659](https://github.com/BerriAI/litellm/pull/41659) - fix(tests): resolve the integration support package without run.py's PYTHONPATH by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41373](https://github.com/BerriAI/litellm/pull/41373) - fix(ui): keep untimed guardrail entries on the request lifecycle by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41374](https://github.com/BerriAI/litellm/pull/41374) - fix(anthropic-bridge): convert mid-conversation system turns to user turns on /v1/messages to chat completions by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41493](https://github.com/BerriAI/litellm/pull/41493) - fix(bedrock): support aws-sdk-bedrock-runtime 0.10/0.11 in Bedrock Realtime by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41542](https://github.com/BerriAI/litellm/pull/41542) - feat(cli): deprecate the litellm-proxy entrypoint in favour of lite by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41673](https://github.com/BerriAI/litellm/pull/41673) - fix(scim): align pagination `count` validation with RFC 7644 by [@&#8203;zachbernstein-sdx](https://github.com/zachbernstein-sdx) in [#&#8203;41444](https://github.com/BerriAI/litellm/pull/41444) - fix(bedrock): never emit Converse cachePoint for OpenAI-family models by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41419](https://github.com/BerriAI/litellm/pull/41419) - fix(images): stop forwarding the raw image\[] and mask\[] form keys by [@&#8203;mateo-berri](https://github.com/mateo-berri) in [#&#8203;39512](https://github.com/BerriAI/litellm/pull/39512) - feat(management\_v1): bulk update team member budgets by [@&#8203;ryan-crabbe-berri](https://github.com/ryan-crabbe-berri) in [#&#8203;41632](https://github.com/BerriAI/litellm/pull/41632) - refactor(rust): extract provider translations by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41690](https://github.com/BerriAI/litellm/pull/41690) - feat(cli): rename lite autoroute up/down to start/stop, keeping the old names as deprecated aliases by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41672](https://github.com/BerriAI/litellm/pull/41672) - fix(responses): keep the addressed response id off bridged provider requests by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41689](https://github.com/BerriAI/litellm/pull/41689) - fix(license): let a wildcard allowed\_features license grant the auto\_router feature by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41684](https://github.com/BerriAI/litellm/pull/41684) - fix(ui): list every provider in the cache leakage by-model table by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40875](https://github.com/BerriAI/litellm/pull/40875) - fix(team): keep a forked member budget's reset window and audit bulk member budget writes by [@&#8203;ryan-crabbe-berri](https://github.com/ryan-crabbe-berri) in [#&#8203;41686](https://github.com/BerriAI/litellm/pull/41686) - feat(proxy): add TypeSafe AI Jev evaluate passthrough with registry-priced spend tracking by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41607](https://github.com/BerriAI/litellm/pull/41607) - test(e2e): cover bedrock batch file upload and create in the us-gov-west-1 partition by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41536](https://github.com/BerriAI/litellm/pull/41536) - feat(grafana): add all-metrics dashboard and fix stale dashboard\_v2 gauges by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41578](https://github.com/BerriAI/litellm/pull/41578) - fix(cost): price Azure PTU spillover requests at standard token rates by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41569](https://github.com/BerriAI/litellm/pull/41569) - build(deps): bump soupsieve to 2.9.2 to clear the osv-scan advisories by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41703](https://github.com/BerriAI/litellm/pull/41703) - fix(fireworks\_ai): restore supports\_vision on minimax-m3 in the cost map by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41699](https://github.com/BerriAI/litellm/pull/41699) - feat(policy\_engine): explicit priority for policy attachment execution order by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41571](https://github.com/BerriAI/litellm/pull/41571) - feat(router): add TypeSafe Jev as a complexity router classifier by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41615](https://github.com/BerriAI/litellm/pull/41615) - ci(auto-merge): stop requiring Greptile and Bugbot on price sync pull requests by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41678](https://github.com/BerriAI/litellm/pull/41678) - fix(ui): persist disabling cache control injection points on model update by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40632](https://github.com/BerriAI/litellm/pull/40632) - fix(bedrock): gate Invoke tool search on the model map for Opus 4.8 and gen 5 Claude by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41702](https://github.com/BerriAI/litellm/pull/41702) - fix(proxy): propagate db model renames to key, team, org, project and user model allowlists by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41694](https://github.com/BerriAI/litellm/pull/41694) - test: delete unit-test assertions that pin cost-map prices, limits and deprecation dates by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41443](https://github.com/BerriAI/litellm/pull/41443) - chore(tests): remove commented-out hf, petals and vertex ai completion blocks by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41640](https://github.com/BerriAI/litellm/pull/41640) - chore(openai): drop commented-out legacy cost\_per\_token implementation by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41641](https://github.com/BerriAI/litellm/pull/41641) - chore(proxy): delete deprecated unused litellm/proxy/\_logging.py by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41642](https://github.com/BerriAI/litellm/pull/41642) - chore(proxy): remove unreferenced performance\_utils profiling module by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41643](https://github.com/BerriAI/litellm/pull/41643) - test(streaming): remove commented-out retired-provider streaming tests by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41648](https://github.com/BerriAI/litellm/pull/41648) - refactor(langfuse): remove unreachable langfuse v1 logging path by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41652](https://github.com/BerriAI/litellm/pull/41652) - test: remove 15 fully commented-out test files that collect no tests by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41654](https://github.com/BerriAI/litellm/pull/41654) - chore(tests): remove fully commented-out proxy test files and their CI entries by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41660](https://github.com/BerriAI/litellm/pull/41660) - refactor(prometheus): remove unreferenced metric validators and pretty printers by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41661](https://github.com/BerriAI/litellm/pull/41661) - chore(streaming): remove retired ai21/maritalk/baseten/azure raw-bytes handlers and dead palm completion code by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41662](https://github.com/BerriAI/litellm/pull/41662) - refactor(vertex\_ai): remove constant-False is\_using\_v1beta1\_features stub and its dead call sites by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41665](https://github.com/BerriAI/litellm/pull/41665) - fix(passthrough): keep target URL query when client sends no query params by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41448](https://github.com/BerriAI/litellm/pull/41448) - fix(responses): drop top\_p for gpt-5 reasoning models when drop\_params is set by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41469](https://github.com/BerriAI/litellm/pull/41469) - fix(ocr): keep a downloaded document inlined when callbacks intercept the request ([#&#8203;41550](https://github.com/BerriAI/litellm/issues/41550) follow-up) by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41719](https://github.com/BerriAI/litellm/pull/41719) - fix(models): rolling registry audit: Azure retirement dates, Bedrock Mantle Grok 4.3 context window by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41597](https://github.com/BerriAI/litellm/pull/41597) - test(logging): add azure\_spillover to the GCS pub/sub spend-log golden by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41729](https://github.com/BerriAI/litellm/pull/41729) - fix(proxy): forward every method on the typesafe pass-through route by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41723](https://github.com/BerriAI/litellm/pull/41723) - test(cost\_map): stop pinning supports\_reasoning absent on the openrouter o1 entry by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41734](https://github.com/BerriAI/litellm/pull/41734) - fix(model\_prices): add cache-read pricing to Mistral chat models missing it by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41736](https://github.com/BerriAI/litellm/pull/41736) - refactor(rust): isolate legacy callback contract by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41752](https://github.com/BerriAI/litellm/pull/41752) - test(cost\_map): drop tests that pin provider-owned catalog values by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41763](https://github.com/BerriAI/litellm/pull/41763) - test(e2e/ui): wait for the filtered budget list before clicking a row action by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41756](https://github.com/BerriAI/litellm/pull/41756) - chore(prices): sync OpenRouter prices: 443 models, 191 new, 4 deprecated by [@&#8203;berriai-litellm-provider-info-sync](https://github.com/berriai-litellm-provider-info-sync)\[bot] in [#&#8203;41727](https://github.com/BerriAI/litellm/pull/41727) - fix(batches): bill Bedrock Titan embedding batch lines from inputTextTokenCount by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41767](https://github.com/BerriAI/litellm/pull/41767) - fix(proxy): persist only the keys a caller changed in save\_config by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41748](https://github.com/BerriAI/litellm/pull/41748) - chore(prices): sync OpenRouter prices: 2 models, 1 deprecated by [@&#8203;berriai-litellm-provider-info-sync](https://github.com/berriai-litellm-provider-info-sync)\[bot] in [#&#8203;41770](https://github.com/BerriAI/litellm/pull/41770) - fix(proxy): run prompt injection heuristics off the event loop by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41541](https://github.com/BerriAI/litellm/pull/41541) - fix(proxy): evict jwt key mapping cache on user, team, org, and bulk key deletion by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41707](https://github.com/BerriAI/litellm/pull/41707) - refactor(ui): remove unused HelpLink and HelpIcon components by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41644](https://github.com/BerriAI/litellm/pull/41644) - chore(ui): remove orphaned ROLE\_STYLES and RoleStyle from pretty messages view by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41645](https://github.com/BerriAI/litellm/pull/41645) - chore(ui): remove never-rendered GuardrailConfig mock component and its test by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41646](https://github.com/BerriAI/litellm/pull/41646) - chore(ui): remove unused NewBadge component and its test by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41647](https://github.com/BerriAI/litellm/pull/41647) - chore(ui): remove dead compareUI ModelSelector and its test by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41649](https://github.com/BerriAI/litellm/pull/41649) - refactor(ui): remove unused createCredentialFromModel helper and CredentialValues interface by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41650](https://github.com/BerriAI/litellm/pull/41650) - refactor(ui): drop unused cost-tracking barrel re-exports and response types by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41651](https://github.com/BerriAI/litellm/pull/41651) - refactor(ui): drop unused rolesAllowedToSeeUsage, viewOnlyRoles and isViewOnlyRole exports by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41653](https://github.com/BerriAI/litellm/pull/41653) - chore(ui): remove unused access-groups type interfaces by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41655](https://github.com/BerriAI/litellm/pull/41655) - refactor(ui): remove dead networking exports and orphaned Claude Code marketplace helpers by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41656](https://github.com/BerriAI/litellm/pull/41656) - refactor(ui): remove dead useKeyList hook from key\_list.tsx by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41657](https://github.com/BerriAI/litellm/pull/41657) - chore(ui): remove orphaned useDeleteProject hook and its test by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41658](https://github.com/BerriAI/litellm/pull/41658) - refactor(interactions): remove expired use\_legacy\_interactions\_schema shim by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41663](https://github.com/BerriAI/litellm/pull/41663) - refactor(rust): align crates with Python package layering by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41829](https://github.com/BerriAI/litellm/pull/41829) - chore(prices): sync OpenRouter prices: 15 models, 6 deprecated by [@&#8203;berriai-litellm-provider-info-sync](https://github.com/berriai-litellm-provider-info-sync)\[bot] in [#&#8203;41772](https://github.com/BerriAI/litellm/pull/41772) - refactor(proxy): make the config file win over the database by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41779](https://github.com/BerriAI/litellm/pull/41779) - fix(ui): let admins change a model's team from the model edit page by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40700](https://github.com/BerriAI/litellm/pull/40700) - fix(ui): show per-second pricing for video models instead of $0.00 token costs by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;39308](https://github.com/BerriAI/litellm/pull/39308) - fix(cost): bill cache-read tokens at the input rate when the map has no cache-read rate by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41832](https://github.com/BerriAI/litellm/pull/41832) - fix(responses): honor nested additional\_drop\_params paths by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40730](https://github.com/BerriAI/litellm/pull/40730) - feat(router): reject with 429 when a deployment's max\_parallel\_requests slots are all in use by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41555](https://github.com/BerriAI/litellm/pull/41555) - perf: defer fastapi and tiktoken BPE imports out of import litellm by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41585](https://github.com/BerriAI/litellm/pull/41585) - feat(proxy): add Amazon Transcribe pass-through with completion-time job pricing by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41515](https://github.com/BerriAI/litellm/pull/41515) - feat(proxy): per-key default budget for dynamically created customers by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41636](https://github.com/BerriAI/litellm/pull/41636) - feat(mcp): show live gateway sessions by AI client and user by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41692](https://github.com/BerriAI/litellm/pull/41692) - ci: replace the title-similarity duplicate bot with a Codex semantic check by [@&#8203;ryan-crabbe-berri](https://github.com/ryan-crabbe-berri) in [#&#8203;40935](https://github.com/BerriAI/litellm/pull/40935) - feat(proxy): temporary budget increase for team members by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41620](https://github.com/BerriAI/litellm/pull/41620) - feat(vault): add separate login and secret namespaces for HashiCorp Vault by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41539](https://github.com/BerriAI/litellm/pull/41539) - feat(vertex\_ai): stream GCS batch output files from /v1/files/{id}/content by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41506](https://github.com/BerriAI/litellm/pull/41506) - feat(a2a): reach Microsoft Foundry agents with Entra auth and versioned card discovery by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41511](https://github.com/BerriAI/litellm/pull/41511) - fix(azure): strip litellm format field from file and image content parts by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41275](https://github.com/BerriAI/litellm/pull/41275) - ci: classify new issues into domain, provider, kind, priority and lift labels by [@&#8203;ryan-crabbe-berri](https://github.com/ryan-crabbe-berri) in [#&#8203;41695](https://github.com/BerriAI/litellm/pull/41695) - fix(router): validate routing\_groups at save time and keep invalid DB groups from blocking SSO load by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41351](https://github.com/BerriAI/litellm/pull/41351) - fix(bedrock): send aws\_session\_tags on every STS call via one typed auth struct by [@&#8203;ryan-crabbe-berri](https://github.com/ryan-crabbe-berri) in [#&#8203;40500](https://github.com/BerriAI/litellm/pull/40500) - fix(anthropic): register thinking-binding-controls-2026-08-01 in beta headers config by [@&#8203;clonylu](https://github.com/clonylu) in [#&#8203;41203](https://github.com/BerriAI/litellm/pull/41203) - feat(guardrails): add TypeSafe Jev relevance-based compaction guardrail by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41757](https://github.com/BerriAI/litellm/pull/41757) - feat(keys): let team service account keys use key management endpoints for their own team by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40807](https://github.com/BerriAI/litellm/pull/40807) - test(docs): read only the first column of the router\_settings reference table by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41860](https://github.com/BerriAI/litellm/pull/41860) - fix(scim): accept entitlements and roles entries without a value on SCIM user PUT by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41830](https://github.com/BerriAI/litellm/pull/41830) - perf(proxy): split aggregated usage query into key-free rollups and bounded top-N keys by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41293](https://github.com/BerriAI/litellm/pull/41293) - chore(deps): bump anyio from 4.13.0 to 4.14.2 by [@&#8203;dependabot](https://github.com/dependabot)\[bot] in [#&#8203;41846](https://github.com/BerriAI/litellm/pull/41846) - feat(proxy): limit repeated failed Admin UI sign-in attempts by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40982](https://github.com/BerriAI/litellm/pull/40982) - fix(proxy): make SettingsStore.clear() terminate when the config file owns a key by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41862](https://github.com/BerriAI/litellm/pull/41862) - feat(vscode): add LiteLLM language model provider extension by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41865](https://github.com/BerriAI/litellm/pull/41865) - feat(mcp): let proxy admins force-close live MCP sessions and revoke stored user credentials by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41725](https://github.com/BerriAI/litellm/pull/41725) - feat(models): add qwen3.8 flash rows, fix Cohere embed v3 context, Bedrock Mantle and OpenRouter pricing by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41754](https://github.com/BerriAI/litellm/pull/41754) - fix(azure): keep api-version query after vector store search path by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41384](https://github.com/BerriAI/litellm/pull/41384) - fix(router): honor stream\_timeout on the SDK-native passthrough route (/v1/messages, /converse) by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41875](https://github.com/BerriAI/litellm/pull/41875) - fix(proxy): track team member spend when the member has no budget by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41349](https://github.com/BerriAI/litellm/pull/41349) - feat(proxy): add Azure AI Speech pass-through route by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41557](https://github.com/BerriAI/litellm/pull/41557) - fix(responses): stop managed Responses WebSocket from leaking litellm\_params into provider request body by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;33101](https://github.com/BerriAI/litellm/pull/33101) - feat(rust): port exception\_type to litellm-core-utils by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41873](https://github.com/BerriAI/litellm/pull/41873) - fix(ui): show internal user email in logs table and log detail drawer by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40737](https://github.com/BerriAI/litellm/pull/40737) - fix(router): report null cost for unpriced deployments instead of 0 by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40878](https://github.com/BerriAI/litellm/pull/40878) - feat(azure\_ai): support FLUX.2 flex images by [@&#8203;emerzon](https://github.com/emerzon) in [#&#8203;39424](https://github.com/BerriAI/litellm/pull/39424) - fix(mistral): accept reasoning\_effort on all models and drop client\_metadata for Codex compatibility by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41062](https://github.com/BerriAI/litellm/pull/41062) - feat(passthrough): deepgram streaming /v1/listen WebSocket passthrough with duration-based cost tracking by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41554](https://github.com/BerriAI/litellm/pull/41554) - test(ocr): declarative provider x auth x input matrix, fix Rust 401 mapping by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41884](https://github.com/BerriAI/litellm/pull/41884) - fix(proxy): classify Azure Speech short audio behind a prefixed api base by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41882](https://github.com/BerriAI/litellm/pull/41882) - feat(proxy): add LiteLLM\_DailyGlobalSpend key-free rollup for the usage dashboard by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41324](https://github.com/BerriAI/litellm/pull/41324) - fix(proxy): keep requested model guardrails and key disable\_fallbacks on rate-limit fallback by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41783](https://github.com/BerriAI/litellm/pull/41783) - fix(bedrock): carry s3\_endpoint\_url and s3\_region\_name into file content downloads by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41138](https://github.com/BerriAI/litellm/pull/41138) - ci(duplicate-check): let Codex reach GitHub from its sandbox by [@&#8203;ryan-crabbe-berri](https://github.com/ryan-crabbe-berri) in [#&#8203;41883](https://github.com/BerriAI/litellm/pull/41883) - fix(proxy): resolve model\_group\_alias to its target for /v1/models metadata by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41483](https://github.com/BerriAI/litellm/pull/41483) - fix(proxy): reset sibling tpm/rpm counters when the shared rate limit window rolls over by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41838](https://github.com/BerriAI/litellm/pull/41838) - feat(ui): link MCP Servers page to the user's connected MCP servers by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41888](https://github.com/BerriAI/litellm/pull/41888) - fix(proxy): name the blocking guardrail in x-litellm-applied-guardrails by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41583](https://github.com/BerriAI/litellm/pull/41583) - fix(responses): merge deployment litellm\_params into native websocket response.create frames by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41881](https://github.com/BerriAI/litellm/pull/41881) - feat: honor eager\_input\_streaming on Bedrock and Anthropic Claude tools by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41871](https://github.com/BerriAI/litellm/pull/41871) - fix(otel): keep caller traceparent and tracestate on pass-through relays by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41786](https://github.com/BerriAI/litellm/pull/41786) - ci: remove the dead Agent Shin triage workflows and scripts by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41894](https://github.com/BerriAI/litellm/pull/41894) - fix: set vertex gemma-4-26b-a4b-it-maas context window to 262144 by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41887](https://github.com/BerriAI/litellm/pull/41887) - refactor(rust): formalize legacy callback contract by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41885](https://github.com/BerriAI/litellm/pull/41885) - fix(gemini): preserve candidates with finishReason and no content ([#&#8203;40477](https://github.com/BerriAI/litellm/issues/40477)) by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41892](https://github.com/BerriAI/litellm/pull/41892) - fix(team): apply team\_member\_budget updates to members still on the team default by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41347](https://github.com/BerriAI/litellm/pull/41347) - fix(enterprise): resolve openai\_moderations model at call time and default to omni-moderation-latest by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41895](https://github.com/BerriAI/litellm/pull/41895) - fix(proxy): track project spend and enforce project budgets additively by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41354](https://github.com/BerriAI/litellm/pull/41354) - fix(proxy): refuse config-owned keys on POST /config/update by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41868](https://github.com/BerriAI/litellm/pull/41868) - test(integration): cover off-peak pricing on a live proxy by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41901](https://github.com/BerriAI/litellm/pull/41901) - fix(proxy): requeue daily spend rows when the commit fails without the Redis buffer by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41878](https://github.com/BerriAI/litellm/pull/41878) - fix(responses): emit typed streaming failure events by [@&#8203;zoroyihan7](https://github.com/zoroyihan7) in [#&#8203;40243](https://github.com/BerriAI/litellm/pull/40243) - fix(bedrock): clamp maxTokens to the 16-token minimum for OpenAI GPT and xAI Grok models on Converse by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41870](https://github.com/BerriAI/litellm/pull/41870) - chore(model\_info): backfill reseller Gemini entries from provider catalogs and prune retired ids by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41902](https://github.com/BerriAI/litellm/pull/41902) - feat(mcp): allowlist MCP client applications at the gateway by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41667](https://github.com/BerriAI/litellm/pull/41667) - fix(schema): classify off\_peak\_pricing as a structured object in the model prices schema generator by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41847](https://github.com/BerriAI/litellm/pull/41847) - fix(rate\_limiter): render the 429 reset time in UTC as labelled by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41911](https://github.com/BerriAI/litellm/pull/41911) - ci(issues): comment which release carries the fix when a pull request closes an issue by [@&#8203;ryan-crabbe-berri](https://github.com/ryan-crabbe-berri) in [#&#8203;41910](https://github.com/BerriAI/litellm/pull/41910) - feat(proxy): let team admins manage projects via team\_admin\_editable\_team\_fields by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41916](https://github.com/BerriAI/litellm/pull/41916) - fix(bedrock): sign batch retrieve and cancel with deployment credentials when AWS\_BEARER\_TOKEN\_BEDROCK is set by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41904](https://github.com/BerriAI/litellm/pull/41904) - fix(websearch\_interception): surface a failed search as a web\_search\_tool\_result\_error block and end the turn by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41905](https://github.com/BerriAI/litellm/pull/41905) - fix(cost\_calc): default fireworks cached input to the documented 50% discount when the map has no cache-read rate by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41917](https://github.com/BerriAI/litellm/pull/41917) - fix(timing): anchor response duration and overhead at proxy receive time by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41891](https://github.com/BerriAI/litellm/pull/41891) - feat(xai): add speech-to-text (Grok Voice Transcribe) via /v1/audio/transcriptions by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41914](https://github.com/BerriAI/litellm/pull/41914) - feat(rust): add litellm-http client pool and inject it into the OCR route by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41897](https://github.com/BerriAI/litellm/pull/41897) - feat(vertex\_ai): stream Chirp speech-to-text over /v1/realtime by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41721](https://github.com/BerriAI/litellm/pull/41721) - chore: consolidate CLAUDE.md into AGENTS.md by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41921](https://github.com/BerriAI/litellm/pull/41921) - feat(proxy): serve the Claude Code gateway protocol under /claude\_code\_gateway by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;34267](https://github.com/BerriAI/litellm/pull/34267) - fix(responses): restore encrypted\_content and apply affinity on the native WebSocket relay by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41893](https://github.com/BerriAI/litellm/pull/41893) - feat(proxy): add RFC 8693 token exchange for IdP JWTs on the gateway token endpoint by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41485](https://github.com/BerriAI/litellm/pull/41485) - fix(websearch): forward the deployment api\_base to agentic follow-up calls on /v1/messages by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41918](https://github.com/BerriAI/litellm/pull/41918) - fix(proxy): parse role\_permissions where it is read by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41924](https://github.com/BerriAI/litellm/pull/41924) - fix(responses): announce message item before text events in the chat completions bridge by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41564](https://github.com/BerriAI/litellm/pull/41564) - fix(proxy): unpin cost-map pricing copied into model\_info and report pricing overrides by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41843](https://github.com/BerriAI/litellm/pull/41843) - feat(websearch): let the model emit objective + multi-query search shapes by [@&#8203;adssoccer1](https://github.com/adssoccer1) in [#&#8203;40399](https://github.com/BerriAI/litellm/pull/40399) - fix(exceptions): keep internal\_server\_error as the public type of an upstream 500 by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41930](https://github.com/BerriAI/litellm/pull/41930) - fix(proxy): dispatch llm\_api\_check moderation through during\_call\_hook by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41685](https://github.com/BerriAI/litellm/pull/41685) - fix(policy\_engine): deliver guardrail text rewrites on multi-choice, unfinished, and envelope-less streams by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41933](https://github.com/BerriAI/litellm/pull/41933) - fix(anthropic): keep cache\_control for Gemini targets on /v1/messages and normalize Anthropic ttl units by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41938](https://github.com/BerriAI/litellm/pull/41938) - fix(guardrails): stop the Javelin api\_version default leaking into Azure Content Safety by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41941](https://github.com/BerriAI/litellm/pull/41941) - fix(alerting): clarify budget threshold messages by [@&#8203;gaurav-pandey-zocdoc](https://github.com/gaurav-pandey-zocdoc) in [#&#8203;39102](https://github.com/BerriAI/litellm/pull/39102) - fix(cost): carry image and video input tokens through the Responses usage bridge (internal copy of [#&#8203;36887](https://github.com/BerriAI/litellm/issues/36887)) by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41237](https://github.com/BerriAI/litellm/pull/41237) - ci(unit): fail a hung test in 120s with a traceback instead of idling the shard to its step timeout by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41948](https://github.com/BerriAI/litellm/pull/41948) - refactor(types): replace Any with proven types in 6 files by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41947](https://github.com/BerriAI/litellm/pull/41947) - fix(proxy): register transcribe as a known provider for model grants by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41926](https://github.com/BerriAI/litellm/pull/41926) - feat(batches): support Mistral files/batches and per-page OCR batch cost tracking (internal copy of [#&#8203;40484](https://github.com/BerriAI/litellm/issues/40484)) by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41934](https://github.com/BerriAI/litellm/pull/41934) - fix(utils): reject an untranslatable tool\_choice with a 400 instead of a 500 by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41234](https://github.com/BerriAI/litellm/pull/41234) - fix(proxy): keep request metadata out of the cost tracking failure alert by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41950](https://github.com/BerriAI/litellm/pull/41950) - fix(masker): memoize shared nodes and fail closed past the depth cap by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41952](https://github.com/BerriAI/litellm/pull/41952) - fix(responses): drop tool\_search and local\_shell in the chat completions bridge by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41953](https://github.com/BerriAI/litellm/pull/41953) - fix(rag): resolve registry stores on /v1/rag/ingest and reject providers without ingestion by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41940](https://github.com/BerriAI/litellm/pull/41940) - fix(azure): send the resolved Entra ID token on image generation requests by [@&#8203;abhirup7](https://github.com/abhirup7) in [#&#8203;40147](https://github.com/BerriAI/litellm/pull/40147) - fix(proxy): keep the raw client model out of spend logs for rejections outside the router by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41943](https://github.com/BerriAI/litellm/pull/41943) - fix(cost): resolve dated openai/azure snapshots to their undated cost map entry by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41423](https://github.com/BerriAI/litellm/pull/41423) - fix(proxy): /key/bulk\_update writes only the fields each item carries by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41949](https://github.com/BerriAI/litellm/pull/41949) - fix(cost): bill DeepSeek V4.1 Flash and V4 Pro at off-peak rates outside peak hours by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41960](https://github.com/BerriAI/litellm/pull/41960) - test(cost): point dated snapshot tests at a date the cost map cannot carry by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41971](https://github.com/BerriAI/litellm/pull/41971) - fix(proxy): refuse runtime writes to config-owned settings by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41931](https://github.com/BerriAI/litellm/pull/41931) - refactor(rust): centralize layered settings resolution by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41969](https://github.com/BerriAI/litellm/pull/41969) - test(utils): isolate dated model fallback from pricing additions by [@&#8203;joshua-berri](https://github.com/joshua-berri) in [#&#8203;41975](https://github.com/BerriAI/litellm/pull/41975) - test(response\_metadata): anchor detailed-timing test on a fixed instant instead of wall clock by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41946](https://github.com/BerriAI/litellm/pull/41946) - test(integration): literal request/response cost tracking suite on a test-owned cost map by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41328](https://github.com/BerriAI/litellm/pull/41328) - chore(prices): sync Azure prices: 5 models, 5 deprecated by [@&#8203;berriai-litellm-provider-info-sync](https://github.com/berriai-litellm-provider-info-sync)\[bot] in [#&#8203;41966](https://github.com/BerriAI/litellm/pull/41966) - feat(ocr): add Rust-only Textract and sign provider requests after host hooks by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41977](https://github.com/BerriAI/litellm/pull/41977) - refactor(rust): use typed pyo3 APIs instead of getattr/import strings by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41981](https://github.com/BerriAI/litellm/pull/41981) - fix(router): enforce model tpm limits against shared redis usage across replicas by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41915](https://github.com/BerriAI/litellm/pull/41915) - feat(proxy): say when a stored setting is ignored because the config file owns it by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;41985](https://github.com/BerriAI/litellm/pull/41985) - fix(otel v2): summarize embedding vectors as Langfuse observation output by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41982](https://github.com/BerriAI/litellm/pull/41982) - fix(caching): scope automatic breakpoints to supported Claude transports by [@&#8203;tin-berri](https://github.com/tin-berri) in [#&#8203;41920](https://github.com/BerriAI/litellm/pull/41920) - fix(proxy): return 400 instead of 500 for /v1/responses without input by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41939](https://github.com/BerriAI/litellm/pull/41939) - fix(llmguard): accept proxy async call types by [@&#8203;yucheng-berri](https://github.com/yucheng-berri) in [#&#8203;41787](https://github.com/BerriAI/litellm/pull/41787) - fix(model\_prices): drop anthropic deprecation floors and correct azure gpt-4.1-nano retirement date by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41964](https://github.com/BerriAI/litellm/pull/41964) - fix(ui): show user attribution in Top Virtual Keys usage tables by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;40729](https://github.com/BerriAI/litellm/pull/40729) - chore(prices): sync OpenRouter prices: 172 models, 2 new by [@&#8203;berriai-litellm-provider-info-sync](https://github.com/berriai-litellm-provider-info-sync)\[bot] in [#&#8203;41833](https://github.com/BerriAI/litellm/pull/41833) - fix(ocr): set DeepSeek OCR sampling defaults by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41992](https://github.com/BerriAI/litellm/pull/41992) - ci: remove auto-merge-price-sync workflow, the Devin sync automation merges price PRs by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41993](https://github.com/BerriAI/litellm/pull/41993) - refactor(mcp): upgrade SDK2 while preserving legacy gateway behavior by [@&#8203;joshua-berri](https://github.com/joshua-berri) in [#&#8203;41718](https://github.com/BerriAI/litellm/pull/41718) - revert(guardrails): drop the scoped request conversation and tools from post-call scans ([#&#8203;41220](https://github.com/BerriAI/litellm/issues/41220)) by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41986](https://github.com/BerriAI/litellm/pull/41986) - chore(prices): sync OpenRouter prices: 2 models by [@&#8203;berriai-litellm-provider-info-sync](https://github.com/berriai-litellm-provider-info-sync)\[bot] in [#&#8203;41996](https://github.com/BerriAI/litellm/pull/41996) - test(unified\_google\_tests): use the Vertex global endpoint and retry 429s with backoff by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41995](https://github.com/BerriAI/litellm/pull/41995) - fix(rust): refuse native routes in processes forked after the runtime started by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41987](https://github.com/BerriAI/litellm/pull/41987) - fix(terraform): unlink the registry docs entries that 404 on click by [@&#8203;shivamrawat1](https://github.com/shivamrawat1) in [#&#8203;42003](https://github.com/BerriAI/litellm/pull/42003) - fix(otel v2): map Responses API output onto the Langfuse generation output by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41991](https://github.com/BerriAI/litellm/pull/41991) - test(e2e): stop the config suite locking itself out of the shared proxy by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;42008](https://github.com/BerriAI/litellm/pull/42008) - chore: bump litellm-enterprise 0.1.68 -> 0.1.69, litellm-proxy-extras 0.4.99 -> 0.4.100 by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;42025](https://github.com/BerriAI/litellm/pull/42025) - fix(proxy): close the config-ownership gaps QA found in the settings store by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;42009](https://github.com/BerriAI/litellm/pull/42009) - fix(proxy): block project requests when max\_budget is 0 by [@&#8203;ryan-crabbe-berri](https://github.com/ryan-crabbe-berri) in [#&#8203;41997](https://github.com/BerriAI/litellm/pull/41997) - fix(auth): inherit org alias, budget and rate limits for JWT and team-linked keys by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41681](https://github.com/BerriAI/litellm/pull/41681) - feat(batches): run hosted\_vllm batches inside LiteLLM by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41942](https://github.com/BerriAI/litellm/pull/41942) - fix(proxy): forward stream response attributes through the hook boundary and merge logged applied\_guardrails by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;42027](https://github.com/BerriAI/litellm/pull/42027) - feat(ui): configure web search interception from the Admin UI by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;42007](https://github.com/BerriAI/litellm/pull/42007) - fix(azure): drop tool\_choice when the request has no tools (internal copy of [#&#8203;41781](https://github.com/BerriAI/litellm/issues/41781)) by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;42031](https://github.com/BerriAI/litellm/pull/42031) - fix(azure): tool choice without tools causes 400 by [@&#8203;dsteeley](https://github.com/dsteeley) in [#&#8203;41781](https://github.com/BerriAI/litellm/pull/41781) - test(mcp): verify scoped execution and OAuth credential isolation by [@&#8203;joshua-berri](https://github.com/joshua-berri) in [#&#8203;41731](https://github.com/BerriAI/litellm/pull/41731) - test(e2e): cover MCP OAuth SSO and cold restart persistence by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41909](https://github.com/BerriAI/litellm/pull/41909) - fix(proxy): estimate auto-router baseline costs from durable cache history by [@&#8203;tin-berri](https://github.com/tin-berri) in [#&#8203;41177](https://github.com/BerriAI/litellm/pull/41177) - fix(auto-router): show heuristic v2 score estimates in routing details by [@&#8203;tin-berri](https://github.com/tin-berri) in [#&#8203;42001](https://github.com/BerriAI/litellm/pull/42001) - feat(router): add maintained Fuse model and harness presets by [@&#8203;tin-berri](https://github.com/tin-berri) in [#&#8203;41617](https://github.com/BerriAI/litellm/pull/41617) - refactor(rust): rename legacy callback adapter crate by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;42037](https://github.com/BerriAI/litellm/pull/42037) - Revert "test(mcp): verify scoped execution and OAuth credential isolation" by [@&#8203;mateo-berri](https://github.com/mateo-berri) in [#&#8203;42039](https://github.com/BerriAI/litellm/pull/42039) - revert(e2e): remove MCP OAuth SSO and cold restart tests by [@&#8203;mateo-berri](https://github.com/mateo-berri) in [#&#8203;42040](https://github.com/BerriAI/litellm/pull/42040) - test(mcp): cover SDK redirect compatibility by [@&#8203;joshua-berri](https://github.com/joshua-berri) in [#&#8203;42033](https://github.com/BerriAI/litellm/pull/42033) - feat(ui): report whether the serving proxy has applied web search interception by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;42042](https://github.com/BerriAI/litellm/pull/42042) - fix(test): unbreak the integration-cost and proxy\_e2e\_anthropic\_messages CircleCI jobs on main by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;42048](https://github.com/BerriAI/litellm/pull/42048) - chore(prices): sync OpenRouter prices: 2 models by [@&#8203;berriai-litellm-provider-info-sync](https://github.com/berriai-litellm-provider-info-sync)\[bot] in [#&#8203;42006](https://github.com/BerriAI/litellm/pull/42006) - feat(otel v2): opt-in llm\_only span scope for Langfuse destinations and the operator Langfuse exporter by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41740](https://github.com/BerriAI/litellm/pull/41740) - test(e2e): point the Nova Sonic realtime test at nova-2-sonic by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;42053](https://github.com/BerriAI/litellm/pull/42053) - fix(team): emit audit events for member\_delete and role changes and carry the final roster on team create by [@&#8203;devin-ai-integration](https://github.com/devin-ai-integration)\[bot] in [#&#8203;41840](https://github.com/BerriAI/litellm/pull/41840) - chore(prices): sync OpenRouter prices: 5 models by [@&#8203;berriai-litellm-provider-info-sync](https://github.com/berriai-litellm-provider-info-sync)\[bot] in [#&#8203;42058](https://github.com/BerriAI/litellm/pull/42058) - chore(prices): sync OpenRouter prices: 2 models by [@&#8203;berriai-litellm-provider-info-sync](https://github.com/berriai-litellm-provider-info-sync)\[bot] in [#&#8203;42063](https://github.com/BerriAI/litellm/pull/42063) - chore: rebuild Admin UI bundle from main (build kXnLzJ6ylsRPmgSkCkCKM) by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;42054](https://github.com/BerriAI/litellm/pull/42054) - test(mcp): migrate the mcp test helpers to the mcp 2.x MCPServer API by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;42075](https://github.com/BerriAI/litellm/pull/42075) - test(logging): add autorouter estimate keys to the GCS pub/sub spend-log golden by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;42076](https://github.com/BerriAI/litellm/pull/42076) - test(batches): skip the Bedrock GovCloud batch e2e until its secrets are provisioned by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;42081](https://github.com/BerriAI/litellm/pull/42081) - fix(bedrock): backport the /v1/messages Invoke streaming pass-through to rc/1.103.0 ([#&#8203;42607](https://github.com/BerriAI/litellm/issues/42607)) by [@&#8203;mateo-berri](https://github.com/mateo-berri) in [#&#8203;42658](https://github.com/BerriAI/litellm/pull/42658) - revert(usage): remove the top-N key cap and global spend rollup code from rc/1.103.0 by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;43326](https://github.com/BerriAI/litellm/pull/43326) - fix(proxy): backport team member spend jsonb flush to rc/1.103.0 ([#&#8203;43029](https://github.com/BerriAI/litellm/issues/43029)) by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;43323](https://github.com/BerriAI/litellm/pull/43323) - fix: backport five regression fixes to rc/1.103.0 by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;43331](https://github.com/BerriAI/litellm/pull/43331) - chore: rebuild Admin UI bundle for rc/1.103.0 by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;43328](https://github.com/BerriAI/litellm/pull/43328) - fix(jwt,otel): backport session conversation id and JWT team header selection to rc/1.103.0 by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;43343](https://github.com/BerriAI/litellm/pull/43343) - fix(caching): stand default cache points down when extra\_body hides a direct client mark by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;43342](https://github.com/BerriAI/litellm/pull/43342) - test(integration): make rc/1.103.0 integration groups collect and pass again by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;43382](https://github.com/BerriAI/litellm/pull/43382) - test(e2e): clear the two rc/1.103.0 e2e reds owned by upstream providers by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;43388](https://github.com/BerriAI/litellm/pull/43388) - test(ci): fix the e2e and integration reds left on rc/1.103.0 by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;43391](https://github.com/BerriAI/litellm/pull/43391) - fix(streaming): backport text-completion usage fix and e2e provider-flake tolerance to rc/1.103.0 by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;43400](https://github.com/BerriAI/litellm/pull/43400) - fix(proxy): unregister logging callbacks removed from the stored config by [@&#8203;yuneng-berri](https://github.com/yuneng-berri) in [#&#8203;43429](https://github.com/BerriAI/litellm/pull/43429) #### New Contributors - [@&#8203;joshgarnett](https://github.com/joshgarnett) made their first contribution in [#&#8203;36363](https://github.com/BerriAI/litellm/pull/36363) - [@&#8203;HUAHAODIA](https://github.com/HUAHAODIA) made their first contribution in [#&#8203;41048](https://github.com/BerriAI/litellm/pull/41048) - [@&#8203;rad-p44](https://github.com/rad-p44) made their first contribution in [#&#8203;40315](https://github.com/BerriAI/litellm/pull/40315) - [@&#8203;AaronHowell](https://github.com/AaronHowell) made their first contribution in [#&#8203;40228](https://github.com/BerriAI/litellm/pull/40228) - [@&#8203;MvdB](https://github.com/MvdB) made their first contribution in [#&#8203;36775](https://github.com/BerriAI/litellm/pull/36775) - [@&#8203;IToSSc](https://github.com/IToSSc) made their first contribution in [#&#8203;41179](https://github.com/BerriAI/litellm/pull/41179) - [@&#8203;max-sixty](https://github.com/max-sixty) made their first contribution in [#&#8203;34829](https://github.com/BerriAI/litellm/pull/34829) - [@&#8203;runjivu](https://github.com/runjivu) made their first contribution in [#&#8203;41379](https://github.com/BerriAI/litellm/pull/41379) - [@&#8203;elifozdamar](https://github.com/elifozdamar) made their first contribution in [#&#8203;40843](https://github.com/BerriAI/litellm/pull/40843) - [@&#8203;etiennechabert](https://github.com/etiennechabert) made their first contribution in [#&#8203;37983](https://github.com/BerriAI/litellm/pull/37983) - [@&#8203;zachbernstein-sdx](https://github.com/zachbernstein-sdx) made their first contribution in [#&#8203;41444](https://github.com/BerriAI/litellm/pull/41444) - [@&#8203;clonylu](https://github.com/clonylu) made their first contribution in [#&#8203;41203](https://github.com/BerriAI/litellm/pull/41203) - [@&#8203;zoroyihan7](https://github.com/zoroyihan7) made their first contribution in [#&#8203;40243](https://github.com/BerriAI/litellm/pull/40243) - [@&#8203;adssoccer1](https://github.com/adssoccer1) made their first contribution in [#&#8203;40399](https://github.com/BerriAI/litellm/pull/40399) - [@&#8203;gaurav-pandey-zocdoc](https://github.com/gaurav-pandey-zocdoc) made their first contribution in [#&#8203;39102](https://github.com/BerriAI/litellm/pull/39102) - [@&#8203;abhirup7](https://github.com/abhirup7) made their first contribution in [#&#8203;40147](https://github.com/BerriAI/litellm/pull/40147) **Full Changelog**: <https://github.com/BerriAI/litellm/compare/v1.102.0...v1.103.0> </details> --- ### Configuration 📅 **Schedule**: (in timezone Europe/Rome) - Branch creation - At any time (no schedule defined) - Automerge - At any time (no schedule defined) 🚦 **Automerge**: Disabled by config. Please merge this manually once you are satisfied. ♻ **Rebasing**: Whenever PR becomes conflicted, or you tick the rebase/retry checkbox. 🔕 **Ignore**: Close this PR and you won't be reminded about this update again. --- - [ ] <!-- rebase-check -->If you want to rebase/retry this PR, check this box --- This PR has been generated by [Mend Renovate CLI](https://github.com/renovatebot/renovate). <!--renovate-debug:eyJjcmVhdGVkSW5WZXIiOiI0NC4xMDQuMiIsInVwZGF0ZWRJblZlciI6IjQ0LjExNS4xMyIsInRhcmdldEJyYW5jaCI6Im1haW4iLCJsYWJlbHMiOlsicmVub3ZhdGUvY29udGFpbmVyIiwidHlwZS9taW5vciJdfQ==-->
feat(container): update image ghcr.io/berriai/litellm (v1.102.1 ➔ 1.103.0)
All checks were successful
Labeler / Labeler (pull_request) Successful in 4s
Lint / actionlint (pull_request) Successful in 6s
Lint / yamllint (pull_request) Successful in 12s
AI PR Review / AI PR Review (pull_request) Successful in 30s
Konflate 1 resource changed
e3309a4c15
Collaborator

✅ Automated recommendation: APPROVE

Analysis engine: minimax/MiniMax-M2-7-anthropic@http://litellm.ai.svc.cluster.local:4000/v1 (anthropic)

Approve — routine Renovate minor version bump for ghcr.io/berriai/litellm (v1.102.1 → v1.103.0) with updated SHA256 digest.

Changed file: kubernetes/apps/ai/litellm/app/litellmproxy.yaml

  • Image tag bumped from v1.102.1 to v1.103.0
  • Digest updated: sha256:87f349… → sha256:bd089a…
  • 1 resource across 1 app; konflate confirms no cautions (data-loss, immutable-field, RBAC, suspend/prune)

The change follows repository conventions: container image pinned with both tag and @sha256: digest, no structural changes to the HelmRelease, and the rendered diff matches the raw diff.

<!-- ai-pr-reviewer --> <!-- ai-pr-reviewer:{"version":1,"head_sha":"d37ce3e020688664beed823adbf06ec38349aa8a","base_sha":"3dca87826ca4c3d778e93969935fa3a4e6a12e9e","review_scope":"full","review_result":"clean"} --> <!-- ai-pr-review-sha:d37ce3e020688664beed823adbf06ec38349aa8a --> <!-- ai-pr-review-fingerprint:e06b66c46531e9f500601bb318e9377688e2ab01a3995f099f32c2d25c8fbe4d|cfg:d27ea58bdbdafc403f62b1b84c70d905cc97c77c6d72d767872b88951af9ea8d --> ✅ **Automated recommendation: APPROVE** _Analysis engine: minimax/MiniMax-M2-7-anthropic@http://litellm.ai.svc.cluster.local:4000/v1 (anthropic)_ **Approve** — routine Renovate minor version bump for `ghcr.io/berriai/litellm` (v1.102.1 → v1.103.0) with updated SHA256 digest. **Changed file:** `kubernetes/apps/ai/litellm/app/litellmproxy.yaml` - Image tag bumped from `v1.102.1` to `v1.103.0` - Digest updated: `sha256:87f349…` → `sha256:bd089a…` - 1 resource across 1 app; konflate confirms no cautions (data-loss, immutable-field, RBAC, suspend/prune) The change follows repository conventions: container image pinned with both tag and `@sha256:` digest, no structural changes to the HelmRelease, and the rendered diff matches the raw diff.
Collaborator

Routine: only container-image and chart-version changes; 1 resource across 1 app

image from to upstream
ghcr.io/berriai/litellm v1.102.1@sha256:87f349… v1.103.0@sha256:bd089a… ❔

konflate 0.6.4 · rendered d37ce3e · full diff →

<!-- konflate:pr-2226 --> **Routine**: only container-image and chart-version changes; 1 resource across 1 app | image | from | to | upstream | |---|---|---|---| | `ghcr.io/berriai/litellm` | `v1.102.1@sha256:87f349…` | `v1.103.0@sha256:bd089a…` | ❔ | <sub>konflate 0.6.4 · rendered `d37ce3e` · [full diff →](https://konflate.aresu.eu/#/pr/2226)</sub>
renovate-bot force-pushed renovate/ghcr.io-berriai-litellm-1.x from e3309a4c15
All checks were successful
Labeler / Labeler (pull_request) Successful in 4s
Lint / actionlint (pull_request) Successful in 6s
Lint / yamllint (pull_request) Successful in 12s
AI PR Review / AI PR Review (pull_request) Successful in 30s
Konflate 1 resource changed
to d37ce3e020
All checks were successful
Labeler / Labeler (pull_request) Successful in 3s
Lint / actionlint (pull_request) Successful in 6s
Lint / yamllint (pull_request) Successful in 11s
AI PR Review / AI PR Review (pull_request) Successful in 29s
Konflate 1 resource changed
2026-09-27 21:01:26 +02:00
Compare
renovate-bot changed title from feat(container): update image ghcr.io/berriai/litellm (v1.102.1 ➔ 1.103.0) to feat(container): update image ghcr.io/berriai/litellm (v1.102.1 ➔ v1.103.0) 2026-09-27 21:01:51 +02:00
Sign in to join this conversation.
No description provided.