开源litellm Releases·原文 2026年9月2日本站收录 2026年9月7日

LiteLLM v1.101.0-dev.1:新增Claude Fable 5.1、GLM-5.3定价及工作负载身份联合支持

LiteLLM发布v1.101.0-dev.1开发版,新增Claude Fable 5.1模型支持、Qwen平台别名、GigaChat原生直通、分时非高峰定价,并推出OpenID连接工作负载身份联合,还修复了多项代理与模型路由问题。

开源LLM网关LiteLLM发布v1.101.0-dev.1开发版,围绕代理稳定性、模型定价和云身份认证做了大量更新。该版本由官方维护者合并了超过百个PR,含多名首次贡献者的提交。

模型支持与定价

新增对Anthropic Claude Fable 5.1的支持,覆盖Anthropic直连、AWS Bedrock、Google Vertex AI和Microsoft Azure AI四条路径。

新增Azure AI DeepSeek V4 Flash 0731定价,以及Friendli平台上zai-org/GLM-5.3和GLM-5.3-Flash的定价。

  • 模型成本地图同时更新了陈旧来源URL、弃用日期,并为veo 3.1引入分档定价。
  • DashScope新增QwenCloud和Qwen AI Platform两个provider别名,可更清晰地区分阿里云的两个平台入口。
  • 成本计算开始支持基于时间的非高峰定价(off-peak pricing)。
  • OCR注解页按annotation_cost_per_page独立计费。

代理与路由修复

代理在OpenAI /v1/responses和 /v1/messages接口上新增计时与开销响应头;新增 /v1/responses/input_tokens令牌计数端点。

当流式返回多个分片时,修复了response id在不同chunk间保持不变的问题。

修复了gpt-5回退到Claude对话时tool call id形状不匹配导致的会话崩溃,同时移除了无工具请求中多余的tool_choice参数。

模型重命名现在会同步应用到内存中的部署列表,而不仅限于配置;/model/block与 /model/unblock接口对成功操作返回HTTP 200而非 500。

对于未知模型别名,现在会转发reasoning_effort参数而不是直接失败。

安全、认证与平台集成

代理新增对OpenID Connect工作负载身份联合的支持,OpenAI通道可用OIDC token交换云凭证,降低对长期密钥的依赖。

/customer/update接口现在允许解除对客户的封锁。

修复了主密钥轮换时模型表字段丢失的问题,并允许在 /key/update上对非管理员key_type预设进行切换。

Bedrock的凭证加载现在会传递aws_external_id,用于文件和批量任务。

  • SpendLogs分区检测的逻辑此前因缺少psycopg驱动而未真正运行,本版本修正了这个问题。
  • 团队级日志回调现在会接入直通端点。
  • OpenTelemetry的v2 LLM span开始输出缓存token计数。

网关与护栏路由

网关现支持OpenID工作负载身份联合、GigaChat原生API直通路由、以及带消费记录的 /v1/messages、/v1/responses开销响应头。

guardrails层增加Alice防护栏,并补充了Prompt Security文件超时策略,HiddenLayer v1扫描开始排除图片。

在代理上新增名为ENABLE_TOOL_SEARCH的环境变量,可在CLI模式下为lite claude启用工具搜索。

新增基于续轮跳过分词器的分类模式,以及针对图像请求的基于能力路由。

shadow_eval现在可针对团队和用户进行配置,以评估JWT-auth流量的效果。

Docker镜像签名

发布说明重申所有LiteLLM Docker镜像均使用cosign签名,签名密钥固定为commit 0112e53。

推荐用不可变的commit hash校验,同时也提供tag校验方式。

信息来源

litellm Releases原始来源