Open WebUI发布v0.11.1:引入工具调用人工审批与模型向用户提问功能,重构流式响应
新版本允许管理员开启“人在回路”工具审批,模型使用工具前需经用户确认;内置工具支持模型暂停并最多向用户提出三个选择题。据发布说明,流式传输机制重写后,超长回复的数据发送量最高可减少 1000 倍。
AI解读:Open WebUI在v0.11.1中新增了“人在回路”工具审批和模型提问功能,这直接回应了代理(agent)自主调用工具时缺乏控制的问题。如果你在团队或生产环境中运行Open WebUI,管理员现在可以开启审批开关,之后模型每次想用工具(如搜索或写文件)都会先等待你点击允许或拒绝,你的选择会被记住,且自动化、频道回复和临时聊天不受影响。此外,模型现在能暂停并向你提出最多三个选择题,答案可在刷新后继续回答,减少因中断而丢失的上下文。此次更新还重写了流式传输机制,回复改为增量推送而非整段重发,官方称超长回复的数据量可降低达 1000 倍,对高并发服务器和长对话场景尤其重要。若你只使用单机简单对话,这些改动带来的提升可能不明显,但如果你管理多用户实例,建议关注性能优化部分,尤其是流式传输和缓存相关的改进。
Open WebUI发布了v0.11.1版本,新增了需要管理员启用的“人在回路”工具审批功能,以及一个内置工具,让模型在继续前可暂停并向用户提出最多三个多项选择题。据官方发布说明,流式传输机制被“从头重建”,现在以小块增量发送回复而非每次都重发整个消息,这可以将超长回复的数据发送量减少高达 1000 倍。
工具调用与提问:新增人工控制层
管理员可开启“人在回路”工具审批:当启用后,用户可将对话从“工具自由运行”切换为“先询问”,模型在调用工具前会暂停,等待用户在一次已保存对话中通过按钮或键盘快捷键逐次允许或拒绝每个调用。在已保存的对话中,用户的每次选择都会被记住,并应用于当前及未来的对话,切换回自由运行模式会释放任何已等待的调用。官方说明指出,自动化、频道回复和临时聊天不受此功能影响。
版本还引入了一个新的内置工具,使模型能够暂停并向用户展示最多三个多项选择题,用户也可以输入自己的答案而不是选择一个选项。在已保存的对话中,即使页面刷新,问题也会保留,用户之后可以返回并回答,而不会丢失对话。
流式传输、性能与文件系统优化
此版本对性能进行了大量优化。流式传输机制被重建,现在回复以小块形式流式传输,而不是每次更新都重发整个消息,这降低了服务器编码和中继数据的开销,并减少了支持Redis的部署中共享缓存的负载。官方表示,对于一个非常长的回复,这减少了数据发送量和服务器的追加工作高达 1000 倍。此外,仍在进行中的回复现在保留在服务器上(在Redis部署中),刷新后重新打开对话会从中断处恢复,而不是显示空白消息。
优化包括:移除数百个被禁用且未使用的详细日志记录点(将构建日志文本的开销降低),更快的模型列表查找、权限检查、JSON处理(启用ENABLE_ORJSON选项时),加速发送到Ollama和Anthropic模型的请求,更快的代码解释器输出,减少每条消息的一次数据库读取,以及加速技能、工具、文件访问检查、文件夹列表和文件夹加载。还修复了空闲实例持续高负载的问题(每秒扫描计时器),将在线状态的写操作限制为每人每分钟最多一次,并将请求处理层从五个减少到一个。
聊天搜索现在会查找包含所有词语(任意顺序)的对话,而不仅仅是精确短语匹配,精确的结果仍会优先显示,预览片段会指向匹配的词项。消息输入框的斜杠命令支持显示当前模型("/model")、通过ID切换模型("/model <id>"),并可直接从斜杠菜单打开模型选择器。
- 消息发送时如果文件尚未上传完成,现在会排队并在就绪后自动发送,而拒绝报错;每个排队的消息会显示其附件的进度。
- 终端文件浏览器新增搜索框(按文件名和内容匹配)、树状视图、右键菜单、隐藏文件显示、大小排序和文件夹展开功能。终端中的代理现在可以直接在回复中展示其创建的文件,并支持预览和下载按钮;新增设置控制文件是在回复中打开还是在文件面板中打开。模型展示的PDF、Word或幻灯片可以从特定页或幻灯片打开。
- 管理员现在可以通过终端对多个服务器连接(包括llama.cpp和LM Studio)执行下载、加载和卸载模型的操作。