开源open-webui Releases·原文 2026年9月22日

Open WebUI v0.11.4发布:slim镜像缩至约 175 MB,终端技能与聊天内建技能成主线

这一版把slim镜像砍到约 175 MB、标准镜像减重约 170 MB,同时让终端服务器的技能进入统一技能菜单、模型能自动发现可用技能,并新增从聊天一键生成技能、终端多命令标签页和逐语言模型文案。

AI解读:Open WebUI v0.11.4是一次以镜像瘦身和终端/技能联动为主的更新。slim构建降到约 175 MB,比上一版小近 89%;标准镜像去掉了重复的Python、无人加载的字体、没人import的包和装包工具,减重约 170 MB。对自托管的人来说,这直接影响拉取时间和磁盘占用。

更实际的变化在技能系统。接入的终端服务器提供的技能现在会出现在所有选技能的地方(“$”“/”菜单、集成菜单、技能面板),并标注Terminal;模型即使只被告知技能存在,也能自己打开它。模型还开始自动看到所有可触达技能的名称和描述,只有决定使用时才加载全文——此前未在输入框选中的技能对模型是不可见的。

配合终端,模型每轮开始会读到该终端home目录下的AGENTS.md;在已有内容的聊天里输入“/skills:create”,能把刚走完的流程写成可复用技能,存到终端根工作目录的“.agents/skills”下。终端面板为模型运行的每条命令开一个标签页,文件浏览器也能整文件夹上传,并支持两文件并排比对差异。

其他值得留意的点:新增Staan作为面向欧盟部署的联网搜索选项,Exa结果可设字符上限;“X-OpenWebUI-Auth-Type”头会说明请求来自浏览器登录还是API key;登录页的表单可在认证设置里关掉,只留SSO或目录登录。

性能方面,聊天与知识库的文本搜索、模型对知识库执行的grep改为不阻塞其他请求;多人共享笔记的编辑流量减半,人越多越省;消息写入不再整段重写长对话。流式回复可用“ENABLE_CHAT_RESPONSE_STREAM_INPLACE_APPEND”启用CPython原地字符串拼接,默认关闭。

安全修复是这一版的推荐升级理由:官方表示包含安全与访问控制修复,并建议生产部署尽快更新,部分修复未在本版列出,以留给管理员升级时间。登录失败不再把身份提供商凭据写进应用日志,但更新说明中“身份提供商角色映射”条目在来源里未写完整。

Open WebUI发布v0.11.4。按发布说明,这一版新增了大幅缩小的slim镜像、更小的标准镜像,以及围绕终端服务器与技能系统的一批功能。

slim构建现在约为 175 MB,比上一版小近 89%,其中本地模型、其周边包以及安装它们的工具都被移除;发布说明称这一变化对实例行为的影响写在Changed一节和文档中。标准镜像则去掉了第二份Python、两套从未被加载的字体、无人import的包和装包工具,一个标准构建因此减少约 170 MB。

终端技能进入统一技能菜单,模型可自动发现技能

发布说明称,连接的终端服务器提供的技能现在会出现在所有挑选技能的入口旁边——包括“$”和“/”菜单、集成菜单和技能面板,每个都标有Terminal,使用方式相同:选中一个技能会把它的指令、文件夹和随附文件放到模型面前,而只是被告知某技能存在的模型可以自行打开它。这些技能跟随当前选中的终端,终端切换时清空。

模型现在会自动获得所有可触达技能的名称和描述列表,只有它决定使用时才加载完整文本;此前未在消息框选中的技能对模型不可见。这一行为适用于开启了内置工具的模型。

终端中的模型在每一轮开始时会被交给该终端home目录下的AGENTS.md,并每轮重新读取。

从聊天生成技能与终端操作界面更新

在已有内容的聊天中输入“/skills:create”,并选中终端,会把刚经历的工作流转化为可复用技能,写到该终端根工作目录下的“.agents/skills”,而不是shell恰好所在的文件夹,并按Open WebUI的技能标准编写。

终端面板现在为模型运行的每条命令提供一个标签页,与用户自己的shell并列,可以观看、切换并接手shell,每个标签页以产生它的命令命名。打开面板会进入一个标签页并在没有其他任务运行时启动shell,关闭最后一个标签页会收起面板。

终端旁的文件浏览器现在可以接收整个文件夹,通过拖放或菜单里的Upload Folder项,边传边重建其中的子文件夹;此前拖放只会上传顶层散落的文件。

在文件浏览器里选中两个文件会点亮Compare按钮,将它们并排或上下排列,标注行号,逐行标记新增和删除,精确到行内变化部分,并统计两边数量,还允许调换左右或忽略空白,且会记住该选择;终端版本过旧无法比较时会明确提示,而不是静默失败。

模型背景图、界面文案与语言相关能力

工作区模型现在可以携带背景图,在模型编辑器中上传,选中该模型时绘制在聊天背后,层级位于文件夹背景之下、个人背景之上,并会随模型导出导入一起走。

新安装会以界面所设语言提供建议提示词,而不是所有人都是同样的四条英文;模型默认值面板在其建议被编辑后提供了一个恢复默认的入口。

模型、工具、技能、函数、横幅或竞技场条目现在可以为名称、描述、起始提示词和阀门标签按语言各存一份,在各自编辑器的可搜索表格中填写或以JSON文件导入;若翻译丢掉原文填充的占位符,导入会被拒绝。界面按设定语言显示措辞,该语言没有翻译时回退到纯文本。

管理员现在可以在管理设置的面板中逐语言替换界面自带措辞,替换文本若丢掉原文填充的占位符会被拒绝。

搜索、认证与文件元数据

通过Exa进行的网页搜索可以限制每条结果的字符数,在管理员网页搜索设置中其密钥旁设置,或使用“EXA_MAX_CONTENT_LENGTH”。

Staan现在可作为网页搜索提供商,为需要搜索在欧盟境内的部署提供一个无需自托管的选项,通过管理员网页搜索设置或“STAAN_API_KEY”“STAAN_MARKET”“STAAN_MAX_SNIPPETS”配置。

请求OpenAI或Ollama连接时现在会带上“X-OpenWebUI-Auth-Type”,说明请求者是通过浏览器登录还是用API key调用;该名称由“FORWARD_USER_INFO_HEADER_AUTH_TYPE”设置,“{{AUTH_TYPE}}”可用于自定义头。

登录页上要求邮箱和密码的输入框现在可以从认证设置中移除,此前只能在服务器启动前设定,移除后由单点登录或目录来登录用户。

上传文件的元数据现在会随该文件被切分出的片段一起走,并随检索到的来源返回,过大的和内部的字段被排除;运维人员可在“RAG_SOURCE_METADATA_KEYS”中指定模型能随文本一起看到哪些字段。

性能、开销与搜索行为

对聊天与知识库文本的搜索,以及模型对知识库执行的grep,现在与服务器其余部分并行运行,而不是挡在前面,长时间搜索不再让其他请求排队等待。

多人同时编辑的笔记不再把每次按键按每个查看者回传给服务器;发布说明称两个编辑者之间流量减半,加入的人越多还会继续下降,共享笔记在人多时仍保持流畅。

在多个服务器通过Redis共享websocket流量的部署中,聊天请求不再为了查询少数模型而从Redis拉取整个共享模型列表;每个worker保留自己的副本,只会在列表确实变化时重新拉取,成本不再随配置的模型数量增长。

写入或读取单条消息不再加载、检查并重写整个对话来改动几百字节,因此向长对话流式写入不再越长越贵;发布说明称在数千条消息的对话上,一条消息事件的整个往返成本降到一小部分。

流式回复可以用CPython的原地字符串追加来拼装,通过“ENABLE_CHAT_RESPONSE_STREAM_INPLACE_APPEND”开启,在逐步铺开期间默认关闭。

安全修复与其他更新

发布说明包含一条安全公告:本版包含安全与访问控制修复,建议生产部署尽快更新;并非本版所有安全修复都会在修复章节列出,部分可能暂时保留,以给管理员升级时间。

使用身份提供商登录中途失败时,不再把它收到的凭据写进应用日志,而是记录提供商和其报告的错误。

发布说明中“登录角色映射”一条称,身份提供商发送的角色在某些设置下未被应用,导致账户停留在默认角色;该条目在来源中被截断,未给出完整处理结果。

信息来源