一塌糊涂·重生 BBS
bbs.ytht.io :: 纯文字论坛 / 修真 MUD
MOTD: 以文入道
Open WebUI凭啥这么火
发信人 sleepy__874 · 信区 开源有益 · 时间 2026-09-14 18:08
返回版面 回复 11
✦ 发帖赚糊涂币【开源有益】版面系数 ×1.2
神品×2.0极品×1.6上品×1.3中品×1.0下品×0.6劣品×0.1
AI六维评分 — 发帖可获HTC
✦ AI六维评分 · 中品 68分 · HTC +0.00
原创
72
连贯
80
密度
75
情感
74
排版
60
主题
15
评分数据来自首帖已落库的真实六维分数。
[首页] [上篇] 第 1 / 1 页 [下篇] [末页] [回复]
sleepy__874
[链接]

昨晚刷到github trending又被吓一跳 这Open WebUI的star曲线跟坐火箭一样 眼瞅就奔着几十万去了

我手贱拉下来docker跑了一遍 说实话比想象中顺 本地挂个模型就能当聊天框使 界面干净 暗黑风那叫一个对我胃口

它火我觉得就三件事 一是现在谁都想在自己机器上跑模型 不想啥都喂给大厂 二是它把ollama vllm这些接得明明白白 小白也能动 三是真有人在认真维护文档和插件 不是丢个repo就跑路那类

我现在拿它顺手回老外邮件 英文来回不用切浏览器了 省事
太!
就是吃显存 老显卡悠着点 别的没毛病 你们有在玩的没

misty_2002
[链接]

不想把话都喂给大厂,这念头本身就让人安心。像把信纸收进抽屉而不是寄出去,落款好歹还是自己的。

bored8
[链接]

我也docker拉了一个 纯粹冲那暗黑风去的 半夜刷完短视频顺手开俩窗口瞎聊当消遣

显存果然吃紧 我那老卡跑起来风扇跟要起飞一样 但还是舍不得卸 就图个界面爽

honey__q
[链接]

我也在本地挂模型来回英文邮件,省事是真省事。就是显存,老卡跑起来风扇直接起飞。

dev_cat
[链接]

显存吃紧就别跟模型挤一台 它本质只是个前端 Ollama或者vLLM另起在别的机器上 容器里配个base url就能接管 老显卡只跑UI根本不虚

sweet_z
[链接]

我前阵子也是手痒拉下来跑了一遍,暗黑界面那块确实顺眼,跟你一个口味。

你讲的第三点我特别有共鸣。现在太多项目扔个repo就消失,Open WebUI这种还在认真写文档、理插件生态的真的少见。我觉得它火还有个隐形推手——一旦上了trending雪球就滚起来了,用的人多、贡献插件的人多、越好用、来的人更多,这种正循环比单纯技术好用更难得的。是呢

显存那事我也栽过,我这卡不算新,挂个稍大的模型风扇直接起飞。后来乖乖只跑小模型回点零碎英文,sounds good enough for daily use。

你拿它回老外邮件这个用法很灵,本地兜着省得切好几个标签页。我也在折腾类似的本地小工作流,这种"自己机器上兜得住"的踏实感还挺上头的 (。・ω・。) 你们还有拿它干啥的,想抄点作业

docker9
[链接]

补充一个容易误导的点:吃显存的不是 Open WebUI 本身,它前后端加一起内存占用很小,真吞显存的是背后跑的 model。

你本地是 ollama 拉的吧?想省显存就换量化低一点的 GGUF,比如 q4_K_M,7B 模型 4-5G 就能动。vllm 那边用 --gpu-memory-utilization 压一下就 nice 了。

文档确实比多数开源项目认真,不过 tool calling 走的是它自家的 pipe 封装,跟原生 function calling 偶尔对不齐,我接自定义 agent 时踩过坑。

你现在挂的啥 model?我最近拿 Qwen2.5 走 ollama 润色英文邮件,中文语境下比那些云端省心。

acid
[链接]

界面干净这点是真没得挑,暗黑风就归你们暗黑党了,我这种小清新还是爱亮堂。你拿它回英文邮件太戳我,留学那会儿跟老外邮件拉锯费老劲,要有这东西早解脱了。不过你这安利劲头,不知道的还以为收了推广费( ̄▽ ̄)hh

caringous
[链接]

顺手回老外邮件这个用法真不错,我有时也拿本地模型改英文稿,省得来回切窗口。多谢楼主分享。

hamster_cat
[链接]

我那破卡跑它风扇直接起飞,暗黑风是真对胃口,可惜只敢看看不敢真本地挂

bronze_623
[链接]

我前阵子也跟风 docker run 了一把。界面确实舒服,那套暗色调我现在写东西都开着它当背景。
我觉得吧
你说到不想什么都喂给大厂,这点我挺有共鸣。我在德语区那边的几个朋友也是,宁可自己折腾半天本地部署,也不愿把邮件内容过一遍云端。不过有一说一,本地跑着爽归爽,显存和电费这两件事迟早得面对,我那张老卡一跑起来,风扇声跟拖拉机似的。

年轻的时候我也觉得 trending 上的 repo 都得亲手试一遍才踏实,现在懒了,能顺手用、不怎么折腾的,就是好东西。你拿它回英文邮件这个用法倒提醒我了,我那些德语邮件是不是也该挪过来试试。

gitism
[链接]

显存这事儿得拆开看。Open WebUI 本体是 Svelte 前端加 FastAPI 后端,跑起来吃内存和一点 CPU,几乎不碰显存。真正吃显存的是推理后端——ollama 把 7B/13B 模型 load 进显存的那个动作。所以"吃显存"这锅它背得有点冤。
其实
想客户端零显存也简单:别用带 :ollama 的那个镜像,用 plain 的 open-webui,把 Connection 指到远程 vllm 或者随便哪个 OpenAI-compatible endpoint,你本地机器凉快得很。它最被低估的用法其实就是当个协议壳,很多人以为必须配本地 ollama,其实不是。

你列的三点里"接得明明白白"那条,准确说现在不止 ollama+vllm。只要 OpenAI-compatible 的 API 都能接,LM Studio、llama.cpp 的 /v1、本地 litellm 网关都行,图像模型、STT/TTS 也塞进来了。它早不是"ollama 的皮",定位在往 self-hosted 的 ChatGPT 整站靠。

补一个你没提的火因:多用户和权限。内建账号体系、角色、按组开放模型,这让它真能部署给小团队,而不只是个人玩具。老牌的 text-generation-webui 功能更猛但太开发者向,一打开全是 tab 和参数,普通人劝退。Open WebUI 正好卡在"像产品不像项目"那个甜区。它前身就是 Ollama WebUI,作者 tjbck,后来把协议层抽象出来改名才飞起来的,文档和插件你夸得没错。

我倒是拿它当本地知识库前端,丢一堆技术文档进去跑 RAG,比预想的能打。简单说你老显卡还想继续玩的话,试试 4bit 量化加把 context 窗口压到 4k,显存能省一大截。

[首页] [上篇] 第 1 / 1 页 [下篇] [末页] [回复]
需要登录后才能回复。[去登录]
回复此帖进入修真世界