资讯动态

Hermes WebUI 多模型切换完全指南:云端与本地模型一个界面管起来

发布时间:2026/9/9 15:07:34 来源:尧图企业网站定制
Hermes WebUI 多模型切换完全指南云端与本地模型一个界面管起来【免费下载链接】hermes-webuiHermes WebUI: The best way to use Hermes Agent from the web or from your phone!项目地址: https://gitcode.com/GitHub_Trending/he/hermes-webui本文讲 Hermes WebUI 的多模型功能从零配置第一个模型、接入 Ollama 这类本地模型、在会话中切换模型、查看用量。跟着做你自己就能完成模型配置和切换。场景一个模型不够用你在写代码希望用云端大模型保证质量但你又有一些隐私数据不想发到外部 API。或者云端的额度快用完了手头正好有一台跑着 Ollama 的机器。以前你得开两套工具、来回复制上下文。Hermes WebUI 的做法是把多个模型提供商可以理解为模型服务方如 OpenAI、Anthropic、Ollama配置在同一个界面里会话进行中随时换模型对话上下文不丢失。快速上手5 分钟配好第一个模型前提一台能跑 Linux、macOS 或 WSL2 的机器以及一个提供商的 API 密钥。获取代码并启动git clone https://gitcode.com/GitHub_Trending/he/hermes-webui hermes-webui cd hermes-webui python3 bootstrap.py按终端输出的地址打开浏览器会进入初始设置向导。选提供商分三组信息量不同快速开始OpenRouter、Anthropic、OpenAI填密钥选模型即可。自托管/开源Ollama、LM Studio、自定义端点需要填 Base URL。专业提供商Gemini、DeepSeek、小米 MiMo 等填专属密钥。选一个工作区目录会话的文件存放位置可选设密码完成。向导会把密钥写入 Hermes 的.env文件、把默认模型写入config.yaml不用手动改配置。细节见 初始配置指南。完成后输入框底部的模型下拉框里就是可用的模型。核心能力拆解动态模型选择器它能做什么从已配置提供商的 API 实时拉取模型列表按提供商分组显示并标注每个提供商配置了多少个模型。怎么操作点输入框底部的模型下拉框选一个模型下一条消息就用新模型发出。会话不用关上下文保留。什么时候用对话中途换口味比如长文用大模型、追问用快模型或者额度告急时切到备用模型。如果某个会话原来的模型失效了密钥过期、模型被下架选择器会自动回退到一个可用的默认模型对话不中断。提供商管理面板它能做什么在设置面板里查看所有提供商的配置状态、模型数量更新 API 密钥和 Base URL测试连接。怎么操作点侧边栏底部的设置入口进入 Providers 页。每个提供商是一个折叠卡片显示X 个模型 · 已配置/未配置和密钥状态。什么时候用接新提供商、换密钥、排查模型列表拉不到的问题时。本地模型接不通先在这里点测试连接错误会直接显示在卡片里DNS 失败、连接被拒、超时等。多配置文件隔离它能做什么每个配置文件Profile有独立的模型、工作区与会话。比如工作档案用 GPT 系列写作档案用 Claude。怎么操作输入框底部的档案下拉框切换即可切换后模型和工作区下拉框会跟着更新。什么时候用一个 Hermes 服务同时服务多个项目或团队又不想互相污染配置。完整任务演示接入本地 Ollama 模型下面从一个只配了云端模型的状态走完整接入 Ollama 并验证的流程。确认 Ollama 正在运行终端里ollama list能看到模型。打开设置面板进入 Providers找到 Ollama 卡片填入 Base URLhttp://127.0.0.1:11434/v1 # 与 Ollama 同一台机器 http://局域网IP:11434/v1 # Ollama 在另一台机器点测试连接。成功后模型下拉框自动填充选一个模型作为默认。回到聊天页输入框底部把模型下拉框切到这个 Ollama 模型。发一条测试消息确认回复来自本地模型。打开 Insights 面板确认这个模型的 token 用量开始被单独统计。全程不需要重启服务也不需要改代码。避坑指南现象Docker 里测试连接报连接被拒绝同一台机器上手动访问却正常。原因容器内的localhost指向容器自己不是宿主机。 解决Docker Desktop 用http://host.docker.internal:11434/v1Linux Docker 在 Compose 里加extra_hosts别名后改用别名地址。详见 Docker 部署文档。现象换了 API 密钥后选择器里的模型列表还是旧的。原因模型列表有缓存不会每次展开都去拉。 解决关闭再展开选择器或在设置面板里触发刷新缓存失效后会重新拉取。现象测试连接失败模型下拉框是空的。原因Base URL 指向的不是 OpenAI 兼容的 API 根路径或鉴权信息没配对。 解决看测试连接的行内报错按提示分类处理URL 必须以/v1结尾。仍解决不了翻 故障排查文档。进阶技巧用量分析控成本Insights 面板按模型统计会话数、token 量、估算成本和占比能直接看到哪个模型花掉的钱最多。本地 云端混合日常问答、隐私数据走本地 Ollama重活走云端大模型靠会话内切换完成不用改任何配置。按档案分模型用 Profile 把日常和项目隔离开各自的默认模型、工作区独立切换零成本。收尾记住三件事模型选择器在输入框底部随时能换提供商管理在设置面板接不通就先测连接Docker 环境下localhost是最大的坑。下一步打开设置面板的 Providers 页给一个还没配置的提供商点一次测试连接——这一步做完你就掌握了 Hermes WebUI 多模型管理的全部入口。【免费下载链接】hermes-webuiHermes WebUI: The best way to use Hermes Agent from the web or from your phone!项目地址: https://gitcode.com/GitHub_Trending/he/hermes-webui创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

读完文章,也想定制专属网站?

尧图设计师 24 小时内与您沟通定制方案

免费获取报价