资讯动态

Hermes WebUI 多模型管理与切换:3 步配好,会话内随时换

发布时间:2026/9/9 15:29:03 来源:尧图企业网站定制
Hermes WebUI 多模型管理与切换3 步配好会话内随时换【免费下载链接】hermes-webuiHermes WebUI: The best way to use Hermes Agent from the web or from your phone!项目地址: https://gitcode.com/GitHub_Trending/he/hermes-webui桌面同时挂着 OpenAI 和 Ollama 的 key要在三个标签页、三套客户端、三份配置之间来回切模型切换不该这么累。Hermes WebUI 是 Hermes Agent 的浏览器端它的多模型管理把所有提供商收进同一个模型选择器会话里随时可换。下面按真实使用顺序展开首启配置、会话内换模型、算成本账。 30 秒配好第一个模型首次启动 Hermes WebUI 会进入设置向导四步系统检查 → 选提供商 → 工作区与默认模型 → 可选密码走完就能开聊。向导按需要填多少信息把提供商分成三类快速开始OpenRouter、Anthropic、OpenAI只填 API Key 和模型。开放/自托管Ollama、LM Studio、自定义 OpenAI 兼容服务填Base URL和模型Key 可留空。专业Gemini、DeepSeek、Z.AI/GLM、xAI 等填提供商 Key 和默认模型。模型服务器不在同一台机器时Base URL 最容易填错# LM Studio / Ollama 与本机同机 http://127.0.0.1:1234/v1 # LM Studio http://127.0.0.1:11434/v1 # Ollama # Docker Desktop 里访问宿主机 LM Studio http://host.docker.internal:1234/v1注意 Docker 里的localhost指向容器自身而不是宿主机模型服务跑在容器外时别写 127.0.0.1。向导保存前会先探测Base URL/models端点成功后模型下拉框自动填充失败则卡在这一步直接告诉你失败原因——DNS 解析失败、连接被拒、超时或 HTTP 错误。更多细节见 onboarding 文档。 按任务挑模型4 个场景直接抄结论先行模型列表已经齐了问题在于选哪个。Hermes WebUI 的模型选择器按提供商分组展示所有已配置提供商的模型照下面四个场景选就行。写代码。选 Claude 系或 OpenAI Codex工具调用精准、推理链清晰适合多文件重构和定位疑难 bug。追求速度就把推理强度降到 medium。做创作。选想象力输出强的模型推理强度拉高到 high 或 xhigh让它多想一会儿这个场景质量优先于速度。跑本地。Ollama 或 LM Studio 指到本机数据不出机器Key 都不用配。内部文档、个人数据这类隐私敏感任务默认走这条路。控成本。日常问答挂便宜模型重要任务再切大模型月底打开 Insights 对账看看模型组合到底花在哪一档。 会话内换模型上下文不断Composer 底部的模型下拉是一个动态入口你做了什么、系统就响应什么点开模型下拉 → 列表不是静态文件系统从各提供商实时拉取新上线或下线的模型自动出现和消失整体按提供商分组。输入关键词 → 列表实时过滤直接跳到目标模型。对话中途切换模型 → 历史与上下文原样保留Hermes WebUI 发一条 toast 提示本次切换聊天头部同步显示当前模型与实时 TPS。原模型缺失或不可用 → 系统自动降级到安全默认模型composer 会标出正在生效的哪个默认值不用你自己猜。切到不属于当前提供商的模型 → 弹出提供商/模型不匹配警告防止请求被静默发错地方。切换的关键是上下文不断会话历史、工作区、记忆都挂在会话与档案上模型只是可替换的执行人随时换。 一套档案多副面孔Profile 隔离Hermes WebUI 支持多档案profile一台服务器挂多个独立人格每个档案有自己的提供商配置、模型列表、记忆、工作区和定时任务顶栏下拉切换时不重启服务模型列表、记忆、cron、工作区全部跟着刷新。给项目 A 用 Claude、项目 B 跑 Ollama的场景为两个项目各建一个档案分别配默认模型和工作区切换项目就是顶栏点一下。给团队分级的场景把不同档案分给不同成员.env 里的密钥按档案隔离互相切不到对方的凭证。并发场景也安全档案级的上下文 home 覆盖机制让并行 worker 不会互相踩配置。 模型掉链子时怎么办先别慌这几种情况 Hermes WebUI 都有兜底模型缺失或不可用自动降级到安全默认模型composer 明确标注正在生效的默认值对话不中断。提供商/模型不匹配toast 警告会话元数据会显示实际服务的模型与 failover 路径能看出请求去了哪。配额耗尽错误卡片展示详情例如 Codex 的配额错误卡片到 composer 换一个提供商的模型重试即可。流式中途断网SSE 通道按退避策略自动重连断开后可按会话重新拉取已有内容不丢。设置时探测失败向导直接拦住保存并给出具体错误——DNS 失败、连接被拒、超时、HTTP 错误或响应格式异常。更多诊断信息见 troubleshooting 文档。 看清花了多少钱、跑了多快Insights 面板就是账单。打开后先看四个数字会话数、消息数、token 总量、估算成本。下面一张每日 token 趋势图按输入/输出分色再往下是模型明细表每个模型的会话数、token 数、估算成本和占比谁贵谁便宜一目了然。速度也看得见聊天头部的 TPS 徽章随 token 流实时更新对比哪个模型快。系统状态同样在这里CPU、内存、磁盘占用是实时快照本地模型跑在哪个资源上是瓶颈时看一眼就知道。 排障速查模型列表为空先查Base URL是否以/v1结尾、是否可达Docker 内把localhost换成host.docker.internal或局域网 IP。点测试连接/models探测会给出具体失败原因。本地服务没开 KeyAPI Key 留空即可多数 Ollama / LM Studio 部署就是这样。切换失败目标模型不在选择器里说明该提供商的实时发现没返回它重新核对 Base URL。弹出不匹配警告换回该提供商分组内的模型。响应变慢看聊天头部 TPS 徽章确认慢在哪个模型。本地模型先确认是否同机网络有没有绕 Docker NAT。把推理强度从 high 降到 medium或换一个更轻的模型。外部改了 auth 文件不用手动清缓存刷新页面后模型选择器的数据会自动刷新。 进阶工具箱四步接入自定义 OpenAI 兼容端点在设置面板Providers区选择自定义/自托管类型填Base URL以/v1结尾和可选 API Key点测试连接通过即探测/v1/models成功、模型列表自动填充保存后新提供商的模型出现在所有选择器里。全程不用改config.yaml。参数composer 里有推理强度选择器low/medium/high/xhigh/reasoning命令可随时改设置面板还有最大输出 token 等参数。温度这类生成参数在 Hermes Agent 的config.yaml里配WebUI 负责模型选择与切换这一层。三套组合直接抄代码审查——Claude 低推理强度 专注工作区创意头脑风暴——高想象力模型 高推理强度本地隐私——Ollama 档案 无外部 Key。 路线图一瞥近期计划都围着模型管理本身转统一 WebUI/CLI/Gateway 三处的提供商与模型解析、为模型管理做独立模态框、档案与运行时模型对齐长期则是 Insights 监控套件做深以及把 Hermes WebUI 暴露为 MCP server。完整清单见 ROADMAP.md。✅ 三步走跑一遍 bootstrap 启动 Hermes WebUI走完四步向导选定第一个主力提供商。再加一个提供商比如 Ollama在会话里练一次不丢上下文的切换。打开 Insights 对账看哪个模型慢、哪个模型贵回头调默认模型和档案组合。第一步行完换模型就只是点一下下拉框的事。【免费下载链接】hermes-webuiHermes WebUI: The best way to use Hermes Agent from the web or from your phone!项目地址: https://gitcode.com/GitHub_Trending/he/hermes-webui创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

读完文章,也想定制专属网站?

尧图设计师 24 小时内与您沟通定制方案

免费获取报价