尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

Hermes WebUI多模型切换:完整指南

Hermes WebUI多模型切换:完整指南 Hermes WebUI多模型切换完整指南【免费下载链接】hermes-webuiHermes WebUI: The best way to use Hermes Agent from the web or from your phone!项目地址: https://gitcode.com/GitHub_Trending/he/hermes-webuiHermes WebUI 的模型管理功能让你在一个网页界面里同时配置 OpenAI、Anthropic、Ollama、LM Studio 等提供商并在会话中随时切换。它适合需要在多个 AI 模型之间频繁切换、又不想手动管理一堆密钥和接口的人。 用多个AI模型你中过这些招吗这一节回答一个问题为什么值得把多个模型收进同一个入口。写代码的时候想换 Claude Code得切到另一个工具重新登录处理隐私敏感的数据想改用本地 Ollama 模型又得自己改 Base URL改完还不知道能不能通OpenRouter 的额度用完了只能切回 OpenAI 重新粘贴密钥。每个模型一套密钥、一个界面、一种请求格式一个任务来回切换三四次是常事。Hermes WebUI 把这些收拢到一个入口密钥配置、模型列表、会话内切换都在同一个网页里完成。下面从跑通第一个模型开始讲到日常的自动化用法。 3步跑通你的第一个模型从打开浏览器到发出第一条消息三步就够用时不超过 5 分钟。第一步在初始设置向导里选提供商。首次启动会出现向导提供商分三类快速开始OpenRouter、Anthropic、OpenAI填 API 密钥即可、自托管/开源Ollama、LM Studio、任意 OpenAI 兼容服务需要 Base URL、专业提供商Gemini、DeepSeek 等。任选一类进入下一步。第二步给本地模型填对 Base URL。自托管模型成败就在这个字段。两个常用地址# LM Studio与 WebUI 同一主机 http://127.0.0.1:1234/v1 # Ollama与 WebUI 同一主机 http://127.0.0.1:11434/v1第三步确认模型下拉列表能加载。配置完成后向导会自动探测base-url/models端点。探测成功模型下拉列表就会填满该提供商的可用模型此时可以直接发消息。完整流程参考官方文档。 日常用得最多的4个操作配置完成后日常 90% 的模型使用只靠下面 4 个操作。从动态模型列表里快速找到合适的模型什么时候用开新会话、准备发消息之前。点开输入框底部的模型选择器列表是实时从各提供商 API 拉取的按提供商自动分组每个模型旁边能看到配额与可用状态。输入几个字符即可过滤几秒内定位目标不用翻长列表。会话中途切换模型不丢上下文什么时候用任务从写文案变成调代码或者高价模型额度见底的时候。直接在输入框底部的模型下拉里换一个模型继续发消息之前的对话上下文原样保留不需要重开会话重述背景。在设置面板里管理和测试提供商什么时候用新加提供商、更换过期密钥、或者怀疑某条配置有问题的时候。路径是 Settings → Providers。每个提供商是一张卡片卡片上直接标注模型数量和密钥状态绿色 API key configured 徽章表示该提供商已就绪。展开卡片可以编辑 Base URL、密钥并测试连接确认无误再保存。用多配置文件隔离不同工作的模型配置什么时候用主项目和试验新模型想分开管理的时候。Hermes WebUI 支持多个 Profile配置文件每个 Profile 有独立的模型设置和 workspace。在输入框底部的 Profile 切换器里换到另一个配置提示词、模型列表会整体跟随切换主配置不会受到试验操作的干扰。 两个值得打开的开关自动切换和使用洞察基础操作熟练后这两个功能能让模型管理从手动走向半自动。自动切换把选哪个模型交给系统。Hermes WebUI 会按任务类型给出倾向代码任务推荐 Claude Code 或 GPT-4 系列创意写作推荐 Claude 3 系列简单问答推荐更便宜的模型。故障转移也是内置的——连接超时时自动重试或转备用提供商配额耗尽时切到同一提供商的其他模型API 报错时按错误类型选择恢复路径。使用洞察搞清楚钱花在哪。打开侧边栏的 InsightsUsage Analytics 页面汇总最近 30 天的会话数、消息数、总 token 和估算成本下面的 Daily Tokens 图按天分布Models 表格按模型拆开哪个模型占了几成花费、每个模型多少 session一目了然。同一页面下方的 System health 区块显示服务器 CPU、内存、磁盘的实时占用。模型慢的时候先在这里区分是模型侧的问题还是机器资源的问题再决定下一步动作。 卡住了照着这份自救清单查绝大多数模型问题落在三类症状里按顺序勾选动作即可不用先重启服务。症状一模型列表为空。检查 Base URL 是否带/v1结尾、有没有多输一层路径确认网络可达本机应能访问base-url/models重新粘贴 API 密钥然后翻服务端日志看具体报错症状二切到新模型后发送失败。检查目标模型的配额和权限是否足够确认会话上下文与新模型兼容不同模型的输入格式要求可能不同换同一提供商的另一个模型试一次判断是模型问题还是提供商问题症状三响应明显变慢。打开 Insights 看该模型的延迟是否持续升高调低最大 token 数或换更小的模型在 System health 里排除 CPU、磁盘占满的情况更完整的排查步骤在故障排查文档。⚙️ 进阶玩法让模型管理自动跑起来习惯手动操作之后这三件事可以把模型管理变成半自动。模型参数调优。每个模型都能单独设置温度、最大令牌数、频率惩罚、存在惩罚。同一个模型温度 0.2 和 0.8 的输出风格完全不同前者收敛、后者发散按任务调好一次就能长期复用。预设会话模板。给高频场景固定一套模板代码审查会话锁定 Claude Code、温度 0.2创意写作会话用 Claude 3 Opus、温度 0.8数据分析会话用 GPT-4 并启用代码解释器。下次开始新任务时选模板即可不必每次重挑模型和参数。接入自定义 OpenAI 兼容提供商。只要目标服务兼容 OpenAI 接口就能接在设置里添加自定义提供商填端点 URL 和认证信息测试连接后保存它的模型随后会自动出现在模型选择器中。现在就做三件事先添加两个不同类型的提供商例如一个云端的 OpenRouter 加一个本地的 Ollama再在一个真实会话里切换一次模型确认上下文没有丢失最后打开 Insights把最近 30 天各模型的 token 占比和成本看一遍。做完这三步下一次该用哪个模型、花了多少钱数据里都有答案。【免费下载链接】hermes-webuiHermes WebUI: The best way to use Hermes Agent from the web or from your phone!项目地址: https://gitcode.com/GitHub_Trending/he/hermes-webui创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表