告别「SSH 客户端 + 记事本 + 聊天框」三开:我做了一款 AI 运维工作台 Mini Assistant
文章目录
- 告别「SSH 客户端 + 记事本 + 聊天框」三开:我做了一款 AI 运维工作台 Mini Assistant
- 一、写在前面
- 二、它能帮你做什么?
- 1. 用中文说需求,助手去执行(可审批)
- 2. 多 Agent 角色,按场景切换
- 3. 终端 + 文件同屏(少开一个 Xftp)
- 4. 会话绑定服务器,状态一目了然
- 5. 执行结果能看懂:Markdown + 图表 + 持久化日志
- 6. 工作流:把重复部署固化下来
- 7. 网页 / 桌面一体,数据在你自己机器上
- 三、和传统 SSH 客户端差在哪?
- 5 分钟跑起来
- Mock 模式(无需 API Key,先体验流程)
- 四、接本地大模型(Ollama 示例)
- 五、桌面免安装包(Windows)
- 六、架构一览(给爱看代码的同学)
- 七、适合谁?不适合谁?
- 八、结语
适合人群:运维 / 后端 / 全栈 / 想自托管 AI 助手的开发者
—
一、写在前面
不知道你有没有这种日常:
- Xshell / FinalShell 连服务器敲命令
- Xftp / WinSCP 再开一个窗口传文件
- ChatGPT / 本地大模型窗口里问「这段报错怎么排查」
- 再把答案复制回终端……
窗口切来切去,上下文碎成三份。
命令在终端,文件在 SFTP,思路在聊天框——人成了中间件。
于是我做了Mini Assistant:把AI 对话 + SSH 终端 + 远程文件 + 部署工作流揉进同一套本地工作台。
网页能跑,也能打成 Windows 免安装 exe;模型可用 Mock、Ollama,或任意 OpenAI 兼容接口。
一句话:不是又一个 SSH 客户端,而是能「说人话干活」的运维助手。
二、它能帮你做什么?
1. 用中文说需求,助手去执行(可审批)
例如你说:
- 「看一下磁盘和内存占用」
- 「nginx 服务状态怎么样」
- 「在服务器上执行
df -h」
助手会发起工具调用(如ssh_run),先弹出审批卡片,你点「批准」才真正执行。
写文件、跑命令、抓网页、远程操作——高风险动作默认要你点头。
这不是让 AI 乱来,而是:AI 拟计划,人掌握最终确认权。
2. 多 Agent 角色,按场景切换
顶栏可切换会话人设(落盘到会话,换会话不丢):
| Agent | 适合场景 |
|---|---|
| 默认助手 | 沙箱文件、白名单命令、抓取、可选 SSH |
| 运维 Agent | 远程巡检:磁盘 / 进程 / 服务状态 |
| 排障 Agent | 日志、端口、只读取证,修复需二次确认 |
| 发布 Agent | 发版核对,引导走工作流而不是一次性塞脚本 |
同样一句话「帮我看看服务器」,不同 Agent 的工具白名单和提示词不一样,回答更聚焦。
3. 终端 + 文件同屏(少开一个 Xftp)
- 多标签交互式 SSH(xterm)
- 右侧远程文件浏览器:本地 | 远程双栏
- 终端
cd与文件树双向跟随 - 上传 / 下载 / 拖拽 / 目录 zip / 同步预览
连上机器之后,敲命令和传文件不用再切软件。
4. 会话绑定服务器,状态一目了然
每个会话可绑定一台机器:
- 侧栏会话列表显示关联服务器
- 选中会话时显示连接状态(已连接 / 连接中 / 未连接)
- 顶栏可筛选全部服务器,选中后自动探测连接
换会话 = 换工作上下文,不再「我到底在操作哪台机」。
5. 执行结果能看懂:Markdown + 图表 + 持久化日志
- 助手回复支持标题、列表、加粗、代码块、表格
df/free/uptime/ps等数值结果可自动配柱状图、环形图、仪表盘- 右侧「执行日志」按步骤落盘:可查阅、展开、导出 txt/JSON、单独删除
对话可以清空,关键操作轨迹还能留着复盘或交接。
6. 工作流:把重复部署固化下来
支持 ComfyUI 风格节点图,也支持手动录制步骤生成流程。
复杂发版(构建 → 打包 → 上传 → 远程命令 → 健康检查)不必每次在聊天里手搓一整段脚本。
7. 网页 / 桌面一体,数据在你自己机器上
npm run dev:浏览器打开即用npm run desktop:Electron 开发窗口npm run dist:portable:打出免安装 Windows 单文件
会话、SSH 配置、工作流、日志都落在本机目录;密钥加密存储,前端不回显秘密。
适合个人自托管,也适合小团队内部分发 exe。
三、和传统 SSH 客户端差在哪?
| 维度 | 传统 SSH 客户端 | Mini Assistant |
|---|---|---|
| 交互 | 人敲命令 | 对话 + 终端都能用 |
| 文件 | 常另开 SFTP 软件 | 终端旁同屏双栏 |
| 风险控制 | 靠习惯 | 工具审批后再执行 |
| 部署 | 脚本 / 记忆 | 可编排工作流 |
| AI | 无 / 外挂聊天 | 原生工具循环 |
| 形态 | 多为桌面商业软件 | 网页 + 免安装包,可自托管 |
如果你只需要「连得稳、会话多」,专业 SSH 客户端仍然很强。
但如果你希望少切窗口、少背命令、少靠记忆拼流程,Mini Assistant 更对口。
5 分钟跑起来
Mock 模式(无需 API Key,先体验流程)
gitclone<你的仓库地址>cdmini-assistantcp.env.example .env# 默认 MOCK_MODE=truenpminstallnpmrun dev浏览器打开:http://127.0.0.1:5173
试试:
- 「列出 sandbox 目录」
- 「执行 date」
- 「在服务器上执行 df -h」(Mock 下也会走审批演示)
四、接本地大模型(Ollama 示例)
在应用「设置」里关掉 Mock,填入:
- Base URL:
http://127.0.0.1:11434/v1(按你的 OpenAI 兼容地址调整) - Model:如
qwen2.5/qwen3等 - API Key:无则可填占位
保存后即可用真实模型驱动工具调用。
五、桌面免安装包(Windows)
npm install# 先关掉正在跑的 Electron 窗口,再打包npm run dist:portable产物在release/:拷走Mini Assistant-Portable-*.exe双击即可,内嵌后端,不必另起npm start。
六、架构一览(给爱看代码的同学)
浏览器 / Electron │ React UI(Vite) │ SSE 聊天 + REST + WebSocket 终端 ▼ Express 后端 ├─ 会话落盘(data/sessions/) ├─ 执行日志(data/session-logs/) ├─ LLM 适配(OpenAI 兼容 / MOCK) ├─ 多 Agent 工具白名单 ├─ 工具循环 + 审批 ├─ SSH 目标 / 终端 / SFTP ├─ 工作流引擎 └─ sandbox + 命令白名单技术栈大致是:React + Vite + Express + ssh2 + xterm + Electron。
安全上:沙箱路径防穿越、命令结构化白名单、SSH 密钥本机加密、审批门控。
七、适合谁?不适合谁?
适合:
- 经常 SSH 管几台~几十台 Linux,又想引入本地大模型的人
- 想把「巡检 / 排障 / 小发版」流程产品化的小团队
- 喜欢自托管、数据不出自己机器的开发者
暂时别指望它替代:
- 超大规模堡垒机 / 审计合规平台
- 只追求极致终端体验、复杂端口转发与串口场景的专业客户端
它更像:AI 时代的本地运维工作台雏形——能用、可扩展、你可以继续在上面长业务。
八、结语
大模型已经很会「说」,真正难的是安全地让它「做」。
Mini Assistant 的取舍很明确:
- 能对话,也能开终端
- 能代操作,但关键步骤要你批准
- 能图表和日志复盘,也能工作流固化重复劳动
- 能网页演示,也能 exe 发给同事
如果你也烦「三窗口运维」,欢迎试用、提 Issue、一起改。
评论区可以聊聊:你最希望 AI 自动帮你干的运维动作是哪一类?