Agent Zero 从启动到自建工具:AI 智能体的完整使用路径
【免费下载链接】agent-zeroAgent Zero AI framework项目地址: https://gitcode.com/GitHub_Trending/ag/agent-zero
你希望把一件完整的活甩给 AI:自己上网查资料、读你的文档、执行代码、下次接着上次的进度干,而不是每句话都你复制粘贴。Agent Zero 就是为这种用法做的开源 AI 智能体框架,核心是它的工具系统:查网页、读文档、操作浏览器、执行代码、存记忆、派子代理,全部是现成工具,而且你可以往里加自己的。
🐳 最短路径:把 Agent Zero 跑起来
最快的方式是 Docker。打开 Docker Desktop,在镜像市场搜 agent-zero,点 Pull 拉取,再点 Run 启动,配置好端口映射,浏览器打开本地地址,聊天、工具调用、设置面板都在同一个界面里。
不装环境、不配依赖,两分钟能用。不想用 GUI 的话,一条docker run命令也可以直接起容器。
有一个事实值得记住:Agent Zero 的工具不是写死在代码里的,而是 tools/ 目录下的独立文件。框架启动时扫描这个目录,文件在就能用,不注册、不配置。这是后面你能自己加工具的基础。
📋 第一次派活:先甩哪几类任务
不用背文件列表,按"你想让它干什么"对号入座:
| 你想让它做的事 | 对应工具,以及它替你省下的事 |
|---|---|
| 上网查实时信息 | search_engine.py,省掉你开浏览器搜一圈再粘贴 |
| 检索文档内容 | document_query.py,直查文件,不靠智能体"记得" |
| 理解你贴的图片 | vision_load.py,截图丢进去就能分析 |
| 操作网页 | _browser插件,打开页面、点击、抓 DOM,"帮我看看这页"变成动作 |
| 跑代码和定时任务 | _code_execution插件、scheduler.py,代码安全执行、任务到点自动跑 |
| 跨会话记住上下文 | _memory插件,换聊天窗口也不丢进度 |
| 多代理分工 | a2a_chat.py智能体互聊、call_subordinate.py派活给子代理、parallel.py并行推进,主智能体只盯结果 |
建议第一次派活就用上面这种具体任务,比如"用浏览器调研三个方案并汇总取舍",比闲聊更能看出工具系统的实际效果。
🔨 扩展它的能力:三步加一个新工具
写自建工具只要三步。
先建文件:在 tools/ 下新建my_tool.py,继承Tool基类(契约在 helpers/tool.py),核心是实现一个async def execute(...),把结果以Response交还给智能体:
class MyTool(Tool): async def execute(self, **kwargs) -> Response: ...然后完事。动态发现机制会把新文件加载进来,不用改任何注册表。最后在 Web 界面里让智能体调一次它,确认返回符合预期。
要改变现有行为,走扩展或插件。扩展放在 extensions/python/,按生命周期阶段分目录,文件名数字前缀决定执行顺序,比如system_prompt/管系统提示词组装,message_loop_prompts_after/管每轮注入的上下文(当前时间、智能体信息都从这里塞进去)。官方建议的顺序是能做成插件就别做扩展:插件更好建、好测、好删;只有要在特定生命周期点插手时才写扩展。
⚙️ 三个参数按什么顺序调
设置页按这个顺序动,每改一项就用同一个任务对比前后输出。
先定聊天模型。温度、上下文长度都在这一层,所有工具输出的质量都压在模型上,这是地基。再配 Agent 的角色设定与行为边界,模型定了,再决定它"是个什么样的人"。最后才动单个工具的开关和输出详略,改动小、见效快。
🧭 常见翻车点
四个新手最容易踩的:把工具当插件做,工具只是给智能体多一个能力,要改界面或完整功能该走插件;一个工具塞太多事,每个工具只管一件事,好维护,智能体也好选;改了不测,没有对比就没有"改好了";不写说明,项目里每个工具都配了同名.dox.md文件,照这个习惯来。
下一步建议:先按上面的顺序跑通一个场景,再写第一个小插件,然后尝试扩展改生命周期行为,最后把工具系统吃透。版本更新很快,docs/guides/里的新指南值得常回来看。
【免费下载链接】agent-zeroAgent Zero AI framework项目地址: https://gitcode.com/GitHub_Trending/ag/agent-zero
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考