什么是 AI Agent
AI Agent 可以理解为一个不只“回答问题”,还可以在你的允许下读取文件、修改内容、运行工具并连续完成任务的 AI 助手。
先分清六个常见概念
Section titled “先分清六个常见概念”Agent
你实际操作的工具,例如 Codex 或 Claude Code。它负责理解任务、规划步骤并使用工具。
模型
Agent 背后的智能能力。不同模型在理解、速度、价格和擅长任务上会有区别。
API
Agent 与模型服务沟通的方式。API Key 用于确认你有权使用这个服务。
工具调用
Agent 在你授权后读取文件、搜索内容、执行检查或修改项目的过程。
生成式 AI / 大语言模型(LLM)
生成式 AI 可以生成文字、代码、图片或其他内容;LLM 是专门处理语言的模型。它们提供“理解和生成”的能力,但不自动拥有你的文件、账号或最新资料。
Skill
一套可复用的知识、步骤、模板和判断规则,让 Agent 在某类任务中少走重复流程。Skill 不是模型,也不会自动绕过权限。
MCP
Model Context Protocol 是连接 AI 应用与外部工具、资源的一种开放协议。通过 MCP 连接能力时,仍要检查来源、权限和数据范围。
Agent 是怎样完成任务的
Section titled “Agent 是怎样完成任务的”可以把一次会话简化成:
理解目标 → 查看上下文 → 制定步骤 → 调用工具 → 检查结果 → 汇报或继续真正可靠的使用方式不是“把所有事情交给它”,而是让它在关键节点展示计划、范围、风险和验证结果。你仍然负责确认需求、授权敏感操作和检查最终结果。
它和普通聊天有什么不同
Section titled “它和普通聊天有什么不同”普通聊天主要返回文字;Agent 可能在你的工作目录中读取和修改文件,甚至访问外部服务。因此第一次使用要特别关注:
- 当前工作目录是否正确;
- 允许读取和修改的范围;
- 哪些动作需要逐次确认;
- 失败后怎样恢复;
- API Key 和私人资料是否会被发送。
它适合做什么
Section titled “它适合做什么”- 理解和整理已有项目;
- 修改代码、文档或配置;
- 排查错误并提出修复方案;
- 按明确规则重复处理多个文件;
- 先制定计划,再分步骤完成复杂任务。
Agent 不是自动正确的。重要修改前应保留备份或使用版本管理,并认真检查最终结果。
适合新手的第一个任务
Section titled “适合新手的第一个任务”选择一个可以快速验收、没有敏感数据的小任务,例如总结一个项目目录、整理一篇文档或修复一个静态页面的文字。先要求 Agent 只分析不修改,理解它的计划后再授权执行。