当前位置: 首页 > news >正文

从零到手搓一个Agent:AI Agents新手入门精通

这一天,你的女朋友问你(假设我们有女朋友),宝宝,什么是Agent啊,Agent和LLM有什么区别呀,最近大家都在说的Agent究竟是什么,包括很多文章都在写的Agent,还有之前谷歌发布的Agents白皮书究竟是什么,对我们有什么帮助,对我们有什么影响呢?现在,编者专门做了一个系列,从最简单的讲起,解开这个迷雾,这个系列的教程,会帮助你了解基本概念,并且能够手搓一系列的agent

那么,chatgpt是Agent还是LLM,有了LLM为什么还需要Agent呢,这次我们就把概念弄清楚以及有什么用讲清楚

一、LLMs的局限与Agents的诞生(结合ChatGPT举例)

你或许已经体验过 ChatGPT 的强大对话能力,它能流畅地与你聊天、回答问题,甚至帮你写诗、写代码。这背后正是 LLMs(大型语言模型)在发挥作用。LLMs 就像一个超级博览群书的“大脑”,它掌握了海量的文本知识,可以根据你的提问,生成相应的文本回复

那么,为什么说 LLMs 仍然存在局限性呢? 让我们以 ChatGPT 为例来看:

1. 知识的滞后性:

举例: 你问 ChatGPT “今天的天气怎么样?” 或者 “最新的股票价格是多少?”,它很可能无法给出准确的回答。因为它所拥有的知识来源于训练时的数据,无法实时获取最新的信息。它可能告诉你的是前几天的天气,或者很久之前的股票行情。

解释: LLMs 的知识就像一本厚厚的“旧书”,书里记载着很多知识,但无法知道书出版之后发生的新鲜事。

2. 无法与外界交互:

举例: 你让 ChatGPT “帮我预订一张明天的机票”,它会很热情地告诉你预订机票需要哪些步骤,却无法实际帮你预订。你让它 “帮我发送一封邮件给同事”,它也只能为你写好邮件内容,而不能帮你发送出去。

解释: LLMs 只能进行文本理解和生成,它就像一个“只会说”的人,但没有“手脚”去执行实际操作。

3. 缺乏自主行动能力:

举例: 你问 ChatGPT “如何制定一个完美的旅行计划”,它会给出你很多建议,例如选择目的地、预订酒店、规划行程等等。但是它不会主动帮你把这些都安排好。它只是在回答你的问题,而不是主动帮你解决问题。

解释: LLMs 只能被动地接收指令,然后给出回答,无法根据目标自主规划行动。就像一个“听话的助手”,但是没有自己的想法和主动性。

二、为了突破这些限制,Agents(智能体)应运而生。

Agents 的核心思想:给 LLMs 配备“手脚”和“大脑”

我们可以将 Agents 想象成一个升级版的 ChatGPT,它不仅具备强大的语言理解和生成能力,还拥有了:

“手脚”(工具): Agents 可以利用各种工具(例如,搜索引擎、数据库查询工具、邮件发送工具)与外界互动,获取信息、执行操作。就像给 LLMs 配备了可以操作各种工具的 “手脚”。

“大脑”(编排层): Agents 具备推理和规划能力,可以根据目标自主规划行动,并合理地调用各种工具。就像给 LLMs 配备了一个可以自主思考和决策的“大脑”。

Agents 与 LLMs 的区别:

特性
LLMs (例如 ChatGPT)
Agents (智能体)
核心能力
语言理解和生成
语言理解、推理规划、工具使用、自主行动
知识来源
训练数据
训练数据 + 实时信息 + 外部知识库
与外界交互
无法直接交互
可以通过工具与外界交互
行动能力
无法执行实际操作
可以根据目标自主执行操作
解决问题方式
被动回答问题
主动分析问题、规划行动、解决问题
例如
ChatGPT 可以回答你的问题,但无法帮你订机票或查询天气
Agent 可以帮你预订机票、查询天气、发送邮件,并根据你的需求主动规划行程

简而言之:

LLMs 就像一个知识渊博的“问答机器人”,你问什么,它答什么。

Agents 就像一个“智能助手”,它不仅能回答你的问题,还能主动帮你完成任务。

通过这样的解释,希望能够帮助读者更好地理解 LLMs 的局限性,以及 Agents 的优势和价值。Agents 的出现,标志着人工智能正朝着更智能、更强大的方向发展。

为了克服这些局限,谷歌的研究人员在《New whitepaper Agents》中详细阐述了“Agent”的概念。他们将LLMs与工具和编排层相结合,赋予了LLMs自主行动的能力,使其能够像一个真正的“智能体”一样工作。

三、Agents的核心组件:智能体的“三大支柱”

一个完整的Agent通常由三个核心组件构成,它们相互协作,共同支撑起Agent的智能行为:

1、 模型 (Model): Agent 的“大脑”

2、 工具 (Tools): Agent 与外界交互的“桥梁”

3、编排层 (Orchestration Layer): Agent 的“指挥中心”

四、Agents的运作机制:从输入到输出

Agent 的运作流程可以概括为以下几个步骤:

  1. 接收输入: 接收用户的指令或问题。

  2. 理解输入: 模型理解用户的意图,并提取关键信息。

  3. 推理规划: 模型根据用户输入和当前状态,进行推理和规划,确定下一步行动。

  4. 选择工具: 模型根据目标选择合适的工具。

  5. 执行行动: Agent使用工具执行行动,例如查询数据库、发送邮件等。

  6. 获取结果: Agent获取工具执行的结果。

  7. 输出结果: Agent将结果输出给用户,或进行下一步行动。

相较于传统的LLMs,Agents 具备以下显著优势:

五、Agents的应用:从智能客服到虚拟助手

Agents 的应用场景非常广泛,以下仅列举部分:

Agents的开发工具:从LangChain到Vertex AI

为了方便开发者构建 Agents,Google 提供了多种工具和平台:

Agents 的未来充满无限可能,技术发展将推动 Agents 走向更智能化和强大:

六、结语:Agent,AI的未来

Agents 代表着生成式AI模型的进阶形态,它们拥有自主行动能力,能够利用工具与外界交互,并根据目标进行决策,具有更广泛的应用范围和更强大的能力。随着技术的不断发展,Agents 将会改变我们的生活和工作方式,并推动人工智能进入新的发展阶段。未来,Agent 将成为人工智能发展的重要方向,为我们带来更智能、更便捷的未来。

这里给大家精心整理了一份全面的AI大模型学习资源包括:AI大模型全套学习路线图(从入门到实战)、精品AI大模型学习书籍手册、视频教程、实战学习、面试题等,资料免费分享

👇👇扫码免费领取全部内容👇👇

1. 成长路线图&学习规划

要学习一门新的技术,作为新手一定要先学习成长路线图方向不对,努力白费

这里,我们为新手和想要进一步提升的专业人士准备了一份详细的学习成长路线图和规划。可以说是最科学最系统的学习成长路线。

2. 大模型经典PDF书籍

书籍和学习文档资料是学习大模型过程中必不可少的,我们精选了一系列深入探讨大模型技术的书籍和学习文档,它们由领域内的顶尖专家撰写,内容全面、深入、详尽,为你学习大模型提供坚实的理论基础(书籍含电子版PDF)

3. 大模型视频教程

对于很多自学或者没有基础的同学来说,书籍这些纯文字类的学习教材会觉得比较晦涩难以理解,因此,我们提供了丰富的大模型视频教程,以动态、形象的方式展示技术概念,帮助你更快、更轻松地掌握核心知识

4. 2026行业报告

行业分析主要包括对不同行业的现状、趋势、问题、机会等进行系统地调研和评估,以了解哪些行业更适合引入大模型的技术和应用,以及在哪些方面可以发挥大模型的优势。

5. 大模型项目实战

学以致用,当你的理论知识积累到一定程度,就需要通过项目实战,在实际操作中检验和巩固你所学到的知识,同时为你找工作和职业发展打下坚实的基础。

6. 大模型面试题

面试不仅是技术的较量,更需要充分的准备。

在你已经掌握了大模型技术之后,就需要开始准备面试,我们将提供精心整理的大模型面试题库,涵盖当前面试中可能遇到的各种技术问题,让你在面试中游刃有余。

7. 资料领取:全套内容免费抱走,学 AI 不用再找第二份

不管你是 0 基础想入门 AI 大模型,还是有基础想冲刺大厂、了解行业趋势,这份资料都能满足你!
现在只需按照提示操作,就能免费领取:

👇👇扫码免费领取全部内容👇👇

http://www.cnnetsun.cn/news/1278488.html

相关文章:

  • 全球财经资讯日报(夜间-凌晨)2026年3月12日
  • ROS2 -01-ROS2操作系统简介
  • 很多中国人看不了YouTube,但很多中国人靠 YouTube赚钱
  • TextureView 播放视频报错:java.lang.IllegalArgumentException: surfaceTexture must not be null
  • 企业培训ROI怎么算?这套可直接套用的量化表,让效果看得见
  • 你的数据库防火墙,可能只是个“透明人”
  • MFC CDialog触摸屏长按不响应右键消息解决方案
  • 单片机/C语言八股:(十一)指针的补充,包括指针的类型和大小
  • 从面试官视角:.NET高级工程师必问的5个实战问题(附避坑指南)
  • 湘情游戏盾AI防护引擎
  • LangGraph 实战笔记:用 AI 发起流程应用
  • 告别电脑卡顿:Everything+批处理脚本打造自动化清理系统(含完整代码)
  • 高频高速多层FPC叠层优化精准实现阻抗匹配
  • TA-Lib MACD实战避坑指南:Python金融分析中常见的5个参数设置错误
  • MusePublic惊艳案例展示:看AI如何画出故事感时尚人像
  • 基于改进遗传算法的风电场优化调度策略验证——提升整体输出功率及达到最大功率输出的完整详实方案(...
  • Phi-3-mini-128k-instruct多语言代码生成能力横向对比
  • Qwen-VL-Narrator:影视剧视频片段的理解和生成细粒度描述
  • OpenClaw Skills 全面拆解:从能力模块到 AI 协作进化系统
  • GLM-4-9B-Chat-1M实战案例:跨境电商产品说明书多语言自动校验与合规提示
  • Python+pytest接口自动化之测试函数、测试类/测试方法的封装
  • 解决 cosyvoice failed to load library libonnxruntime_providers_cuda.so 错误的实战指南
  • 搭建虚拟机
  • LobeChat语音合成实测:让AI助手开口说话,打造沉浸式对话体验
  • Gemma-3-12b-it流式生成体验优化:逐字输出+加载动画「▌」实现原理
  • BiLSTM锂电池剩余寿命预测,NASA数据集(5号电池训练6号电池测试),MATLAB代码
  • TKDE-2023《Self-Supervised Discriminative Feature Learning for Deep Multi-View Clustering (SDMVC)》
  • 突破Windows文件管理瓶颈:QTTabBar实现效率提升的终极方案
  • Gemma-3-12b-it效果惊艳集锦:12B参数下媲美云端多模态模型的表现
  • Super Resolution处理结果保存:输出路径与命名规则说明