Agent & AI 名词大扫盲

作者:我是一筐橙子日期:2026/7/26

Agent & AI 名词大扫盲:一篇文章搞懂 10 个核心概念

你是不是经常在 AI 圈听到一堆名词——大模型、Agent、RAG、MCP、Function Call……每个都似懂非懂?这篇文章用最通俗的语言,一口气帮你扫清 10 个高频 AI 术语。


1. 什么是大模型?

一句话:大模型就是「读过全网、能对答如流」的超级大脑。

大模型(Large Language Model,LLM)是指参数规模巨大的神经网络模型,通过在海量文本数据上训练而来。它学到的不是「死记硬背」,而是语言的模式、逻辑的脉络和知识的关联。

典型代表: GPT-4、Claude、Gemini、DeepSeek、Qwen 等。

可以这样理解:一个学生读了互联网上几乎所有的书、文章和对话,虽然不能保证每个知识点 100% 准确,但绝大多数问题都能给出像样的回答——这就是大模型。

💡 为什么叫「大」? 因为参数多、训练数据大、计算资源大。模型越大,通常能力越强,但成本也越高。


2. 什么是 Prompt?

一句话:Prompt 就是你跟 AI 说的话——它是你给模型的「指令」。

Prompt(提示词)是用户输入给大模型的文本,用来引导模型生成期望的输出。同一个模型,用不同的 Prompt,可能得到天差地别的结果。

例子:

  • 差 Prompt: “写点什么”
  • 好 Prompt: “你是一个资深科技博主,请用通俗易懂的语言写一篇 800 字左右的 AI 科普文章,面向编程初学者,语气轻松有趣。”

进阶技巧: 好的 Prompt 通常包含角色设定 + 任务描述 + 输出要求 + 约束条件。这被称为「Prompt Engineering」(提示工程)。


3. 什么是 Agent?

一句话:Agent 是「会自己动手干活的 AI」,不只是聊聊天而已。

Agent(智能体)是指能够自主感知环境、做出决策、执行行动的 AI 系统。它不只是回答问题,而是可以:

  • 拆解复杂任务(规划)
  • 调用工具来执行(行动)
  • 根据结果自我修正(反思)
  • 记住上下文(记忆)

普通的 LLM 就像一个「纸上谈兵的顾问」——你问他怎么修水管,他能说得头头是道。而 Agent 则像是一个「带着工具箱上门的水管工」——先检查哪里漏水,然后决定用扳手还是生料带,动手修好,最后检查效果。

💡 典型 Agent 框架: LangChain、AutoGPT、Claude’s Agent Loop、OpenAI Assistants API。


4. 什么是 Tool?

一句话:Tool 是 AI 的「手脚」,让它不光能说,还能做。

Tool(工具)是赋予 AI 执行具体操作的能力。没有工具,AI 只能生成文本;有了工具,AI 可以:

工具类型例子
搜索工具联网查最新信息
计算工具执行精确数学运算
代码执行运行 Python 脚本
文件操作读取、写入、编辑文件
API 调用查询天气、发送邮件

Tool 就像给 AI 配了各种「外挂设备」——计算器、搜索引擎、记事本、电话……AI 不再是「空口说白话」,而是真的能动手做事。


5. 什么是 Function Call?

一句话:Function Call 是 AI 和代码之间的「翻译官」,让 AI 知道什么时候该调用什么函数。

Function Call(函数调用)是一种让大模型结构化输出调用请求的机制。当 AI 认为需要执行某个操作时,它不再输出普通文字,而是输出一段结构化的函数调用指令:

1{
2  "function": "get_weather",
3  "arguments": {
4    "city": "北京",
5    "date": "2026-07-21"
6  }
7}
8

然后由外部系统解析这个指令,真正执行对应的函数,再把结果返回给 AI。

说白了就是:你和 AI 聊天,AI 说「我需要查一下天气」→ 它输出一个格式化请求 → 系统接收到请求后去调天气 API → 系统把结果还给 AI → AI 再告诉你天气怎么样。Function Call 就是中间那步「格式化的请求」。


6. 什么是 MCP?

一句话:MCP 是 AI 的「万能插头」,让不同模型和不同工具能互相插拔。

MCP(Model Context Protocol,模型上下文协议)是由 Anthropic 提出的一种开放协议,旨在统一 AI 模型与外部工具、数据源之间的通信方式。

核心思想: 就像 USB-C 统一了充电接口一样,MCP 想要统一 AI 的工具接口。有了 MCP:

  • 一个工具写一次 MCP 接口,就能被所有支持 MCP 的模型使用
  • 一个模型通过 MCP,就能接入成百上千的工具和数据源

架构图(概念):

1┌─────────────┐        MCP 协议        ┌──────────────┐
2│  AI 模型     │ ◄──────────────────► │  工具/数据源   │
3│  (Client)    │                       │   (Server)    │
4└─────────────┘                       └──────────────┘
5

以前每个 AI 都有自己的「专用充电线」——A 模型的工具在 B 模型上不能用。MCP 就像是大家统一用 USB-C,所有工具都能插拔,所有模型都能用。


7. 什么是 Skills?

一句话:Skills 是 AI 的「操作手册」,告诉它遇到特定任务时该怎么做。

Skills(技能)是对特定任务的最佳实践模板。一个 Skill 通常包含:

  • 场景描述: 什么时候触发这个技能
  • 步骤指南: 具体的操作流程
  • 约束规则: 什么能做、什么不能做
  • 示例输出: 期望的结果格式

例子(Obsidian YOLO 中的 Skill):

1skill: obsidian-output-format
2描述: 当需要编辑 .md 文件时,输出格式规范
3规则:
4  - 用 <yolo_block> 包裹编辑内容
5  - 支持 REPLACE / INSERT_AFTER / APPEND
6

打个比方,Skills 就像是给 AI 的「SOP(标准作业程序)卡片」——不教 AI 死记硬背,而是告诉它「遇到这类任务,按这个流程走就对了」。


8. 什么是 RAG?

一句话:RAG 是给 AI 配的「参考书」,让它能查资料再回答,而不是瞎编。

RAG(Retrieval-Augmented Generation,检索增强生成)是一种让 AI 在回答问题前先检索相关知识的技术架构。

工作原理:

  1. 用户提问
  2. 检索: 从知识库(文档库、数据库)中找出最相关的片段
  3. 增强: 将检索到的片段作为上下文提供给大模型
  4. 生成: 大模型结合上下文给出答案

与其让 AI 闭卷考试(全靠记忆),不如让它开卷考试——先翻书,再答题。这样回答更准确,还能引用来源。

💡 RAG 的最大价值: 解决大模型「幻觉」问题(胡编乱造),同时让 AI 可以回答私有知识库中的内容。


9. 什么是向量数据库?

一句话:向量数据库是 AI 的「语义搜索引擎」,找的不是关键词,而是「意思相近」的内容。

传统数据库搜索靠关键词匹配——搜索「苹果」,只能找到包含「苹果」两个字的内容。而向量数据库把数据转换成数学向量(一堆数字),搜索时找的是语义上最相似的内容。

  • 传统搜索:搜「猫咪」→ 只找出写了「猫咪」的文档
  • 向量搜索:搜「可爱的毛茸茸小动物」→ 找出关于猫咪、小狗、仓鼠的所有内容(因为语义相近)

典型产品: Pinecone、Weaviate、Milvus、ChromaDB、Qdrant。

主要用途: RAG 的检索环节、相似图片搜索、推荐系统。


10. 什么是 Harness 工程?

一句话:Harness 工程是 AI 的「驾驶舱」,让你能操纵和管理 AI 干活的全过程。

Harness(直译为「挽具」或「控制装置」)工程指的是围绕 AI 模型构建的工程化系统,让 AI 不再是黑箱,而是可控制、可调试、可观察的工具。

包括的环节:

环节说明
Prompt 管理编写、测试、版本控制 Prompt
工具编排配置 AI 能用哪些 Tool
Memory 管理控制 AI 的记忆和上下文
观测/调试监控 AI 的每一步思考和行动
安全/合规限制 AI 的行为边界

换个角度说:如果把大模型比作发动机,那么 Harness 工程就是整辆汽车的驾驶系统——方向盘、仪表盘、刹车、油门。发动机再强,没有好的 Harness 也开不远。

💡 例子: Obsidian YOLO 插件的 Agent 系统就是一种 Harness 工程——它帮你管理工具、技能、记忆、上下文,让 AI 在你的笔记库里高效工作。


总结对照表

序号名词一句话记忆法
1大模型(LLM)AI 的「超级大脑」
2Prompt你给 AI 下的「指令」
3Agent会自己动手的「AI 打工人」
4ToolAI 的「外挂装备」
5Function CallAI 和代码之间的「翻译官」
6MCPAI 工具的「万能插头」
7SkillsAI 的「标准作业手册」
8RAG让 AI 「开卷考试」的技术
9向量数据库AI 的「语义搜索引擎」
10Harness 工程操作 AI 的「驾驶舱」

它们之间是什么关系?

最后用一个简单的场景串起来:

1你写了一个 Prompt(指令)
2   ↓
3大模型理解后,需要查私有知识
4   ↓
5通过 RAG(检索)+ 向量数据库(语义搜索)找到相关资料
6   ↓
7如果需要调外部 API → Function Call / Tool 上场
8   ↓
9如果有 MCP 协议 → 各种工具即插即用
10   ↓
11Agent(智能体)统管整个流程:规划→执行→反思→修正
12   ↓
13Skills(技能模板)指导 Agent 按最佳实践操作
14   ↓
15Harness 工程把控全局:调试、安全、观测
16

这样一来,这 10 个名词就不再是孤立的碎片,而是组成了一整套现代 AI 应用的技术栈。



《Agent & AI 名词大扫盲》 是转载文章,点击查看原文。


相关推荐


MVI模式的完整历史、误解和现代Android范式
稀有猿诉2026/7/18

本文译自「Yes, That’s MVI: The Pattern’s Full History, Misconceptions, and Modern Android Form」,原文链接proandroiddev.com/yes-that-is…,由Eury Pérez Beltré发布于2025年5月29日。 每项传统背后都有其原因——而原因背后,又蕴藏着一个故事。 – 佚名 欢迎阅读本文!我的目标是帮助你真正理解 MVI 模式的本质,解释我为何对我的观点充满信心,以及该模式的起源


别再手动拼接路径了!Node.js path 模块的 9 个核心 API 详解
先吃饱再说2026/7/10

别再手动拼接路径了!Node.js path 模块的 9 个核心 API 详解 摘要:路径处理是每个 Node.js 项目都绕不开的活。本文从 path.join 和 path.resolve 的区别入手,逐一拆解 path 模块的 9 个核心 API,并结合代码演示跨平台路径处理的正确姿势。读完你会发现——原来我之前一直在用错误的方式拼接路径。 📑 目录 为什么需要 path 模块? path.join 与 path.resolve:最容易被搞混的两个 API path.dirname


用 Vibe Coding 搭了一个完整小程序「一定能成」
有趣的老凌2026/7/2

前言 这不是一篇技术教程,而是一个产品创作者的完整记录——从脑子里一个模糊的想法,到上线一个包含用户端、API、后台管理、AI 集成的真实产品,全程用 Codex 协作完成。 一、引子:一个想法的诞生 我一直有一个困扰。 市面上缺一个让我能把目标「真正执行下去」的工具。 Notion 太自由,需要自己搭建模板,搭完模板就没动力执行了。待办清单太简单,只能记「今天要做什么」,解决不了「今天为什么要做这个」和「明天该做什么」。OKR 太企业级,适合团队管理,不适合个人日常。 我想要的东西其实很简单


图解 MongoDB 08|ESR 原则:复合索引的字段顺序怎么定
十三Tech2026/6/23

复合索引是 MongoDB 性能优化里最常用、也最容易用错的工具。很多人建复合索引的方式是「查询用到哪几个字段,就按想到的顺序建一个」,结果发现索引只用了第一个字段,查询照样慢。问题不在「有没有建索引」,而在字段顺序。 复合索引的字段顺序,决定了它能服务哪些查询、能用上几个字段。同样的三个字段 {a, b, c},排成 {a, b, c} 和 {c, b, a} 是两棵完全不同的 B-tree,能加速的查询也完全不同。这一篇讲清楚复合索引字段排序的核心原则——ESR(Equality, Sort


古法编程秘籍(七):互联网到底是什么?把两台电脑怎么说话搞懂就够了
JustHappy2026/6/15

Hi!这里是 JustHappy 这是专为编程初学者准备的专栏。这次我们来“上网”,但是互联网不是网页,也不只是 HTTP,它本质上是不同机器上的程序按规则交换数据。看懂客户端、服务器、协议、操作系统、网卡这条链,再分清 HTTP 的“一问一答”和 WebSocket 的“持续通信”,你的网络世界观才算真正搭起来。 上一篇我们讲到这里: 代码会执行、会发起 IO、硬件会工作、中断会通知CPU、操作系统会处理。 最后程序收到事件,再继续执行。 写到这里,很多人会自然冒出一个新问题: 如果 IO


Java MyBatis-Plus 实战指南:用 BaseMapper、Wrapper 和分页写好数据层
唐青枫2026/6/8

简介 MyBatis-Plus 是一个基于 MyBatis 的增强工具。 它经常被简称为 MP。 它的核心定位是: 只做增强,不改变 MyBatis 原有能力。 普通 MyBatis 项目里,哪怕只是做一张表的增删改查,也经常要写: Mapper 接口 Mapper XML insert SQL delete SQL update SQL select SQL 分页 SQL 条件 SQL MyBatis-Plus 把这些单表常规操作封装成了通用方法。 最常见的写法是: public inte


基因泰克:检测级虚拟细胞基准!大语言模型+智能体
Omics Pro2026/6/1

摘要 机器学习与大规模生物数据的进展重新激发了构建虚拟细胞(预测细胞行为的计算模型,可加速生物学发现)的研究前景。该愿景的核心应用是体外表型筛选,即模型预测细胞扰动在未知生物场景下的效应,该任务融合异质文本输入与多样表型输出,高度适配大语言模型与智能体系统。但目前该任务缺乏标准化基准,现有研究仅聚焦分子层面读数,与真实药物研发流程中的表型终点脱节。本研究推出基于1,920个公开CRISPR筛选构建的表型筛选预测基准AssayBench,覆盖5大类细胞表型;将筛选预测任务定义为单筛选基因排序任务


Spring MVC 的核心知识点梳理
huohuopro2026/5/11

MVC 是什么 MVC 不是 Spring 发明的,而是一种设计模式,目的是“解耦”。 M(Model,模型):数据 + 业务逻辑。比如 Teacher 类,TeacherService。V(View,视图):展示数据的界面。比如 JSP、Thymeleaf 模板,或者是现代返回 JSON 的前端页面。C(Controller,控制器):接收用户请求,调用 Model,最后选择 View 来展示。 流程:用户点击一个链接 → Controller 拿到请求 → 调 Service 拿到数据(Mo


精准医学的数据平台化与Python编程实战(中)
Allen_Lyb2026/5/1

第五章:高性能数据处理与分析 5.1 使用Pandas进行临床数据清洗与特征工程 import pandas as pd import numpy as np from sklearn.impute import SimpleImputer from sklearn.preprocessing import StandardScaler, OneHotEncoder # 加载模拟临床数据 df = pd.read_csv('clinical_cohort.csv') # 处理缺失值 nu


每天刷十几个平台的热榜太累了?我用一个页面全部搞定
扑克中的黑桃A2026/4/22

这里写目录标题 前言1.什么是DailyHot?2.在飞牛OS上部署DailyHot3.docker部署DailyHot4.使用DailyHot5.安装cpolar内网穿透6.配置公网地址7.保留固定公网地址总结 前言 每天看热点,你要打开几个 App? 微博、知乎、Hacker News、V2EX、豆瓣、少数派……每个平台都有热榜,每个平台都得点进去刷一遍。等把这些都刷完,半个小时过去了,真正有用的信息反而被稀释了。 而且还有个更现实的问题——你在公司想看看知乎热榜发生了啥,

首页编辑器站点地图

本站内容在 CC BY-SA 4.0 协议下发布

Copyright © 2026 聚合阅读