本阶段课程 · AI 与大模型基础
AI、大模型与聊天应用的关系训练与推理:模型怎样学会和生成Token、上下文与多轮对话模型的能力、局限与幻觉
LESSON 01 / 36阅读约 8 分钟

AI、大模型与聊天应用的关系

从人工智能、机器学习到生成式AI,分清模型能力与应用功能。

先分清我们正在谈哪一种 AI

平时说“用 AI 写文章”“让 AI 看图片”,通常指的是生成式 AI。它能根据输入生成文字、图像、声音等内容。但 AI 的范围更大:识别人脸、判断邮件是否为垃圾邮件、推荐视频,也可以使用 AI,而这些任务不一定要生成一篇新内容。

所以,学习 AI 的第一步,是把几个经常混用的名称放回各自的位置。你不需要先学数学公式,但需要知道这些词分别指什么,否则看到“模型升级”“应用新增功能”“接入一个 Agent”时,很容易以为说的是同一件事。

名称在说什么一个例子
人工智能,AI让计算机完成识别、预测、生成、决策等任务的领域图片识别、推荐系统、聊天助手
机器学习,ML从数据中学习规律的一类方法看过大量标注邮件后,判断新邮件是否像垃圾邮件
深度学习,DL使用多层神经网络学习表示的机器学习方法现代图像识别与许多生成模型
生成式 AI按输入生成内容的一类能力与系统写一段文字、生成一张图片
大语言模型,LLM以语言处理与生成为核心的一类模型根据上下文生成回答、翻译、摘要

现代大语言模型通常使用深度学习。生成式 AI 的范围又不限于语言模型,例如生成图片的系统可以采用不同的模型结构。先理解这些关系即可,不必把所有 AI 技术画成一条没有例外的包含链。

“模型”究竟是一个什么东西

在机器学习里,模型可以理解为一套通过训练得到的计算方法。它接收输入,进行计算,产生预测或生成结果。模型内部有许多数值,称为参数;训练会调整这些参数,使模型在训练目标上表现得更好。

以邮件分类为例,输入是一封邮件,输出可以是“正常邮件”和“垃圾邮件”的判断。以语言模型为例,输入可以是问题与相关背景,输出是一段回答。两者都使用模型,但任务和输出形式不同。

不要把模型想成一本可以逐页翻阅的百科全书。训练留下的是大量数值与其中编码的规律。模型有时能复现熟悉的信息,也能组合出以前没有出现过的表达;这些能力都不意味着每一条回答有一份可以直接引用的原始文献。

模型和你打开的聊天应用有什么关系

你在网页里看到的聊天框,是一个应用界面。应用负责接收消息、保存对话、展示回答,还可能提供文件上传、联网搜索和其他功能。模型是这个应用使用的核心能力之一。

可以把一次聊天拆成三部分:你在页面输入问题;应用把问题和需要的背景交给模型;模型返回结果,应用把它显示在页面里。若要搜索网页,还需要应用连接搜索能力,并把搜索结果交给模型使用。

因此,同一个模型被放进两个应用后,体验可能很不一样:一个应用只让它回答文本,另一个应用给它资料、搜索与文件处理能力。反过来,同一个聊天应用也可能提供多个模型供选择。模型能力和应用功能需要分别理解。

用一个问题检查这个区别

假设你问:“把这段通知改得简洁一些。”应用只要把原文交给语言模型,就可能完成改写。接着你问:“我们公司今天更新了哪条报销政策?”如果当前没有提供政策文件,也没有连接内部系统,模型就缺少回答这个问题所需的信息。

这里的区别在于信息来源与系统能力。后面的课程会依次解释:模型怎样生成文字、怎样使用上下文、应用如何调用模型,以及怎样补上资料与工具。理解这条关系,才有基础继续理解 Agent。

检查一下理解

同一个模型放进两个应用,功能可能不同,主要因为?

本节参考与继续阅读

下列章节用于核对概念与机制。本站以中文重新组织讲解,例子和练习为独立编写。

可选练习把一条语气生硬的催稿消息,改成可以发给同事的两句话。
练习目标

把一条语气生硬的催稿消息,改成可以发给同事的两句话。

打开你常用的 AI 对话工具,选择“新建对话”或“新建聊天”。在输入框粘贴下面的内容,点击发送。后续步骤留在同一段对话里;只有明确要求时才新开对话。

练习原文
报告怎么还没给我?今天下午三点之前必须发我,不然来不及了。

跟着做一遍

下面的结果是本站编写的对照示例。实际工具的措辞可能不同,按每步的关键条件检查即可。

01

打开对话,直接发这段话

先新建对话。复制下面整段文字到输入框并发送,不要只复制原文。

发给 AI 的内容
请把下面的消息改得礼貌一些,保留今天下午三点这个截止时间。只给我可以直接发送的正文。
原文:报告怎么还没给我?今天下午三点之前必须发我,不然来不及了。
做完后,展开结果对照
对照示例 · 不要求逐字相同

麻烦你今天下午三点前把报告发给我,方便我安排后续工作。谢谢!

为什么这样做你交给 AI 的工作是改写,它只需要使用你提供的文字,不需要查网页。

02

把不满意的地方说出来

不要点新建对话。在刚才的对话里继续发送这句反馈。

发给 AI 的内容
有点像公文。我们是熟悉的同事,请说得自然一点,控制在两句话,不要增加新的理由。
做完后,展开结果对照
对照示例 · 不要求逐字相同

报告方便今天下午三点前发我吗?我这边要接着往下安排,谢谢啦。

为什么这样做同一段对话能让它知道“刚才那条消息”是什么。不同工具的措辞会不同,重点是改动有没有符合你的要求。

03

自己核对三个地方

先不发给同事。逐项检查结果:有没有三点、语气是否自然、有没有捏造经理要求或项目背景。若发现新增理由,发送下面这句。

发给 AI 的内容
保留礼貌语气和今天下午三点的截止时间,删除我没有提供的背景、人物和原因。
做完后,展开结果对照
对照示例 · 不要求逐字相同

今天下午三点前方便把报告发给我吗?谢谢!

为什么这样做最后这一步由你决定是否采用。读起来顺,不代表它没有悄悄添加信息。

刚才用到的一个新词

AI 对话工具

你用日常语言提出要求,它根据输入生成回复;你写给它的要求常被叫作“提示词”。

没做出来?从这里排查

回答太长,夹着“当然可以”等说明

补一句“只输出消息正文,不解释”。

它没有保留三点

明确写“今天下午三点不可修改”,再核对一次。

换一个例子验证

换成一条你平时不太会写的消息。

  1. 用虚构人名写一条提醒或婉拒。
  2. 让 AI 改写,再给一次具体反馈。
  3. 核对日期、人物与口吻,选出你愿意发送的一版。
检查标准能得到可用消息,也能说出自己为什么选它,而不只是“看起来不错”。

完成状态仅保存在当前浏览器,可再次点击取消。