本阶段课程 · 可靠使用与综合实践
隐私、数据边界与提示注入评估:怎样判断结果真的变好成本与效率:计算一项任务的总投入综合实践:解释并完成一个 AI 项目
LESSON 36 / 36阅读约 7 分钟

综合实践:解释并完成一个 AI 项目

把模型、API、资料、工具和Agent对应到实际需求,建立完整验收。

用一个完整任务把前面的概念连接起来

本课程从模型、训练与上下文开始,逐步加入提示词、实际应用、API、知识库、工具、工作流和Agent。最后一课要回答的是:面对一项自己的任务,怎样知道需要哪些部分,它们怎样协作?

以一个虚构活动助手为例:它需要根据活动规则回答问题,起草通知,查询场地并给出推荐。只有用户确认之后,才允许进行相应预约。这个任务能把多种能力放在同一条可解释的流程中。

每个部件怎样对应到实际工作

任务中的需要对应概念具体负责什么
理解问题、组织语言语言模型解释规则,生成通知与推荐说明
把请求交给模型API与消息传入任务、规则、材料和历史
知道当前活动规则资料与RAG找出与问题相关的有效条款
获得场地实时状态工具调用实际查询营业、空位与总价
按固定条件处理报名工作流检查必填信息与人数上限
A不合适时继续找BAgent循环根据反馈选择下一步
控制预约后果权限与确认展示具体方案,核对执行回执
判断是否可用评估与成本检查质量、时间、费用和失败

这不是要求每个项目都用满所有组件。如果只需要把通知写顺,文字模型与明确材料可能已经足够。只有问题实际需要额外能力时,才增加相应部分。

第一版应该交付什么

先准备一份清楚的当前资料,标出时间、人数、报名方式和规则,以及尚未确认的事项。用一份可复用要求生成通知,再用五个问题检查资料问答。这样先建立了事实来源、文本产物和验收标准。

随后加入场地查询,区分模型请求与工具结果。任务只要求推荐时,符合条件并给出依据即可结束;如果还需预约,必须另外处理授权与执行成功。不要让一个“已完成”的统一标签掩盖中间不同状态。

怎样检查整个系统有没有接错

假设通知里写场地已预约,日志却只有查询结果,这是状态越界。假设回答使用旧版退费政策,是资料或检索版本问题。假设预算600元却推荐680元场地,需要检查约束是否保留、比较是否正确。

把错误归回对应部件,能找到具体修复位置。换模型可能改善某些理解问题,但不能自动补上缺失的工具、错误的权限或过期资料。

下一次换成自己的任务

可以选择入职资料问答、每周工作汇总、客户留言整理或个人研究助手。先说明最终产物,准备一小份有权使用的材料,写出几个通过标准,再做最小流程。

不需要在开始时就建立多个Agent、向量数据库和复杂自动化。重要的是你能解释:信息从哪里来,模型负责什么,哪些步骤由程序完成,结果怎样核对,什么条件下应停止。能够清楚回答这些问题,就已经具备继续学习和判断AI系统的基础。

交互演示 · Agent 透明实验室跟着一次真实机制的模拟,看助手如何行动。 8 分钟 · 教学模拟

检查一下理解

完成第一个项目后,最合适的下一步是什么?

本节参考与继续阅读

下列章节用于核对概念与机制。本站以中文重新组织讲解,例子和练习为独立编写。

可选练习把前面的方法连成一份能再次使用的小项目,并能解释它每一步怎样工作。
练习目标

把前面的方法连成一份能再次使用的小项目,并能解释它每一步怎样工作。

准备一个笔记文档和常用AI对话工具。基础路线不需要代码或付费API;可选择用知识库阶段的资料笔记、API阶段的Dify小应用扩展。涉及场地查询时使用本站实验,不把教学数据当成真实场地信息。

完整项目材料包
项目:虚构的青禾读书会。
时间:周日14:00—16:00。人数:最多12人。场地预算:600元。
报名:群里回复“参加”;截止周五20:00。
规则:提前至少24小时可全额退,不足24小时不退但可转让;不要求读完整本书。
场地:尚未确定,不得写已预约。
停车费用、联系电话:没有提供。
交付:活动通知草稿、规则问答、场地比较记录、上线前检查表。
下载练习文件 · TXT

跟着做一遍

下面的结果是本站编写的对照示例。实际工具的措辞可能不同,按每步的关键条件检查即可。

01

先把资料整理成可维护的一页

下载材料包,在笔记中加上“教学练习、当前版本、待确认事项”三个字段。把规则与场地状态分开。

发给 AI 的内容
请把以下活动材料整理成“已确定事实、活动规则、待确认事项”三部分。原文未提供的信息保留未知,不新增场地或电话。
周日14—16点,最多12人,预算600元,群里回复参加、周五20点截止;提前至少24小时可全额退款,不足24小时不退款但可转让;不要求读完整本书;场地未定,停车和电话未知。
做完后,展开结果对照
对照示例 · 不要求逐字相同

应清楚保留场地未定、停车未知、电话未知。退费条件不能被简化成随时可退。

为什么这样做这份文件是后面生成与问答共同使用的事实来源。先整理一次,可以减少几个产物各说各话。

02

产出通知,自己做一次定点修改

使用整理后的材料生成初稿;再根据你希望的口吻改一次,保留全部事实。

发给 AI 的内容
只根据当前材料写一则120字以内的读书会通知。包括时间、人数、报名方式和截止时间;地点明确写“待确认”。语气像朋友群聊,不声称已预约。
做完后,展开结果对照
对照示例 · 不要求逐字相同

通知应含周日14—16点、限12人、回复参加、周五20点截止、地点待确认。若超长,先删宣传词。

为什么这样做你在提示词阶段学的提问与反馈,现在变成整个项目中的一个具体产物。

03

建立规则问答,并跑五题

把当前规则加入资料笔记,或在新对话完整粘贴规则。逐题问下面问题,与自己的标准表核对。

发给 AI 的内容
请只依规则逐题回答:①活动几点开始?②提前30小时取消能退吗?③提前2小时能退吗?④没读完整本书能参加吗?⑤停车免费吗?给每题指出对应规则;无依据则写无法确认。
做完后,展开结果对照
对照示例 · 不要求逐字相同

答案依次为14点、可退、不退但可转让、可参加、停车无法确认。引用必须能在当前资料中找到。

为什么这样做这组验收连接了资料整理、检索、条件判断和未知处理。没过的题先修好再继续扩展功能。

04

接上一段可观察的行动过程

打开Agent实验,使用默认600元预算跑到推荐B。保存事件顺序或手工记下关键结果,此处不需确认模拟预约。

做完后,展开结果对照
对照示例 · 不要求逐字相同

记录查A→A关闭→查B→B可用520元→满足条件、等待确认。另标明这是教学模拟,并非真实查询。

为什么这样做这一步让你解释模型API、工具执行、反馈、循环和停止如何配合。项目中的通知仍不能据此宣称现实场地已经预约。

05

做一次总验收,再决定扩展

对照所有产物,检查事实一致、来源可追溯、未知保留、执行边界和总投入。

发给 AI 的内容
请生成一张项目验收清单:通知事实完整;问答五题通过;场地状态与回执分开;没有编造电话停车信息;知道下一步由谁确认;记录准备与核验时间。仅生成清单,不替我宣称已经通过。
做完后,展开结果对照
对照示例 · 不要求逐字相同

得到待勾选清单。你需要亲自核对成果后填结果,并写下一个仍待解决的问题。

为什么这样做项目完成不等于一切自动化。知道哪些已做到、哪些仍未知、什么时候需要人接手,就是可用系统的重要部分。

刚才用到的一个新词

最小可用项目

先完成一个范围清楚、能验收的任务闭环,再根据实际问题增加能力。

没做出来?从这里排查

产物之间事实冲突

回到唯一的当前材料,更新后重新生成受影响的部分,不靠人工猜哪份是最新。

总想一次做成全自动系统

先交付一份可核对结果,记录实际卡点,再决定下一项需要增加的能力。

换一个例子验证

把毕业项目换成你的真实小任务。

  1. 选一个每周重复、材料边界清楚的任务。
  2. 交付材料文档、可复用任务卡、五题验收记录。
  3. 写一段白话说明:哪些靠模型,哪些靠资料或工具,哪里需要人决定。
检查标准你能展示一个可复用成果,也能解释它为什么有效、会在哪里失败。

完成状态仅保存在当前浏览器,可再次点击取消。