本阶段课程 · 可靠使用与综合实践
综合实践:解释并完成一个 AI 项目
把模型、API、资料、工具和Agent对应到实际需求,建立完整验收。
用一个完整任务把前面的概念连接起来
本课程从模型、训练与上下文开始,逐步加入提示词、实际应用、API、知识库、工具、工作流和Agent。最后一课要回答的是:面对一项自己的任务,怎样知道需要哪些部分,它们怎样协作?
以一个虚构活动助手为例:它需要根据活动规则回答问题,起草通知,查询场地并给出推荐。只有用户确认之后,才允许进行相应预约。这个任务能把多种能力放在同一条可解释的流程中。
每个部件怎样对应到实际工作
| 任务中的需要 | 对应概念 | 具体负责什么 |
|---|---|---|
| 理解问题、组织语言 | 语言模型 | 解释规则,生成通知与推荐说明 |
| 把请求交给模型 | API与消息 | 传入任务、规则、材料和历史 |
| 知道当前活动规则 | 资料与RAG | 找出与问题相关的有效条款 |
| 获得场地实时状态 | 工具调用 | 实际查询营业、空位与总价 |
| 按固定条件处理报名 | 工作流 | 检查必填信息与人数上限 |
| A不合适时继续找B | Agent循环 | 根据反馈选择下一步 |
| 控制预约后果 | 权限与确认 | 展示具体方案,核对执行回执 |
| 判断是否可用 | 评估与成本 | 检查质量、时间、费用和失败 |
这不是要求每个项目都用满所有组件。如果只需要把通知写顺,文字模型与明确材料可能已经足够。只有问题实际需要额外能力时,才增加相应部分。
第一版应该交付什么
先准备一份清楚的当前资料,标出时间、人数、报名方式和规则,以及尚未确认的事项。用一份可复用要求生成通知,再用五个问题检查资料问答。这样先建立了事实来源、文本产物和验收标准。
随后加入场地查询,区分模型请求与工具结果。任务只要求推荐时,符合条件并给出依据即可结束;如果还需预约,必须另外处理授权与执行成功。不要让一个“已完成”的统一标签掩盖中间不同状态。
怎样检查整个系统有没有接错
假设通知里写场地已预约,日志却只有查询结果,这是状态越界。假设回答使用旧版退费政策,是资料或检索版本问题。假设预算600元却推荐680元场地,需要检查约束是否保留、比较是否正确。
把错误归回对应部件,能找到具体修复位置。换模型可能改善某些理解问题,但不能自动补上缺失的工具、错误的权限或过期资料。
下一次换成自己的任务
可以选择入职资料问答、每周工作汇总、客户留言整理或个人研究助手。先说明最终产物,准备一小份有权使用的材料,写出几个通过标准,再做最小流程。
不需要在开始时就建立多个Agent、向量数据库和复杂自动化。重要的是你能解释:信息从哪里来,模型负责什么,哪些步骤由程序完成,结果怎样核对,什么条件下应停止。能够清楚回答这些问题,就已经具备继续学习和判断AI系统的基础。
检查一下理解
本节参考与继续阅读
下列章节用于核对概念与机制。本站以中文重新组织讲解,例子和练习为独立编写。
- Hugging Face · 从API与工具构建最小Agent
对应从一次调用到工具执行、结果回传与继续生成的教学顺序;本站用白话伪代码和自写场地示例讲解。
- Dify · 可视化工作流入门
参考先展示产物,再配置输入、处理和输出节点的教程结构。
- OpenAI · 评估实践
可选练习把前面的方法连成一份能再次使用的小项目,并能解释它每一步怎样工作。
把前面的方法连成一份能再次使用的小项目,并能解释它每一步怎样工作。
准备一个笔记文档和常用AI对话工具。基础路线不需要代码或付费API;可选择用知识库阶段的资料笔记、API阶段的Dify小应用扩展。涉及场地查询时使用本站实验,不把教学数据当成真实场地信息。
项目:虚构的青禾读书会。 时间:周日14:00—16:00。人数:最多12人。场地预算:600元。 报名:群里回复“参加”;截止周五20:00。 规则:提前至少24小时可全额退,不足24小时不退但可转让;不要求读完整本书。 场地:尚未确定,不得写已预约。 停车费用、联系电话:没有提供。 交付:活动通知草稿、规则问答、场地比较记录、上线前检查表。
跟着做一遍
下面的结果是本站编写的对照示例。实际工具的措辞可能不同,按每步的关键条件检查即可。
先把资料整理成可维护的一页
下载材料包,在笔记中加上“教学练习、当前版本、待确认事项”三个字段。把规则与场地状态分开。
请把以下活动材料整理成“已确定事实、活动规则、待确认事项”三部分。原文未提供的信息保留未知,不新增场地或电话。 周日14—16点,最多12人,预算600元,群里回复参加、周五20点截止;提前至少24小时可全额退款,不足24小时不退款但可转让;不要求读完整本书;场地未定,停车和电话未知。
做完后,展开结果对照
应清楚保留场地未定、停车未知、电话未知。退费条件不能被简化成随时可退。
为什么这样做这份文件是后面生成与问答共同使用的事实来源。先整理一次,可以减少几个产物各说各话。
产出通知,自己做一次定点修改
使用整理后的材料生成初稿;再根据你希望的口吻改一次,保留全部事实。
只根据当前材料写一则120字以内的读书会通知。包括时间、人数、报名方式和截止时间;地点明确写“待确认”。语气像朋友群聊,不声称已预约。
做完后,展开结果对照
通知应含周日14—16点、限12人、回复参加、周五20点截止、地点待确认。若超长,先删宣传词。
为什么这样做你在提示词阶段学的提问与反馈,现在变成整个项目中的一个具体产物。
建立规则问答,并跑五题
把当前规则加入资料笔记,或在新对话完整粘贴规则。逐题问下面问题,与自己的标准表核对。
请只依规则逐题回答:①活动几点开始?②提前30小时取消能退吗?③提前2小时能退吗?④没读完整本书能参加吗?⑤停车免费吗?给每题指出对应规则;无依据则写无法确认。
做完后,展开结果对照
答案依次为14点、可退、不退但可转让、可参加、停车无法确认。引用必须能在当前资料中找到。
为什么这样做这组验收连接了资料整理、检索、条件判断和未知处理。没过的题先修好再继续扩展功能。
接上一段可观察的行动过程
打开Agent实验,使用默认600元预算跑到推荐B。保存事件顺序或手工记下关键结果,此处不需确认模拟预约。
做完后,展开结果对照
记录查A→A关闭→查B→B可用520元→满足条件、等待确认。另标明这是教学模拟,并非真实查询。
为什么这样做这一步让你解释模型API、工具执行、反馈、循环和停止如何配合。项目中的通知仍不能据此宣称现实场地已经预约。
做一次总验收,再决定扩展
对照所有产物,检查事实一致、来源可追溯、未知保留、执行边界和总投入。
请生成一张项目验收清单:通知事实完整;问答五题通过;场地状态与回执分开;没有编造电话停车信息;知道下一步由谁确认;记录准备与核验时间。仅生成清单,不替我宣称已经通过。
做完后,展开结果对照
得到待勾选清单。你需要亲自核对成果后填结果,并写下一个仍待解决的问题。
为什么这样做项目完成不等于一切自动化。知道哪些已做到、哪些仍未知、什么时候需要人接手,就是可用系统的重要部分。
最小可用项目
先完成一个范围清楚、能验收的任务闭环,再根据实际问题增加能力。
没做出来?从这里排查
产物之间事实冲突
回到唯一的当前材料,更新后重新生成受影响的部分,不靠人工猜哪份是最新。
总想一次做成全自动系统
先交付一份可核对结果,记录实际卡点,再决定下一项需要增加的能力。
换一个例子验证
把毕业项目换成你的真实小任务。
- 选一个每周重复、材料边界清楚的任务。
- 交付材料文档、可复用任务卡、五题验收记录。
- 写一段白话说明:哪些靠模型,哪些靠资料或工具,哪里需要人决定。
完成状态仅保存在当前浏览器,可再次点击取消。