一、智能体1.1 什么是智能体智能体Agent以大模型为大脑能够感知目标、自主规划、调用工具、执行行动、接收反馈、迭代修正自动完成复杂任务的 AI 系统。1.2 智能体与大模型的区别大模型你问它答只输出文字建议被动等待指令像一个只会动口的顾问。智能体你给一个总目标它自己拆步骤、动手干活把整件事做完像一个数字员工 / 管家。核心区别在于大模型是“超级大脑”而智能体是“会行动的超级大脑”。1.3 智能体如何工作智能体并非“大脑”和“手脚”的简单拼接。其强大之处在于感知与记忆、思考规划、行动执行三个维度的深度协同形成一个自主的智能闭环。1.3.1感知与记忆感知像人的眼睛和耳朵通过调用搜索、数据库、文件读取等工具主动获取实时、动态的外部信息。记忆短期记忆记住当前任务的上下文。长期记忆存储历史经验与用户偏好。1.3.2 思考规划大脑以大模型为“大脑”理解指令的真实意图。规划运用思维链等技术将宏观目标规划成具体的执行步骤。1.3.3 行动执行调用工具根据规划自主调用日历、邮件、代码解释器、软件API等外部工具执行具体操作。任务结果状态改变和任务完成。1.3.4工作流程感知 → 思考规划 → 行动执行 → 接收反馈 → 重新感知无限迭代直到任务完成1.4 智能体开发路径选择三条主流技术路径低代码 / 无代码、Java 方向、Python 方向。这三条路径分别代表了三种不同的核心理念——效率、稳定、灵活它们服务于不同的开发角色、技术背景以及业务场景。二、Coze扣子2.1 Coze介绍Coze扣子 是由字节跳动推出的一个AI助手和应用程序编辑开发平台。国内版访问地址https://www.coze.cn/overview背后大模型应用的是字节自研的豆包大模型、通义千问和deepseek大模型Coze还提供了多种插件、知识库、工作流、长期记忆和定时任务等功能来增强聊天机器人的能力和交互性。2.2 Coze注册打开国内的访问地址https://www.coze.cn/overview点击免费开始。可以使用手机号进行注册也可以使用抖音或飞书进行注册。2.3 扣子的积分2.3.1积分介绍扣子的积分是他的收费方式使用扣子进行对话、图片生成、视频生成即每一次在扣子上使用大模型的能力都需要扣除积分。2.3.2收费规则如果在Coze平台上使用Deepseek大模型收费规则如下短文本[0 ~ 32Ktoken]输入一千token2积分输出一千token3积分长文本[32 ~ 128Ktoken]输入一千token4积分输出一千token6积分2.3.3 查看消耗积分点击左下角积分卡片出现的页面中点击积分消耗即可查看2.3.4 积分获取获取方式积分数量有效期新用户注册150030天每日登录1500当日有效注1每日赠送的1500积分当日有效不会累积注2积分用完不要买淘宝上积分很便宜2.4 扣子入门2.4.1 打开操作界面1.回到主页面点击扣子编程。随着扣子版本更新界面入口会有变化可访问如下地址https://www.coze.cn/home2.点击智能体开发3.创建智能体4.填写智能体信息然后点击确定2.4.2 智能体页面介绍左侧智能体人设与回复逻辑中间智能体重模型和插件等设置右侧与智能体交互的聊天框此时一个最简单的智能体我们已经搭建好了在右侧可以跟智能体开启聊天了。2.4.3 智能体中模型设置2.4.3.1 模型选择扣子编程已接入多款大模型支持对各种大模型进行精细化的参数设置。可以根据不同的业务选择不同的大模型每一个模型下面都有介绍擅长的点如果只是文字处理任意模型均可。如果切换大模型如下图所示根据大模型的描述选择适合当前业务的大模型即可2.4.3.2 协议类型Coze针对不同的业务推出了两种协议类型。Chat Api传统通用接口普通聊天、简单问答用这个兼容性最好所有模型都支持上下文要你手动带上全部历史消息每次请求重复传对话记录适合单次提问、简单闲聊、简单插件调用Responses Api新一代增强接口大模型新版协议自动存上下文不用每次粘贴完整聊天记录省 token、更快原生适配复杂多步任务、连环工具调用代码解释、联网、多轮推理适合复杂智能体、长对话、频繁调用工具、多步骤任务链2.4.3.3 生成多样性精确模式模型的输出内容严格遵循指令要求准确性更高、创新性更低。平衡模式默认模型的输出内容更具随机性和准确性准确性和创新性平衡。创意模式模型的输出内容更具多样性和创新性某些场景下可能会偏离主旨。自定义选择了解生成随机性专业叫做温度调整生成结果的随机性。Top P控制生成结果的多样性。简单记生成随机性值越小提高“概率高”词的概率生成随机性值越大提高“概率小”词的概率。Top P控制范围值越高词池越大可能性越多。注意这块得了解大模型生成内容的原理。2.4.3.4 输入及输出设置用于指定模型的输出格式等参数通常包括以下设置。携带上下文轮数设置代入模型上下文的对话历史轮数。轮数越多多轮对话的相关性越高但消耗的 Token 也越多。最大回复长度输出最终结果的最大 token 数量不同模型的 token 限制也不同。指定最大长度可以防止过长或不相关的响应并控制成本。最大推理回答长度 输出推理内容的最大token数量2.4.3.5 默认指令开启后扣子编程将在对话中自动拼接并执行指令包括当前时间开启后智能体在与用户对话时能实时获取并提供准确的时间信息。SP防泄漏指令开启后当用户尝试获取或复述系统内部的规则、提示词或其他敏感内容时智能体将礼貌地拒绝用户的请求确保机密信息不被泄露。2.4.3.6 深度思考普通对话类的可以关闭深度思考节约token。如果涉及复杂业务、计算可打开。​​​​​​​2.4.4 插件2.4.4.1 什么是插件插件是给 AI 智能体新增联网、计算、外部查询等实操能力的外置工具例如查询实时天气、最新资讯。2.4.4.2 插件的使用点击插件后面的号给大模型添加额外的技能。​​​​​​​2.选择想要得插件点击后面的小箭头展开这个插件。点击添加把该插件添加到智能体中。​​​​​​​2.4.5 智能体中的知识库因为大模型在训练时主要依赖网络上公开可获取的数据而大量专业领域知识或企业内部数据并未对外公开导致模型在这些场景下存在明显的知识盲区。为了解决刚刚的问题我们就需要把大模型不知道的内容传递给他这样大模型就可以根据提供的内容回答更精准的数据了。RAG 的全称是 Retrieval-Augmented Generation翻译过来就是「检索增强生成」。 核心思想非常简单先从外部知识库中检索Retrieval出和用户问题相关的资料把检索到的资料作为增强Augmented上下文和用户的问题一起给到大型模型大模型基于这些真实的资料来生成Generation回答这样一来大模型的回答就有了「依据」不再是凭空编造而是基于真实文档生成的。知识可以随时更新更新知识库就行私有数据也能用了把公司文档放进知识库幻觉问题也大幅减少了2.4.5.1 Coze中的知识库在Coze当中知识库中数据的格式支持以下三种格式文本支持PDFTXTMDDOCDOCX和在线文档表格支持EXCELCSV和在线表格照片支持JPGJPEGPNG只能本地​​三、智能体发布3.1 智能体发布扣子商店点击右上角发布按钮。选择发布渠道。Coze的智能体可以发布在很多地方现在我们学习下面两种扣子商店发布到Coze官方应用商店供其他用户搜索和使用。API方式对外提供一个接口对接到我们的项目当中实现私有化部署和深度集成。按照实际情况选择分类。发布记录可以写也可以不写。点击右上角发布。发布成功。3.2 智能体发布API将智能体转为接口支持Java、Python、前端项目直接对接把AI能力融入到我们自己的项目中实现真正的商用落地。对接流程创建个人访问令牌身份密钥智能体开启API发布平台Playground调试接口确保畅通复制官方示例代码对接前后端项目调试排错最终实现流式对话、AI功能落地。3.2.1 准备个人令牌个人令牌是你的身份凭证用于授权API调用防止未授权访问。选择API管理→ 点击授权→ 点击个人访问令牌。点击添加。选择过期时间30天→ 点击全选→ 选择个人空间→ 点击确定。3.3 把Agent融入到项目当中3.3.1 调试在发布页面中点击Playground调试会自动跳转到调试页面。如果不小心关闭了也可以点击发布左侧的三个点再点击API进入。调试参数说明token指个人访问令牌不是大模型的消耗单位。bot_id智能体的唯一标识。user_id与智能体对话的用户标识。stream控制智能体回复是否为流式。流式打字机效果回复内容一段一段出现。非流式所有文字生成完毕后一次性展示。这些参数Coze已默认填充通常无需修改。直接点击右侧的运行按钮进行测试。正常下方响应区域显示绿色成功状态。错误下方有红色错误提示需要根据提示修改输入参数。如果一切正常点击复制按钮获取官方示例代码即可用于项目对接。注意务必先完成调试确保接口畅通再将示例代码交给开发工具如Claude Code参考或集成否则可能导致对接失败。