Skip to content

关键概念 ​

连接 AI 助手

这里汇总平台通用概念和各产品的常用术语。产品相关术语按所属产品解释;需要了解具体用法时,可以继续阅读词条中的链接。

租户 ​

租户是智算云平台中的组织隔离单元,代表一个独立的账户空间。每个租户拥有独立的资源配额、用户管理、计费和权限体系。

租户内的用户可根据被授予的权限策略和授权范围执行对应操作,例如管理用户、资源配额、API 密钥或访问特定资源。

更多内容请见 租户管理。

超级管理员 ​

超级管理员是租户内权限最高的管理角色,通常拥有平台预置的全局管理权限。

超级管理员可用于完成租户级配置、权限管理、资源管理和高权限运维操作。为降低误操作风险,应仅将该角色授予确实需要全局管理权限的用户。

用户组 ​

用户组是一种批量管理用户权限的机制。通过将用户加入用户组,可以统一授予该组内所有用户相同的资源访问权限。

  • 一个用户可以属于多个用户组。
  • 用户的最终权限为其个人权限与所属用户组权限的并集。

API 密钥 ​

API 密钥(API Key)是用于访问 API 服务的身份凭证。

  • 用于 GenStudio API 服务调用。
  • 可在访问控制中创建、查看和管理。

更多内容请见 API 密钥管理。

权限策略 ​

权限策略定义用户可以执行的操作。策略需要与授权范围配合使用,授权范围限定策略作用的资源。

  • 系统策略:平台预置的权限策略,用于授予产品功能的常见访问权限。
  • 自定义策略:具备权限管理权限的用户根据业务需求自定义的细粒度权限策略。

更多内容请见 理解策略和授权范围。

授权范围 ​

授权范围用于限定权限策略作用的资源边界。权限策略定义用户可以执行哪些操作,授权范围定义这些操作可以作用于哪些资源。

配置用户或用户组权限时,管理员需要同时选择权限策略和授权范围,才能形成完整的访问控制规则。

更多内容请见 理解策略和授权范围。

按量付费 ​

按量付费是一种按实际使用量结算费用的计费方式。用户无需提前购买长期资源,平台会根据资源运行时长、调用量、存储用量或其他计量维度产生费用。

文档中的“按量计费”与“按量付费”通常指同一类计费方式。实际费用以费用中心、订单、账单或产品页面展示的计费规则为准。

工作流 ​

工作流是由多个步骤、节点或工具调用组成的自动化流程,用于把输入、处理逻辑和输出组织成可复用的执行链路。

在智能体和 ComfyUI 等场景中,用户通过工作流编排模型调用、工具调用、图像生成、数据处理或其他业务逻辑,并可通过页面或 API 发起运行。

智能体开发服务平台(AgentWorks)术语表 ​

本页逐项解释智能体、能力、会话、容错、权限、渠道和 API 中的常用术语。需要了解它们如何配合使用,参见 智能体、插件和实例的关系。

智能体与能力 ​

智能体模板 ​

智能体模板保存可复用的智能体设计,包括模型、提示词、能力关联和运行配置。一个智能体模板可以用于创建多个智能体实例。

修改智能体模板不会自动更新已有智能体实例。需要让实例使用新配置时,请手动更新实例并重新验证运行结果。

任务标题中的“智能体”有时泛指要构建的对象;涉及选择、编辑或更新具体资源时,文档使用“智能体模板”指代这个可复用设计。更多内容请见 智能体、插件和实例的关系。

智能体实例 ​

智能体实例是根据智能体模板创建的运行对象,可以通过网页版对话、调用 API、飞书或 QQ 使用。

每个智能体实例都引用一个智能体模板,但可以具有自己的运行参数、能力资源、访问凭证、状态和会话。部分渠道配置界面使用“应用实例”指代同一个对象。

智能体实例不等同于一次会话或一次调用任务。更多内容请见 从智能体到智能体实例。

主智能体 ​

主智能体是在委托关系中接收原始请求、判断是否委托并组织最终回答的智能体实例。

“主智能体”表示实例在当前委托关系中的角色,不是另一种资源类型。

更多内容请见 理解主智能体和子代理的关系。

子代理 ​

子代理是通过主智能体模板关联、以受委托角色执行专业任务的已有智能体实例。

添加子代理关联不会创建新实例;主智能体根据当前任务决定是否委托,子代理使用自己的模型、提示词和能力完成任务。

更多内容请见 了解子代理和动态委托。

插件配置 ​

插件配置记录智能体模板与能力对象之间的关联,用于让智能体检索知识、调用工具、保存记忆、执行命令或委托子代理。

插件配置不是独立的运行资源。根据能力类型,它可以引用能力模板、已有能力实例、平台工具包、用户工具契约或已有智能体实例。

保存插件配置后,还需要创建或更新智能体实例,并通过实际任务和 Trace 确认能力已经生效。更多内容请见 为智能体添加能力。

能力模板 ​

能力模板保存可重复使用的能力配置,并可以决定创建智能体实例时允许填写哪些参数。

智能体模板通过插件配置选择能力模板后,平台会在创建智能体实例时按照该模板准备或绑定运行所需的能力资源。能力模板适合统一基线、复用配置或按需准备资源的场景。

创建第一个智能体并不要求预先创建能力模板。更多内容请见 模板和实例如何影响资源。

能力实例 ​

能力实例是智能体运行时实际使用的能力资源或连接,例如 MCP 连接、知识库组、记忆库、技能组或沙箱。

在插件配置中选择已有能力实例,会让智能体模板直接关联该资源。由同一智能体模板创建的多个智能体实例可能共享它;选择已有实例不会自动复制资源或隔离其中的数据、凭证和权限。

需要按统一配置为新智能体实例准备资源时,请改用能力模板。更多内容请见 模板和实例如何影响资源。

知识库组 ​

知识库组把一个或多个知识库集合(Collection)及默认检索参数提供给智能体,用于检索已经完成入库的资料。

知识库组引用集合,不复制其中的资料;不同知识库组仍可引用同一个集合。

更多内容请见 配置知识库组模板和实例。

知识库集合(Collection) ​

知识库集合(Collection)保存资料入库后实际用于检索的向量数据。

文件、飞书文档、网页 URL 或 Sitemap 中的资料导入集合后,可以通过知识库组提供给智能体检索。

向量模型把资料和检索问题转换成用于匹配相关内容的向量,不负责生成智能体回答。集合列表中的“向量模型(只读)”显示这个模型的标识,不是智能体回答时使用的语言模型。

更多内容请见 创建集合并导入知识。

记忆库 ​

记忆库保存可以在后续交互中检索的事实、偏好和上下文,让智能体在另一段会话中继续使用这些信息。

新建会话不会创建、清空或隔离记忆库;多个智能体实例连接同一个记忆库时,会使用同一份记忆。

更多内容请见 添加并验证记忆库。

MCP ​

MCP(Model Context Protocol,模型上下文协议)是一种连接智能体与外部工具、数据的协议。在 智能体开发服务平台(AgentWorks) 中,MCP 能力用于连接平台外运行的 MCP Server,让智能体发现并调用其中的工具。

MCP 实例保存实际使用的服务地址、超时、TLS 和请求头配置;工具由远程 MCP Server 执行。

更多内容请见 使用 MCP 实例连接外部工具。

Skill ​

Skill 是包含 SKILL.md 和相关文件的版本化工作说明包,为智能体提供完成任务的方法和资源。

智能体通过技能组按需加载 Skill;Skill 本身不是可直接执行的工具,调用服务、运行命令或执行脚本还需要相应的工具或沙箱。

更多内容请见 创建和维护可复用的 Skill。

技能组 ​

技能组把一个或多个 Skill 组合起来,供智能体按当前任务选择和加载。

智能体模板可以关联已有技能组实例,也可以通过技能组模板为每个智能体实例生成独立技能组;加入技能组不表示每次请求都会激活其中全部 Skill。

更多内容请见 使用技能组为智能体提供一组 Skill。

沙箱 ​

在智能体开发服务平台(AgentWorks)中,沙箱是与智能体实例关联的隔离运行环境,可向智能体提供命令、文件和代码执行工具。

选择沙箱模板时,创建智能体实例会为该实例创建沙箱资源;选择现有沙箱实例时,会复用同一个资源。新建会话不会自动创建沙箱。选择方法参见 配置沙箱模板和实例。

平台工具包 ​

平台工具包是 智能体开发服务平台(AgentWorks) 内置工具的选择入口,所选工具由 AgentWorks 执行,不需要另外部署 MCP Server 或由调用方执行并回传结果。

平台工具包与沙箱是独立配置,添加平台工具包不会创建或关联沙箱。

更多内容请见 使用平台工具包。

用户工具包 ​

用户工具包让智能体调用业务应用提供的工具,由智能体模板保存工具定义,业务应用实现并执行对应操作。

智能体开发服务平台(AgentWorks) 通过中断返回工具名称和参数,你自己的应用校验请求、在自己的环境中执行工具并回传结果,智能体再继续处理任务。

更多内容请见 使用用户工具包让智能体调用你自己的业务能力。

会话与运行 ​

API 会话 ​

通过 API 调用时,平台按渠道身份和会话信息组织多轮对话。服务端返回的 context_key 对应事件中的 sid;每次输入的 msg_id 对应事件中的 mid。

会话和一次运行是不同对象。运行完成或取消不表示历史已删除,开始新会话也不会自动创建或清空记忆库和沙箱。

调用方应保存用户、业务会话和服务端标识的对应关系。更多内容请见 管理会话、运行和中断。

单次运行(调用任务) ​

单次运行(调用任务)是智能体实例处理一次输入的执行过程,同一段会话可以包含多次运行。

自动重试仍属于原请求,不表示用户发起了另一次调用;收到重试提示也不表示本轮已经结束。

中断后回传响应是让尚未完成的任务继续处理,不表示新建会话;本轮结束不会自动结束整个会话、记忆库或沙箱。

更多内容请见 管理会话、运行和中断。

中断 ​

中断表示智能体暂时停止继续处理,等待外部决定或工具结果,例如等待 工具审批,或等待你自己的应用执行用户工具。暂停等待不等于运行失败。

调用方提交决定或结果后,还要根据后续运行事件判断本轮是否结束;提交成功不等于任务完成。

更多内容请见 响应中断。

Trace(运行记录) ​

Trace(运行记录)记录一次智能体运行的输入、模型执行、工具调用与结果、耗时,以及中断和恢复信息,用于定位问题发生在哪个环节。

更多内容请见 查看智能体实例 Trace。

容错与重试 ​

容错配置 ​

容错配置用来限制智能体等待多久,并决定调用失败后是否自动重试、是否尝试备用模型。

任务级容错管理整次处理的超时和重试,包括其中的模型调用和工具调用;步骤级容错分别管理每一次模型或工具调用的超时和重试。这里的“步骤”指一次调用,不是文档中的操作步骤。

更多内容请见 配置超时、自动重试和备用模型。

自动重试 ​

自动重试是在遇到可恢复的调用失败时,平台按配置再次尝试当前任务或其中的一次模型、工具调用,用户不必重新发送同一条消息。重试仍属于原请求。

重试不会撤销已经完成的业务操作。下单、发送通知等工具可能重复执行,因此需要业务系统支持重复请求去重。

更多内容请见 设置模型和工具的单次超时与重试。

模型降级切换(Failover) ​

模型降级切换(Failover)是在主模型暂时不可用时,按配置的顺序尝试备用模型,让当前任务有机会继续处理。

切换发生在模型调用的自动重试中,受重试次数和超时限制,不保证尝试列表中的每个模型。主模型和备用模型共用当前智能体的模型凭证。

更多内容请见 在模型调用失败时切换备用模型。

租户备用模型池 ​

租户备用模型池是租户统一维护的备用模型清单,用来限定智能体可以选择哪些备用模型。

启用非空备用池后,智能体模板和实例只能从池内选择备用模型。池里保存的是模型清单,不是所有智能体共用的一份凭证;各智能体仍使用自己的模型凭证。

更多内容请见 为租户限定备用模型范围。

成员权限与工具审批 ​

访问控制 ​

访问控制用于规定团队成员在智能体开发服务平台(AgentWorks)中能执行哪些操作、能操作哪些资源。

权限来自直接授予账号的 权限策略,或所属用户组的策略。它管理的是成员对平台资源的访问,不代替智能体运行时的工具审批。

更多内容请见 查看用户与权限。

权限策略 ​

权限策略是智能体开发服务平台(AgentWorks)中的一组权限规则,写明允许或拒绝哪些操作,以及这些操作适用的资源范围。

资源范围写在策略正文中。把同一策略授予不同用户或用户组时,使用的都是这份策略内容;只创建或保存策略,不会自动给成员授权。

更多内容请见 配置权限策略。

工具审批(HITL) ​

工具审批(HITL)是在智能体准备调用工具时,按规则决定直接批准、拒绝执行,或暂停并等待人工确认。

它管理的是运行中的工具调用,不是控制台成员的资源访问权限。人工批准只允许当前调用继续,不会增加工具本身的文件、网络或业务系统权限,也不表示工具已经执行成功。

更多内容请见 配置工具审批流程。

渠道与 API ​

渠道账号 ​

渠道账号把飞书、QQ 或 WebSocket 等外部入口连接到 智能体开发服务平台(AgentWorks),并保存该入口所需的渠道配置和凭证。

渠道账号可以绑定一个已有智能体实例,让渠道用户共享该实例;也可以绑定智能体模板,让不同渠道用户通过 /init 按需创建专属智能体实例。

渠道账号不等同于渠道用户、用户绑定或渠道会话。更多内容请见 通过渠道提供智能体。

模板绑定 ​

模板绑定是渠道账号关联智能体模板、为不同渠道用户按需创建专属智能体实例的绑定方式。

用户首次完成 /init 时,平台创建实例并保存用户绑定;实例分开不等于关联的数据、记忆和权限自动隔离。

更多内容请见 为每位用户按需开通实例。

实例绑定 ​

实例绑定是渠道账号将消息发送到一个已有智能体实例的绑定方式,不会按渠道用户动态创建实例。

同一账号可以供一位或多位用户使用;不同渠道会话可以分开对话,但仍可能共用实例配置及其关联资源。

更多内容请见 使用已有智能体实例。

用户绑定 ​

用户绑定记录一个渠道用户与一个专属智能体实例之间的对应关系。它只在渠道账号使用模板绑定、并为用户按需创建实例时产生。

后续消息根据用户绑定进入已经创建的智能体实例。删除用户绑定不会删除原智能体实例;用户重新执行 /init 后,平台可以创建实例并建立新的绑定。

用户绑定不等同于渠道会话,也不会单独证明记忆、业务数据或外部账号已经按用户隔离。更多内容请见 管理渠道账号与用户绑定。

智能体接入 Token ​

智能体开发服务平台(AgentWorks)的智能体调用 HTTP 请求与 WebSocket 握手使用 WebSocket Token。它绑定渠道账号,渠道账号再绑定智能体模板或实例。

Token 由调用方服务端保管,不能代替控制台登录身份,也不同于大语言模型的文本计量 Token。

创建步骤请见 为客户端创建 Token;更换或撤销凭证请见 分批轮换 WebSocket Token。

智能体调用接口(Bridge API) ​

Bridge API 是 智能体开发服务平台(AgentWorks) 提供给业务应用调用智能体的一组接口,包括 HTTP API 和 WebSocket API。应用通过 HTTP 发送消息、查询历史和回传工具结果,通过 WebSocket 订阅并接收智能体回复和运行事件。

平台技术文档也将这条接入通道称为 Bridge Channel。它不是额外的通信协议,也不包含控制台内部的资源管理接口。

接入方式和调用流程参见 API 接入概览。

大语言模型 ​

大语言模型是面向自然语言理解、生成、推理和对话等任务的基础模型。文档中的“大模型”在多数上下文中也指这一类模型或以大语言模型为核心的模型服务。

在 GenStudio 中,用户可以通过体验中心、API、模型广场或微调服务使用大语言模型,并根据模型能力、上下文长度、价格和调用限制选择合适的模型。

模型广场 ​

模型广场是 GenStudio 用于集中展示平台预置模型的产品页面。用户可以按模型类型、任务场景、上下文长度、兼容协议、模型提供方等条件筛选模型,并查看模型卡片和详情页。

模型广场中的模型卡片和详情页通常提供模型 ID、上下文长度、最大生成长度、输入输出模态、兼容协议、调用说明、价格或服务限制等信息。接入 GenStudio API 或编码套餐前,用户应以模型广场展示的当前能力和调用信息为准。

Token ​

Token 是大语言模型处理文本的基本计量单位。模型会把输入文本拆分为 Token,并按 Token 序列生成输出。

在 GenStudio 中,Token 常用于描述上下文长度、最大输出长度、API 频率限制、用量统计和计费。一次调用通常会分别统计输入 Token 和输出 Token。

上下文长度 ​

上下文长度是模型一次请求中可处理的输入与输出 Token 总量上限。它决定模型能够同时接收多少历史消息、提示词、工具结果或其他文本内容。

选择模型时,用户应结合任务所需的上下文长度和最大输出长度评估模型是否适合当前业务场景。

API 频率限制 ​

API 频率限制用于控制租户或 API Key 在固定时间窗口内可发起的请求量、Token 用量或其他调用量,避免单个调用方影响整体服务稳定性。

GenStudio LLM API 常见限制维度包括 RPM、RPD 和 TPM。触发频率限制后,请求可能返回限流错误,用户需要降低调用频率、缩短请求内容或升级服务等级。

包并发服务 ​

包并发服务是一种预先购买并发处理能力的容量保障方式。用户购买并发槽位后,可在约定范围内获得更稳定的请求处理能力。

在 GenStudio LLM API 和 ComfyUI 工作流等场景中,包并发服务可用于降低高峰期与其他用户争用公共资源的风险,并提升实时业务的响应稳定性。