deepseek-v4-flash 将于 2026 年 10 月 9 日 12:00 下架。推荐替换模型为 deepseek-v4.1-flash,请提前完成迁移。
Release notes
更新日志
2026-09-24
智能体模板新增容错配置,可以分别设置整次任务、模型调用和工具调用的超时与自动重试,并为模型调用选择备用模型。模板还可以允许不同实例单独调整容错设置。
配置方法参见 配置超时、自动重试和备用模型。
模型凭证页提供备用模型池配置入口。启用非空备用池后,智能体模板和实例从租户备用池选择模型;使用来源凭证测试并保存时,核对模型名称是否在该凭证的模型列表中,获取列表失败或名称不符时不会保存。
详情参见 为租户限定备用模型范围。
飞书渠道账号新增可自我审批人员名单。名单中的人员只能处理自己发起的任务;全局审批人员仍可处理其他人发起的任务,两份名单可以同时使用。
详情参见 配置工具审批流程。
自动重试过程可在网页版对话、飞书和 QQ 中查看。网页版对话显示重试状态、折叠已作废的输出,并在历史记录中保留任务重试次数;重试期间仍可停止任务。
详情参见 查看自动重试和失败结果。
智能体接入 API 新增 lifecycle.phase=retry 事件,可提供重试范围、尝试序号和上限。该事件表示任务仍在运行,客户端应继续等待成功、失败或取消,不要立即重新提交请求。
接口影响参见 智能体接入 API 更新日志。
知识库集合列表新增只读向量模型信息,方便核对集合使用的向量模型。
详情参见 创建知识库集合并导入资料。
新建智能体模板默认开启模型和工具调用的步骤级容错:单次超时 3600 秒,最多重试 3 次,间隔 3 秒。任务级容错、备用模型切换和实例单独配置默认关闭。尚未设置容错的历史模板会补充这份默认配置;已设置的配置保持不变。已有实例需要应用模板更新后再验证。
详情参见 应用到已有实例并验证。
任务失败后保留本次运行的上下文。继续同一会话前,可以查看失败原因和已有输出;需要不受这次任务影响的对话时,开启新会话。
详情参见 管理会话和处理中断。
飞书扫码注册增加通讯录、部门和用户信息相关权限的申请,以便识别审批人员。已有飞书应用需要检查实际授予的权限。
详情参见 扫码注册飞书账号。
移除按租户单独配置导航和插件类型的功能。控制台显示统一导航及插件选项;账号能查看和操作哪些资源仍由访问控制策略决定。
详情参见 准备租户资源与成员权限。
凭证管理不再显示旧 Agent API Token 页签。业务系统调用智能体时,使用绑定渠道账号的 WebSocket Token。
修复部分受“仅自己数据”权限限制的账号无法重启智能体、更新实例或操作关联能力的问题。
修复共享记忆库内容按登录账号分散显示的问题。同一记忆库中的条目按共享资源管理,查看、检索和清空不按登录用户分别划分;界面不再把条目显示为某个登录用户的个人记忆。
共享范围参见 管理记忆条目。
智能体详情的渠道列表改为显示实际绑定的渠道账号,修复手动创建渠道账号后列表中看不到它的问题。
修复沙箱运行记录的时长和结束时间显示错误,以及部分受限账号看不到自己沙箱运行记录的问题。
详情参见 查看 Trace、指标和运行记录。
任务失败或取消后,网页版对话将未完成工具标记为已终止,失效的审批和提问卡片不能继续操作,避免把旧卡片当作仍待处理的任务。
修正运行记录中已有的调用者信息,优先使用本轮实际调用者,而不是实例创建者。子代理失败时保留可取得的错误原因,缺少错误文字时提供可读提示,避免只显示空白错误。
详情参见 查看智能体实例 Trace和 管理子代理委托。
明确定时任务工具默认按北京时间生成表达式;用户没有指定其他时区时,不需要换算成 UTC。
详情参见 验证定时任务。
加强智能体实例、渠道账号、知识库任务和沙箱运行记录的租户及资源权限检查,防止仅凭资源 ID 读取不属于当前授权范围的数据。
飞书已配置审批人员但所有人员身份都无法解析时,审批和提问卡片不提供可用操作入口,不会自动改为由发起人自行处理。检查飞书通讯录权限和审批人员配置后再继续。
2026-09-21
修复多个子代理并行时,某个子代理尚未完成的工具调用出现在主会话的问题。这类调用刷新后不在历史中,界面却一直停在执行中。现在工具调用留在产生它的那次子代理运行里。
详情参见 排查子代理委托。
修复多个子代理完成后,网页版对话里主会话的用量和轮次标记消失的问题。这些用量记入触发委托的那次用户提问,轮次标记也会保留;回退仍停在这次用户输入之前。子代理面板中的用量和轮次仍单独显示。一条用户消息都没有的定时任务会话,用量仍在会话累计用量中查看。
修复多个子代理几乎同时完成时,结果回不到主会话的问题。同时完成的结果会一起交给主智能体;其中失败的任务会标明失败,不会被当成已经取到结果。
修复 MCP 工具返回文件链接或非图片文件后,本轮对话中断的问题。模型随后收到的是链接或类型与长度说明,二进制内容不会进入对话。图片和文本资源的返回方式不变。
详情参见 在智能体实例中验证工具。
2026-09-18
新增对公汇款充值功能。完成企业认证的租户可在费用中心获取专属收款账号、创建汇款订单,并使用与认证主体一致的企业银行账户汇款。订单有效期为 48 小时;支付成功后,充值金额自动计入账户余额,并向所有租户超管发送到账短信。支持查看汇款记录和订单详情,以及关闭等待付款的订单。非租户超管用户可通过权限策略授权使用相关功能。
2026-09-16
网页版对话支持按名称搜索智能体实例。实例列表按需加载;后续加载失败时,已显示的实例会保留,方便重试。
详情参见 在网页版对话中验证对话。
在智能体模板中添加记忆能力时,交互模式默认选择 AUTO_EXTRACT_AND_TOOL:自动保存记忆,需要时由智能体调用工具检索。也可选择 TOOL,由智能体通过工具保存和检索记忆。
详情参见 选择写入和检索方式。
智能体模板中选定的模型凭证显示凭证名称;凭证设有默认模型时,同时显示模型名称,方便核对所选凭证。
修复部分 MCP 服务无响应时,连接测试或工具列表获取长时间停留在等待状态的问题。超时后会返回失败结果,便于检查连接配置后重试。
详情参见 测试连接并查看工具列表。
修复部分耗时较长的 MCP 工具调用被连接初始化阶段的超时设置提前中断的问题。
修复 Trace 详情改写输入和输出的问题。空白的输入或输出不再用其他观测记录填上,输出中的消息也不再因为编号与输入相同而被删除。刷新 Trace 后,按记录本身的输入和输出核对。
详情参见 查看智能体实例 Trace。
修复历史消息较多时回放容易断开,以及部分断线重连后无法继续收到新消息的问题,改善网页版对话和通过 API 接入的应用的历史恢复。
WebSocket 协议格式和鉴权方式不变,无需再次迁移接口。历史回放可能合并同一消息的相邻文本增量,正文与思考文本分别合并;请检查客户端的文本拼接和失效游标恢复逻辑。
兼容性影响参见 智能体接入 API 更新日志:2026-09-16;接入方法参见 心跳、重连与补偿。
2026-09-15
智能体模板新增用户提问、联网搜索和当前时间设置。智能体可在信息不足时向用户提问,使用 Tavily 搜索和读取网页,并在处理任务时参考当前时间。联网搜索需要配置 Tavily API Key。
详情参见 按任务补充交互能力。
登录改为通过云管平台统一认证。请从 AgentWorks 地址进入,在跳转后的登录页使用分配的完整登录名和密码登录,完成后返回 AgentWorks。
详情参见 登录 AgentWorks。
智能体测试改用独立的「网页版对话」,替代实例详情中的 Playground。可选择智能体实例进行多轮对话、填写补充信息,并逐项批准或拒绝工具调用;多个调用同时等待审批时,也可全部批准或全部拒绝。
详情参见 在网页版对话中验证对话。
**API 不兼容变更:**WebSocket 子协议由 infini.bridge.v1 改为 infini.bridge.v2。消息和中断响应改用 HTTP 提交,WebSocket 用于订阅智能体回复和运行事件。旧 Direct Invoke 和旧 WebSocket 客户端均需迁移,不能只替换接口地址。
连接后的 auth / auth_ok 流程已移除,改为握手鉴权;客户端需订阅会话,并调整运行结束判断和默认会话类型。
兼容性变化参见 智能体接入 API 更新日志:2026-09-15;旧 Direct Invoke 和 Bridge v1 调用方参见 迁移旧版智能体接入。
文件系统工具支持逐项选择,并提供「仅只读」预设,便于按任务限制可用的文件操作。开启「写前必须读」后,使用文件写入或编辑工具修改已有文件前,需要先读取当前版本。
详情参见 配置文件工具。
上下文压缩统一通过「启用压缩」开关配置,使用主模型生成摘要,无需选择压缩模式、单独配置压缩模型或设置阈值。
详情参见 配置上下文压缩。
编辑并保存智能体实例时,由能力模板生成的 MCP、mem0 记忆库、知识库组、技能组和沙箱配置会按当前模板和实例参数重新应用。直接修改过的生成资源配置可能被覆盖;更新前请记录需要保留的配置,保存后逐项检查实际结果。直接关联的已有能力实例仍按原引用使用。
详情参见 手动应用新配置。
修复知识库定时重跑的状态展示。最近一次执行失败时显示失败原因,并将此前的成功记录标为「上次成功任务」,避免把旧记录误认为本次重跑成功。
详情参见 检查任务状态和日志。
2026-09-09
「费用中心」新增一次性预算,支持自定义有效期起止日期,并设置有效期内的累计消费预算额度。
2026-08-28
自 2026 年 8 月 28 日起,deepseek-v4-flash-0731 和 deepseek-v4-pro-0813 支持闲时半价计费:每日北京时间 22:00 至次日 08:00 为闲时,按忙时价格的 50% 计费;其余时段为忙时。deepseek-v4-flash 和 deepseek-v4-pro 的价格也将于近期调整。
以下模型已于 2026 年 8 月 28 日下线。请按照以下建议迁移至替代模型:
-
已下线 DeepSeek 模型:建议替换为
deepseek-v4-flash或deepseek-v4-pro。deepseek-r1deepseek-v3deepseek-v3.1deepseek-v3.1-terminusdeepseek-v3.2deepseek-v3.2-thinking
-
已下线 GLM 文本模型:建议替换为
glm-5.2。glm-4.5glm-4.5-airglm-4.6glm-4.7glm-5
-
已下线 GLM 视觉模型:建议替换为
kimi-k2.6。glm-4.5vglm-4.6v
-
已下线 MiniMax 模型:建议替换为
minimax-m2.7。minimax-m2.1minimax-m2.5
-
已下线 Kimi 模型:建议替换为
kimi-k2.6。kimi-k2.5
2026-08-20
新增文件系统功能和 Todo List。新建智能体默认启用文件系统,可为模型提供读写文件工具;需要纯模型对话时,请在创建前关闭该开关。Todo List 默认关闭,可按任务需要单独启用。未关联沙箱时,智能体文件工具按会话读写文件,新会话看不到上一会话创建的文件;关联沙箱后,文件工具使用沙箱工作区。需要跨会话长期保留文件时,请写入已批准的外部存储。详情参见 创建智能体。
Invoke API 和 WebSocket API 新增尽力而为的运行进度事件,Playground 会显示相应进度。进度仅用于改善等待体验,不替代 Trace、审计记录或完成事件;该次发布的调用方仍须以 done 作为流结束标志。升级到 Bridge v2 时,参见 迁移回复解析和完成判定。
工具审批统一迁移到智能体的「工具权限」配置,不再使用沙箱级审批开关。规则按拒绝、允许、默认策略的顺序判定;新建智能体不配置规则时默认不启用人工审批。渠道自动批准和用户自定义工具的交互式回复仍是独立机制。详情参见 配置工具权限和人工审批。
上下文压缩新增使用主模型生成摘要的新版模式,同时保留兼容模式。修改已有智能体的压缩模式后,需要同步配置并重启现有实例;新版模式不再单独配置摘要模型和压缩阈值。详情参见 配置新版压缩。
2026-08-18
上线 DeepSeek V4 系列模型。
deepseek-v4-flash-0731deepseek-v4-pro-0813
2026-08-14
GenStudio Embeddings API 新增支持 OpenAI 兼容参数 dimensions。bge-m3 模型不支持该参数,请求时必须将其省略。
2026-08-03
统一 OpenAI Chat Completions API 流式响应中的 Token 用量统计行为。兼容性提示:若需在流式响应中获取 usage,请显式设置 stream_options.include_usage=true。此前依赖部分模型默认返回 usage 的调用可能受到影响;如果所用 SDK 已自动设置该参数,则无需调整。
2026-07-28
智能体模板同时关联 Skill 组和「沙箱 - 模板」时,新建智能体实例会将所选 Skill 版本的文件以只读方式挂载到实例沙箱的 /skills 目录。直接选择现有沙箱实例不会新增该挂载;需要不同 Skill 集的智能体实例不要复用同一沙箱。脚本仍需显式执行,运行依赖仍需由沙箱环境提供。详情参见 准备沙箱执行内容。
优化知识库检索相关性,新增结果重排能力。该能力由平台统一配置,用户无需在知识库组中单独设置。检索结果包含图片时,使用支持图像输入的模型可以处理图片内容。详情参见 理解一次运行时检索。
Invoke API 的文件上传端点由 /api/agents/Upload 调整为 /api/v2/UploadMedia,旧端点不再提供。上传响应中的 url 现在是包含 exp 和 sig 参数的限时签名 URL。已有调用方需要迁移端点,并把返回的完整 URL 作为不透明值使用;URL 过期后请重新上传文件。当前接入的文件支持范围,参见 能否像旧 Invoke 一样,通过调用接口直接提交文件?。
修复飞书消息卡片在同一轮响应包含多个工具调用时可能漏显中间调用或错配结果的问题。现在会按调用 ID 关联并分别显示每项执行状态和结果。
修复渠道消息达到重试上限后原消息入口可能没有错误提示的问题。平台现在会尝试返回错误提示,减少只有后台错误而用户没有提示的情况。
优化多副本部署下的数据库连接管理,提高服务稳定性。
2026-07-23
AgentWorks 首次发布,支持在控制台创建智能体模板和智能体实例。
2026-07-22
不再支持个人实名认证。
2026-06-30
以下模型已下架:
deepseek-r1-distill-qwen-32bdeepseek-v3.2-expqwen3-vl-235b-a22b-thinkingqwen3-vl-235b-a22b-instructqwen3-next-80b-a3b-thinkingqwen3-next-80b-a3b-instructqwen3-coder-480b-a35b-instructqwen3-235b-a22b-instruct-2507qwen3-235b-a22bqwen3-8bqwen3-14bqwen3-32bqwen3-30b-a3bkimi-k2-thinking
如果您的业务此前使用这些模型,可以按业务场景优先评估以下替换方向,帮助完成迁移:
- 如果当前使用上述 Qwen3 系列模型,建议优先评估
qwen3.6。 - 如果当前使用
deepseek-r1-distill-qwen-32b或deepseek-v3.2-exp,建议优先评估deepseek-v4-flash或deepseek-v4-pro。 - 如果当前使用
kimi-k2-thinking,建议优先评估kimi-k2.6。
2026-06-19
以下模型已于 2026 年 6 月 19 日下架:
baichuan-m2-32bjina-embeddings-v2-base-codejina-embeddings-v2-base-zh
2026-06-18
上线 Qwen3.6 系列模型。可在体验中心试用,支持 API 调用。
qwen3.6-27bqwen3.6-35b-a3b
2026-06-17
上线 GLM-5.2。可在体验中心试用,支持 API 调用。
glm-5.2
2026-06-16
以下产品支持预算管理:
- ComfyUI 工作流调用
ComfyUI API 新增错误码 10024,表示当前账号消费已超过预算金额上限。遇到该错误时,请调整预算上限,或联系管理员处理预算限制。
GenStudio API 新增错误码 10024,表示当前账号消费已超过预算金额上限。遇到该错误时,请调整预算上限,或联系管理员处理预算限制。详情请参见 GenStudio LLM API 错误码、图片和视频生成 API 错误码。
以下产品支持预算管理:
- 预置服务按量在线调用
- 视频大模型调用
- 批量推理
2026-05-31
大语言模型 API 新增被动缓存(cache)功能,输入中被缓存命中的部分按优惠价格计费。
- 于 2026 年 6 月 1 日 00:00 起生效。
- 暂仅支持部分模型。已支持被动缓存的模型及缓存命中后的计费价格,请前往平台服务列表页面查看。
- 仅适用于采用按量计费的客户。如合同已约定具体价格或优惠,则以合同约定价为准。
2026-05-28
「费用中心」新增预算管理功能。支持按用户设置每周、每月预算额度,查看预算消耗情况。支持限制全部产品或指定产品。
2026-05-07
2026-04-28
上线 Mimo V2.5 Pro。可在体验中心试用,支持 API 调用。
mimo-v2.5-pro
2026-04-22
2026-04-21
上线 Kimi K2.6。可在体验中心试用,支持通用 LLM API 调用。
kimi-k2.6
2026-04-10
以下模型下架,请提前完成迁移或替换:
deepseek-ocrernie-4.5-21b-a3bernie-4.5-300b-a47bkimi-k2-instructminimax-m2qwq-32b
2026-04-08
上线 GLM-5.1。可在体验中心试用,支持 API 调用。
2026-04-02
调整用量统计页面的数据更新时效:用量统计页面中的数据通常会在您实际发起 API 调用后约 10 分钟更新。
2026-03-30
停止提供基础版 LLM API 免费服务(网页端持续免费),请关注账户余额,及时充值。
2026-03-18
上线 Minimax 系列大语言模型。可在体验中心试用,支持 API 调用。
minimax-m2.7
2026-02-13
2026-02-12
上线智谱系列大语言模型。可在体验中心试用,支持 API 调用。
glm5
2026-02-11
下架 OpenAI GPT OSS 系列模型。
gpt-oss-20b
2026-02-02
2026-01-29
上线 Kimi 系列大语言模型。可在体验中心试用,支持 API 调用。
kimi-k2.5
2026-01-17
2025-12-24
上线 Minimax 系列大语言模型。可在体验中心试用,支持 API 调用。
minimax-m2.1
2025-12-23
上线智谱系列大语言模型。可在体验中心试用,支持 API 调用。
glm4.7
2025-12-10
上线智谱系列大语言模型。可在体验中心试用,支持 API 调用。
glm4.6v
2025-12-02
上线 DeepSeek 系列大语言模型。可在体验中心试用,支持 API 调用。注意,以下单独的模型 ID 能力相同,仅默认行为不同。
deepseek-v3.2(默认非思考模式)deepseek-v3.2-thinking(默认开启思考模式)
2025-11-21
支持 Anthropic 兼容的 Messages 接口。暂仅支持部分模型。
glm-4.6glm-4.5minimax-m2
最新支持情况请访问智算云平台 GenStudio 模型广场,以「Claude 兼容」筛选结果为准。
2025-11-20
下架阶跃星辰 Step 系列大语言模型。
step3
2025-11-06
上线 DeepSeek-OCR 模型。支持 API 调用。
deepseek-ocr
2025-10-21
参数调试页支持「刷新参数」。在参数表单未包含最新参数时,可拉取最新枚举值(如模型列表、采样器等),最长约 5 分钟完成。
原生 ComfyUI 编辑器可自动获取最新枚举值(如模型列表、采样器等)。
调整原生 ComfyUI 编辑器入口为工作流详情页的标签页,ComfyUI 编辑器支持全屏展示。
调用记录新增「任务来源:系统任务」,可区分由平台发起的维护性任务。系统任务不计费,且不占用租户购买的包并发槽位。