Skip to main content
Agnes 2.5 Flash 是基于 Agnes 2.0 Flash 升级的全量可用语言模型。它沿用 OpenAI 兼容的 Chat Completions 接入方式,同时在编码任务、智能体工作流、工具调用、多轮对话、推理和图像理解体验上进行了优化。

模型名称

agnes-2.5-flash

API Endpoints

Chat Completions:POST /v1/chat/completions
Responses:POST /v1/responses
Messages:POST /v1/messages

发布状态

已全量上线,面向具备 Agnes API 访问权限的用户开放。

升级路径

与已废弃的 agnes-2.0-flash API 兼容,便于迁移。

概述

Agnes 2.5 Flash 面向已经接入 Agnes 2.0 Flash 的开发者设计。大多数场景下,你只需要把请求中的 model 值替换为 agnes-2.5-flash;Base URL、Endpoint、请求头、消息格式、流式响应格式、工具调用格式和图像 URL 输入格式保持不变。 该模型重点提升开发者体验、指令遵循稳定性、多轮输出一致性,以及代码生成、调试、重构、解释和智能体编码工作流等代码专项能力。
直接使用 agnes-2.5-flash 作为模型名称。agnes-2.0-flash 已废弃,现有集成应尽快完成迁移。

核心能力

聊天补全

为对话、应用和业务系统生成高质量响应。

多轮对话

在连续交互中保持上下文一致性。

图像 URL 输入

支持通过公开可访问的图像 URL 输入视觉内容。

图像理解

可用于截图分析、图像描述、视觉问答和信息提取。

工具调用

支持函数调用和外部工具编排。

智能体工作流

优化规划、执行、上下文跟踪和多步骤任务完成体验。

代码专项任务

针对代码生成、调试、重构、解释和补丁式开发工作流进行优化。

流式输出

支持实时返回响应,提升交互体验。

适用场景

AI 助手

通用问答、效率助手、个人助理和应用内 Copilot。

自主智能体

多步骤任务执行、规划、工具使用和工作流调度。

编码助手

代码生成、Bug 排查、重构建议、代码审查、测试生成和代码解释。

客户支持

FAQ 自动回复、客服机器人和服务自动化。

搜索与问答

基于检索的问答、摘要生成和信息提取。

图像理解

截图分析、图片描述、视觉问答和结构化提取。

从 Agnes 2.0 Flash 升级

如果你已经在调用 agnes-2.0-flash,升级到 2.5 Flash 的改动很小。
对已有集成来说,迁移通常只需要替换模型名称。请勿继续将已废弃的 agnes-2.0-flash 作为兼容回退。

API Reference

Endpoint

请求头

请求参数

图像 URL 输入

Agnes 2.5 Flash 支持在同一个 messages 请求中同时传入文本和图像 URL。

请求示例

响应格式

响应字段

Responses API

除 Chat Completions 外,该模型还支持 OpenAI Responses API。使用 input 代替 messages 传递输入。

Responses Endpoint

Responses 请求参数

Responses 输出格式

当前响应不包含顶层 output_text 便捷字段。请从 output[].typemessage、且 output[].content[].typeoutput_text 的内容块中读取生成文本。
Reasoning 输出是可选项,可能位于 content[].reasoning_text,也可能位于 summary[].summary_text。不同模型的 Token 字段命名也可能不同,客户端应同时兼容 input_tokens / output_tokensprompt_tokens / completion_tokens
如果 statusincomplete,请检查 incomplete_details,并使用更大的 max_output_tokens 重试。推理模型可能在输出回答正文前消耗一部分输出预算。

Messages API

该模型还支持 Anthropic 兼容的 Messages API。使用 messages 传递对话输入,并通过 x-api-key 完成认证。

Messages Endpoint

Messages 请求头

Messages 请求参数

Messages 请求示例

Messages 响应格式

请从 content[].typetext 的内容块读取生成正文。如果 stop_reasonmax_tokens,请提高 max_tokens 后重试。

Thinking 模式

对于编码、调试、推理和智能体工作流,可以启用 Thinking 模式以提升任务分解和问题解决能力。
常规编码任务建议从 budget_tokens: 2048 开始;复杂调试、重构或多步骤智能体任务可适当提高预算。

最佳实践

限制与价格

Agnes 2.5 Flash 已全量上线。可用性、速率限制和计费规则以你的 Agnes AI 账户和 API Key 权限为准。

接入检查清单

使用 agnes-2.5-flash 作为模型名称。
基础聊天补全请求必须包含 modelmessages
图像输入需要使用公开可访问的 image_url
流式响应请将 stream 设置为 true