Skip to main content
Agnes 3.0 Flash Max 是 Agnes AI 的付费文本模型,在国际站提供服务。模型名称为 agnes-3.0-flash-max,按普通输入、缓存输入和输出 Token 分别计费。

概述

通过以下接口接入 Agnes 3.0 Flash Max,构建对话、编码与工具调用应用。

Chat Completions API

Endpoint 与请求头

请求字段

Agnes 3.0 Flash Max 支持以下请求字段。

图像 URL 输入

在 messages[].content 中,将公开可访问的图像 URL 与文本一起传入。

基础请求

响应格式

Chat Completions 响应使用 OpenAI 兼容结构:

工具调用请求

从 choices[].message.content 读取生成文本。模型返回工具调用时,读取 choices[].message.tool_calls,在你的应用中执行相应函数,将结果追加到 messages 后发起下一次 Chat Completions 请求。

Responses API

Responses API 使用 input 传入文本或结构化消息。
从 output 中类型为 message 的项读取生成内容,其中 output[].content[].type 为 output_text。响应对象还可能包含 usage、error 和 incomplete_details。

Messages API

Agnes 3.0 Flash Max 支持 Anthropic 兼容 Messages API。
从 content[] 中 content[].type 为 text 的内容块读取生成文本。

Thinking 模式

需要更充分的任务拆解或推理时,可启用 Thinking 模式。

最佳实践

明确任务目标、仓库或运行环境上下文、限制条件、预期输出和工具权限。执行完工具后,应将工具结果返回对话,再请求模型给出下一步动作。
工具描述与 JSON Schema 应保持精确、聚焦。在应用侧执行会产生副作用的操作前,应先校验工具参数。
将复杂任务拆分为可验证的阶段,并在每轮执行中保留目标、限制条件和关键工具结果。
模型可用性、速率限制和计费以你的 Agnes AI 账户与 API Key 权限为准。

价格与计费

以下为国际站美元价格,M 表示一百万 Token。本模型为付费模型,不适用 Agnes 3.0 Flash 的免费优惠。 缓存价格仅适用于服务确认命中缓存的输入 Token;其余输入按普通输入单价计费,同一输入 Token 不重复计费。模型可用性与速率限制以账户权限为准。