Agnes 3.0 Flash Max 是 Agnes AI 的付费文本模型,在国际站提供服务。模型名称为
agnes-3.0-flash-max,按普通输入、缓存输入和输出 Token 分别计费。概述
通过以下接口接入 Agnes 3.0 Flash Max,构建对话、编码与工具调用应用。Chat Completions API
Endpoint 与请求头
请求字段
Agnes 3.0 Flash Max 支持以下请求字段。图像 URL 输入
在messages[].content 中,将公开可访问的图像 URL 与文本一起传入。
基础请求
响应格式
Chat Completions 响应使用 OpenAI 兼容结构:工具调用请求
choices[].message.content 读取生成文本。模型返回工具调用时,读取 choices[].message.tool_calls,在你的应用中执行相应函数,将结果追加到 messages 后发起下一次 Chat Completions 请求。
Responses API
Responses API 使用input 传入文本或结构化消息。
从
output 中类型为 message 的项读取生成内容,其中 output[].content[].type 为 output_text。响应对象还可能包含 usage、error 和 incomplete_details。
Messages API
Agnes 3.0 Flash Max 支持 Anthropic 兼容 Messages API。
从
content[] 中 content[].type 为 text 的内容块读取生成文本。
Thinking 模式
需要更充分的任务拆解或推理时,可启用 Thinking 模式。- OpenAI 兼容格式
- Anthropic 兼容格式
最佳实践
Agnes Code 与智能体任务
Agnes Code 与智能体任务
明确任务目标、仓库或运行环境上下文、限制条件、预期输出和工具权限。执行完工具后,应将工具结果返回对话,再请求模型给出下一步动作。
工具调用
工具调用
工具描述与 JSON Schema 应保持精确、聚焦。在应用侧执行会产生副作用的操作前,应先校验工具参数。
长任务执行
长任务执行
将复杂任务拆分为可验证的阶段,并在每轮执行中保留目标、限制条件和关键工具结果。
模型可用性、速率限制和计费以你的 Agnes AI 账户与 API Key 权限为准。
价格与计费
以下为国际站美元价格,M 表示一百万 Token。本模型为付费模型,不适用 Agnes 3.0 Flash 的免费优惠。
缓存价格仅适用于服务确认命中缓存的输入 Token;其余输入按普通输入单价计费,同一输入 Token 不重复计费。模型可用性与速率限制以账户权限为准。