Agnes 3.0 Flash 上手:把活干完的免费模型
Agnes 3.0 Flash 是 Agnes AI 在 2026 年 9 月初推出的一款免费大模型,主打「把任务真正跑完」而不是只回一段漂亮文字。它在 OpenAI 与 Anthropic 双协议下提供函数调用、图片 URL 识图和轻量思考,免费 Key 开箱即用,上下文窗口沿用 256K 规格,适合喂长文档、跑长链路 Agent 任务。
一句话定位:免费、双协议、带工具编排的实干型模型——接到任务会自己调接口、查数据、收结果,而不是停在「我建议你……」。
一、它到底是啥
把它想成「雇了个会自己跑流程的实习生」:你给一个目标,它先规划步骤,需要查天气就调天气接口,需要读图就传图片地址,拿到返回直接整理成结论交给你。前代 2.x 更像「会聊天的助手」,3.0 把重心挪到「动手把活干完」。
能力上支持文本输入、图片 URL 识图,完整具备 Function Calling 与思考模式,同时兼容 OpenAI、Anthropic 两套接口协议,迁移现有代码基本只改一个 base_url 就行。
二、核心能力
任务执行
减少「话说完、活没干」的现象,接到指令就推进到出结果。
工具编排
合理地调工具,拿回数据就收尾,不空转、不反复错调。
上下文遵循
长任务里不跑偏,不漏掉你给的约束条件。
可信交付
拒绝虚构结果,不会假装「我已经做完了」。
三、三个月三次大更新
| 时间 | 版本 | 更新重点 |
|---|---|---|
| 05-26 | 2.0 首发 | 起步 256K 超大上下文窗口 |
| 06-01 | 全模态免费 API | 正式永久免费,首周释放 1T tokens 额度 |
| 07-13 | 2.5 版本 | 强化代码能力,SWE-bench 分数 72.4% 提升到 75.6% |
| 09 月初 | 3.0 版本 | 全力优化 Agent 链路,覆盖规划→调用→确认全流程 |
路线很清晰:2.0 解决「免费可用」,2.5 打磨「代码能力」,3.0 攻坚「任务执行」。
四、和 2.5 Flash 同条件对照
同一把 Key、同一组提示词,挑了几个典型 Agent 场景跑对照:
| 测试场景 | 表现 | 耗时 |
|---|---|---|
| 基础问答 | 回答准确简洁,不堆废话 | 6.5s |
| 函数调用 | 干净调起 get_weather 查上海天气 | 1.5s |
| 工具结果编排 | 拿回 JSON 直接总结,不重复调工具 | 3.9s |
| 代码指令 | 只输出代码,无多余解释 | 6.6s |
对照 2.5 Flash:答案同样正确,但会吐出大量思考 token,整体耗时拉到 52s。3.0 内置轻量思考(响应里能看到 reasoning_tokens),但最终输出克制干净——比如「只输出代码、别解释」,它能严格执行。
在 Agent 自动化高频调用里,几十秒的差距会被持续放大,这也是 3.0 最值得换的理由。
五、30 秒接入
- 前往 platform.agnes-ai.com 注册,生成 API Key,免信用卡、完全免费;
- 接口地址:国际站 https://apihub.agnes-ai.com/v1,国内 CN 站 https://api.agnes-ai.cn/v1;
- 请求模型名填
agnes-3.0-flash; - 用 Anthropic 协议时,访问路径为
/v1/messages; - 要开深度思考,请求参数加
chat_template_kwargs.enable_thinking: true。
坑点提醒:国际站与国内 CN 站的账号、API Key 互不通用。密钥字符串看着一样,跨域名调用会返回「令牌无效」。追求低延迟就单独在 CN 站注册一把 Key,别混用。
1 | from openai import OpenAI |
六、适合谁,不适合谁
适合
做 Agent / 工作流编排、要函数调用、想白嫖且不接受「只给建议不动手」的场景;免费档够个人和小团队试水。
暂不适合
重度生产高并发(免费档限频)、需要超长输出或私有化部署的商业关键链路,那类还是上付费方案更稳。
一句话结论:想要一个「免费、双协议、会自己把任务跑完」的模型,Agnes 3.0 Flash 是目前最顺手的选择之一——把 2.5 的思考开销砍掉,换来的是真能交货的 Agent 体验。





