‘\r

新加坡 Sapiens AI 发布的 agnes-2.5-flash,目前是唯一同时做到永久免费 + 多模态(文/图/视频)+ 编码强的模型:SWE Atlas QnA 从 15.8% 直接跳到 36.5%,512K 上下文,国内节点 apihub.agnes-ai.cn/v1 直连,且完全 OpenAI 兼容。下面用一张总表 + 几段实操 + 几个卡片,把「怎么接、怎么验、怎么不踩坑」一次性说清楚。
\r
<img src="./wp-content/uploads/2026/08/image-95944ce8bd407519981c9f0d785b7f46.jpg" alt="agnes-2.5-flash:支持多模态文图视频、编码强、永久免费" style="width:100%;max-width:760px;height:auto;display:block;margin:20px auto;border-radius:8px">\r
\r

一、核心参数总表:agnes-2.5-flash 是什么

\r

\r \r \r \r \r \r \r \r \r \r \r \r \r \r \r \r \r
维度agnes-2.5-flash说明
定价**永久免费(默认档)**无需绑定信用卡,免费/默认 Key 即可用
多模态文本 + 图片 + 视频均通过 OpenAI 兼容 endpoint 调用
编码能力**SWE Atlas QnA 36.5%**较 2.0 大幅跃升,代码库问答/修改可用
上下文512K长文档、大代码库、批量上下文可用
国内节点`apihub.agnes-ai.cn/v1`直连,无需代理,延迟低
协议OpenAI 兼容改 base_url + model 名即可迁移
速率限制文本约 20 RPM免费档瓶颈在**每分钟请求数**,不在 Token 总量
\r \r

二、免费档的真实限额

\r

官方 Token Plan FAQ 把用户分成三类:免费/默认用户、企业认证用户、Token Plan 订阅用户。本文面向免费/默认用户,核心限制如下:
\r

\r
\r **文本**\r

允许 30 RPM,实际稳定约 20 次/分;512K 上下文。
\r