.cn 专属!Agnes-2.5-flash 中文对话模型开放,速收藏
Agnes API 全面测评:哪些接口真正能用?实测告诉你答案
AI 探索笔记 · 实测日期:2026 年 7 月
最近 Agnes AI 的 API 服务经历了一次重大调整——域名切换、模型更迭、部分接口停服。到底现在哪些 API 能正常使用?文生图质量如何?视频接口为何被禁?本文基于真实调用测试,逐一拆解每个接口的状态,并附上可落地的应用方案。
一、域名迁移:从 .com 到 .cn
Agnes API 的请求地址已从https://apihub.agnes-ai.com/v1切换至https://apihub.agnes-ai.cn/v1。
经实测,两个域名目前都能正常访问,但 .cn 域名有一个显著优势:新增了agnes-2.5-flash模型,而 .com 域名的模型列表中暂未出现该模型。这意味着 .cn 是目前更推荐使用的节点。
两个域名均通过 Cloudflare CDN 加速,实测延迟差异不大。建议开发者在代码中统一切换到 .cn 域名,以获取最新的模型支持。
二、模型全家福:6 款模型一览
当前 .cn 节点共注册了 6 款模型,涵盖文本对话、图像生成和视频生成三大类:
| 模型名称 | 类型 | 实测状态 |
|---|---|---|
| agnes-2.0-flash | 文本对话 | ✅ 可用 |
| agnes-2.5-flash🆕 | 文本对话 | ✅ 可用(仅.cn) |
| agnes-2.5-pro-alpha | 文本对话 | ✅ 可用 |
| agnes-image-2.0-flash | 文生图 | ✅ 可用 |
| agnes-image-2.1-flash | 文生图 | ✅ 可用(推荐) |
| agnes-video-v2.0 | 文生视频 | ❌ 403 禁用 |
三、接口实测:逐一拆解
1. 文本对话接口/v1/chat/completions
POST /v1/chat/completions Model: agnes-2.5-flash Input: "hello" Response: "Hello! I'm Agnes-2.5-Flash, developed by Sapiens AI." Status: 200 ✅文本对话接口运行稳定,响应速度快,实测 30 秒内返回结果。支持三个模型版本:2.0-flash(基础版)、2.5-flash(新版,推荐)和 2.5-pro-alpha(高级版)。适用场景包括智能客服、内容创作辅助、代码生成、知识问答、多轮对话应用等。接口完全兼容 OpenAI 格式,迁移成本极低。
2. 文生图接口/v1/images/generations
POST /v1/images/generations Model: agnes-image-2.1-flash Size: 768×1152(竖屏9:16) Response: 返回图片URL Status: 200 ✅ 生成耗时: 15-30秒/张文生图是目前最稳定、最实用的接口,也是本文测试中最推荐的模型。agnes-image-2.1-flash生成的图片质量优秀,支持多种尺寸(1024×1024、768×1152、1152×768 等),画面细节丰富、色彩还原准确。
我们用它制作了一系列竖屏短视频,包括《贝加尔湖的深渊密码》《武夷山悬棺》等未解之谜系列,8 张场景图并行生成,单张耗时 15-30 秒,成功率接近 100%。
3. 图生图接口/v1/images/edits
⚠️ 状态:503 Service Unavailable
错误信息:no available server —— 后端推理节点未部署
图生图接口虽然已注册路由,但后端推理服务当前处于不可用状态。实测使用小文件(292 字节)和大文件(1.6MB 图片)均返回 503 错误,排除了 Cloudflare 上传限制的可能,确认是服务端本身的问题。该接口的缺失意味着目前无法实现图片风格迁移、细节修改、局部重绘等高级图像编辑功能,期待后续版本能够恢复。
4. 文生视频接口/v1/video/generations
❌ 状态:403 Forbidden
错误信息:Model is blocked —— 模型已被封禁
视频生成接口agnes-video-v2.0已被后端封禁,调用时返回 403 错误。该接口之前支持 keyframes 模式生成短视频,但目前完全不可用。封禁原因未公开,可能是出于成本控制或服务稳定性考虑。
替代方案:文生图 + TTS 语音合成 + FFmpeg 视频拼接。虽然画面是静态的,但配合高质量 AI 图片和语音旁白,最终效果在短视频平台上依然有不错的表现。
四、实战应用:用现有 API 打造短视频生产线
虽然视频接口不可用,但我们用文生图 + edge-tts + Pillow + FFmpeg 搭建了一套完整的短视频生产流水线:
🔧 技术栈
- 场景图生成:agnes-image-2.1-flash,支持 768×1152 竖屏 9:16
- 语音旁白:edge-tts(微软免费 TTS 引擎),中文发音自然
- 标题叠加:Pillow 库,半透明黑色底条 + 白色大字
- 视频合成:FFmpeg,静态图 + 音频 → H.264 视频片段 → concat 合并
📊 生产效率
- 8 张场景图并行生成:约 60-90 秒
- TTS 语音合成:约 20 秒
- 标题叠加:约 5 秒
- 视频片段编码 + 合并:约 3-5 分钟
- 总计:一支 8 场景竖屏短视频,从零到成品约 5 分钟
💡 关键经验
- 并行生成:图片接口支持并发,4 线程并行可将 8 张图的总耗时缩短至 60 秒内
- 错误重试:API 偶发 429(限流)和 503 错误,建议加入指数退避重试机制
- edge-tts 参数:语速调节必须用
--rate=-5%格式(等号连接),用空格会报错- FFmpeg 编码:concat 合并时避免 stream copy,建议统一 re-encode(
-c:v libx264 -preset fast -crf 23)- 竖屏输出:请求 768×1152,实际返回 832×1248,注意尺寸差异对字幕布局的影响
五、API 调用代码示例
importrequests API_KEY="your-api-key"API="https://apihub.agnes-ai.cn/v1"headers={"Authorization":f"Bearer{API_KEY}","Content-Type":"application/json"}# 1. 文本对话r=requests.post(f"{API}/chat/completions",headers=headers,json={"model":"agnes-2.5-flash","messages":[{"role":"user","content":"你好"}],"max_tokens":100})print(r.json()["choices"][0]["message"]["content"])# 2. 文生图r=requests.post(f"{API}/images/generations",headers=headers,json={"model":"agnes-image-2.1-flash","prompt":"cinematic sunset","n":1,"size":"768x1152"})url=r.json()["data"][0]["url"]img=requests.get(url).content六、总结与建议
✅ 当前推荐使用
- agnes-2.5-flash(文本对话):速度快、质量好、仅 .cn 可用
- agnes-image-2.1-flash(文生图):最稳定的图像生成模型,强烈推荐
- agnes-2.5-pro-alpha(文本对话):高级版,适合对质量要求更高的场景
⏳ 暂时不可用
- agnes-video-v2.0(文生视频):403 封禁,可用图片 + TTS 方案替代
- /v1/images/edits(图生图):503 无服务,期待后续恢复
📝 开发建议
- 统一使用 .cn 域名,获取最新模型支持
- 所有接口兼容 OpenAI 格式,可直接用 openai SDK 或 requests 调用
- 加入 429/503 自动重试机制,建议间隔 10-30 秒
- 文生图支持并发,善用多线程可大幅提升生产效率
关注“GC随笔” 获取更多AI前沿知识
