WorkBuddy 加 Agnes AI,免费 API 生图生视频全链路实测
用 WorkBuddy 按 Agnes 文档自动生成调用 Skill,五分钟接通免费 API;文生图质量够用,图生图/图生视频会暴露模型自带的韩系审美与人脸一致性短板,人物数字人场景应分流到 HeyGen 一类专用方案。
基本信息
- 来源类型:文章(掘金 juejin.cn)
- 标题:WorkBuddy 加 Agnes AI,免费 API 生图生视频全链路实测
- 作者:小虎AI生活(小虎)
- 原文位置:
raw/articles/2026-07-17-juejin-workbuddy-agnes-ai-api.md - 原文 URL:https://juejin.cn/post/7660513725812162610
- 发布日期:2026-07-10
- 消化日期:2026-07-17
- 字数:约 220 行 / 约 1.1 万字符(含图片 URL)
核心观点
-
接入路径是「文档 → WorkBuddy 生成 Skill → API Key 环境变量」而非手写客户端:Agnes 文档页
agnes-ai.com/doc/cid5直接教 AI 生成 Skill;作者把文档喂给 WorkBuddy,生成支持agnes-image-2.0-flash、agnes-image-2.1-flash(生图)与agnes-video-v2.0(生视频)的 Skill,覆盖文生图 / 图生图 / 图生视频;API Key 在控制台创建后写成 Windows 环境变量,启动即自动读取。全链路约 5 分钟,作者评价比接大多数 API 更简单。 -
额度分「免费额度」与「Token Plan」两层,先免费后充值:免费额度注册即送;标价生图约 0.005/秒,文中称当前免费不扣款。Token Plan 三档,作者认为对内容生产「价格可忽略」,建议先用免费额度跑通再考虑充值。
-
文生图(2.1 Flash)在氛围/场景图上表现惊艳,适合非身份特写:Prompt 示例「旗袍女子 + 江南水乡 + 电影级写实 + 浅景深 + 768×1024 竖版」,约十几秒出图;构图、光影、旗袍纹理与水乡氛围均到位。结论:不涉及特定真人身份的场景图、产品图、氛围图,免费 API 完全够用。
-
图生图保留身份痕迹但会叠加模型审美,静态「微妙违和」到视频才被放大:用作者头像做汉服茶室图生图,五官有本人影子但整体风格「说不出来的微妙」;图生视频后面部细节在运动中漂移,表情眼神与静图不完全一致。作者回头发现:人物面部/气质偏韩剧东亚审美,汉服亦呈「韩版」质感;动态 + 自动配音(默认韩语)把审美倾向坐实。
-
Agnes Video V2.0 最长 18 秒、可出语音,但不支持人脸锁定——与行业共性瓶颈重叠:最长 18 秒试跑会让模型「自行表演」;可改中文语音但动作神态仍韩剧质感。作者明确:需要 IP 形象 / 数字人 / 人脸高度一致时,应选 HeyGen 等专用方案;Agnes 更适合创意前端的文生图与氛围图,而非人物一致性视频终稿。
-
适合场景四象限清晰:氛围/概念图、快速原型、学习测 API/Skill;人物视频走专用工具:免费额度足够测试与练 Skill;Token Plan 作为效果验证后的扩容。金句:「想,都是问题。干,就对了。」
实操内容保留
Prompt 模板(文生图实测)
一位穿旗袍的女性站在江南水乡的石桥边,晨光柔和,水面倒映着白墙黑瓦,电影级写实风格,浅景深。
用 2.1 Flash, 768x1024(竖版)
操作步骤(五分钟接入)
- 打开 Agnes 文档指引:
https://agnes-ai.com/doc/cid5(教 AI 帮你生成 Skill) - 把文档喂给 WorkBuddy,按指引生成调用 Agnes API 的 Skill 文件
- 确认 Skill 覆盖模型:
agnes-image-2.0-flash/agnes-image-2.1-flash→ 生图agnes-video-v2.0→ 生视频- 能力:文生图、图生图、图生视频
- 在
agnes-ai.com注册 → 控制台创建 API Key → 复制 - 将 Key 交给 WorkBuddy;作者实践:Windows 系统环境变量写入,启动自动读取
- 开始生图 / 图生图 / 图生视频实测
图生图 / 图生视频口语指令(作者实测)
- 图生图:「用这张照片生成一张穿汉服在茶室品茶的图片。」
- 图生视频:「把这张汉服照变成视频,让它动起来。」
- 最长视频:请求 18 秒(Video V2.0 上限)
- 语言纠正:「不要讲韩语,要讲中文。」
额度与选型要点
| 项 | 说明 |
|---|---|
| 免费额度 | 注册赠送;文中称当前生图/生视频不扣款 |
| 标价参考 | 生图约 0.005/秒 |
| Token Plan | 三档,价格偏低,适合验证后扩容 |
| 不支持 | Agnes Video V2.0 无人脸锁定 |
| 分流 | 人脸一致性 / 数字人 → HeyGen 等专用方案 |
关键概念
- Agnes AI — 本文实测的免费/低价生图生视频 API 服务与模型族
- WorkBuddy — 把文档变成可调用 Skill、并持有 API Key 的 Agent 工作台
- Skill — 由文档自动生成的 Agnes API 调用程序性知识包
- HeyGen — 作者推荐的人脸一致性/数字人专用方案(对照 Agnes 短板)
- 视频生成模型 — 行业层:静图→动视频的人脸一致性是共同挑战
- agnes-image-2.0-flash / agnes-image-2.1-flash — 生图模型(2.1 擅长复杂场景与细节)
- agnes-video-v2.0 — 生视频模型,最长 18 秒,可自动配音
与其他素材的关联
- 与 2026-07-16-woshipm-workbuddy-ima-workflow:同一 WorkBuddy 平台的不同能力面——前篇是「ima 知识库 + 运营工作流」,本篇是「文档 → Skill → 多模态 API」;共同证明 WorkBuddy 是可挂知识/可挂 Skill 的执行工作台,而非单一 PM 工具包。
- 与 2026-06-10-codex-hyperframes-video / HyperFrames:另一条视频路线——Codex + HeyGen 开源 HyperFrames(HTML 合成视频)vs 本篇 WorkBuddy + Agnes 直出 AIGC 视频;终局若要人脸一致仍回到 HeyGen 产品侧。
- 与 2026-06-23-image2-seedance-long-video-brand-ad:长视频方法论强调资产前置与分镜拼接;本篇则暴露「无脸锁」时单段 18 秒直出的身份漂移,可互补为「创意探索用 Agnes,品牌人物片用资产锁定 + 专用工具」。
- 与 2026-07-16-woshipm-ai-comic-drama-addiction:AI 漫剧能容忍画面瑕疵是因短镜头/情绪交换;本篇说明人物面部一致性在「像本人」场景不可同样容忍,品类容器决定技术瑕疵是否可接受。
- 与 2026-07-16-ai-learning-human-cognition / 视频生成模型:理论侧「视频生成逼出世界理解」;本篇是消费侧实测——理解≠身份锁定,生成模型有自己的审美先验。
原文精彩摘录
先说结论,免费生图够用于测试和创意探索,生视频方面有些有趣的细节值得聊聊。
Agnes AI 有个文档指引页面,地址是 agnes-ai.com/doc/cid5 ,上面写了怎么让 AI 帮你生成一个 Skill。这个操作特别省事,你不需要自己写代码,直接把文档喂给 WorkBuddy,让它按照指引生成一个调用 Agnes API 的 Skill 文件就行了。
原来之前那种微妙的距离感,是因为模型生成的人物面部风格偏向东亚另一种审美体系。五官、气质、神态,带着一种我们在韩剧里常见的那种风格。穿汉服看着有些违和,也是因为这是韩版的服装。动态视频把这个特征放大了不少。静态图你还可以把它理解为一种风格化的处理,视频里人物一开口说韩语,整个审美倾向就非常明确了。
Agnes Video V2.0 目前不支持人脸锁定,所以视频里的人物神态和动作会有自己的发挥。如果你需要数字人或者人脸高度一致的视频,HeyGen 这种专用方案会更对口。
想,都是问题。干,就对了。