翔宇工作流 · 用 Claude Code 从零做出 AI 视频自动化剪辑 web 应用

一套 2 小时+ 的零基础 Claude Code(视频里念作 “Cloud code”)实战课:以博主自己真实开发的”AI 视频自动化剪辑外部应用”为案例,从心态认知、安装配置、产品设计、架构规划、前端/核心开发、质量保障到部署交付,完整覆盖,并沉淀出一套给新手的工具观与开发原则。ASR 转写素材。

基本信息

  • 来源类型:YouTube 视频(无字幕,Gemini ASR 转写)
  • 作者:翔宇工作流(专注 AI 自动化的博主,长期做 n8n 工作流内容)
  • 原始链接https://youtu.be/hy2vZip4m2s
  • 原始素材raw 文件
  • 时长/体量:录制 4–5 小时、剪辑到约 2 小时;配套 82 页 PPT,作者自称写了 20 万字文案、Ultra Think 统计整个视频文档 138 万字
  • 开发成本披露:4 个月、约 $200/月的 Claude Code Max 套餐、累计约 4300 美元等值 token、9600 条对话、5.5 万行 TypeScript、6 万多字文档、15 张表、34 个路由、8 个前端页面、16 次大版本重构

核心观点

  1. N8N 与 Claude Code 的本质区别是”地铁 vs 出租车”n8n 是节点 + 固定化流程,从 A 站到 B 站不能回头(直线单向自动化);Claude Code 是”大模型 + 一个完整环境”——能读写本地文件、调用 MCP 模型上下文协议 工具、有记忆系统、能调用 Chrome 浏览器,遇到报错能多轮重试、绕路重来,是”会思考且能在环境里干活”的 Agent。

  2. 五大组件各司其职Claude Code 五大组件):command(斜杠命令=预置提示词)、agent(子代理,核心价值是上下文隔离/节省)、skill(重点,需单独讲)、hooks(强制触发,如注入时间/自动 push)、MCP(联网与外部能力)。作者强调 CLAUDE.md 记忆是”建议性”、MCP 是”能力型/选择性”、Hooks 是”强制性”。

  3. 五条新手核心理念:①理解 Claude Code 不只是大模型,而是”会思考 + 能在环境干活”;②大模型有容量上限,必须渐进式披露(给目录不给百科全书);③精细的上下文管理让模型时刻处于最高性能;④知识/技能文档化,把经验存进环境当外挂记忆;⑤把这些内化成自己的能力。

  4. 六条学习原则:①关注 Claude Code 本身能力、少装第三方插件(更新极快会吸收插件能力);②从简单开始(作者把目标定太大才有 16 次重构);③先做 MVP 最小可行版本;④每次对话都加”最佳实践”这四个字(浓缩全网最优解、避免踩坑);⑤规范先行(把版本号规范、Markdown 规范等写进 knowledge/standard);⑥学会放弃(换模型、清空上下文、参考开源、深度思考,实在不行才放弃)。

  5. “边界先行 + 胶水编程”是普通人的开发范式:先开发固定不变的边界(密钥保存、数据输入、后台数据库),中间易变的流程后做;开发方式优先胶水编程——“能抄不写、能连不造、能复用不原创”,用成熟 SDK 和页面模板拼装,而不是从零造轮子。

  6. 产品设计(PRD)必须先行,不清晰的设计就是重构代价:作者用一条自研 command 把 n8n 工作流反向提取成 PRD 文档(五阶段:分析工作流类型→提取外部 URL→输出摘要→交互式追问需求→SDK 调研→生成完整 PRD)。因为 n8n 工作流本身就定义了输入/输出/触发/格式/步骤/外部服务/串并行/产物,是天然的 PRD 素材。

  7. SDK 选型是隐性成本黑洞:作者一开始用了谷歌旧版 AI SDK(即将停维、不支持隐式缓存),因不知情按全价跑大视频,一次花掉 100 多美元。教训:产品设计阶段就要调研 SDK 的官方性、维护频率、功能覆盖、文档完整度,最终选定 Google GenAI 新版 SDK。

  8. 编程语言/框架要选”训练数据多”的高质量语言:TypeScript / Python / JavaScript 属高质量(开源训练数据多、AI 报错能修);本项目用 TypeScript(type as documentation、interface 直观、前后端一体、AI 补全好),全栈框架选 Next.js(同样因训练数据多)。

  9. 开发路径 = TDD 手搓 + 胶水借鉴两条腿:先在 TMP/ 临时文件夹写测试脚本(如先测 Gemini API 连通性),跑通再逐步组代码;配合三种权限模式(normal 确认 / auto-accept 直接干 / plan mode 先出报告再执行)按项目阶段切换。

  10. 代码质量遵循官方”刚刚好”原则:明确反对顺手优化、避免过早工程化(重复三遍代码不急着封装)、只在接收外部数据时做校验;核心逻辑是”简洁、不向后兼容、面向新功能”,好代码不是写得多而是刚刚好。

  11. “半部署”是新手保护知识产权 + 零成本的变现路径半部署):不公开做 SaaS,而是把应用放到部署平台的模板市场,用户凭授权码自行部署、自己填 API Key、自付成本;开发者不承担并发/服务器/API 成本,通过控制分发权变现。一个短视频剪辑成本约 $0.08–0.2(Gemini + FishAudio),可批量化。

实操内容保留

作者演示的产品:AI 视频自动化剪辑外部应用

  • 能力:上传视频 → 自动完成视频分析、文案生成、分镜脚本、配音、字幕同步、音画同步、剪辑输出。基于翔宇的 n8n”视频 34/38”工作流演化而来。
  • 配音双通道:FishAudio(几十万种音色,注册 API 拷贝音色)+ 微软免费 TTS(云溪等音色,普通话/美式英语等)。可调配音与配乐音量配比。
  • 模型:仅需一个 Google AI Studio Key 即可运行(也支持 Vertex);主力 Gemini 2.5 Pro。
  • 可调参数:分镜并发数(推荐 3)、低分辨率采样帧数(帧越多 token 越大)、旁白批量生成数量(10 个/组 vs 20 个/组影响价格)、字幕开关。
  • 风格系统:预制 20+ 剪辑风格,可自定义。“爆款复刻”玩法——把爆款短视频(如《舌尖上的中国》《毒蛇电影》)文案 Copy 进去,用一句提示词让 AI 分析”爆款基因”并转化成自己主题的提示词,存为自定义风格。
  • 原声支持:可设置在成片中保留几段原始视频原声(0 = 全 AI 配音),自动匹配最激烈/最精彩片段。
  • 成本实测:一条 15–25 秒短视频约 0.2(含缓存与音频)。适合抖音/TikTok/YouTube 带货、财经口播、美食纪录片、广告等批量生产。

环境与快捷键(Warp + Claude Code)

  • 终端选 Warp:免费、纯粹轻量、AI 功能可关(专注 Claude Code 自身能力),技能可随客户端迁移不绑定复杂 IDE。关键设置:关 Warp AI;开 restore windowsNew tab placement 设为 after all tabs;Left Option Key is Meta(供 Option+P/T 切换模型/思考模式);working directory 用上次历史目录。
  • 常用斜杠命令/clear(清空上下文/新对话)、/compact(压缩总结上下文,建议开自动压缩,约 70–85% 触发)、/config/context(查看新对话 token 占用:系统提示词 ~1.5%、系统工具、MCP ~10%、记忆文件 ~1.3%,剩余约 64%)、/init(生成项目记忆)、/mcp/memory/agents/model/export/status/resume。最常用三个:compactclearinit
  • 快捷键:双击 ESC 清屏 / 恢复上次对话;Shift+Tab 切换三种模式(normal / auto-accept / plan);Ctrl+V/Ctrl+C 粘贴、Ctrl+J 换行、Ctrl+B 后台运行脚本、Ctrl+R 清屏、Tab 选项切换、Option+P/T 切换模型/思考。
  • 深度思考:末尾加 Ultra Think(配色变彩色)让思考 token 拉满;配合 config 里打开的详细/调试输出模式可看到完整 thinking 过程。

三层记忆系统(渐进式披露)

  • 项目记忆:项目根目录 CLAUDE.mdcld 启动时自动加载(约 1.2K token);作者在 docs/ 下建 Agent/架构等文档,用目录索引按需加载,不用官方 root 目录(怕每次都加载占上下文)。
  • 用户记忆~/.claude/CLAUDE.md,宏观世界观——Identity(我是翔宇,每次回复带”翔宇”)、哲学、代码质量、技术栈、文档、可用 MCP。作者扩展了 .knowledge 目录(43 篇教程、2 个标准、9 个方法指南、15 个凭据),用目录让 CLAUDE.md 按需检索凭据/标准,避免每次手输。
  • 企业记忆Library/Application Support 下的企业策略(普通用户用不到)。加载顺序覆盖式,从当前目录向上遍历合并所有 CLAUDE.md,子目录 CLAUDE.md 访问时才加载。

GitHub / MCP / Hooks 配置

  • GitHub 三种配置:SSH(推荐,ssh-keygen -t ed25519 生成密钥、cat 公钥贴到 GitHub Settings)、Token、MCP。
  • MCP 安装两种传输:HTTP(如 Notion,--transport http --scope user)、STDIO(需 Token,如 Brave);scope 分 user / project(project 会在根目录生成 mcp.json)。作者推荐精选:Brave(网络检索)、Context7(查库/SDK 上下文)、Chrome(浏览器操作)、Firecrawl(整页抓取)、EXA(查 code/SDK context,可选),并在用户记忆里写清每个 MCP 的使用场景以省上下文。
  • 两个推荐 Hooks:①UserPromptSubmit 注入当前北京时间——减少模型时间幻觉(否则查最新股价可能按旧知识日期检索);②PostToolUse 监控 Edit/Write 调用累计到 30 次自动 push GitHub 备份。另可用 Stop hook 保存每次对话日志。

Command 开发四大原则

分两类:带 code 后缀(含大量代码,如 dev-restart-code 探测端口/停服务/清缓存/重启)、面向人的文本对话型。开发遵循:①YAML 格式化描述;②角色定义;③输出格式;④工作流程。示例:n8n-2prd command 五阶段自动生成 PRD。

云端/本地测试与排查三件套

  • 本地测试:Claude Code 已支持调用 Chrome 浏览器(原生或 MCP),可截图、填表、检查元素、看控制台日志、自动登录本地环境,做到”不介入测试”。作者在 docs/agent/ 放动态测试(Chrome 点击操作)+ 静态测试(函数/数据库分析)文档。
  • 云端测试:ZEABUR(视频里念 “ZEBU”)平台部署后可看项目日志、报错返回程序修改。
  • 排查三件套Fix / For-Review(官方 Review 汉化版)/ 借鉴大佬的 TypeScript 排查提示词,配合 plan mode 逐步调研。

原文精彩摘录

“N8N 相当于地铁,从 A 站到 B 站,中间 CDEF 不同站点,它是直线距离不能回头……但是 Cloud Code 相当于打的一个出租车,从 A 到 B 走到 B 了发现报错了,我再回到 A 可不可以?所以 Cloud Code 可以多轮的运行,遇到报错它可以再尝试重新的。”

“什么叫渐进式披露?我把目录给你,你需要的时候你自己在目录里面学百科全书去,但是你不能把百科全书直接给他——目录是渐进式披露。”

“产品设计不清晰的代价,就是你写代码、测 bug、迁移重构。宁愿多花两天想清楚,也不要马上就开始做。”

“能抄不写,能造不连,能连不造,能复用不原创……你不做前端,也不做 SDK,那我就通过胶水把 SDK 和前端和后台链接起来,这就是现在未来开发的一个模式。”

“好代码不是写得多,而是刚刚好。“(引官方代码质量原则:明确反对顺手优化、避免过早工程化、只在接收外部数据时检查)

“我一开始没有遵循 SDK 的选择,直接用的谷歌旧版 AI SDK……我以为自己支持隐式缓存,给它一个大视频来回掉,一下就花了 100 多刀。“

关键概念

相关页面