1. 基本信息
| 项目 | 内容 |
|---|---|
| 名称 | story-to-handdrawn-video |
| 作者/维护者 | gnipbao(独立开发者) |
| 来源链接 | https://github.com/gnipbao/story-to-handdrawn-video |
| 许可证 | MIT(附带的站酷马善政毛笔字体另遵循 SIL Open Font License) |
| GitHub Stars | 699(GitHub API,2026-07-30) |
| Forks | 78(GitHub API,2026-07-30) |
| 最新版本 | v1.0.0(2026-07-21 首次发布) |
| 安装方式 | git clone 渲染器工程 + 复制 skill-package 到 Agent 的 skills 目录 |
2. 功能介绍与亮点
把中文故事文案或一组有序的手绘/漫画图片,转换成竖屏「手绘日记漫画动画」:手写体字幕、从左到右的「文字 → 黑白画稿 → 彩色插画」揭示效果,可选右下角卷页翻书转场,画面构图安全不裁剪。底层基于 Remotion 渲染引擎,默认只输出无配音、无音乐的静音 H.264 画面轨,方便用户自行做后期配音。
亮点:
- 故事文本自动分句分镜,保留用户原文措辞,不做AI改写;
- 上传的漫画页可自动拆分文字区与插画区,本地生成对齐的黑白线稿;
- 默认走 Codex Image2 生图,仅在用户明确要求时才切换到需要 API Key 的 OpenAI 图片生成兜底路径;
- 同时提供预览(720×960)与正式(1080×1440)两档渲染分辨率;
- 随包提供开源的中文毛笔字体(Ma Shan Zheng),无需用户额外配置字体。
3. 适用场景
固定分类:内容创作与知识管理。
适合把文字故事或已有插图快速做成短视频初稿的中文内容创作者:短视频/图文平台的故事类账号、儿童绘本/成长记录类自媒体、需要批量产出手绘风格片头或转场素材的创作者,以及希望先出无声画面轨、再自行配音配乐的视频剪辑爱好者。
4. 跨 Agent 兼容性
| Agent | 结论 | 依据 |
|---|---|---|
| Claude Code | ✅ 原生支持 | README 明确给出 cp -R skill-package/story-to-handdrawn-video ~/.claude/skills/ 安装命令 |
| Codex | ✅ 原生支持 | 主要目标平台,skill-package/ 内含 agents/openai.yaml,README 用例均以 Codex 为例 |
| OpenClaw | ❓ 未验证 | 已抓取材料未点名 OpenClaw |
| Hermes Agent | ❓ 未验证 | README 仅笼统提及“支持 Skill 的 Agent 运行时(Codex、Claude Code、Kimi Code 等)”,未点名 Hermes Agent |
5. 推荐理由
它把“文字故事/手绘图片 → 手绘风格短视频”这条内容生产链路自动化到只需一句自然语言指令,分句、分镜、生图、线稿提取、渲染全部由 Agent 按 Skill 约定完成,省去用户手动跑脚本、拼素材的过程,且默认零外部 API 依赖、静音输出便于二次创作,适合追求“手绘温度感”的中文内容创作者快速出片。
6. 评分
| 维度 | 分数 | 说明 |
|---|---|---|
| 受欢迎程度 | 6 | GitHub 699 星、78 fork(2026-07-30 抓取),仓库创建于 2026-07-21,9 天内积累这一星数,增长速度较快;仓库贡献记录仅作者本人,暂无外部 issue/PR 讨论 |
| 可用性 | 7 | 需自行搭建 Node.js 20+、Python 3.10+、FFmpeg、npm 及 Chrome(或 Remotion 托管的兼容浏览器)本地渲染环境,非一条命令直接可用;README 与 SKILL.md 文档结构完整、步骤清晰;自首次发布后暂无后续更新提交 |
| 安全性 | 8 | 见下方检查清单 |
安全检查清单:
① Shell 命令执行:通过 Python/Node 子进程调用本地 ffmpeg、npm 渲染管线,范围限定在项目本地文件读写与视频编码,用途说明清楚,不扣分。
② 联网外发:默认不联网,图片生成走 Agent 自身的 Codex Image2;仅当用户显式加 --generator api 且设置 OPENAI_API_KEY 时才会调用 OpenAI 接口,属明确的用户主动选择,不扣分。
③ API Key/凭据:可选 OPENAI_API_KEY,从环境变量读取,仓库内未见硬编码或落盘存储,不扣分。
④ 可疑指令:逐一审阅 SKILL.md 与全部脚本文件,未发现 prompt injection 或隐蔽外发迹象,不扣分。
⑤ 作者信誉:独立个人开发者,提交记录与仓库结构清晰,未见刷星或身份造假痕迹,不扣分。
⑥ License:MIT,明确;附带字体另遵循 SIL Open Font License,同样明确,不扣分。
⑦ 维护时间:自 2026-07-21 首次发布后暂无后续提交,距今约 9 天,尚属新发布项目,需持续观察后续维护频率,轻微扣分。
7. 跟同类 Skills 相比的优势
| 项目 | 定位 | 与本技能的差异 |
|---|---|---|
| xiejunjie524/handdraw-story-video(700★,MIT) | 把用户预先准备好的 7-9 张已上色手绘母图,制作成 35-45 秒的线稿显现+逐步上色短视频,底层用 HyperFrames + GSAP | 不绑定任何生图服务,但也不负责“从文字生成插画”这一步——用户需要自己先画好/生成好每一幕的彩色母图;本技能则能直接从纯文字故事出发,自动完成分镜与配图 |
| yokel1121/muyang-flat-animation(241★,MIT) | 把中文观点/知识点转成纸上钢笔线稿+彩铅风格的知识讲解动画素材 | 面向“知识讲解”场景、强依赖付费 Gemini API Key 才能生成画面;本技能面向“故事/日记漫画”场景,默认零付费依赖即可跑通完整流程 |
8. 用户评价
该技能目前在第三方平台尚无具名用户评价。
9. 其他补充
仓库同时提供“上传图片模式”与“翻书转场模式”两种视觉风格,翻书模式会在纸背保留淡化的原页纹理;随附 CONTRIBUTING.md 与 CODE_OF_CONDUCT.md,具备基础的开源协作规范。
10. 安装使用方式
# 1. 克隆渲染器工程
git clone https://github.com/gnipbao/story-to-handdrawn-video.git
cd story-to-handdrawn-video
npm ci
npm run check # TypeScript 检查 + 分镜结构校验,不访问网络
# 2. 把 Skill 装进 Agent 的 skills 目录
cp -R skill-package/story-to-handdrawn-video ~/.claude/skills/ # Claude Code
cp -R skill-package/story-to-handdrawn-video ~/.codex/skills/ # Codex
# 3. 告诉 Skill 渲染器工程的位置(在工程目录内运行 Agent 时可省略)
export STORY_VIDEO_PROJECT=/absolute/path/to/story-to-handdrawn-video
安装后用自然语言触发,例如:「使用 $story-to-handdrawn-video 把这段故事生成可后期配音的手绘动画」。首次使用前建议先跑一次预览模式(--mode preview)确认效果,再出正式版。
11. 注意事项
- 完整功能需要本地搭建 Node.js/Python/FFmpeg/Chrome 渲染环境,比纯 Prompt 型 Skill 的安装门槛更高。
- 输出为静音画面轨,配音与背景音乐需要用户自行做后期,不是开箱即用的“成品视频”。
- 仓库自首次发布以来暂无更新提交,后续维护活跃度有待观察。
- 遇到时间跳跃、指代不明、医疗场景或年龄敏感角色等情形,官方建议先让 Agent 输出视觉规划 JSON 确认后再生成,避免误判。