把口播、讲座、直播或 Vlog 转录并改写成小红书笔记、公众号文章或知乎内容,同时抽帧配图。当用户说“视频转图文/文章/笔记、视频扒文案、口播转文章、视频内容复用”时使用。只生成字幕文件用 auto-subtitle;翻译已有字幕用 subtitle-translate。
npx skills add https://github.com/ZJU-REAL/Easel --skill video-to-article
> 把视频复用成图文内容:转录 → 结构化成篇 → 抽帧配图。转录与抽帧走确定性脚本
> (asr.py / video_ops.py),结构化成文由你(LLM)完成——这是本 SKILL 的核心价值。
> 只出字幕文件见 auto-subtitle;翻译字幕见 subtitle-translate;
> 出成套小红书卡片见 xhs-note-creator;纯文案润色见 text-polisher。
| 字段 | 必填 | 说明 |
|------|------|------|
| 视频文件 | 是 | 口播/讲座/直播/Vlog(没给就问) |
| 目标形态 | 否 | 小红书笔记(默认)/ 公众号文章 / 知乎回答 / 通用图文 |
| 配图数量 | 否 | 从视频抽几张配图(默认 3-6,按内容节点) |
outputs/主题名/)article.md — 成篇图文(标题 + 正文 + 小标题/要点 + 金句 + 话题标签)assets/frame-*.jpg — 抽取的配图assets/transcript.txt / assets/transcript.json — 转录原文与时间轴(备查)脚本路径(相对项目根):skills/shared/scripts/asr.py、skills/shared/scripts/video_ops.py。
python skills/shared/scripts/asr.py transcribe -i input.mp4 --format json \
-o outputs/主题名/assets/transcript.json
python skills/shared/scripts/asr.py transcribe -i input.mp4 --format txt \
-o outputs/主题名/assets/transcript.txt
(首次跑 ASR 需外网代理下模型,见 auto-subtitle 前置说明。)
读转录,按目标形态改写成图文,不是照抄口语:
知乎(专业、有逻辑链)。字数与排版参考 post-formatter / social-content 规范。
article.md,并在文中标注"【配图1:xx画面 @ 02:15】"指明每张配图对应的视频时间点。按第 2 步标注的时间点,逐个抽帧:
python skills/shared/scripts/video_ops.py frame -i input.mp4 \
-o outputs/主题名/assets/frame-01.jpg --time 00:02:15 --width 1080
挑画面清晰、有信息量的时间点(避免糊帧/转场帧)。
需要做成小红书卡片组时,把 article.md 交给 xhs-note-creator 或 card-xiaohongshu。
platforms.md 主平台;语气/称呼/emoji 尺度贴合 style.md;话题标签贴合账号垂类;合规底线遵守 preferences.md。
article.md 放 outputs/主题名/,转录和抽帧等中间件放 outputs/主题名/assets/。视频→图文是创作者复用内容的高频需求(一鱼多吃)。转录用 faster-whisper(asr.py),配图用
ffmpeg 抽帧(video_ops.py frame),成文结构化交给 LLM——把确定性 IO 与创意改写分层。
Take zju-real/video-to-article from the repository into ~/.claude/skills for personal
use, or into .claude/skills inside a project.
The agent identifies a skill by the name field in its header. Two skills with the
same name cannot sit side by side — one of them will be ignored.