关联主题:: Skills索引
同级::
下一级::
003|哔哩哔哩Note Skill(Bilibili Video Note)
一句话说明
“哔哩哔哩Note”不是只把视频转成一段摘要,而是把一个 B 站或在线视频链接加工成一套可离线打开、可复盘、可分享的视觉化学习笔记:先取得媒体和转写依据,再按自然章节组织内容,最后生成 SVG 图解、离线 HTML、整页长图与切片。
本页边界
本页归档的是当前 Codex 环境中的
bilibili-video-noteSkill。它与001|逐字稿 Skill、bilibili-video-learner是不同的实现:逐字稿重点是音视频转写,bilibili-video-learner重点是通过 B 站字幕生成学习笔记,而本 Skill 重点是“视频内容 → 结构化视觉笔记 → 离线长图产物”的完整链路。
1. 基本信息
| 字段 | 内容 |
|---|---|
| Skill 编号 | 003 |
| 展示名称 | 哔哩哔哩Note |
| 英文名称 | Bilibili Video Note |
| 功能定位 | 将在线视频加工为带来源依据的结构化视觉笔记和离线长图产物 |
| 适用平台/场景 | B站及其他可由 yt-dlp 获取的在线视频;课程、讲座、访谈、播客、评论、AI学习笔记,以及需要界面证据的工具演示视频 |
| 类型 | 不开源 |
| 许可证 | 待核验 |
| 当前状态 | 已安装(Codex 本机) |
| 命令别名 | $bilibili-video-note |
| 来源 | 本机 Codex Skills 目录;已有 Obsidian 实现文档与 CFlow 记录,公开上游待核验 |
| 关联入口 | Skills索引 |
2. 它解决什么问题
普通的视频总结容易只留下几段概括,读者很难回到原视频核对;单独下载字幕又缺少章节结构、视觉组织和可分享的成品页面。这个 Skill 将视频处理拆成一条有质量检查的内容生产链:
在线视频链接
↓
抓取元数据与音频
↓
字幕或 Whisper 转写
↓
媒体时长与转写结尾审计
↓
按章节、话题变化和画面变化自然拆分
↓
生成结构化学习笔记与时间戳依据
↓
为每章生成内容对应的 SVG 图解
↓
按需加入界面/工具演示的真实截图
↓
渲染离线 HTML、整页 PNG 与长图切片它的核心价值是把“理解视频”和“交付可阅读产物”连在一起,同时保留原视频链接、时间戳、元数据和审计信息,便于后续复核。
3. 适用场景与边界
3.1 适合使用的场景
- 提供 B 站链接,希望得到一份结构化的视频学习笔记。
- 处理课程、讲座、访谈、播客、评论等知识密度较高的视频,并保留时间戳原文依据。
- 将工具、界面、文档、代码或操作演示视频做成包含真实关键帧的视觉笔记。
- 需要把视频内容输出为离线 HTML、整页长图和可分享的切片图片。
3.2 不应混用的场景
- 只需要高保真音视频转写时,优先使用逐字稿 Skill。
- 只需要通过 B 站字幕快速生成一篇 Obsidian 学习笔记时,应先评估
bilibili-video-learner,不要默认生成整套视觉产物。 - 对纯口播、访谈或概念讲解视频,不应为了装饰而加入无证据的视频截图;真实关键帧只用于界面、工具、文档、代码或操作状态本身就是证据的章节。
- 不能把结构化概括伪装成作者原话;每个重要结论都应能回到转写内容和时间戳。
4. 标准输出
每个视频使用独立输出目录,通常包含:
| 输出 | 作用 |
|---|---|
index.html | 内嵌 CSS 和 SVG 的离线视觉笔记页面 |
structured-note.md | 先结构化概括、再拆解要点、最后给出时间戳原文依据的学习层 |
page.png | HTML 渲染后的整页长图 |
slices/ | 带适度重叠的长图切片,便于阅读和分享 |
transcript/ | 转写 JSON 与中文 Markdown 文稿 |
media/ | 视频元数据、音频、封面或必要的视频文件 |
frames/ | 仅在界面/工具/操作演示需要证据时保存的真实画面 |
audit/ | 媒体时长、转写覆盖和渲染检查记录 |
5. 处理流程
- 建立干净的临时输出目录,避免把不同视频的媒体、转写和图片混在一起。
- 用
yt-dlp获取标题、UP 主、BV 号或 AV 号、分 P 信息、简介、标签、章节、封面、发布时间、链接和时长。 - 默认下载最佳音频并转换为 MP3;只有需要真实画面证据或音频提取不稳定时才下载视频。
- 使用
media_audit.py对元数据时长、媒体时长和 Whisper 转写结尾进行比较;差异超过 5% 时重试或明确标记异常。 - 根据语言选择 Whisper 模型;中文使用
turbo,英文先用small.en再翻译为中文,并检查转写结尾是否接近音频结束。 - 依据 B 站章节、分 P、转写主题变化、幻灯片/界面变化和说话人提示自然拆章,不使用固定章节模板。
- 对知识型视频先生成
structured-note.md,每个章节遵循“结构化概括 → 要点拆解 → 原文依据”。 - 读取页面规范,为每章编写短文本、关键观点、陷阱、步骤、结论、引文和视觉锚点。
- 根据章节真实内容生成 SVG 图解;流程、层级、对比、因果和时间变化分别采用匹配的图式。
- 只有操作/界面章节才通过
extract_frame.py提取真实关键帧;口播和概念章节只保留文字与 SVG。 - 按“正文 → SVG 图解 → 必要时的视频时间戳截图”组织离线 HTML,并在页尾保留来源信息和原视频链接。
- 用无头浏览器渲染整页 PNG,再用
slice_tall_image.py生成带重叠的切片,检查图片、字体、留白、重叠和标题裁切情况。
6. 依赖与权限边界
- 依赖
yt-dlp获取公开视频元数据和媒体,依赖ffmpeg/ffprobe处理音频、截图和时长检查。 - 转写可以使用 B 站字幕或 Whisper;转写质量、字幕可用性、登录限制和网络状态都会影响结果。
- 需要浏览器渲染时使用 Chrome 或 Playwright;不能把浏览器 Cookie、Token 等凭据写入归档产物。
- 生成的媒体和页面应放在视频专属输出目录;本 Skill 的脚本只负责处理用户授权获取的本地文件和链接。
7. 来源与安装状态
7.1 当前实际位置
本轮核验到的活动文件是:
/Users/bairimengyushi/.codex/skills/bilibili-video-note/SKILL.md该目录同时包含 references/structured-note-spec.md、references/page-spec.md、scripts/media_audit.py、scripts/extract_frame.py 和 scripts/slice_tall_image.py 等配套文件。agents/openai.yaml 将运行时展示名写为 Bilibili Video Note。
本轮没有在 .agents/skills/ 或 .claude/skills/ 发现同名兼容副本,因此本 Skill 当前按“Codex-only”登记;没有擅自复制或移动运行文件。以后如果用户明确要求统一导入知识库的 .agents/.claude 目录,再单独进行安装/复制变更。
7.2 来源与类型判定
当前 Skill 目录没有 README、LICENSE、公开仓库地址或其他可核验的许可证声明。已有B站视频图解笔记长图 Skill 的实现流程和 2026-07-06 的 CFlow 汇总记录了它的设计与产物,但这些是本地知识库中的实现记录,不构成公开上游来源。
因此本次登记为 不开源,许可证记为“待核验”。这不是说它的 Skill 文件不可读取,而是目前不能用公开源代码和许可证证明它属于开源项目;也没有证据表明它是“基于某个开源项目的本地魔改”。
8. 相关 Skill 与知识入口
- Skills索引:本 Skill 的永久编号和导航入口。
- 001|逐字稿 Skill(Transcript):负责音视频转写,适合作为本 Skill 的前置或独立替代链路。
bilibili-video-learner:仓库已有的 B 站字幕学习 Skill,关注字幕获取、学习笔记和 Obsidian 文档,不与本 Skill 合并登记。- B站视频图解笔记长图 Skill 的实现流程:已有实现复盘文章。
- Skill(AI技能):复用的上位概念卡,本轮没有新建概念卡。
文档更新日志
- 2026.08.28|建立 003 说明页:按当前 Codex 实际路径登记
bilibili-video-note,补充功能定位、适用场景、输出契约、来源边界和与逐字稿/B站视频学习 Skill 的区别。
🔐 GitHub 评论(Giscus)
正在连接 GitHub 评论…