关联主题:: Skills索引
同级::
下一级::

003|哔哩哔哩Note Skill(Bilibili Video Note)

一句话说明

“哔哩哔哩Note”不是只把视频转成一段摘要,而是把一个 B 站或在线视频链接加工成一套可离线打开、可复盘、可分享的视觉化学习笔记:先取得媒体和转写依据,再按自然章节组织内容,最后生成 SVG 图解、离线 HTML、整页长图与切片。

本页边界

本页归档的是当前 Codex 环境中的 bilibili-video-note Skill。它与001|逐字稿 Skillbilibili-video-learner 是不同的实现:逐字稿重点是音视频转写,bilibili-video-learner 重点是通过 B 站字幕生成学习笔记,而本 Skill 重点是“视频内容 → 结构化视觉笔记 → 离线长图产物”的完整链路。

1. 基本信息

字段内容
Skill 编号003
展示名称哔哩哔哩Note
英文名称Bilibili Video Note
功能定位将在线视频加工为带来源依据的结构化视觉笔记和离线长图产物
适用平台/场景B站及其他可由 yt-dlp 获取的在线视频;课程、讲座、访谈、播客、评论、AI学习笔记,以及需要界面证据的工具演示视频
类型不开源
许可证待核验
当前状态已安装(Codex 本机)
命令别名$bilibili-video-note
来源本机 Codex Skills 目录;已有 Obsidian 实现文档与 CFlow 记录,公开上游待核验
关联入口Skills索引

2. 它解决什么问题

普通的视频总结容易只留下几段概括,读者很难回到原视频核对;单独下载字幕又缺少章节结构、视觉组织和可分享的成品页面。这个 Skill 将视频处理拆成一条有质量检查的内容生产链:

在线视频链接

抓取元数据与音频

字幕或 Whisper 转写

媒体时长与转写结尾审计

按章节、话题变化和画面变化自然拆分

生成结构化学习笔记与时间戳依据

为每章生成内容对应的 SVG 图解

按需加入界面/工具演示的真实截图

渲染离线 HTML、整页 PNG 与长图切片

它的核心价值是把“理解视频”和“交付可阅读产物”连在一起,同时保留原视频链接、时间戳、元数据和审计信息,便于后续复核。

3. 适用场景与边界

3.1 适合使用的场景

  • 提供 B 站链接,希望得到一份结构化的视频学习笔记。
  • 处理课程、讲座、访谈、播客、评论等知识密度较高的视频,并保留时间戳原文依据。
  • 将工具、界面、文档、代码或操作演示视频做成包含真实关键帧的视觉笔记。
  • 需要把视频内容输出为离线 HTML、整页长图和可分享的切片图片。

3.2 不应混用的场景

  • 只需要高保真音视频转写时,优先使用逐字稿 Skill
  • 只需要通过 B 站字幕快速生成一篇 Obsidian 学习笔记时,应先评估 bilibili-video-learner,不要默认生成整套视觉产物。
  • 对纯口播、访谈或概念讲解视频,不应为了装饰而加入无证据的视频截图;真实关键帧只用于界面、工具、文档、代码或操作状态本身就是证据的章节。
  • 不能把结构化概括伪装成作者原话;每个重要结论都应能回到转写内容和时间戳。

4. 标准输出

每个视频使用独立输出目录,通常包含:

输出作用
index.html内嵌 CSS 和 SVG 的离线视觉笔记页面
structured-note.md先结构化概括、再拆解要点、最后给出时间戳原文依据的学习层
page.pngHTML 渲染后的整页长图
slices/带适度重叠的长图切片,便于阅读和分享
transcript/转写 JSON 与中文 Markdown 文稿
media/视频元数据、音频、封面或必要的视频文件
frames/仅在界面/工具/操作演示需要证据时保存的真实画面
audit/媒体时长、转写覆盖和渲染检查记录

5. 处理流程

  1. 建立干净的临时输出目录,避免把不同视频的媒体、转写和图片混在一起。
  2. yt-dlp 获取标题、UP 主、BV 号或 AV 号、分 P 信息、简介、标签、章节、封面、发布时间、链接和时长。
  3. 默认下载最佳音频并转换为 MP3;只有需要真实画面证据或音频提取不稳定时才下载视频。
  4. 使用 media_audit.py 对元数据时长、媒体时长和 Whisper 转写结尾进行比较;差异超过 5% 时重试或明确标记异常。
  5. 根据语言选择 Whisper 模型;中文使用 turbo,英文先用 small.en 再翻译为中文,并检查转写结尾是否接近音频结束。
  6. 依据 B 站章节、分 P、转写主题变化、幻灯片/界面变化和说话人提示自然拆章,不使用固定章节模板。
  7. 对知识型视频先生成 structured-note.md,每个章节遵循“结构化概括 → 要点拆解 → 原文依据”。
  8. 读取页面规范,为每章编写短文本、关键观点、陷阱、步骤、结论、引文和视觉锚点。
  9. 根据章节真实内容生成 SVG 图解;流程、层级、对比、因果和时间变化分别采用匹配的图式。
  10. 只有操作/界面章节才通过 extract_frame.py 提取真实关键帧;口播和概念章节只保留文字与 SVG。
  11. 按“正文 → SVG 图解 → 必要时的视频时间戳截图”组织离线 HTML,并在页尾保留来源信息和原视频链接。
  12. 用无头浏览器渲染整页 PNG,再用 slice_tall_image.py 生成带重叠的切片,检查图片、字体、留白、重叠和标题裁切情况。

6. 依赖与权限边界

  • 依赖 yt-dlp 获取公开视频元数据和媒体,依赖 ffmpeg/ffprobe 处理音频、截图和时长检查。
  • 转写可以使用 B 站字幕或 Whisper;转写质量、字幕可用性、登录限制和网络状态都会影响结果。
  • 需要浏览器渲染时使用 Chrome 或 Playwright;不能把浏览器 Cookie、Token 等凭据写入归档产物。
  • 生成的媒体和页面应放在视频专属输出目录;本 Skill 的脚本只负责处理用户授权获取的本地文件和链接。

7. 来源与安装状态

7.1 当前实际位置

本轮核验到的活动文件是:

/Users/bairimengyushi/.codex/skills/bilibili-video-note/SKILL.md

该目录同时包含 references/structured-note-spec.mdreferences/page-spec.mdscripts/media_audit.pyscripts/extract_frame.pyscripts/slice_tall_image.py 等配套文件。agents/openai.yaml 将运行时展示名写为 Bilibili Video Note

本轮没有在 .agents/skills/.claude/skills/ 发现同名兼容副本,因此本 Skill 当前按“Codex-only”登记;没有擅自复制或移动运行文件。以后如果用户明确要求统一导入知识库的 .agents/.claude 目录,再单独进行安装/复制变更。

7.2 来源与类型判定

当前 Skill 目录没有 README、LICENSE、公开仓库地址或其他可核验的许可证声明。已有B站视频图解笔记长图 Skill 的实现流程和 2026-07-06 的 CFlow 汇总记录了它的设计与产物,但这些是本地知识库中的实现记录,不构成公开上游来源。

因此本次登记为 不开源,许可证记为“待核验”。这不是说它的 Skill 文件不可读取,而是目前不能用公开源代码和许可证证明它属于开源项目;也没有证据表明它是“基于某个开源项目的本地魔改”。

8. 相关 Skill 与知识入口

文档更新日志

  • 2026.08.28|建立 003 说明页:按当前 Codex 实际路径登记 bilibili-video-note,补充功能定位、适用场景、输出契约、来源边界和与逐字稿/B站视频学习 Skill 的区别。