一个面向 AstrBot 的视频/音频总结插件。
插件会根据用户输入的 URL 进行解析与下载资源,提取音频后调用必剪转写接口生成字幕,再交给 LLM 输出结构化中文总结。
- 支持多平台 URL 解析,支持直链媒体作为回退兜底
- 借助必剪接口实现音频转文字
- 本地硬盘缓存,重复 URL 直接从本地获取字幕和总结内容,降低成本
- 支持强制总结,复用本地字幕并重新调用 LLM,覆盖旧总结,防止偶然错误
- 注册 LLM 工具,对话中自动识别视频/音频链接并提取内容,无需手动指令
- 用户发送
/总结 url或/强制总结 url指令 - 解析器识别并解析目标平台链接
- 下载媒体并提取音频
- 调用必剪接口进行字幕转写
- 按提示词模板构建 Prompt 并调用 LLM
- 返回总结结果,并按配置写入本地缓存
下载仓库 zip 压缩包,在astrbot仪表盘安装
llm_provider:总结使用的模型提供商,留空使用全局 LLMshow_token_usage:是否在结尾输出 token 使用情况与总结耗时enable_cache:是否启用本地缓存processing_timeout:LLM 总结超时秒数summary_template:总结模板选择,仅支持内置default.txt和concise.txtwhitelist/blacklist:白名单/黑名单source_max_size/source_max_minute:下载资源大小与时长限制download_timeout/download_retry_times/common_timeout:下载与请求超时控制proxy:全局代理地址enable_media_summary_tool:是否向 LLM 注册媒体总结工具enable_media_subtitle_tool:是否向 LLM 注册字幕提取工具parsers_template:各平台解析器开关与参数,默认启用 B站、抖音、直链媒体,具体请参考astrbot_plugin_parser
插件注册了两个 LLM 工具,可在对话中由 LLM 自动判断并调用,无需用户手动输入指令:
当对话中出现视频/音频链接时,LLM 可调用此工具获取内容的 AI 总结。
- 流程:解析链接 → 下载媒体 → 提取音频 → 必剪转写 → 调用插件配置的 LLM 生成总结 → 返回精炼摘要
- 适用场景:用户分享视频链接并询问"这个视频讲了什么"时,LLM 自动提取并总结
提取视频/音频链接中的原始字幕文本(含时间戳),不进行 AI 总结。
- 流程:解析链接 → 下载媒体 → 提取音频 → 必剪转写 → 返回带时间戳的字幕
- 适用场景:需要逐字分析原始语音内容,或对字幕进行二次处理
当 enable_cache=true:
/总结 url:若命中 URL 对应总结缓存,直接返回缓存总结/强制总结 url:若命中本地字幕缓存,跳过下载与转写,直接交给 LLM 重新总结并覆盖旧缓存总结- LLM 工具与
/总结命令共用同一套本地缓存。
缓存数据储存在 data/plugin_data/astrbot_plugin_summary/cache/
- 支持的 URL 请参考 astrbot_plugin_parser
- 提示词模板位于
data/plugins/astrbot_plugin_summary/core/prompts/,可直接修改已有模板文件来自定义输出效果;插件更新时模板会恢复为仓库原模板。 - 本插件的工作依赖于音频转文字,并非直接浏览视频
- 本插件采用 vibe coding,作者已对其功能进行严格审查,但不保证插件稳定性
- 本项目使用了 astrbot_plugin_parser 的部分代码实现资源下载
- 本项目受 astrbot_plugin_biliVideo 启发,使用必剪的接口实现视频字幕提取
- 本项目使用了 astrbot_plugin_markdown_killer 的主要逻辑实现对 markdown格式 的严格剔除