视频 → 字幕 → 讲义

一门课的视频,
整理成一份能翻的讲义

拓义把课程视频抽出音频、识别成带时间轴的字幕,再交给 AI 写成带关键帧截图的 Markdown 讲义。讲义 PDF、课本、资料和进度,都按课程文件夹放在你自己的磁盘上。

密钥自备:阿里云百炼、火山引擎豆包,或本机 Whisper。没有账号、没有遥测。

室内设计导论
第一部分 · 基础
01 空间与尺度
02 动线
03 光与色彩
04 材料
第二部分 · 案例
05 小户型
06 工作室
Light and Color光与色彩:房间的第一材料
04:02Artificial light is layered: ambient, task, and accent.人工照明是分层的:环境光、任务光和重点光。
04:12A common mistake is one big ceiling fixture.一个常见的错误是只装一盏大吸顶灯。
04:19Now, color. Color is never seen alone.接下来说色彩。色彩从来不是孤立地被看到的。
笔记资料

三层照明

  • 环境光:填满房间,均匀、无方向
  • 任务光:书桌、灶台,局部、够亮
  • 重点光:一幅画、一面粗糙的墙

色彩从不单独出现

同一面灰墙,在蓝沙发旁偏暖,在橙沙发旁偏冷。样色要刷在真实的墙上、真实的光线下,住几天再定。

怎么用

把视频文件夹交给它,剩下的按顺序发生

拓义不改你的文件。视频留在原处,每一步的产物都写回同一个课程文件夹,随时能用别的软件打开。

抽出音频

ffmpeg 从视频里抽出单声道音频,只留下识别需要的部分。

识别成字幕

句级时间戳,跟着播放滚动,点一句就跳到那一秒。有同名字幕文件就直接导入,不再识别。

AI 整理讲义

按课程自己的提示词,把口语整理成有层级、保留例子和原话的 Markdown。

关键帧插图

板书、幻灯片切换的画面自动截下来插进讲义;看视频时也能随手截图配进笔记。

功能

一个课程文件夹,就是一门课的全部

登记一个「资产库」文件夹,里面的课程按层级自动出现,上级文件夹名就是分类。每门课用同一套预设子目录,也可以自己改名。

标准课程文件夹

视频/ 讲义/ 课本/ 资料/ 字幕/ 笔记/,加一个放派生数据的 .tayi/。老课程一条命令整理成这个样子,只复制不删除。

资产库自动纳管

把文件夹放进资产库就成了课程;库外的文件夹可以一键导入并整理。多个资产库、多块硬盘都行。

字幕:识别、导入、编辑、翻译

逐句编辑随时保存;英文课程一键逐行翻成中文,原文下方对照显示。

讲义与截图

Markdown 讲义在课程文件夹里,所见即所得地改;截图直接插进当前段落,图片存在旁边的目录。

讲义 PDF 与资料

讲义 PDF 可以挑页插进笔记;课本、资料在讲次页右栏直接预览,也能全屏读。PDF 还能整本翻译。

进度、看板、封面墙

看到哪一秒记在课程文件夹里,换台电脑接着看。首页按书架、目录、看板、封面墙四种方式浏览。

界面

看视频、读字幕、写讲义,在一个窗口里

讲次页:左侧讲次列表,中间播放器与双语字幕,右侧讲义
讲次页字幕跟着播放滚动,译文在原文下方;右栏在笔记和资料之间切换。
课程资料面板:讲义 PDF 及其中文译本、双语对照本
课程资料讲义、课本、资料分栏;PDF 一键翻译,译文存在原文件旁边。
设置弹窗:语音识别服务、配套服务、插件、资产库
设置识别服务各一行、各一个开关;密钥只存在本机。

识别与隐私

识别服务自己选,密钥自己填

拓义不经手你的账号。云端识别用你自己的 API Key,按各家的价格直接结算;不想上传就用本机 Whisper。

服务特点音频怎么传
阿里云百炼Qwen-Audio 文件转写,中文准,有免费额度直传百炼临时存储,不需要对象存储
火山引擎 豆包标准版 / 极速版 / 闲时版,中文与中英混合最稳极速版随请求直传;标准版、闲时版经你自己的对象存储中转
本机 Whisper插件多语种,俄语、韩语、日语都好;不花钱、不上传不传,全在本机
兼容接口任何 OpenAI 式转写接口:另一台机器、远程服务直接发给那台机器
1

没有账号系统,没有遥测

应用不向任何人报告你在学什么。设置、密钥、进度都在本机的配置目录里。

2

数据格式是普通文件

字幕是 JSON 和 SRT,讲义是 Markdown,截图是 PNG。不用拓义了也一样能读。

3

对象存储可选,且随你选

只有火山的标准版和闲时版要经它中转。腾讯云 COS、阿里云 OSS、AWS S3、MinIO 都行,设置页里能一键测试。

插件

重的活交给插件,装在数据目录里,卸载就是删文件夹

插件是独立的服务,拓义通过本机端口调它。它们可以装在这台电脑上,也可以跑在别的机器上,多台设备共用。

Whisper 本机识别

不上传、不花钱的语音识别

基于 whisper.cpp,在 Apple Silicon 上用 Metal 加速。插件和模型分开:模型自己挑、自己决定放哪块盘,推荐 large-v3-turbo 量化版,574 MB。

Apple Silicon多语种模型可选

PDF 翻译

整本讲义翻成中文,保留版式

基于开源的 BabelDOC,输出单语版和双语对照版,写在原 PDF 旁边。翻译用你在讲义里填的同一个 AI 接口。服务本身开源(AGPL),可以放在 NAS 的容器里给全家用。

一键安装远程服务双语对照

两种用法

Mac 上直接用,或者部署到家里的 NAS

Mac 桌面版

一个 .app,打开就是。视频可以在本地硬盘,也可以在挂载的网络盘上。

  • 插件装在应用的数据目录里
  • 本机 Whisper 只在 Apple Silicon 上可用
  • 正式版会签名并支持自动更新

NAS · Docker 自部署

同一套服务端跑在容器里,浏览器里用;手机、平板也能看视频读讲义。

  • 视频目录只读挂载,配置目录单独挂载
  • 低配 NAS 用 poppler 渲染 PDF,不需要 AVX
  • 翻译服务可作为旁路容器一起部署

下载

拓义 0.1.0 预览版

macOS 13+Apple SiliconDMG · 152 MB2026-09-15

预览版还没有签名。第一次打开会提示「无法验证开发者」:右键点应用 → 打开 → 再点一次打开;或者在终端执行 xattr -dr com.apple.quarantine /Applications/拓义.app。识别和讲义需要你自己的 API Key,或者装本机 Whisper 插件。