尧图建网站 尧图建网站 YAOTU WEB BUILD 免费咨询
ARTICLE DETAIL

资讯详情

深耕网站建设与建站编程的一线实战洞察。

Vibe Coding 实战:我把抖音收藏做成了一个会“看视频”、会整理、还能追溯来源的 AI 知识工作台

Vibe Coding 实战:我把抖音收藏做成了一个会“看视频”、会整理、还能追溯来源的 AI 知识工作台 收藏按钮只能帮我把内容留下来却不能保证我以后还能找到、看懂和用起来。我学的是数据科学与大数据技术正在准备数据分析、数据开发和 AI 相关岗位。SQL、Codex、Obsidian、数据分析项目、新工具……我在抖音和 B 站收藏了不少“以后一定会看”的视频。问题是收藏越多我越不知道自己收藏过什么。真正需要某个知识时我通常只剩下一点模糊印象我之前好像看过一个相关视频但它到底在哪于是我和 Codex 一起做了“知序”。它不是一个把链接换个地方存放的收藏夹而是一套以 Obsidian Markdown 为长期数据源的本地优先 AI 知识工作台视频链接进入系统后可以经过画面、声音和字幕理解被整理成可搜索、可关联、可追溯的知识以后问问题时系统不仅回答还保留原视频入口。先看结果我现在怎么使用它知序最核心的使用链路并不复杂在手机或电脑看到值得保存的内容 → 分享链接或写下自己的想法 → 进入“待查看”缓冲区 → AI 理解视频并整理知识 → 写回 Obsidian Markdown → 通过搜索、图谱或 AI 问答重新找到 → 需要时回看原视频我只负责“先收进来”和最终确认系统负责减少机械整理工作。第一步先收藏不要求当场整理快速收藏支持抖音、B 站、网页、新闻、汽车资讯和兴趣内容。没有链接时也可以直接写自己的理解、知识或灵感。![外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传第二步内容先进入缓冲区我不想把“收藏”变成另一项必须立刻完成的任务所以内容先进入待查看区。这里可以手动补充、立即读取、自己整理也可以保留到自动处理时间。第三步AI 整理但原始来源一直保留视频会经过临时解析和多模态理解再被整理为标题、摘要、关键内容、逐字稿、时间点、主题和来源信息。处理完成后长期留下的是 Markdown 笔记而不是占空间的视频文件。第四步以后可以直接问也可以回去看原视频系统回答时会引用本地知识库中的来源。如果 AI 总结不够完整我仍然可以打开原视频、知序笔记或 Obsidian 文件继续确认。这才是我真正想解决的问题不是“替我收藏”而是“让我以后能再次找到并继续使用”。它为什么从视频收藏工具变成了个人工作台项目一开始只围绕求职学习视频。但真正用起来以后我发现自己想保存的不只是 SQL 和面试知识。汽车、时事、基金观察、兴趣爱好、突然想到的点子也都会成为长期知识的一部分。最近开始准备实习和求职投递以后我还需要知道今天应该做什么记录项目过程而不是最后才回忆管理投递状态整理一部分可以公开展示的内容逐渐形成一份可以由我自己修正的“我的画像”。所以知序不是先画好一张巨大产品图再一次生成出来的。它是在不断使用、发现问题和继续补功能的过程中长出来的。真实使用界面下面这些是我实际使用知序时的界面。为了让文章保持阅读节奏这里以图为主不再逐张重复说明。13 个导航实际上对应四条主线为了不把文章写成菜单说明书我把它们分成四组。每一组解决一类真实问题。一、收集与理解1. 首页显示全部知识、待查看数量、主题节点、知识关联和今日行动。每次打开先看到系统现状而不是面对复杂文件夹。2. 快速收藏保存视频、网页或文字也允许主动写知识。个人知识库不能只是别人的内容搬运站。3. 待查看作为三天缓冲区支持 AI 整理和人工整理。AI 失败时保留原文不会为了“自动化成功”而丢内容。二、知识与检索4. 知识库展示已归档的 Markdown 笔记支持新增、修改、删除、附件和 Obsidian 跳转。文件夹只负责粗略安放主题、链接和搜索才负责真正查找。5. 全文搜索使用本地模糊搜索。即使忘了标题和文件夹只记得一句话或一个片段也有机会重新找到。6. 知识图谱根据 Obsidian 的双向链接和主题关系生成可视化网络。它不是为了好看而是让我看到学习、兴趣、经历和项目之间原本不明显的联系。7. 问知识库先检索本地笔记再把少量相关上下文交给 DeepSeek。回答附来源编号和入口资料不足时应该明确说不知道而不是假装已经看过。三、行动与求职8. 计划与今日目标和待办可以编辑任务可以完成、恢复和删除。完成事项进入历史记录状态同步写回 Markdown。它不使用手机通知制造压力只在打开系统时告诉我今天能做什么。9. 项目记录目标、过程、附件、结果和复盘。这样以后写简历或介绍作品时有过程证据可用而不是只剩一句模糊的项目名称。10. 求职投递记录公司、岗位、阶段、日期、备注和下一步。求职记录默认私密但可以和学习计划、项目成果形成关联。四、自我理解与公开展示11. 我的画像保存兴趣、能力、目标、偏好和使用规则。AI 只能根据我主动保存的内容提出理解而且每条都允许我查看和修改。“越来越懂我”不应该等于偷偷收集信息而应该是一份可解释、可纠正的自我认识。12. 公开作品集只有明确标记为visibility: public的允许类型才进入公开区。日记、求职记录、投资观察和私人画像默认不会公开。13. 设置个人主页文案、知识库路径、展示信息和运行状态可以修改并联动。API 密钥仍只保存在本机环境文件中不在网页里回显。我怎么和 Codex 一起做这个项目我更愿意把这个过程叫做“带着产品判断的 Vibe Coding”而不是“一句话生成应用”。我负责什么Codex 负责什么提出真实问题和使用场景搜索相关代码并提出实现方案决定产品规则和隐私边界编写、修改和整理代码在 Windows、iPhone、Obsidian 和抖音中实际试用运行测试、构建和隐私扫描指出哪里点不了、哪里不符合使用习惯根据现象定位接口、路径和状态问题判断结果是否真的解决问题修复后再次验证它的真实循环更接近我描述需求 → Codex 检查现有项目并提出方案 → 实现一个可运行版本 → 我实际点击和使用 → 截图指出不符合预期的地方 → 一起定位原因 → 修复并测试 → 继续产生新的需求AI 加快了实现速度但需求、方向、隐私判断和最终验收仍然由人负责。技术架构为什么同时使用 DeepSeek 和豆包我没有为了显得“技术很多”而堆叠工具。每项技术都对应一个在实际使用中遇到的问题模块使用技术在知序中解决什么问题应用界面Next.js 16、React 19、TypeScript构建桌面工作台、导航页面和可编辑交互长期知识库Obsidian、Markdown、YAML Frontmatter、Wikilink保存笔记、来源、主题和双向链接不把知识锁进应用数据库视频获取yt-dlp、登录后的 Edge 会话解析用户主动收藏且有权访问的视频链接视频处理FFmpeg在本机临时压缩视频减少多模态分析的传输与处理成本多模态理解豆包视觉模型理解视频画面、声音、字幕、画面文字和关键时间点知识整理与问答DeepSeek API生成摘要、宽分类、关联建议并基于本地检索结果回答问题搜索与图谱Fuse.js、Cytoscape完成本地模糊搜索和知识关系可视化数据校验与质量Zod、Vitest、ESLint校验 AI 结构化输出、核心规则和代码质量手机收集iCloud Drive、iOS 快捷指令电脑关机时先保存分享链接开机同步后再由知序导入AI 协作开发Codex检查项目、实现功能、定位问题、运行测试并整理文档其中DeepSeek 和豆包并不是重复使用两个模型而是让它们分别处理更适合的任务。DeepSeek 更适合普通知识摘要与宽分类主题和知识关联建议基于本地检索结果回答问题。豆包多模态模型更适合理解视频画面读取画面文字和字幕理解人物说话和声音信息输出关键内容、逐字稿和时间点。视频处理链路是原始分享链接 → yt-dlp 或登录后的 Edge 会话解析 → FFmpeg 临时压缩 → 豆包理解画面、声音和字幕 → DeepSeek 整理知识结构 → 写回 Obsidian → 删除临时视频为什么不能只把抖音链接发给 DeepSeek因为模型收到一个 URL不等于它真的看完了视频。只有把视频内容交给支持多模态理解的模型才能基于画面和声音总结。DeepSeek 在这里更像知识编辑和问答层而不是视频播放器。这套选择也不是一开始就确定的。最初系统只保存链接直到真实问答暴露出“模型根本没有看过视频”的问题我才补上视频解析、多模态理解和可追溯来源。技术架构是被使用过程推着长出来的而不是先列一张漂亮的技术清单。数据为什么最终写回 Markdown我没有为知序再建立一套封闭知识数据库主要有四个原因文件可以直接被 Obsidian、VS Code 或其他工具打开应用以后不维护了知识仍然在双向链接、主题和来源都是可读文本AI 失败时原始内容仍然可以留在收件箱中等待处理。公开仓库只提供脱敏示例 Vault。真实知识库、API Key、Cookie、求职记录和本机运行状态都不会上传。真实踩坑好看的页面离“能用”还很远1. Obsidian 提示 Vault not found网页能显示笔记但点击 Obsidian 时找不到仓库。原因是 URI 中的 Vault 名称、实际仓库名和路径编码不一致。解决后网页入口会指向真实 Markdown 文件而不是只打开 Obsidian 软件。2. 第一版按钮很多但点了没有反应首页卡片、今日记录、项目、作品集和待办最初只是视觉组件。后来逐个补上路由、接口和 Markdown 写回逻辑。现在任务可以完成、恢复、修改和删除目标可以更新知识和画像可以编辑删除内容进入可恢复回收站。这让我最直观地理解了一件事能截图展示和能长期使用是两回事。3. DeepSeek 只知道“有一条视频”我曾收藏一条汽车视频。问知识库时DeepSeek 只能回答“存在一条记录但摘要待处理”。原因不是模型不够聪明而是系统当时只保存了链接和标题根本没有把画面和声音交给模型。这个问题直接推动了 yt-dlp、FFmpeg、豆包视频理解和 DeepSeek 整理组成的多模态链路。4. 抖音公开链接也不一定能稳定解析短链接会跳转页面可能需要登录下载工具也可能拿不到真实播放地址。后来增加独立 Edge 会话用户只登录自己原本就有权访问的页面登录状态保存在本机.runtime不进入 Obsidian也不交给 AI。5. iPhone 快捷指令被一个“日期”变量卡住iOS 18.6 的界面和不少旧教程不一样。我一度把快捷指令输入当成日期传给格式化动作分享时反复提示无法转换。最后重新确认变量来源使用“当前日期”格式化后再拼接到文件名中手机分享链路才真正跑通。6. iCloud 有文件知序却没有内容实际遇到过三种原因iCloud 空间已满新文件没有同步Windows 只有云端占位符文件尚未下载手机文件比手动刷新晚了几分钟才到电脑。排查时把链路拆成“手机快捷指令 → iCloud → Windows 文件 → 知序导入接口”逐段检查而不是只盯着网页按钮。导入规则也曾误排除正常内容后来改成只排除精确说明文件名并补了自动测试。7. AI 回答正确也不能替代来源步骤类视频的总结很容易漏细节。所以来源卡必须保留原视频、知序笔记、Obsidian 文件和重新分析入口。AI 是理解和检索助手不是原始资料的替代品。8. 公开与私密不能只靠两个页面区分如果“公开作品集”只是另一个页面筛选错误时仍可能泄露内容。所以公开区采用显式白名单只有用户主动设置为 public 的允许类型才能导出。私密是默认状态。9. 桌面版、代理和 Windows 兼容也会影响体验桌面启动器需要判断服务是否已经启动、隐藏后台窗口并使用 Edge App Mode。Windows PowerShell 的中文引号兼容、系统代理对 B 站访问的影响也都在真实使用时暴露出来。这些问题没有多“高级”但它们决定了应用能不能每天打开。当前状态它不是完美产品但已经不是演示页面公开副本发布前完成了13 项核心规则测试全部通过ESLint 检查通过Next.js 正式构建通过私人 Vault、密钥、登录状态和运行缓存隔离示例知识库和真实数据分离视频只临时处理不长期保存在仓库中。当前限制也很明确抖音等平台规则变化时解析流程仍可能需要调整视频理解会产生 API 费用电脑关机时可以通过 iCloud 先保存链接但自动分析需要电脑再次运行它首先是为我自己设计的个人工具不是多人协作平台。我不想把它包装成“已经解决所有知识管理问题”的成品。它更像一个会继续随着我学习、求职和工作一起变化的系统。这个项目适合谁参考收藏很多视频、文章却很难再次找到的人想把 Obsidian 作为长期知识底座的人想尝试多模态视频理解和本地检索问答的人想用 Vibe Coding 做一个真正为自己服务的工具而不是只做一次性 Demo 的人想了解 AI 编程中需求、测试、隐私和迭代如何落地的人。为什么开源我希望开源的不只是最后一份代码也包括需求如何变化、问题如何出现、为什么做这些取舍。仓库会包含完整程序代码脱敏示例 Vault安装与使用文档视频处理和隐私边界说明项目完整复盘测试代码。仓库不会包含我的真实知识库API Key抖音登录状态和 Cookie求职记录、日记和私人画像临时下载的视频。项目地址GitHub知序 · Personal Knowledge OS如果你也遇到“收藏很多真正需要时却找不到”的问题欢迎在项目开源后试用、提 Issue或者告诉我你希望个人知识工作台解决什么场景。最后“知序”这个名字来自“让知识慢慢形成秩序”。我并不期待它替我记住所有东西。我更希望当未来某一天我再次需要一条知识时它能告诉我你当时保存过什么、为什么保存、它和哪些内容有关以及原始来源在哪里。对我来说这比“又收藏了一条”更有意义。
返回列表