尧图建网站 尧图建网站 YAOTU WEB BUILD 免费咨询
ARTICLE DETAIL

资讯详情

深耕网站建设与建站编程的一线实战洞察。

别再手动复制 AI 对话了:一键把 Google AI Studio 对话导出成 PDF(开源)

别再手动复制 AI 对话了:一键把 Google AI Studio 对话导出成 PDF(开源) 别再手动复制 AI 对话了一键把 Google AI Studio 对话导出成 PDF开源过去几个月我一直在用 Google AI Studio 学习 BIOS 开发让它扮演私教从 GPIO、上拉电阻一路问到中断路由和 NVRAM。几十轮对话下来这堆记录本身成了我最有价值的学习资料——踩过的坑、它的讲解、每次回答前的完整思考过程翻回去看比任何教材都更对症。问题是怎么保存。我最开始的做法是复制粘贴到 Word 再转 PDF体验很糟Markdown 的标题、代码块、表格全变成一团乱码AI 的思考过程在页面上默认折叠复制不到部分长回复还会被截断存完了才发现少了半截。后来找人帮我导出过一次 PDF乍看像模像样。直到某天想回查一个细节那轮对话根本不在文件里。我拿原始数据对了一遍——仅那一次解析就漏了 5 条消息2 条提问、2 条回复、1 条思考过程。存档缺内容等于白存。于是自己写了个工具整理完开源在这里GitHubhttps://github.com/yongchangxu/aistudio_to_pdf先看效果python aistudio_to_pdf.py https://aistudio.google.com/prompts/xxxxxxxx浏览器自动打开、抓取、关闭全程无需干预。实测导出83 条消息输出 95 页 A4 PDF文件名自动取对话标题。PDF 长这样封面带对话标题、所用模型、轮数统计、原始链接和导出时间正文里用户提问是蓝色标签、AI 回复是绿色标签、思考过程是黄底斜体块代码块灰底等宽字体表格带边框Markdown 的标题层级和列表全部保留。它能做什么一句话把一条 AI Studio 对话链接变成一份排版完整的 A4 PDF。展开一点直接读对话的数据接口而不是页面思考过程、被折叠的长内容、表格代码全都在用户提问 / AI 回复 / 思考过程三种角色分色标注思考过程斜体弱化不打断正文阅读封面自动生成标题、模型名、轮数统计、原始链接、导出时间多账号对话在哪个账号下就在浏览器里切到哪个账号每个账号只需登录一次批量导出一条命令接多个链接挂着跑就行为什么复制粘贴总是丢内容你在浏览器里看到的对话是页面拿到一份 JSON 之后现场渲染出来的。从页面上复制相当于照着渲染结果抄原文思考过程被折叠看不见长内容被截断Markdown 的结构标记标题井号、代码围栏、表格竖线已经被渲染剥掉抄漏抄错都不奇怪。这个工具的思路是绕开页面、直接拿数据源用 Playwright 打开对话链接同时监听网络请求等 AI Studio 加载对话数据的那个内部接口返回把响应里的 JSON 解析出来。这份 JSON 存的就是对话的原始 Markdown 全文从数据源头取就谈不上漏。之后的事就常规了解析每一轮的角色渲染成排版 HTML交给无头浏览器打印成 PDF链路一共五步打开链接 → 监听数据接口 → 解析 JSON → 渲染 HTML → 打印 PDF有一个细节值得说判定思考过程没有用任何关键词猜测。我手头旧导出脚本的做法是拿正则去匹配 “Okay, I’m now…” 这类英文短语来猜哪些是思考段——换成中文思考、或换一代模型这套关键词就失效了。而接口数据本身有结构AI 生成一段回复时思考文本在前、正式回复在最后所以连续的 model 块里除最后一条外全是思考过程。按结构判断不依赖任何语言特征。3 分钟上手环境只要两样Python 3.9本机的 Edge 或 ChromeLinux 用 Chromium 也行。git clone https://github.com/yongchangxu/aistudio_to_pdf.git cd aistudio_to_pdf pip install -r requirements.txt python aistudio_to_pdf.py 你的对话链接第一次运行会弹出浏览器窗口登录一次 Google 账号即可。登录状态存在用户主目录~/.aistudio_profile不进仓库、不上传之后每次运行全自动。对话在别的账号下怎么办AI Studio 的链接里有/u/0、/u/1的编号对应不同的 Google 账号。如果对话属于当前没登录的账号脚本会明确提示在浏览器右上角点头像切换或选添加其他账号登录一次。切过去页面自动加载脚本自动继续该账号名下的所有对话以后都能直接导出。【截图位 3多账号提示的终端输出】常用参数参数作用--no-thinkingPDF 不含思考过程只留提问和回复-o 文件名.pdf指定输出文件名多个链接空格隔开依次批量导出--timeout 秒数等待登录和加载的超时时间默认 300 秒--keep-raw额外保存抓到的原始 JSON调试用隐私整条链路都在本机的浏览器里完成不经过任何第三方服务器。登录凭据存在本机用户目录导出的 PDF 是你自己的对话内容注意别随手传到公开位置就好。写在最后工具 400 来行 Python依赖只有 playwright 和 markdown 两个包。AI 对话正在变成很多人真实的学习和工作档案保存这件事不该靠手工搬运。觉得有用的话去仓库点个 Star解析遇到问题欢迎提 issue附上--keep-raw抓到的原始 JSON我来修。GitHubhttps://github.com/yongchangxu/aistudio_to_pdf
返回列表