Obsidian + AI Agent:96份个人资料一句话调出来
我把 96 条个人资料和 163 个附件放进 Obsidian,再由芬达这个 AI Agent 负责调用。真正省下来的,不只是搜索,而是找、读、抄三道工序。

我的 Obsidian 里放着 43 项证件、40 项账号、11 项资产、2 项其他资料,还有 163 个附件。
这套系统用起来有个很反常的地方:日常取资料时,我不需要先打开 Obsidian。
我要执业证,就在手机上说“把我的执业证发我”;想知道港澳台通行证什么时候到期,直接问日期;站在洗碗机前忘了强力模式怎么开,就让 Agent 从说明书里把步骤找出来。
Obsidian 在这里负责保存事实。常驻在家里机器上的 Agent 负责收资料、整理资料,再按我的话把它们调出来。聊天软件是入口,我说我要什么,它决定去哪里找、取哪一部分、用什么形式交给我。
我做的其实是一套个人资料系统。搜索只是它最初级的能力。资料一旦能被 Agent 准确调用,下一步就是让它拿着这些资料去办事。
过去,索引一直在我脑子里
我以前也用备忘录、手机相册和云盘。它们都能把东西存下来,问题出在取用。
一张证件照片存进相册以后,我还得记得自己拍过。过两年需要它,我要猜拍摄时间、翻相册、辨认缩略图。保修卡放进备忘录,我要记得标题里写的是设备名还是“保修”。十几页说明书找到了,我还得重新读一遍,才能找到那个按钮怎么按。
文件在软件里,目录在我脑子里。换了再好的笔记工具,只要取资料的人仍然是我,这份工作就没有少。
我后来给 Obsidian 接上 Agent,先把这个索引从人脑里拿了出来。
录入时,我只负责把东西扔过去。照片、语音、PDF、文字都可以。Agent 收到以后自己判断它是证件、账号、资产还是其他资料,再提取以后可能用到的字段。取用时,我不再回忆文件名和路径,只说眼前要办的事。
一张 AppleCare 保修凭证就是这样进去的。
我把照片发给 Agent,说“记一下”。图片先做文字识别,Agent 判断它属于资产,提取设备型号、签发日期和保修期限,原图则留在资产目录里。三个月后,我问那台电脑保修到什么时候,它没有把整张图重新甩给我,而是从已经整理好的字段里取出日期。
在这次往返里,我没有给文件命名,没有选文件夹,也没有在三个月后重新找图。我只做了两件事:存的时候说“记一下”,用的时候问保修期。
这套系统替我省下了一次次重复劳动。以后每次使用个人资料,我都不必先恢复当年的记忆,再猜文件放在哪里。
同一份资料,Agent 可以用四种方式交给我
个人资料的用途并不一样。有时我需要文件本身,有时只缺一个数字,有时要读懂一段话,有时正在办一件事。
第一种是拿原件。“把我的执业证发我。”Agent 返回的是图片本身,我可以直接转发,不是一个只在家里电脑上有用的路径。
第二种是拿字段。“这张证什么时候到期?”它从结构化记录里给出日期。型号、购买时间、保修期限、会员到期日,都属于这一类。
第三种是读材料。说明书、体检报告、保险合同和物业公约往往有很多页。我问洗碗机的强力模式怎么开,它定位到说明书里的对应段落,再把步骤写成人能直接照做的话。问体检报告哪几项超出参考范围,它调出项目和数值;问保险合同有哪些责任免除,它把相关原文找出来。最后的医疗、保险或法律判断仍然不能交给它,但翻页和定位已经不必由我完成。
第四种是办事。填写出境申请表时,过去要在护照照片、身份证照片、住址和单位信息之间来回切换。现在可以让 Agent 打开表单,需要哪一栏就回 Obsidian 取哪一个字段,填完停下来等我核对。
同一张证件照片,至此不再只是“保存过的一张图”。Agent 可以把原件发给我,可以回答字段,可以解释其中的内容,也可以在一次明确授权的任务里使用它。
这一步把个人资料从收藏变成了工作材料。Obsidian 保存它们,Agent 使用它们,我决定什么时候能用、能用到哪里。
四段式规定 Agent 怎样使用资料
Agent 要替人调资料,光会 OCR 不够。
文字识别会错。日期可能错一位,分属两行的数字可能被拼在一起。它若把一堆识别文字直接扔进知识库,过几个月照着错数字回答,文件存得再整齐也没有意义。
所以每条资料进入 Obsidian,我都要求它保留四部分:溯源信息、原始附件、结构化字段、原文。
溯源信息回答这条资料从哪里来、何时整理、何时做过识别。原始附件让人随时能回到照片或 PDF。结构化字段供日常查询和办事调用,原文留作核对。AppleCare 凭证里那项跨行识别的保修期限,会明确标注“OCR 分行识别,建议以官方查询为准”。
这个括号让 Agent 知道自己拿到的是什么,也让我知道该不该直接相信。一个日期是原图识别出来的,还是刚从官方网站查到的,不能混成同一种事实。
我从 Apple Notes 迁移旧资料时,也没有把文件批量复制过去就算完成。每条记录都重新过一遍识别、分类、提取、标注和保留原文。迁移因此慢了很多,换来的结果是,几年积下来的内容终于能被 Agent 稳定取用。
Agent 能看见资料,不等于它有权使用
这套系统里有证件、账号、保单和家庭资料,权限不能靠 Agent 自己“懂分寸”。
我的规则是,证件号、协议号、卡号这类信息已经存在于原图的,不在结构化正文里再抄一遍。问“有没有这个账号”,默认只回答有无、绑定邮箱或到期时间,不主动把密码吐进聊天记录。企业 VPN、API Key、Token、恢复码和资金操作权限默认不进库。个人资料区也不进入通用知识索引和长期记忆,只在收到明确请求时受限查找。
Agent 可以找到护照号,不代表它可以把护照号填进任何网页。对外办事是另一道授权。它可以按任务取字段、填写,提交以前要停下来,由我确认哪些信息将发给哪个网站。
这套分工很重要。机器负责记、找、读、抄,人负责目的、核对和授权。Agent 拿走的是重复劳动,不是决定权。
为什么把资料留在 Obsidian 里
我选择 Obsidian,主要因为资料本体仍是自己硬盘上的 Markdown 和原图。文件可以直接备份,也可以换工具继续读。Agent 框架可以换,模型可以换,聊天入口也可以换,资料不必跟着某一家服务一起搬家。
这个分层让硬件门槛也没有想象中高。发原图、取字段、判断分类这类请求,常驻小模型就能处理。读十几页说明书、比对多份文档或协助填表,再按需调用能力更强的模型。日常工作先跑起来,大模型和更强机器可以以后再补。
代价也很明确。机器必须一直开着;资料存在自己手里,备份和恢复也由自己负责。笔记库、附件和规则文件要一起备,备份不能只放在源硬盘上,还要真的恢复一次,确认文件和原图能打开。
目前这套系统仍有缺口。有效期已经进入结构化字段,却还不会在到期前主动提醒。家庭成员不能直接使用,入库后也缺少一个足够轻的确认环节。证件、账号和资产各自保留哪些字段,模板还在继续调整。
但它已经改变了我和个人资料之间的分工。
以前,文件存在哪里、当初叫什么、里面哪一行有用,都要我记。现在这些事由系统处理。我只需要说清楚眼前要什么,然后决定结果能不能用、信息要不要发出去。
文件在哪,机器负责。
这个信息能不能用,还是我决定。