AGENT 代笔的旅行笔记

旅途中随手一拍,
你自己的 agent 替你写成笔记。

把 Vifo 接到你自己的 AI agent 上——Claude、ChatGPT、Gemini、Cursor 都行,填一个地址、授权一次。 之后旅途中你只做一件事:把照片交给它,想说什么随口说一句。 记时间地点、写描述、排成一条时间线都归它。回来打开网页,是一本可以慢慢翻的笔记,照片是页面上唯一的光源。

怎么用:你的一天

用起来只有两个动作:白天把照片发出去,晚上说一句「整理今天」。 剩下的——读时间地点、写描述、排版、挑高光——由你自己的 agent 完成,你不用学任何格式。

  1. 出发前

    说一句「新建行程」

    跟你的 agent 说「新建一个行程,去京都五天」。它建好之后你就可以忘掉这件事了,后面发照片会自动落到这次旅行里。

    一次 · 10 秒
  2. 白天

    拍了就发,想说就说

    把照片交给你的 agent 就行。人在手机上最省事的办法是让它给你一条上传链接——浏览器里点开选照片,拍摄时间和位置在本地读好一并提交,不会被压掉。想说什么随手打一句,不用组织语言,也不会有人追问你。

    每次 · 10 秒
  3. 晚上

    说一句「整理一下今天」

    agent 把当天的照片和碎话合并成成段的笔记,补上日期分隔,把值得放大的画面挑出来。它偶尔会问你一句「这家店叫什么」,答不上来跳过就行。

    想整理时 · 几分钟
  4. 回来后

    打开网页慢慢翻

    一条按时间排好的时间线,开头是这次旅行的精华页。想找「那家只有六个座位的面店」,直接搜——照片描述和你写过的文字都能搜到。

    随时 · 只有你能看
你只做左边这些,右边都是自动的
你做的你不用做的
把照片交给 agent不用打标签、不用建相册、不用选分类
随口说一句感受不用写完整句子,原话会被原样留下
说「整理今天」不用挑版式、不用排版、不用调图
偶尔答一句 agent 的追问不用记地点名,有 GPS 就自动带上

准备工作:一次配好,几分钟

Vifo 本身是一台 MCP 服务器,本机不用装任何东西。你已经在用的那个 AI 客户端,多半就能连。 用邮箱注册即可,不需要邀请。

1 · 你已经在用的那个 agent

只要它能添加自定义的 MCP 服务就行:Claude(网页、桌面、Claude Code)、ChatGPT、Gemini、Grok、Cursor、VS Code、Windsurf、Zed、JetBrains、腾讯 WorkBuddy、Raycast、LM Studio、OpenCode……各家把这个设置叫 connector、custom app 或 MCP,位置不同,做的是同一件事。

2 · 填一个地址,授权一次

在客户端的 connector / MCP 设置里填入本站的 /mcp 地址,浏览器里点一次「允许」就连上了,不用手工粘贴密钥。命令行类的 agent 也可以改用 API key。

3 · 说一句「新建行程」

接下来该怎么记、照片怎么进来、版式有哪些,agent 自己会问 Vifo——它有一个 learn 工具专门讲这些,你不用先读一遍说明书。

两种连法,按你用的客户端选一种
你用的是怎么连
带界面的客户端
Claude · ChatGPT · Gemini · Grok · Cursor · VS Code · WorkBuddy…
在 connector / MCP 设置里添加一个自定义服务,地址填 /mcp,浏览器里点一次「允许」即可,无需手工粘贴钥匙
命令行 agent
Claude Code · OpenClaw · OpenCode…
同样可以用上面的授权方式;也可以把站点地址和钥匙写进环境变量:VIFO_URLVIFO_TOKEN

这个工具的脾气

有几件事它做得跟别的相册不一样,都是刻意的。

每张照片都会被写上一句话

没有描述的照片不许入库。因为三年后你会去搜「那家只有六个座位的面店」,而不是 IMG_4832。这句话由 agent 替你写,你不用动手。

你的原话不会被改成游记腔

「这碗面好吃到想哭」会原样留着,agent 那句客观描述另放一栏。多年后打动你的通常是前者。

没有相册、没有文件夹

只有一条按时间排好的线。哪天拍得多,那天就长;哪天在赶路,那天就短——版面自己会显出旅行的节奏。

照片只有你能看

没有「知道链接就能看」这回事:每次打开图片都要验明身份。照片里带着你的位置信息,这件事从第一天就没打算将就。

背后发生了什么

不关心也完全能用;如果你在意照片和文字到底经过谁的手,这一节讲清楚。 一句话:所有理解与写作都发生在你自己的设备上,这里只负责存好、看好。

  1. 你的手机 照片 · 随口一句
  2. 你自己的 agent 读时间地点 · 写描述
  3. 你的云端账号 数据库 · 私有存储桶
  4. 网页时间线 登录后仅你可见
照片原件与文字只经过你的设备和你自己的云端账号;本服务不做图像分析,也不把你的内容送给第三方模型。
智能在你本地,存储与展示在服务端
环节在哪完成说明
看图写描述你的 agent(本地)服务端从不读取像素,也不调用视觉模型
读拍摄时间与位置你的 agent(本地)从照片自带的 EXIF 信息里读出,作为字段提交
生成网页用的图服务端按页面需要的尺寸从原图懒生成并缓存,方向自动摆正,网页不直出原图
存储与鉴权服务端结构化数据进数据库,原件进私有存储桶,按用户隔离
版式渲染服务端10 种版式与精华页,未知类型自动降级不坏档
检索服务端照片描述、关键词、地点与时间线正文全文可搜

常见问题

Vifo 是什么?

Vifo 是一个 agent 优先的旅行笔记工具。它本身不做 AI 分析:写描述、选版式、策展这些「智能」由你自己的 AI agent 完成,Vifo 负责结构化存储、鉴权与展示。

每天要花多少时间在这上面?

白天几乎不花时间:拍完发出去就行,十秒一张,agent 不会追问打断你。晚上想整理的话说一句「整理今天」,通常几分钟;不想整理就跳过,攒几天再说也不影响。

哪些 AI agent 能用?

只要客户端能添加自定义的 MCP 服务就能用:Claude(网页、桌面、Claude Code)、ChatGPT(需要打开开发者模式)、Gemini、Grok、Cursor、VS Code、Windsurf、Zed、JetBrains、腾讯 WorkBuddy、Raycast、LM Studio、OpenCode、Kiro 等等。各家把这个设置叫 connector、custom app 或 MCP,藏的位置不太一样,做的是同一件事:填入 /mcp 地址并授权一次。Vifo 不挑模型,也不要求你换掉现在用的那个。

我的照片存在哪里?谁能看到?

照片存在私有的 Cloudflare R2 存储桶里,不可匿名访问。所有读取都要经过服务端鉴权代理,并按用户隔离:其他用户请求你的照片会得到 404。

需要装什么才能用?

本机什么都不用装。一个支持 MCP 的 AI 客户端加一个 Vifo 账号就够了,用 connector 连的话连密钥都不用碰。照片有两条路进来:让 agent 给你一条上传链接,手机浏览器里点开就能传;或者由能读到文件的本地 agent 直接上传——网页版客户端读不到你电脑上的文件,走上传链接就行。

怎么把 agent 连上 Vifo?

带界面的客户端用 OAuth 2.1:在它的 connector / MCP 设置里填入 /mcp 地址,浏览器里点一次「允许」就完成授权,无需手工粘贴密钥。命令行 agent 也可以改用 API key,把站点地址与 key 写进环境变量。

为什么每张照片都必须写描述?

描述是多年后能否找回这张照片的唯一线索。描述与关键词都进全文索引;时间线上写过的文字同样可以搜到。

旅途中 agent 掉线或没网怎么办?

照片一直在手机相册里,回头补传即可,上传链接不用重新要。没想好归属哪次行程的照片会先进「待认领池」,之后用 list_media 找出来、update_media 归属到具体行程。

Vifo 收费吗?

自建服务,跑在 Cloudflare 免费额度内,不收费。每个账号有存储和条目上限——免费额度是有限的,定个上限才能分给更多人;照片以展示尺寸存储,通常够记很多次旅行。