Hello 大家好,我是Simon!
前几天,我突然冒出了一个想法:
自己的网站上已经发布了大量文章,能不能把整个网站变成一个知识库,再与Codex连接起来,放在本地供自己使用?
毕竟脑子的主要作用是思考,而不是用来记忆。
电脑内存更适合干存储和提取的活儿,它记得比我们多,提取速度也比我们快!
每次我在写文章的时候,在突然想到曾经写过某个话题或概念时,却又无法回忆起更加细节的信息。
我就必须绞尽脑汁的使用关键词在站内搜索,但经常还是空手而归!
这种感受太难受了!
如果我能解决这个问题,利用大语言模型的语义识别能力,就可以很快从本地知识库中找到答案。
想法很美好,但必须靠实践来验证。
于是我把Codex打开,把自己的需求告诉了它。
没想到,真被我折腾出来了!

PART 01 / 开始让Codex抓取文章
第一次抓取公开网页内容时非常顺利:178篇普通文章,加上7个能够公开读取的页面,共185篇内容以Markdown格式被存进了本地知识库。

PART 02 / 被隐藏的付费内容怎么办?
但是,事情总是不会那么一帆风顺,新问题来了:
网站中还有几十篇付费内容,公开接口拿不到完整正文,怎么办?
最初考虑过使用WordPress自带的文章导出功能。
但是,只要网站继续更新,我就得反复执行“导出—上传—重新同步”这个过程。
这显然解决不了我想要偷懒的痛点。
所以,我又给Codex增加了一个要求:以后网站新增或修改文章,知识库也要自动更新不想每次手动导入。
于是,Codex开动脑筋,给我提供了一个新的解决思路:
1. Codex先帮我制作一个WordPress只读插件;
2. 由我在网站后台专门创建一个用于“文章同步”的专用用户;
3. 为这个用户授权读取内容的权限;
4. 密码由Windows加密保存在本机;
5. 同步脚本定期把网站变化更新到本地。
Codex帮我创建出来的插件不能新增、修改或删除文章,也不会读取用户、订单、评论、草稿和私密文章。
这样就解决了付费内容读取的问题,也不会随意去读其它内容。
PART 03 / 本以为结束了,结果还有坑
方案确定后,Codex直接帮我生成了可以上传到WordPress的插件ZIP。
我兴奋的在Wordpress后台上传安装了这个插件,但是……
上传插件后,在尝试启用该插件时WordPress报错:
Plugin file does not exist.

问题不大,我依然还是把问题扔回给Codex。

Codex检查后发现,原安装包由Windows压缩工具生成,部分Linux主机无法正确识别内部权限和插件主文件。
Codex重新使用跨平台ZIP格式打包,并将插件升级为1.0.1版本,终于成功启用。

PART 04 / 大功告成!
终于把网站所有内容都同步到了本地,Codex还顺手给我设置了自动同步文章的定期任务。

现在,我可以直接问Codex:
例如:根据我的知识库,总结我对GEO优化的主要观点,并附上文章来源。

回过头来看,这件事情最初真的只有一个非常模糊的想法。
我不懂WordPress接口,不会写Python,也不知道什么是应用程序密码和Windows DPAPI。
但是,我知道自己想要什么:
把这些年积累在网站里的内容,变成可以持续更新、随时检索、反复使用的个人知识资产。
AI最强的地方,不只是替我们生成内容,而是能够把过去分散、沉睡的经验重新组织起来,在我们需要的时候再次发挥作用。
从想法到落地之间的距离,从来没有像现在这么近!
AI时代,非常考验我们的想象力,清晰表达的能力,逻辑思考的能力,和一颗愿意去尝试和落地的心!
与正在读本文的你,共勉!
来源公众号: 赛门快跑(ID:SimonS_Rush)分享海外数字营销干货
本文由 @赛门快跑(苏嵩Simon) 原创发布于奇赞平台,未经许可,禁止转载、采集。
该文观点仅代表作者本人,奇赞平台仅提供信息存储空间服务。


