来源:互联网 更新时间:2026-07-27 13:40
今天想和大家聊一个很实在的话题——如何用AI管理1400多篇公众号文章。
这不是一篇空泛的方法论,而是一个真实的案例:从文章下载、标签体系设计到索引系统搭建,完整拆解整个过程。
对于内容创作者来说,如果也有几百上千篇文章躺在云端不知道如何利用,也许这篇文章能提供一些启发。
三年公众号日更,写下了1400多篇文章。以前和大多数人一样,文章发完就沉底了,偶尔想找点素材,要么凭记忆翻半天,要么就放弃了。
去年12月,做了一个决定:把公众号「老生常谭」改名为「AI Rollup」,聚焦AI方向。同时新起了「老谭备忘录」,继承原来的泛话题风格。
两个号要形成差异化,就得清楚知道哪些素材更适合AI Rollup(AI-Rollup、组织AI化、RaaS等核心概念),哪些更适合老谭备忘录(创业心法、认知成长、投资思考)。
要管理文章,第一步是把它们从微信后台搬出来。
找到了一个开源项目:
它支持多种导出格式:HTML(100%还原排版和样式)、Markdown(方便后续编辑和索引)、JSON(结构化数据,便于程序处理)、Excel/Word(传统格式)。最终选择了Markdown格式,因为它既保留了文章结构,又便于后续的标签化处理。
原版工具有个问题:下载速度慢,而且没法批量处理元数据。于是用Claude Code优化了这个项目:增加了并发下载能力(用p-queue管理并发),优化了HTML到Markdown的转换逻辑(基于Cheerio和Turndown),添加了自动提取元数据的功能(标题、日期、URL等),本地用IndexedDB缓存,避免重复下载。
文章下载下来了,但还是一堆散乱的文本文件。真正的知识管理,需要结构化。
设计这套7维标签体系,花了一天时间:
一篇文章可以打1-3个标签,比如AI基础认知(大模型、AGI、AI能力边界)、AI-Agent智能体(Agent、智能体、AI员工)、组织AI化(组织形态被AI重构)、流量方法论(流量的底层逻辑)、创业心法(创业、创始人、方向选择)、认知思维(认知、思维方式、心智模型)。
这些是自创或强绑定的术语:AI-Rollup(核心投资/创业框架)、组织AI化(存量组织被AI改造)、结果即服务RaaS(商业模式主张)、首席流量官(个人标签)、十年战略(长期主义)、共创(投资+赋能关系)。
观点评论、方法论干货(含步骤、指南,可复用)、案例拆解(围绕具体公司/产品分析)、个人随笔(心境、节奏类短文)、深度长文(结构完整的重头文章)。
看多/乐观、看空/警示(泼冷水、拆穿)、行动号召(呼吁读者/企业赶紧行动)、反思自省(对自己过往判断的修正)。
高(有深度论证+含招牌概念+观点长青)、中(有一定价值但不突出)、低(纯日常随笔、过期热点、篇幅极短)。
自动抽取的动态词表:公司/产品(DeepSeek、OpenClaw、Claude、微信、视频号...),人物(巴菲特、芒格、Sam Altman、马斯克...)。
观点素材(可作为论点/金句来源)、案例素材(可作为论据/例子调用)、框架模板(结构清晰,可作为新文章范本)、概念定义源(招牌概念的权威阐述)。
这套标签体系,就是知识图谱的"元数据层"。
标签体系设计完了,但面对1400多篇文章,总不能一篇篇人工打标签。这时候Claude就派上用场了。
用Claude Code写了一个自动打标签的流程:
步骤1:读取标签体系——把7维标签的定义、判定标准、样本案例全部喂给Claude,让它理解每个标签的含义。
步骤2:批量分析文章——用Python脚本遍历所有Markdown文件,逐篇让Claude分析:读取文章内容,根据标签体系给出7维标签,生成YAML格式的frontmatter。
步骤3:写入元数据——把标签写到每篇文章的开头,用YAML frontmatter格式:
--- title: AI时代的生存法则:做减法,是最高级的护城河 date: 2026-02-18 url: https://mp.weixin.qq.com/s/xxx 主题域: [认知与个人成长] 招牌概念: [AI-Rollup] 体裁: 方法论干货 实体: [巴菲特] 立场: 行动号召 写作用途: [观点素材, 框架模板] 可复用分: 高 ---
步骤4:人工校验——Claude打完标签后,抽查一部分,发现问题就调整标签体系的判定标准,然后重新跑一遍。
"AI基础认知"应该是
这样反复迭代几轮,标签准确度就上去了。今天(7月25日)刚用这套流程处理了19篇新文章,从读取、打标签、写入元数据、更新索引,全程自动化,耗时不到10分钟。一个人,用AI,就能完成过去需要一个团队的工作。
标签打完了,但还有一个问题:如何快速检索?不想每次都去文件夹里翻文件,也不想靠全文搜索碰运气。要的是:按任意维度组合查询,瞬间定位到想要的文章。
于是建立了6个索引文件:
索引_by_年度.md,包含2026年(47篇)、2025年(xxx篇)、2024年(xxx篇)等。
索引_by_体裁.md,包含观点评论(xxx篇)、方法论干货(xxx篇)、案例拆解(xxx篇)、个人随笔(xxx篇)、深度长文(xxx篇)。
索引_by_立场.md,包含看多/乐观(xxx篇)、看空/警示(xxx篇)、行动号召(xxx篇)、反思自省(xxx篇)。
索引_by_可复用分.md,包含高(xxx篇—写作系统优先调用)、中(xxx篇—按需调用)、低(xxx篇—仅保留检索)。
索引_by_主题域.md,包含AI-Agent智能体(xxx篇)、AI基础认知(xxx篇)、组织AI化(xxx篇)、流量方法论(xxx篇)、创业心法(xxx篇)、投资逻辑(xxx篇)、认知思维(xxx篇)等。
索引_by_招牌概念.md,包含AI-Rollup(42篇)、组织AI化(24篇)、结果即服务RaaS(22篇)、共创(14篇)、首席流量官(4篇)、十年战略(5篇)等。
## AI-Rollup (42) | 日期 | 标题 | |---|---| | 2026-07-24 | [从四次失败到确定性:我的创业成长史](2026/创业与商业/xxx.md) | | 2026-07-23 | [十年投资路:从财务投资人到AI产业投资人](2026/投资与资本/xxx.md) | | ... |
这6个索引文件,就像6个不同视角的"目录",让人能从任意角度切入知识库。比如想写AI-Rollup相关的文章,打开索引_by_招牌概念.md,看看过去42篇都怎么写的;想找高质量的方法论素材,打开索引_by_可复用分.md,筛选"高"+"方法论干货";想了解自己在某个时期的思考,打开索引_by_年度.md,按时间线回顾。
整理完这1400多篇文章后,真切感受到:
很多人问为什么要花这么多时间整理这些文章?答案是:因为这是"第二大脑"。
人脑的记忆力有限,但AI+标签系统可以做到精准回忆(任意组合查询,瞬间定位)、跨时间连接(把不同时期的思考串联起来)、知识复利(过去的积累,成为未来的杠杆)。
如果也有几百上千篇文章,建议是:别让它们躺在云端吃灰,下载下来,本地化;设计一套适合的标签体系,让AI能读懂文章;建立索引系统,让知识"可检索、可复用、可迭代"。
一个只投AI产业的产业投资人,一个躬身入局的组织AI化推动者。今天,你开始管理你的知识资产了吗?
想复刻这套系统,以下是所用到的工具:
为何比特币BTC价格跌破7.3万美元?一文拆解影响近期比特币行情的五大原因
摩托车活塞环性能如何
ThinkBook系列最新价格全解析:2026年选购避坑与实时询价指南
文雅简易网名男生可爱(精选100个)
GPT5.6惨遭切脑,Fable 5回归要变弱鸡版?
Ondo将于今日上线股票永续合约
区块链存储板块是什么?有哪些?一文详解
暗黑4S14野蛮人终局BD攻略
免费网络收音机软件有哪些?高评分收音机APP推荐
《三角洲行动》S10赛季卡邮件技巧详解-三种方法及风险提示
电视剧《罗曼诺夫后裔》剧情介绍
如何在火狐浏览器中彻底禁用自动更新功能?
区块链OTC交易所有哪几家比较正规?
夸克浏览器AI画质增强功能在旧款手机上无法开启怎么办?
手机qq浏览器误删文件如何找回-手机qq浏览器误删除文件怎样恢复
360浏览器如何设置网页缩放比例
《三角洲行动》GTI超人成就解锁攻略-满辐射状态击杀技巧详解
全链网:戴蒙或继续担任摩根大通首席执行官三年
什么是山寨币?山寨币指数如何查看?全球前10大山寨币盘点
Binance新增15种bStocks代币化证券为杠杆抵押资产
手机号码测吉凶
本站所有软件,都由网友上传,如有侵犯你的版权,请发邮件haolingcc@hotmail.com 联系删除。 版权所有 Copyright@2012-2013 haoling.cc