标题:一个 LLM 维基如何改变了我的工作方式

这是一篇关于 AI 的专栏。我的未婚妻在 Anthropic 工作。完整的伦理声明见这里。
四月初,知名 AI 研究者 Andrej Karpathy 在推特上发了一个想法——对于某种热衷于效率的极客来说,这简直是一种信息公害。他这样描述这个想法:“最近我发现一件很有用的事:用 LLM 为各种研究兴趣主题构建个人知识库。”然后他继续介绍自己的流程:把源文档放进本地文件夹,用 LLM 提取内容并整理成 Markdown 维基,随着他不断加入新材料,这个维基也会同步更新。
Karpathy 关于 AI 的言论在网上向来备受关注——毕竟“vibe coding”这个词就是他想出来的。于是,似乎就在几小时内,网上就涌现出一大批 GitHub 仓库、YouTube 视频和 Substack 文章,教你怎么搭建自己的 LLM 维基。我管这叫“信息公害”,是因为仅仅知道这个想法之后,我就注定要把接下来几周的时间花在搭建它上面,尽管当时完全不确定它对我有没有用。
事实证明,确实有用。今年我为了提升案头工作的效率尝试过不少方法,其中 LLM 维基是最有用的一个,没有之一。它就像一辆老式跑车,需要相当程度的保养,而且几乎肯定有更简单的办法来建个人知识库。但如果你做的任何工作让你渴望有个好研究助理来帮忙,那么 LLM 维基也许值得你花点时间。
这个维基是我年度生产力文章的重头戏。在那篇文章里,我会盘点自己在工作方式上的各种改变,这些改变可能会引起那些对软件有着莫名热情的人的兴趣。(这里是 2023、2024 和 2025 年的文章。)
那么接下来,就来说说哪些我在延续,哪些已经放弃,哪些是新的尝试。
我仍在坚持使用的工具
考虑到我平时频繁切换应用,判断一个工具是否真的提升效率,最好的标准就是看它能用多久。我会在新电脑上重新安装它吗?订阅到期时会续费吗?我能明确说出它到底在哪些地方帮我省了时间吗?
前几年我推荐过的三款应用,至今仍然经得住考验。
Raycast 是一款替代 Spotlight 的启动器应用,至今仍是我操作电脑的首选方式。按下 ⌘-空格,Raycast 窗口会立刻弹出,让我在大多数常用应用里完成各种操作:查词、算数、调整窗口位置、查看剪贴板历史、打开网站。借助付费升级,我还能在 Raycast 窗口里快速完成大量简单的 AI 搜索(我用的是 GPT-5.5 Instant,看中的是它质量和速度兼得)。用完以后,不会迷失在一堆打开的标签页或窗口里——Raycast 会悄然退回后台。到现在,我真的无法想象没有它的 Mac 会怎样。而且自去年以来有个好消息:它现在也推出了 Windows 版本。
Capacities 自称是「大脑的工作室」,我的每日日记就存在这里。每天早晨,我会随意写下当时脑子里想的事情。然后,把 Techmeme 上值得注意的新闻链接贴在日记末尾,并打上标签。这样一来,当我要写报道或准备播客节目时,点一下「劳工」这类标签,就能立刻看到自几年前建立这套系统以来保存的所有相关报道。这对我们正在制作的 AI 与生产力播客系列帮助巨大,因为每期节目都会讨论就业相关新闻。过去我常花大量时间翻数据库,或做一堆毫无结果的 Google 搜索,只为回忆起某篇读过的内容;有了 Capacities,一切都只需一次点击。这类功能用很多应用都能实现,但用了三年之后,我依然欣赏 Capacities 的简洁与安静。
最后,去年我提到自己在测试一款名为 Recall 的应用(算是 LLM wiki 的提前预演!),它能帮你保存和整理网络内容。过去一年里,我发现自己拿它做这件事的次数变少了,只剩一个杀手级用途还在用:它的 Chrome 扩展可以近乎即时地给出 YouTube 视频的文字摘要。过去一年,我把那些觉得工作该听的播客一股脑丢进 Recall,然后只扫一眼摘要,就省下了大把时间。
我不再做的事
过去一年我停掉的两件事,彼此相关——也和 LLM wiki 有关。多年来,我一直在寻找解决记忆问题的办法。我当科技记者快 16 年了,写通讯稿将近 9 年,写这份通讯稿也有 6 年。这期间大部分时间,我都在各处发表报道、保存研究材料。当一条新闻牵扯到过往的某些内容时,我想尽快找到那些背景。
去年我提到过,Notion 上线了一个我盼了好几年的功能:一个代理,可以在这些年我存进去的数千条链接里搜索。它还算好用,但我没法把它变成习惯。数据库自身的搜索只是简单的关键词搜索;代理式搜索藏在应用里众多其他界面的某一处;而且代理经常要在额外提示下才会注明出处。它能用,但用起来费劲。
而且,它只能回看过去。我同样需要一个系统,帮我围绕新概念、大规模地组织报道。在 Capacities 里,我养成了创建一种叫“blips”的页面的习惯(灵感来自 Andy Matuschak),用来收集零散的素材。比如 2024 年夏天,我建了一个叫“AI 可能导致大规模失业”的 blip,然后在日常记录中遇到相关的 AI 与就业报道,就把链接加进去。
有几个月,我自认为非常聪明,因为我在 Capacities 的日记模板里创建了一个动态对象,可以随机展示一批 blips。它会定期提醒我那些忘了更新的 blips,比我以前用过的任何追踪长期故事的体系都管用。
不过说到底,这套系统对我的要求还是有点高。随着 blips 的数量越积越多,我能持续追踪所有线索的能力反而下降了。这又让我更不愿意新建 blips。
所以,当我看到 Karpathy 的那条推文时,我不由得在椅子上坐直了。要是 AI 能替我把这些 blips 都写了、都更新了呢?

Hugging Face agentic 泄露事件的 wiki 页面(Casey Newton / Platformer)
LLM wiki
说真的,过去一年我在效率上最重要的变化,大概就是……我现在会做软件了?和去年年底似乎所有人一样,我开始摆弄 Claude Code,然后做出了几个我真正每天都在用的应用。有时候我也会用 Glaze,Raycast 出品方的另一款应用,设计和打磨都很出色。
不过,LLM wiki 这个项目,我只是让 Claude Fable 5 帮我写了一段提示词,用来生成一个「Karpathy 式 LLM wiki」。我把结果粘进终端(我用的是 Ghostty),没多久就在 Obsidian 里建好了一个装满 Markdown 文件的新文件夹。
这个 wiki 之所以对我特别有价值,是因为我一开始用自己的写作给它「播种」:把整个 Platformer 的存档都喂了进去,Claude 熟练地从中提取出自 2020 年以来我报道过的各色人物、公司和概念,整理成 Markdown 文件,放在我的电脑上。
这些文件可能会变得很长——我关于 Meta 的页面已经超过 12,000 词,里面链接了 1,300 多个维基内其他页面。平时这些内容没什么实际用途,但我不止一次在翻阅这个档案库时度过整个下午,那种状态就跟逛 Wikipedia 一样,带着好奇心和愉悦感,回忆旧闻,琢磨它们和当下发生的事情有什么关联。
不过,我想要的不只是一个记录自己工作的维基。所以现在每天早上写完日记后,我会用 Obsidian 的网页剪藏工具(web clipper)把一批报道存进维基里,它会自动转成 Markdown 格式。然后电脑上的一个脚本会读取这些报道,判断它们应该归入维基的哪个位置。
这样一来,我现在有了 1,440 多个维基页面,覆盖了我在 Platformer 工作期间几乎所有关注过的话题——从最初几年专注的内容审核,到后来对儿童安全和 AI 进展越来越浓厚的兴趣。这个维基会自动生成详细的时间线,并链回原始来源;我还可以通过一个叫 Claudian 的 Obsidian 小插件直接向它提问。
这到底怎么提升效率的?我发现它在那些变化快、情况复杂的事件里特别管用,比如 OpenAI 和 Hugging Face 的智能体入侵事件(agentic breach)——那几周里,每隔几天就能了解到一点新的细节。每天在动笔写文章、录播客,或者去别人的播客做客之前,我会打开相关页面快速回顾一遍,同时点开原始来源核对,确保自己接下来要说的话没有一条是瞎编的。考虑到这件事本身的复杂度——智能体到底是怎么逃出去的?从哪里逃的?逃到了哪里?——这个维基帮我省了大量时间。
它还能给我提供选题灵感,做法就是把我以前的 blips 系统自动化了。每天脚本在读新闻的时候,维基会为新闻里的新概念自动生成页面,比如"tokenmaxxing"(疯狂堆 token)、"青少年社交媒体禁令"、"AI 版权"这类。每天早上它还会更新一个"首页",把当天新闻里值得关注的故事列出来。这周我就是看到维基里出现了"AI 与国会"这个概念,点进去发现页面上已经汇总了不少相关报道,后来我就拿它当选题,去录了一期播客。
这些都很棒。不那么棒的是,这个 wiki 需要几乎持续不断的维护。页面会变得过长,需要精简。代码中的某个错误会导致某个进程停止运行,必须修复。此外,Claude 那种过度压缩、几乎难以阅读的行文风格(见这条推文和这一条)让我改用 GPT-5.6 Sol 来重写系统的大部分内容,使其更接近美联社(AP)风格。(它做得非常好。)
现在,距离我创建这个 wiki 已经一个多月了,我发现自己每天早上都期待查看它又做出了什么。一方面,它对我来说太个人化,也太笨重,我无法自信地向别人推荐。另一方面,“自组织知识库”对我来说,似乎是我在 2008 年第一次在 Mac 上安装 Evernote 那天开始的那一整个过程的终极归宿。
这就是我上周采访 Town 公司首席执行官 Jean-Denis Greze 的原因之一;看待那款产品(或者说它可能演变成的东西)的一种方式,是把它看作一种面向工作的 Karpathy LLM wiki。和以往一样,在刀刃上使用这些工具的代价是,我每次到达得都太早了。而回报是,不知怎地,我乐在其中。

来自赞助商的消息

Mercury Spend 是内置在 Mercury 中的费用管理功能。为你的团队和代理发放卡片,设定每人或每团队的开支限额,相关策略会自动执行。收据会自动从 Gmail 或短信中获取,有逾期任务的卡片会自动锁定,直到问题解决。再也不用到月底手忙脚乱。
探索 Mercury Spend
*Mercury 是一家金融科技公司,并非 FDIC 承保的银行。银行服务由 Choice Financial Group 和 Column N.A. 提供,两者均为 FDIC 成员。IO Card 由 Patriot Bank, N.A. 依据 Mastercard International Incorporated 的许可发行,Patriot Bank, N.A. 为 FDIC 成员。

追踪动态
OpenAI 的安全措施回调
事件经过:
OpenAI 推出了“ChatGPT for Teens”(青少年版 ChatGPT),这是一个带有安全防护机制的新模式,旨在保护青少年用户。早在去年 9 月,OpenAI 就宣布了这项功能的研发计划,此前他们被多名青少年的家属起诉,这些青少年在与 ChatGPT 对话后自杀身亡。
OpenAI 还公布了新的防护措施,来保护成年人(包括他们自己)免受自家产品的伤害。公司表示,其新模型可能已经达到了“关键”级别的网络安全能力——这增加了智能体突破隔离、入侵其他公司的风险,最近就发生过类似事件。
OpenAI 在一篇博客文章中表示,过去两周,他们暂停了最新一代模型的训练,以改进安全系统。同时,OpenAI 也将推迟一次计划中的大规模训练,直到对系统安全性完成更多评估。
为什么我们要关注这件事:在备受关注的安全事件发生后,OpenAI 加强了对安全防护的重视,这值得肯定,尽管可以说来得有些迟。
ChatGPT for Teens 将应用安全防护措施,“旨在减少 18 岁以下用户接触可能有害或不利于其发育成长的内容”。它将基于 OpenAI 早先推出的家长控制功能,允许监护人设置免打扰时段,并在出现可疑活动时收到提醒。
OpenAI 表示:“ChatGPT 不应使用浪漫语言,不应鼓励情感依赖,也不应暗示自己拥有感受或意识。”
这项功能与社交媒体公司为应对儿童安全问题而设立的未成年账号采用类似思路。(去问问那些社交媒体公司效果如何吧!)而且和青少年账号一样,这些防护措施也可以被绕过,正如 OpenAI 几个月前在博客文章中自己承认的那样:“护栏确实有用,但它们并非万无一失,如果有人故意想要绕过,总是能找到办法。”
如果我为人父母,大概不敢让十几岁的孩子去接触一个拥有“关键”网络能力的模型。那我们就希望OpenAI继续沉住气,花够时间确保安全吧。
各方表态:前OpenAI董事会成员Helen Toner在X平台发文,赞同OpenAI暂停训练的决定。“很高兴看到这一步,”她写道。她认为OpenAI的这一做法“是思考‘控制前沿发展节奏’的最佳方式——不是设定一个固定的时间(比如‘暂停六个月’或‘放慢10%’),而是确保留出足够时间,达到合理的安全与保障标准。”
——Ella Markianos
Meta的社交媒体成瘾诉讼再次开庭
发生了什么:加利福尼亚、科罗拉多、肯塔基、新泽西四州今天在加州与Meta对簿公堂。这场具有里程碑意义的诉讼,指控Meta把平台设计得让年轻用户上瘾,并在风险问题上误导公众。
在开庭陈述中,加州司法部副检察长Megan O'Neill表示,Meta的商业模式可以这样概括:“吸引用户、尽可能长时间留住他们、收割他们的数据,然后在公开发言时对公众隐瞒真相。”
O'Neill说,Meta一直清楚其平台对儿童心理健康的上瘾影响,尽管公司一边向国会和家长们宣称Instagram和Facebook是安全的。“它一直在隐瞒真相,”她说。
本案第一位证人是吹哨人、Facebook诚信与关怀团队前负责人Arturo Béjar。他作证说,Meta衡量伤害的指标“非常狭窄”,而且公司低估了有害内容的实际普遍程度。
Meta的律师Paul Schmidt辩称,公司没有把儿童作为目标。他还说,自己会出示数据证明超过90%的Facebook用户是成年人(他承认Instagram用户更年轻,但表示数据类似)。此外,他援引Mark Zuckerberg和Instagram负责人Adam Mosseri此前的声明:平台并非为让人上瘾而设计,而且目前的研究尚未支持“社交媒体成瘾”这个概念。
我们为什么关注:
Meta 近来因儿童安全问题官司缠身,而且节节败退。
几天前,新墨西哥州一家法院裁定 Meta 支付 5.67 亿美元,用于该州的整改计划;此前法院已对其处以 3.75 亿美元民事罚款,原因是 Meta 被认为助长了青少年心理健康危机。在那次庭审中,法官称 Meta 为“公害”,与空气污染类似。
另外,3 月时,洛杉矶一个陪审团认定,Meta 和 Google 对一名年轻女性的抑郁和焦虑负有责任——她小时候沉迷使用社交媒体。
这一具有里程碑意义的审判,也可能迫使 Meta 调整其平台,包括改变推荐算法、引入家长验证,以及取消视频内容的“自动播放”。
各方反应:
肯塔基州总检察长 Russell Coleman 最新将此次诉讼比作 1990 年代各州对烟草公司的胜利:“总检察长们正处于完成这件事的最佳位置。我们在 1990 年代的烟草和解协议中做到了……我们会在 Meta 身上再来一次。”
Meta 则持续否认这些指控。其律师 Schmidt 称 Meta 实际上已经解决了自身的问题:“无可争议的是,Meta 已经意识到人们在使用社交媒体时会遇到或可能遇到困扰,并推出了工具去尝试解决这一问题。”
加州总检察长 Rob Bonta 则说,Meta 的座右铭是“快速行动,打破常规”。“不幸的是,在这里被打破的,是我们孩子的心理健康。”
— Lindsey Choo

那些好帖子
想每天看更多好帖子,请关注 Casey 的 Instagram 快拍。

(Link)

(Link)

(链接)
联系我们
欢迎发送建议、评论、问题以及LLM wiki相关想法至:casey@platformer.news。我们的伦理政策请点击这里查阅。