如果你手头有一堆PDF、网页剪藏和零散笔记,却不知道怎么让AI帮你真正用起来,那这篇文章就是为你写的。我最近用Claude 3.5 Sonnet配合一个开源小工具,实打实搭了个能问答的个人知识库,全程不到10分钟,不需要写代码。
第一步:准备材料。 把你所有想入库的文件(PDF、TXT、Markdown都行)放进一个文件夹。我放了12篇行业报告和30条笔记,总共约15MB。注意:图片和扫描版PDF不行,必须是可复制文字的格式。
第二步:选工具。 我试了三个方案,最后锁定“AnythingLLM”这个桌面软件。免费、支持本地运行、能接Claude API。去官网下载对应版本,安装后打开,选择“新建工作区”,命名随意。
第三步:接上Claude。 在设置里找到“LLM提供商”,选Anthropic,把你在Claude官网申请的API Key粘贴进去。模型选claude-3-5-sonnet-20241022。这一步需要你有API额度,新账号一般有免费试用金。
第四步:喂数据。 把第一步的文件夹整个拖进AnythingLLM的“文档”区域,点“嵌入并上传”。它会自动切分文本、生成向量索引。15MB文件大约花了2分钟。完成后,工作区左侧会出现文件列表。
第五步:开问。 在对话框输入问题,比如“第三篇报告里提到的市场增长率是多少?”它会先检索相关段落,再让Claude生成答案,并附上来源文件。我实测10个问题,8个回答准确,2个因为原文表述模糊而答偏。
真实体验:优点明显,槽点也有。
优点是响应快(平均3秒)、引用可追溯、完全离线存储(除了调用Claude那一步)。而且你可以随时增删文件,索引自动更新。缺点是:第一,免费版AnythingLLM最多支持10个文档,超了要付费;第二,Claude API按token收费,我问了50个问题花了约0.8美元;第三,对表格和复杂排版的PDF解析偶尔会串行。
适合什么人用? 适合经常写报告、做研究、需要从大量资料里快速找答案的人。不适合想完全零成本、或者资料全是扫描件的人。
一条上手建议: 先拿5个文件试跑,确认问答质量后再批量导入。另外,把问题问得具体一点,比如“对比A文件和B文件在成本部分的差异”,比“总结一下”效果好得多。
相关工具直达:本文提到的 Claude 官网,想亲自上手体验?点击直达。