- 难度
- 较难
- 适合
- 入门 / 进阶
- 主要语言
- TypeScript
- GitHub
- ★ 28.2k
- 许可证
- AGPL-3.0
- 快照日期
- 2026年8月9日
先判断要不要学
这个项目值得拆什么?
Karakeep 是一款自托管的收藏与稍后读应用,可保存链接、笔记、图片和 PDF,并提供网页归档、全文与语义搜索、自动标签和摘要。它把浏览器采集、后台抓取、数据库、搜索服务、AI 处理、Web 与移动客户端连接成一条完整信息管线,适合学习真实内容产品的系统边界。
- 01
从“保存一个链接”出发,可以逐层看到抓取、归档、索引、AI 标注和检索
- 02
Web、移动端、扩展、Docker 与文档齐全,能研究一个自托管产品如何交付
可以学什么
不只是看代码,而是找到产品的骨架
- 学 AI 接入
- 学数据库
- 学用户登录
- 学产品结构
- 学部署
- 学完整项目组织
内容进入系统后的完整管线
从用户保存链接开始,追踪抓取、元数据提取、归档、索引和展示之间的分工。
apps/web · packages · dockerAI 是增强层而非唯一入口
学习如何把自动标签、摘要和语义检索叠加到可独立工作的收藏产品上。
apps/web · packages · docs多入口采集与多端消费
比较 Web、移动端、浏览器扩展与 RSS 等入口如何围绕同一数据模型协作。
apps/web · apps/mobile · packages三段学习路径
从理解、修改到做出你的版本
0130 分钟先跑通
建立收藏产品的功能与服务地图。
- 浏览 README 的功能清单和截图
- 查看 apps 与 packages 的职责
- 在 Docker 配置中识别数据库和搜索依赖
完成标志:能解释保存、抓取、索引、搜索和 AI 处理的基本链路。
022 小时动手改
围绕收藏列表完成一个小型体验改造。
- 定位收藏卡片与详情界面
- 增加一种明确的筛选或空状态
- 沿 tRPC 调用找到数据查询
- 验证移动宽度和键盘操作
完成标志:得到一个从查询到界面均可解释的功能改造。
031 天做变体
设计一个面向特定资料类型的收藏工作流。
- 定义资料来源和归档规则
- 为该类型增加字段或标签策略
- 配置 AI 摘要并保留失败降级
- 验证全文搜索结果
- 用 Docker 运行所需服务并记录资源占用
完成标志:得到一条可复现、AI 失败时仍可用的垂直收藏流程。
评分解释
每一分都要说清楚为什么
可复刻性20 / 25
功能可拆成收藏、搜索或 AI 标注练习,但完整复刻依赖较多服务。
文档与代码清晰度17 / 20
工作区和文档边界清楚,业务链路仍需跨包阅读。
新手学习价值18 / 20
问题真实、反馈直观,适合从小功能逐步进入全栈。
产品完整度14 / 15
采集、归档、搜索、AI、移动端和自托管链路完整。
vibe coding 代表性9 / 10
适合用 AI 辅助生成分类、摘要和界面,再由人验证数据与隐私。
活跃度5 / 5
当前仓库活跃且部署资料充分。
新颖性4 / 5
将网页归档、语义检索与多端收藏组合得较有辨识度。