标签:vector-database
-
对话 Turbopuffer 创始人 Simon Ericson:用‘估算思维’重构向量数据库,Cursor 创始人的第一选择
📝
🎙️ AI Engineer
📄 本文是《Pragmatic Engineer》作者 Gergely Orosz 对 Turbopuffer 创始人 Simon Ericson 的深度技术访谈。Simon 分享了他从自学编程、加入 Shopify 搞基础架构,到凭借‘估算思维’(Napkin Math)优化数据库成本并创立 Turbopuffer 的传奇经历。访谈深入探讨了如何利用 S3 极速冷热缓存降本 95%、与英伟达 CEO 黄仁勋的趣味互动、当下云端 CPU 算力短缺的行业内幕,以及独特的远程团队管理模式。 -
CrabRAG:为什么智能体需要图记忆而非更多 Token
📝
🎙️ AI Engineer
📄 Neo4j 的 Steven Chin 阐述了 AI 智能体在记忆和工具调用上面临的瓶颈。通过对比传统的 Markdown 文件和向量数据库,他展示了结合向量检索与图遍历的 Graph RAG 架构如何为智能体提供更精确、可解释且可审计的长期记忆,并通过家庭实验室数字化双胞胎的实战 Demo 证明了图谱在复杂多跳查询和安全检测中的压倒性优势。 -
专访Turbopuffer创始人Simon Ericson:从Shopify基建大拿,到用Serverless重塑向量数据库
📝
🎙️ The Pragmatic Engineer
📄 本文专访了Turbopuffer创始人兼CEO Simon Ericson。他分享了自己通过PowerPoint和诺基亚砖头手机开启编程之路、在Shopify深度参与基础设施扩容(如分片与Toxiproxy)的经历,以及他基于Napkin Math(估算数学)理念创立Serverless向量数据库Turbopuffer的过程。同时,他还分享了与Cursor合作降低95%账单的趣事、与黄仁勋的趣味会面、硬件与CPU选型经验、创业融资的六个真实原因,以及独特的远程 campfires 团队文化。 -
基准测试语义代码检索:Turbopuffer 在 AI 编程中的应用
📝
🎙️ AI Engineer
📄 本次演讲探讨了在 AI 编程环境(如 Claude Code)中,语义代码检索与传统 grep 搜索的性能对比。通过引入 Turbopuffer 的语义搜索工具 Turbo Grep,并参照 Cursor 公司的实践,展示了语义搜索在提升代码检索精度、减少冗余文件读取方面的显著优势。演讲还深入分析了不同检索方式在特定任务中的表现,并强调了将嵌入视为缓存计算的价值。同时,演讲还澄清了语义搜索的定义,探讨了其在代码注释丰富及多模态数据场景下的独特价值。 -
没有向量数据库,AI搜索反而更准了 · 乔木博客
🎙️ 向阳乔木
📄 文章探讨了‘直接语料交互’(DCI)方法,该方法使用grep等工具,在AI搜索中超越了传统的向量数据库。论文对比了DCI与向量搜索的优劣,强调了检索界面的分辨率对AI理解能力的重要性,尤其适用于小规模语料库,并提出AI理解与精确文本定位是互补的。 -
搜索的未来:Agent、RAG 与为何检索依然至关重要——访 Turbopuffer 创始人 Simon Eskildsen
📝
🎙️ Latent Space
📄 本次访谈深入探讨了 Turbopuffer 的诞生背景及其创新的数据库架构。创始人 Simon Eskildsen 分享了他在 Shopify 扩展 Elasticsearch 的痛苦经历,以及如何利用 S3 的强一致性与 NVMe SSD 构建高性能、低成本的向量与全文搜索引擎。他还详细讲述了为 Cursor 和 Notion 优化 RAG 成本的故事,并提出了“P99 工程师”的招聘哲学。 -
OpenClaw 进阶指南:模型精选策略、记忆系统重构与自动化运维实战
📝
🎙️ AI超元域
📄 本内容深度分享了 OpenClaw 的高级进阶经验,涵盖基于任务复杂度的模型筛选逻辑(Claude 3.5 系列对比)、记忆系统从单文件 Markdown 向主题化拆分及向量数据库(LanceDB)的重构方案、集成 Perplexity 的深度搜索 Skill 开发,以及利用 Claude Code 实现 Gateway 崩溃自动诊断与修复的闭环运维机制。 -
揭秘 AWS S3:支撑 500 万亿对象的架构演进与工程哲学
📝
🎙️ The Pragmatic Engineer
📄 本次访谈深入探讨了全球最大云存储服务 AWS S3 的技术内幕。AWS 数据与分析副总裁 Milan 分享了 S3 如何管理数千万块硬盘的超大规模集群,解析了从最终一致性向强一致性跨越的复杂工程,以及如何利用形式化验证确保正确性。对话还涵盖了 S3 Tables 和向量存储等新特性的演进,揭示了“尊重先例”与“技术无畏”并存的工程文化。 -
Jeff on Building Chroma - From Open-Source Vector DB to Context Engineering
📝
🎙️ Latent Space
📄 Chroma founder Jeff discusses the journey of building an open-source vector database, the importance of developer experience, and the emerging discipline of context engineering to make AI applications more like engineering and less like alchemy.