ARTICLE DETAIL

资讯详情

深耕编程入门与网站建设的一线实战洞察。

Company Brain记忆系统揭秘:向量混合搜索如何听懂你的团队

Company Brain记忆系统揭秘:向量混合搜索如何听懂你的团队 Company Brain记忆系统揭秘向量混合搜索如何听懂你的团队【免费下载链接】company-brainOpen-sourcing our company brain - A teammate in your Slack that remembers everything your team says, and can go do the work.项目地址: https://gitcode.com/gh_mirrors/co/company-brainCompany Brain是部署在 Slack 里的 AI 队友它记住团队说过的每一句话还能主动动手完成任务。它的核心能力来自一套向量混合搜索记忆系统——既懂语义、又抓关键词让你随口一问就能召回团队里几个月前的决定、会议结论和分工。如果你想知道Slack AI 机器人到底怎么记住团队对话这篇文章用大白话带你拆解 Company Brain 的记忆架构、混合搜索原理和权限边界。一、Company Brain 是什么Slack 里的团队外脑一句话定义Company Brain 一个会听、会记、会动手的 Slack 机器人。听监听你在工作区里 它 的消息、私聊以及公开频道里的关键讨论。记把对话沉淀成结构化的记忆条目按频道/个人/公司三个层级隔离。答下次有人问Acme 那次会议定了吗它从记忆里检索给出答案并附上来源。做能调用 GitHub、Notion、Gmail 等工具真的去执行任务。架构总览见官方文档 docs/architecture.md它描述了从 Slack 事件到 AI 回复的完整主链路。二、记忆的三层容器谁在记、记在哪Company Brain 不是把所有东西塞进一个大数据库而是把记忆切成三个隔离的容器container每条记忆只写入对话发生的那一间屋子。层级容器标签谁可见典型来源员工记忆user_用户ID仅本人私聊你和机器人的 DM私密频道记忆slack_channel_频道ID该频道成员私密频道里的讨论公开频道记忆sm_org_shared全组织公开频道的持久化信息规则很简单消息写在它发生的那间屋子读取时才能跨屋子借调。读取范围由 src/brain/memory/read-scope.ts 决定公开频道提问 → 只能读公开记忆私密频道提问 → 读该频道 公开记忆私聊提问 → 读你的员工记忆 公开记忆 你所在的所有私密频道记忆。这就是为什么在#general里问不到#acme-deal里的秘密——你的访问边界就是记忆的边界。更多细节见 docs/guide/permissions.md。三、向量混合搜索怎么听懂你的问题这是整篇文章的重点。你问上次那个 SSO 的事谁在跟——这句话既不是精确的字符串也不是一个现成的语义向量。Company Brain 用混合搜索Hybrid Search同时跑两路向量检索语义匹配把你的问题编码成向量在记忆里找意思最接近的条目——哪怕你用了不同的措辞。关键词检索精确匹配匹配字面上出现 SSO、谁、跟 的条目——适合查人名、项目代号、具体术语。两路结果合并打分取相关度最高的 Top 40 条。相关度阈值BRAIN_RELEVANCE_THRESHOLD设为0.3低于它的直接丢弃避免返回看似相关实则跑题的噪音。核心逻辑在 src/brain/memory/search-brain.ts几个关键参数参数值作用searchModehybrid混合搜索向量 关键词limit40/ 容器每个容器最多返回 40 条threshold0.3相关度过滤线rerankfalse不二次重排保证低延迟并发批次6多容器并行查但限流防过载查询多个容器后系统会按 ID 去重保留相似度更高的那条再统一按相似度排序取最终 Top 40。为什么叫混合纯向量搜索擅长意思相近但查SSO这种缩写容易漏纯关键词擅长精确匹配但你换个说法就抓瞎。两路互补召回率更稳。四、标签系统与主题树让记忆更有序每条记忆不止是一段文字它还携带标签Tags——这是 Company Brain 对记忆做结构化分类的关键。标签种类定义在 src/brain/memory/tags.tsperson / channel / topic / project / customer / team / preference / task / other每条记忆最多4 个标签MAX_BRAIN_TAGS_PER_MEMORY 4写入时自动归一化避免张三和Zhang San变成两个标签。在标签之上Company Brain 还维护一棵主题树Topic Tree见 src/brain/memory/tree.ts。它把topic_、project_、customer_、team_这几类标签组织成层级路径比如project/SSO → 包含 3 条相关记忆 customer/Acme → 包含 5 条相关记忆当某个节点下的记忆多到一定程度系统会自动拆节点maybeSplitNode保持树的粒度合适、检索更快。五、从写入到召回记忆的完整生命周期对话发生 → 提取记忆 → 写入容器 → 打标签 → 入主题树 → 下次提问时混合搜索召回写入逻辑在 src/brain/memory/writeback.ts关键点每条消息只写一个容器就是它发生的那间屋子写入时dreaming: instant表示即时向量化不用等后台批处理几秒内可被搜到。召回分两条路径主动搜索searchBrain有人提问时触发就是上面讲的混合搜索。环境注入src/brain/memory/profile-recall.ts每次对话开始时自动把和提问者最相关的个人档案 当前频道画像塞进上下文无需搜索。个人档案 该用户被分桶bucketed的记忆token 预算上限 20K。六、快速上手在你的 Slack 里体验安装管理员从已登录的 Supermemory 组织页点击安装机器人会创建一个#company-brain频道。私聊试用DM 机器人告诉它你负责什么、你的偏好它开始建立你的员工记忆。公开频道问在#product里 它 我们 Q2 路线图是什么它通过连接器如 Notion实时读取并回答。私密频道沉淀在私密频道里讨论的决定会自动写入该频道的记忆只有频道成员能召回。更多使用场景参考 docs/guide/use-cases/meeting-recall.md会议召回和 docs/guide/use-cases/knowledge-recall.md文档问答。七、小结你想了解的答案记忆存在哪三个隔离容器按对话发生地写入怎么搜向量 关键词混合搜索Top 40阈值 0.3怎么分类9 种标签 主题树自动拆节点权限怎么控读取范围 提问者的访问边界私密频道记忆绝不越界Company Brain 的记忆系统不是把所有聊天记录丢给一个大模型而是一套分层容器 混合检索 结构化标签 权限隔离的工程化方案。理解了这个架构你就能明白它为什么既能听懂你的模糊提问又不会把私密信息泄漏到不该出现的地方。 想深入代码核心入口 src/brain/memory/search-brain.ts向量服务封装在 src/compat/services/vectordb/index.ts记忆 CRUD 在 src/memory/memories.ts。【免费下载链接】company-brainOpen-sourcing our company brain - A teammate in your Slack that remembers everything your team says, and can go do the work.项目地址: https://gitcode.com/gh_mirrors/co/company-brain创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表