Bingdada 技术博客Bingdada 技术博客
首页博客SEOGEOAEOAI工具关于
登录注册
Logo

Bingdada 技术博客

专注于SEO搜索引擎优化和GEO生成式引擎优化以及未来人工智能发展趋势的技术博客

快速链接

  • 首页
  • 博客文章
  • 关于我们

联系方式

  • 398848662@qq.com

订阅我们的 Newsletter,获取最新的 SEO 和 GEO 技术资讯。

© 2024 Bingdada 技术博客. All rights reserved.

首页博客国产 AI 前线千问办公开源MyContext:把飞书钉钉聊天记录蒸馏成个人工作档案
千问办公开源MyContext:把飞书钉钉聊天记录蒸馏成个人工作档案
国产 AI 前线

千问办公开源MyContext:把飞书钉钉聊天记录蒸馏成个人工作档案

bingdadabingdada
八月 18, 202638 次阅读约 9 分钟阅读
快速回答

MyContext 是千问办公开源的第一个项目,旨在通过分析用户在飞书、钉钉等工具中的聊天、文档和会议记录,自动生成一份持续更新的个人工作档案,为 AI Agent 提供理解用户工作方式的上下文。

核心要点
  • MyContext 是千问办公首个开源项目,定位为个人工作上下文基础设施。
  • 它通过多步流程从飞书、钉钉中自动蒸馏出个人工作档案。
  • 项目采用本地优先的数据存储策略,强调数据主权和用户控制。
  • MyContext 在架构上分离生成与发送能力,并考虑了 Prompt 注入攻击的防护。
  • 目前项目仍处于开发者预览阶段,距离成熟可用仍有距离。
目录

目录

  • 从聊天记录到个人工作档案:千问办公开源 MyContext
  • 个人上下文:AI 办公的“记忆层”
  • 技术架构:从数据采集到工作模式蒸馏
  • 可信度与安全边界:面对矛盾与注入攻击
  • 开发者视角:从原型到产品的距离
  • 国内视角:AI 办公的“上下文”竞赛
  • 结语:AI 办公的下半场是“理解你”
  • 常见问题
  • MyContext 是什么?
  • MyContext 与 Obsidian 这类知识库有何不同?
  • MyContext 如何处理数据冲突和隐私问题?
  • 目前 MyContext 的成熟度如何?
  • 关于 Bingdada

从聊天记录到个人工作档案:千问办公开源 MyContext

在生成式 AI 进入企业办公的深水区后,一个关键问题逐渐浮出水面:AI 助手虽然能写邮件、做总结,却对“你”一无所知。它不了解你的工作习惯、协作网络和决策偏好,每次任务都像面对一个失忆的同事。近期,千问办公团队开源了其首个项目 MyContext,试图解决这一痛点——从飞书、钉钉等日常办公工具中,自动蒸馏出一份持续更新的“个人工作档案”,让 AI Agent 真正理解用户的工作方式。

个人上下文:AI 办公的“记忆层”

如果把 AI Agent 比作一位新入职的员工,它最大的障碍往往不是能力不足,而是缺乏对业务背景和用户个人风格的了解。每次接受新任务,都需要从零开始理解提示词和零散的资料。这种“上下文缺失”正是许多企业级 AI 项目难以落地的核心原因。根据 MIT 发布的相关报告,约 95% 的企业级生成式 AI 试点未能获得预期收益,数据基础设施的缺失是主要瓶颈之一。

MyContext 的定位正是填补这一层“记忆”空白。它不同于传统的企业知识库,而是聚焦于个人工作场景,通过持续抓取并分析即时通讯、文档协作、会议记录等工作痕迹,构建一个动态更新的个人画像。这个画像不仅包含静态的知识,更涵盖了动态的工作模式,例如:用户的核心职责是什么、同事通常如何寻求协作、接到任务后的处理路径、最终交付的格式,以及个人处事的原则和边界。

技术架构:从数据采集到工作模式蒸馏

MyContext 的运作机制并非简单的 LLM 总结,而是一套多阶段的数据处理流水线,其设计思路颇有参考价值。

第一步是数据接入。 项目提供的 channels 插件目前主要打通了钉钉和飞书,能够将聊天消息、文档、会议纪要、待办审批、日历和通讯录等信息纳入系统。采集过程受用户授权严格控制,涉及保密群组的内容会被自动跳过。数据会按照“数据源+类型+ID”的规则进行增量去重,避免重复读取。

第二步是信息结构化。 原始信息进入系统后,会被切分为会话块(例如,以连续 3 小时无新消息为界)。随后,系统会进行向量化处理、实体与事实抽取,最终构建出一张带有时间和空间维度的个人工作知识图谱。这一步骤确保了后续分析有据可依。

第三步是核心的“蒸馏”环节。 MyContext 会从知识图谱中提炼用户的工作模式,大致生成五类结构化结论:用户角色定位、他人通常的求助类型、任务处理的标准步骤、最终交付形式,以及用户的行事规则与底线。此外,系统还能从对话中识别出多步操作流程,并将其整理成可执行的 playbook,为未来多 Agent 协作铺平道路。

最后是应用与安全。 这些档案最终会被数字分身调用,用于理解新消息、召回相关背景并生成符合用户风格的回复草稿。值得注意的是,MyContext 在架构上刻意将“内容生成”与“消息发送”分离,由独立的管控模块作为唯一决策点。这意味着,生成模块本身不具备对外发送能力,是否发送、如何发送完全由用户策略决定,从而提供了额外的安全缓冲。

可信度与安全边界:面对矛盾与注入攻击

当一份档案需要长期动态更新时,信息冲突在所难免。MyContext 的处理哲学是“不替用户做判断”。当新旧结论出现分歧时,系统会区分三种情况处理:若新信息是细节补充,则直接追加;若同一结论反复出现,则提高其置信度;若新旧结论相互矛盾,则同时保留两者并降低置信度,交由用户在审阅页面进行最终裁决。这种设计避免了 LLM 裁决的高成本和不确定性,让结果更可控。

安全是另一个核心考量。由于档案内容来源于真实的聊天记录,其中可能包含敏感的工作习惯和协作关系。因此,MyContext 默认将数据存储在本机 SQLite 数据库中,知识图谱也采用本地文件模式,不强制上传云端。同时,每条结论都必须附有证据(message_id),无证据的信息无法入库。用户拥有最终修改权,在代码层面,“用户确认后的结论,模型永远不能覆盖”被设为最高优先级。

此外,项目还专门考虑了 Prompt 注入攻击的风险。由于档案中的内容可能源自同事发来的消息,这些信息不能被视为可信指令。为了防止恶意文本污染档案,MyContext 会在数据入库前进行清洗,例如将换行符替换为空格以避免被识别为标题、处理 Markdown 图片链接以防止信息泄露,并替换反引号等特殊字符。

开发者视角:从原型到产品的距离

作为一个开源项目,MyContext 目前仍处于开发者预览阶段。从实际运行体验来看,它更像一套面向开发者的基础设施原型,而非拿来即用的消费级产品。项目没有提供集成安装包,需要开发者自行拉取源码构建。在测试中,数据采集功能基本正常,但知识图谱生成和个人画像提取环节对模型能力有较高要求,若主模型不支持 embedding 功能,流程会直接中断。

尽管存在不少工程上的“踩坑”痕迹,但这也恰好说明了项目的真实性。例如,playbook 的初版算法按“消息最多”原则挑选样本,效果不佳;改为按“流程密度”挑选后,性能显著提升。这些细节表明,MyContext 并非停留在概念层面,而是经过了实际场景的打磨。

国内视角:AI 办公的“上下文”竞赛

MyContext 的出现,也折射出国内 AI 办公赛道的一个新方向。过去,无论是阿里的通义千问、字节的豆包,还是百度的文心一言,竞争焦点多集中在模型本身的参数规模和通用能力上。但随着大模型能力趋同,如何让 AI 深度融入具体工作流,成为差异化的关键。MyContext 所代表的“个人上下文”基础设施,正是这一趋势的体现。它试图将 AI 的竞争力从“模型层”下沉到“数据层”和“工作流层”,通过深度理解用户来构建壁垒。这与海外市场如 OpenAI 等公司探索的“记忆”功能思路相似,但 MyContext 更侧重于本地化、私有化的数据主权,并且直接与国内主流的办公协同软件(如钉钉、飞书)深度绑定,这为国内用户提供了更贴合实际场景的解决方案。

结语:AI 办公的下半场是“理解你”

MyContext 的发布,虽然尚显稚嫩,但清晰地指向了 AI 办公的未来方向:从“帮你完成任务”转向“持续理解你的工作”。当 AI 能够记住你的工作方式、协作关系和决策习惯时,它才真正从工具进化为“数字分身”。从这个角度看,Context 正在成为连接 Agent 与真实世界工作流的关键基础设施,而千问办公的这一步,无疑是在这一领域投下的一枚重要棋子。

常见问题

MyContext 是什么?

MyContext 是千问办公开源的第一个项目,旨在构建“个人工作上下文基础设施”。它通过自动分析用户在飞书、钉钉等工具中的聊天、文档和会议记录,生成一份持续更新的个人工作档案,帮助 AI Agent 更好地理解用户的角色、任务处理方式和协作习惯。

MyContext 与 Obsidian 这类知识库有何不同?

Obsidian 强调用户主动记录和整理知识,内容主要由用户自己撰写。而 MyContext 更强调“自动蒸馏”,它从用户日常的工作痕迹中被动提取信息,自动生成结构化的个人画像,无需用户手动维护。

MyContext 如何处理数据冲突和隐私问题?

当档案中出现信息冲突时,MyContext 会同时保留矛盾的结论并降低置信度,交由用户最终裁决,而不是由模型自动选择。在隐私方面,数据默认存储在本机(SQLite),不强制上云,且 AI 模型只能通过受控接口读取上下文,用户拥有数据的最终所有权和修改权。

目前 MyContext 的成熟度如何?

MyContext 目前仍处于开发者预览阶段,并非面向普通用户的成熟产品。它需要开发者自行拉取源码构建,且对模型能力有一定要求。项目在 GitHub 上已获得超过 1000 星,但其定位更偏向于为 AI 办公产品提供上下文工具的“基础设施原型”。

关于 Bingdada

Bingdada 是一个专注 SEO、GEO(生成式引擎优化)与 AEO(答案引擎优化)的内容平台,由资深内容编辑、SEO 技术工程师与 AI 研究专家组成的团队持续运营。我们追踪搜索引擎与生成式 AI 的最新动态,为读者提供准确、实用、可落地的方法论与行业洞察。

编辑团队:内容策划 · 技术编辑 · AI 研究组
网站:bingdada.com

© 2026 Bingdada. 保留所有权利。

目录

  • 从聊天记录到个人工作档案:千问办公开源 MyContext
  • 个人上下文:AI 办公的“记忆层”
  • 技术架构:从数据采集到工作模式蒸馏
  • 可信度与安全边界:面对矛盾与注入攻击
  • 开发者视角:从原型到产品的距离
  • 国内视角:AI 办公的“上下文”竞赛
  • 结语:AI 办公的下半场是“理解你”
  • 常见问题
  • MyContext 是什么?
  • MyContext 与 Obsidian 这类知识库有何不同?
  • MyContext 如何处理数据冲突和隐私问题?
  • 目前 MyContext 的成熟度如何?
  • 关于 Bingdada
常见问题
黄金广告位 · 限时招商
广告位招商中

把品牌放进读者的阅读流

文章内广告位,高注意力场景,适合新品发布与活动招募。

商务合作

标签

#AI Agent#千问办公#MyContext#个人上下文#开源项目#钉钉#飞书
bingdada

bingdada

SEO & GEO 技术探索者,专注于搜索引擎优化和生成式引擎优化。

相关文章

我让 AI 主编接管了我的信息流:161 个信源如何变成一份私人「赛博报纸」
国产 AI 前线

我让 AI 主编接管了我的信息流:161 个信源如何变成一份私人「赛博报纸」

用 161 个 RSS 信源和 AI Agent 搭建私人资讯筛选系统,从被动接收转为主动溯源,教你如何调教 AI 主编、生成个性化「赛博报纸」,彻底解决信息过载问题。

8月 17约 7 分钟阅读
Databricks估值突破万亿,数据基础设施如何成为AI Agent的隐形战场?
国产 AI 前线

Databricks估值突破万亿,数据基础设施如何成为AI Agent的隐形战场?

Databricks完成50亿美元融资,估值达1900亿美元。文章分析其产品布局、增长逻辑,并探讨数据基础设施如何成为AI Agent落地关键,以及国内厂商在该领域的进展。

8月 16约 7 分钟阅读
旅行AI Agent实测:从“攻略内耗”到“一句话出发”,飞猪帮帮能成为甩手掌柜吗?
国产 AI 前线

旅行AI Agent实测:从“攻略内耗”到“一句话出发”,飞猪帮帮能成为甩手掌柜吗?

旅行AI Agent实测:从“攻略内耗”到“一句话出发”。飞猪帮帮能将网红攻略直接转化为可预订行程单,用自然语言完成酒店筛选、机票预订等琐事,真正实现“甩手掌柜”的梦想。

8月 15约 12 分钟阅读

订阅我们的 Newsletter

获取最新的 SEO 与 GEO 技术资讯。

我们尊重您的隐私,随时可以取消订阅。

评论 ({count}) (0)

登录后即可参与讨论

登录注册
还没有评论,来抢沙发吧