Skip to content

Latest commit

 

History

History
316 lines (214 loc) · 18.8 KB

File metadata and controls

316 lines (214 loc) · 18.8 KB

OS Agent 记忆优化及高效应用研究

比赛方案


一、发榜单位

麒麟软件有限公司

二、题目名称

OSAgent记忆优化及高效应用研究

三、题目介绍

题目背景:

基于麒麟操作系统的OSAgent作为智能交互系统的核心组件,其记忆模块中的偏好记忆与知识记忆是支撑个性化服务适配、知识沉淀复用的核心载体。工具调用执行结果是两类记忆的核心数据源之一,同时记忆还来源于用户手动配置、跨场景行为数据等多类渠道。当前,偏好记忆与知识记忆面临的问题具有多源性:一方面,工具调用执行结果结构化不足、数据质量参差不齐,导致偏好提取(如工具选择偏好)不精准、知识沉淀不高效;另一方面,其他数据源存在用户行为捕捉不全面、跨场景数据不一致、配置版本混乱等问题,叠加形成动态偏好提取偏差、版本化管理效率低、新旧知识冲突滞后、关联检索精度有限等痛点,制约了OSAgent的服务智能化水平与用户体验。

题目需求分析:

本选题聚焦解决两大核心问题:一是优化偏好记忆的动态捕捉与适配机制,尤其是工具调用执行结果数据源的处理,实现用户操作习惯、输出风格、安全策略等偏好的精准提取、版本化更新与跨场景复用;二是提升知识记忆的结构化整合、关联检索与冲突融合能力,强化工作流程知识、历史案例、可复用模板的高效沉淀与智能调用。

题目应用:

成果可直接应用于OSAgent及同类智能Agent产品的记忆模块优化,显著提升个性化服务响应速度、知识复用效率,降低端侧资源占用,适用于办公自动化、智能协作、个性化助手等多场景,具备广泛的技术落地前景。

题目内容:

开发一套应用于麒麟操作系统的OSAgent的多源融合偏好与知识记忆优化解决方案,具备偏好精准捕捉、知识智能整合、高效检索复用等核心功能,具体要求如下:

(1)构建多源数据整合模块,支持工具执行结果、用户行为数据、手动配置信息等数据的统一接入,建立数据清洗、格式标准化与质量校验机制;

(2)构建偏好记忆动态捕捉模块,基于多源融合数据,实现用户操作习惯、输出风格、安全策略等偏好的自动提取与版本化管理,实现跨场景偏好适配与回溯;

(3)设计知识记忆结构化整合机制,实现新旧知识冲突处理、关联检索优化,支持工作流程知识、历史案例、可复用模板的结构化存储与智能调用;

(4)适配端侧部署需求,调用银河麒麟国产桌面操作系统embeddingSDK,设计轻量化存储方案,确保检索响应延迟≤500ms;

(5)集成敏感信息识别与过滤功能,支持自然语言指令驱动的精准遗忘操作,保障数据安全合规;

(6)兼容与记忆模块中短期、中期记忆间的数据流转;

(7)设计量化评测机制,通过标准化数据集验证偏好提取准确率、知识检索召回率等核心指标,形成完整测试报告。

四、参赛对象

学生赛道:2026年6月1日以前正式注册的国内全日制非成人教育的普通高等学校在校专科生、本科生、硕士和博士研究生(不含在职研究生),以及全日制职业教育本科、高职高专在校学生,可通过学生赛道申报作品参赛。

高校青年教师在指导学生参赛的同时不得以参赛人员身份参加同一选题比赛。发榜单位及同发榜单位有相关隶属关系单位的青年不得参加本单位选题比赛。

各赛道参赛对象可以团队或个人形式参赛,每个团队不超过10人,每件作品可由不超过3名指导教师进行指导。

可以跨专业、跨学校、跨单位、跨地域组队,但同一团队所有成员均应符合本赛道相关年龄、身份要求。每件作品只可由1所高等院校、科研院所或企业等作为参赛主体提交申报。

五、答题要求

  • 效果演示报告:提供详细的功能测试报告与效果演示视频,展示偏好捕捉、知识整合、检索复用等核心功能的实现效果。

  • 技术文档与用户手册:编写完整的技术文档和用户手册,包括需求分析、软件架构、核心算法设计、技术实现方案、安装部署指南、操作说明等内容。技术文档中附效果验证报告,包含测试数据集说明、对比实验设计、量化指标分析等内容;

  • 方案需明确兼容记忆流转机制,说明与短期记忆、中期记忆的交互逻辑。

  • 实际应用案例:提供至少1个真实场景下的应用测试案例,展示方案的落地可行性与应用价值。

  • 源代码需提供完整注释,确保可读性与可复用性,无知识产权纠纷;

  • 方案需支持与银河麒麟桌面操作系统的适配兼容,提供相关适配测试报告。

六、作品评选标准

初评: 评审按照下述评审表内容,以100分制进行打分,给出各参赛作品分数,根据分数决定最终复评答辩的参赛队。

评分项 分值 评分标准
技术创新性 30分 偏好提取算法、知识冲突处理机制、关联检索策略等核心机制的创新程度,是否突破现有技术瓶颈
方案可行性 30分 技术架构设计合理性、算法选型适配性、原型开发可落地性,适配端侧部署的轻量化程度,需提供量化论证数据
性能指标 25分 偏好提取准确率≥85%、知识检索召回率≥85%、知识检索响应时间≤500ms,知识冲突处理正确率≥88%(未达基础指标需明确优化方向)
实用性 10分 成果与OSAgent及同类产品的适配性,是否能直接解决实际业务痛点
文档规范性 5分 报告结构清晰、逻辑严谨,核心技术细节阐述完整,符合技术文档规范

复评: 参赛队按照顺序进入擂台环节,评委对参赛作品的设计新颖性(10分)、软件功能实现方案完整性(60分)、应用价值(10分)和参赛队表述能力等综合因素(20分),以100分制进行打分,根据分数决定决赛名次。在作品打擂时需要向评委说明作品设计方案、作品实现技术等内容。

七、作品提交时间

  • 2026年5月至9月上旬:各参赛团队开展研发攻关,各高校组织学生和青年科技工作参赛,发榜单位安排专业人员给予指导,为参赛团队提供支持保障。

  • 2026年9月15日前:各参赛团队向发榜单位完成作品提交,具体要求详见本方案第八点第(二)款,并严格遵照发榜单位明确的提交规范执行。

  • 2026年9月30日前:由发榜单位完成初审,确定入围终审擂台赛的晋级作品和团队。

  • 2026年10月:发榜单位安排专门团队提供帮助和指导,各晋级团队完善作品。

  • 2026年11月:组织终审擂台赛,角逐"擂主"。

八、参赛报名及作品提交方式

(一)报名方式

(1)参赛选手登录"挑战杯"官网www.tiaozhanbei.net,在"揭榜挂帅"擂台赛报名入口注册账号,登录大赛申报系统在线填写报名信息。报名信息提交后,下载打印系统生成的报名表。

(2)申报人在报名表对应位置加盖所在学校或所在单位公章。

(3)将盖章版报名表扫描件上传至报名系统,等待系统审核。请参赛选手注意查看审核状态,如审核不通过,需重新提交。

(4)系统开放报名时间为2026年5月30日—6月30日,逾期后系统将自动关闭报名功能。

(二)作品提交方式

提交的作品应包含项目报告(ppt格式)1份,技术方案及测试结果(word、pdf文档)1份,源代码及规范1份。

请参赛团队将作品文档和源代码等材料打包发至邮箱 wangyu1@kylinos.cn。同时,各参赛团队同步报送1份经报名系统审核通过的参赛报名表,报名表所有信息须与系统内填报内容完全一致。

名称格式: 提报单位(学校全称)-选题名称-作品名称。

九、赛事保障

为参赛者提供必要的软件工具、测试数据集等资源,支持参赛者进行智能调优算法的训练和优化。安排具有丰富经验和专业知识的工程师或专家作为指导人员,与参赛者建立指导关系。指导人员将定期与参赛者沟通,解答技术疑问,提供技术建议,帮助参赛者把握项目方向和技术难点。

十、设奖情况及奖励措施

1. 设奖情况

为激励青年学子勇攀技术高峰,本次赛题奖项设置严格遵循大赛组委会"重奖优秀、鼓励创新"的原则,计划设立总计20个获奖名额,形成梯队式荣誉体系,具体分配如下:

设置特等奖5名("擂主"1名从特等奖中决出),一等奖5名,二等奖5名,三等奖5名。

2. 奖励措施

本单位将结合项目实际,拟奖励"擂主"奖金10万元,特等奖每支队伍2万元;奖励一等奖每支队伍1万元;奖励二等奖每支队伍0.5万元;奖励三等奖每支队伍0.2万元。

备注: "擂主"奖金与特等奖奖金不累加,擂主即10万元。上述奖金金额为税后金额。

获奖团队成员如果有意愿到公司工作的经双方沟通符合公司录取规定的可优先推荐。

3. 奖金发放方式

所有现金奖励将在比赛结束组委会公示成绩后并经公司领导审批后1个季度内,通过银行转账的方式,发放至各获奖团队指定的账号,公司会设置赛事专项组专门负责赛事运营以及资金发放问题。

十一、比赛专班联系方式

赛务办公室: 北京市海淀区北四环中路银谷大厦麒麟软件有限公司

1. 赛事服务团队

  • 联络专员:祖老师,联系电话:13910311214
  • 联络专员:王老师,联系电话:18649147316

负责比赛期间组织服务及后期相关赛务协调联络。

2. 联系时间

比赛期间工作日(9:00-17:00)


附录 A:典型应用场景——家庭支出全局模糊检索

A.1 场景概述

维度 内容
场景名称 家庭支出清单的全局语义检索
核心能力 知识记忆的结构化存储 + 混合检索(BM25 + ANN + Graph)+ 实体关联
用户痛点 传统文件搜索只能匹配关键词(如"超市"),无法回答"上个月在吃的方面花了多少"这类语义模糊查询
对应题目要求 (3) 知识记忆结构化整合与关联检索优化;(4) 检索响应延迟 ≤500ms

A.2 用户故事

时间线:

  • T0(上个月):用户老婆通过微信发来一张家庭支出清单图片,OS Agent 调用 OCR 工具识别内容,经用户确认后作为 KnowledgeItem(kind=FACT) 写入长期记忆。
  • T1(当下):用户突然想起一笔开销,只记得模糊描述:"我们好像在水电燃气方面花了一些钱,花了多少钱来着?"
  • T2(500ms 内):系统返回精确结果并定位到原始 evidence。

A.3 原始数据示例

OCR 识别并经 M1 数据接入模块清洗后的结构化内容:

{
  "title": "2026年4月家庭支出清单",
  "body": {
    "items": [
      {"category": "食品", "vendor": "永辉超市", "amount": 328.50, "date": "2026-04-03", "tags": ["生鲜", "肉类"]},
      {"category": "食品", "vendor": "美团外卖", "amount": 45.00, "date": "2026-04-05", "tags": ["晚餐", "快餐"]},
      {"category": "水电燃气", "vendor": "国家电网", "amount": 210.00, "date": "2026-04-10", "tags": ["电费"]},
      {"category": "水电燃气", "vendor": "市自来水公司", "amount": 68.50, "date": "2026-04-12", "tags": ["水费"]},
      {"category": "水电燃气", "vendor": "新奥燃气", "amount": 156.00, "date": "2026-04-15", "tags": ["燃气", "供暖"]},
      {"category": "食品", "vendor": "盒马鲜生", "amount": 520.00, "date": "2026-04-20", "tags": ["海鲜", "进口"]},
      {"category": "交通", "vendor": "中石化", "amount": 380.00, "date": "2026-04-22", "tags": ["汽油", "私家车"]}
    ]
  },
  "entities": ["永辉超市", "美团外卖", "国家电网", "市自来水公司", "新奥燃气", "盒马鲜生", "中石化"],
  "relations": [
    {"from": "国家电网", "to": "水电燃气", "type": "BELONG_TO"},
    {"from": "市自来水公司", "to": "水电燃气", "type": "BELONG_TO"},
    {"from": "新奥燃气", "to": "水电燃气", "type": "BELONG_TO"}
  ]
}

A.4 系统端到端交互流程

步骤 1:写入阶段(T0 发生,异步完成)

[OS Agent 主进程]
  emit knowledge_event(source=OCR_RESULT, raw=...)
        |
        v
[M1 数据接入]
  - Schema 校验:确认符合支出清单结构
  - 实体规范化:"国家电网" -> 标准名,"新奥燃气" -> 标准名
  - 质量评分:OCR 置信度 0.94 -> quality_score=0.94
  - 敏感度评估:无身份证号/银行卡号 -> sensitivity=0
  - 写入 evidence 表(同步 <50ms)
        |
        v
[异步触发 M2/M3]
  - 抽取实体关系图(国家电网 --BELONG_TO--> 水电燃气)
  - 生成 INT8 embedding(标题 + 类目摘要)
  - 写入 knowledge_items 表,状态=ACTIVE

步骤 2:查询阶段(T1→T2,在线路径 P2)

用户输入:"我们好像在水电燃气方面花了一些钱,花了多少钱来着?"

[OS Agent 主进程]
  query("我们好像在水电燃气方面花了一些钱,花了多少钱来着?",
        context_hint={time_range: "last_month"}, k=3)
        |
        v
[M5.r 查询路由] (15ms)
  - 意图分类:FACT_RETRIEVAL(事实检索)
  - 实体抽取:{"水电燃气", "花了一些钱"} -> 识别为 category=水电燃气
  - 选择通道:BM25(标题) + ANN(语义) + Graph(实体关联)
        |
        +------------+------------+
        |            |            |
        v            v            v
[BM25]           [ANN]         [Graph]
  命中标题中      语义相似:      从"水电燃气"节点
  "支出清单"      "水电煤气费用"   遍历 BELONG_TO
  得分 0.82       "公用事业开销"   边,找到 3 个子实体
                  得分 0.91
        |
        +-------+-----+-----+-------+
                |           |
                v           v
        [M5.合并] RRF + context 加权 (10ms)
        知识条目 "2026年4月家庭支出清单" 综合得分 #1
        |
        v
[M5.重排] INT8 reranker (150ms)
  query vs 知识条目的细粒度 relevance score: 0.93
        |
        v
[M5.a 组装] (30ms)
  - 提取 knowledge.body.items 中 category=="水电燃气" 的子项
  - 计算聚合:210.00 + 68.50 + 156.00 = 434.50 元
  - 附带 evidence_ids,可追溯原始 OCR evidence
        |
        v
[返回 MemoryAtom]
  {
    "answer": "2026年4月,你们在水电燃气方面共支出 434.50 元,"
              "其中电费 210 元、水费 68.50 元、燃气费 156 元。",
    "source_evidence": ["evd_01H..."],
    "source_knowledge": "knw_02K...",
    "confidence": 0.93
  }

总延迟:P50 ≈ 200ms,P95 ≈ 380ms,满足 ≤500ms 硬指标。

A.5 关键设计体现

设计点 场景中的体现
神经-符号混合 (P3) 语义检索理解"水电燃气方面"的模糊表达;结构化字段 category 实现精确过滤和聚合计算
实体-关系图 (Graph 通道) "国家电网"等实体通过 BELONG_TO 关系挂载到"水电燃气"类目,支持跨实体聚合查询
上下文条件化 (P5) context_hint={time_range: "last_month"} 优先召回 2026年4月数据,排除其他月份干扰
证据可追溯 (P4) 返回结果附带 source_evidence,用户可追问"是哪张清单?"系统追溯到原始 OCR evidence
在线零 LLM (P2) 检索路径完全禁用 LLM,仅靠 embedding + 结构化字段 + 图遍历完成,保障延迟

A.6 边界与扩展

  • 模糊表达兼容:用户也可以说"上个月 utilities 花了多少"或"家里水电煤开销",ANN 通道捕获语义等价性。
  • 跨文档聚合:若用户多个月份都发了清单,系统可聚合跨知识条目的同类目数据,回答趋势性问题("近三个月水电燃气平均花费")。
  • 冲突处理:若用户在对话中修正某笔金额("燃气费不是156,是186"),M4 冲突仲裁模块检测到与旧知识的直接矛盾,生成 ConflictRecord,以新版本为准并保留审计痕迹。
  • 遗忘支持:用户可说"忘记那张4月支出清单",M7 模块解析意图,匹配 title 包含"4月"且 source_type=OCR 的知识条目,执行级联遗忘(同时清理关联的 evidence 和实体关系)。

A.7 评测可验证项

指标 验证方法 目标值
检索召回率 构造 50 组家庭支出清单 + 语义查询黄金集,测试 top-1 命中率 ≥85%
检索延迟 压测工具发送 1000 次 query,统计 P95 延迟 ≤500ms
聚合正确率 查询结果中的金额合计是否与清单原始数据一致 100%
证据追溯成功率 返回结果是否包含正确的 source_evidence 100%

附:发榜单位简介

麒麟软件有限公司(简称"麒麟软件")是中国电子信息产业集团有限公司(CEC)旗下科技企业,2020年1月由天津麒麟信息技术有限公司和中标软件有限公司强强整合而成,致力于打造世界级操作系统中国品牌。

麒麟软件以安全可信操作系统技术为核心,面向通用和专用领域打造安全创新操作系统产品,现已形成桌面操作系统、服务器操作系统、万物智联操作系统、工业操作系统、智算操作系统产品等为代表的产品线。根据赛迪顾问统计,麒麟软件旗下操作系统产品连续14年位列中国Linux市场占有率第一名。

麒麟软件注重核心技术创新,2018年荣获"国家科技进步一等奖",2020年发布的银河麒麟操作系统V10被国资委评为"2020年度央企十大国之重器",2021年麒麟操作系统入选央视《信物百年》纪录片,2022年入选工信部"2022年国家技术创新示范企业",入选国资委"创建世界一流专精特新示范企业",2024年麒麟操作系统被中国国家博物馆收藏。

麒麟软件积极贯彻人才是第一资源的理念,以麒麟软件教育发展中心为组织平台,联合政产学研各方力量,探索中国特色的网信人才培养模式,目前已形成了源自麒麟操作系统的"5序"课程体系、教材体系、认证体系、师资体系、平台体系,并与工信部教育与考试中心联合推出"百城百万"操作系统培训专项行动,持续为我国培养各类操作系统专业人才。