Nº1 · 记忆
腾讯开源 Agent Memory:上下文卸载 + Mermaid 画布,Token 降 61% / 成功率反升 52%
维度 D3 上下文工程 / D4 Agent 记忆
装备栈可落地零件改变工作方式
事件:腾讯开源 agent 记忆方案(Agent Memory),核心是"无限画布 + 上下文卸载"——把长会话状态外置为结构化画布节点,按需回载。实测 Token 消耗降低 61%,任务成功率反而提升 52%。
PAAS 关联(D2/D3 + D5)候选研究方向:把"上下文卸载"思路引入 PAAS 的 compact 状态转换——当前纯压缩有损,卸载式外置或更优;DSH spill 机制是天然落点。
来源:ithome · 腾讯云开发者详解
Nº2 · 可观测
DeepSeek Harness 接入 Litefuse:补齐 Agent 可观测与评估
维度 D6 评估与可观测 · DSH 本体生态
装备栈可落地零件
事件:DSH 生态出现与 Litefuse(可观测/评估栈)的接入实践,围绕轨迹(trajectory)做评估闭环——正是 DSH"会话日志=权威真相"设计的外延消费。
PAAS 关联(D5 + DSH 升级线)下次 DSH 升级评估时检查官方是否原生集成类似能力;当前 PAAS 评估靠"独立评估者子代理 + 锚点抽查",Litefuse 类工具可做机械化补充。
来源:阿里云开发者 · SelectDB 博客
Nº3 · 模型
模型层一周三更:"千问办公"聚合 GLM-5.3 + DeepSeek V4 Pro,DeepSeek 涨价
维度 D8 支撑模型动态
装备栈模型层实质影响
事件:千问办公首发上线 GLM-5.3 与 DeepSeek V4 Pro;同期 DeepSeek 调价、阿里云加码开源、智谱高频迭代——国产三旗舰进入聚合通道,agentic 能力与价格同时波动。
PAAS 关联(D5 治理 + 成本)行动项:①评估 deepseek-v4-pro 替换/补充当前 deepseek-v4-flash 的性价比(尤其 subagent 宪法固定开销 ~5 万 token/个 的单价)②涨价若落地,委派纪律权重再上调。
来源:aibase · 东方财富(一周三更分析)
Nº4 · 编排
OpenAI Agents SDK 转向 MCP 原生编排层(单源,待核实)
维度 D2 多 agent 编排
可落地零件改变工作方式
事件:OpenAI Agents SDK 被报道将 MCP 作为一等公民纳入编排层(工具/子 agent 统一经 MCP 描述),被视为对 LangGraph / CrewAI 编排范式的正面竞争。
PAAS 关联(D4 观察)PAAS 编排已绑 DSH 原生(subagent/workflow),不跟随;但"技能跨平台复用"值得持续观察,junction/plugins 装配方式未来可对接。
来源:Agent Market Cap 分析(单源,待官方 changelog 核实)
八维扫描状态
| 维度 | 本轮 | 备注 |
| D1 框架/harness | 中 | DSH 公测+插件生态开放;AI SDK 7 一行配置接 Claude Code(不适用) |
| D2 编排 | 收录 Nº4 | OpenAI Agents SDK MCP 原生(待核实) |
| D3 上下文工程 | 收录 Nº1 | 另有结构化驱逐论文(理论向) |
| D4 Agent 记忆 | 收录 Nº1 | 与 D3 同源 |
| D5 技能/协议 | 低 | 多 harness 插件市场存在已久,观察项 |
| D6 评估/可观测 | 收录 Nº2 | 另有 agentevals 入 CNCF |
| D7 自主长任务 | 无 | OSWorld 2.0 等学术线活跃,PAAS 暂无对应装备 |
| D8 支撑模型 | 收录 Nº3 | GLM-5.3 / V4 Pro 聚合 + 涨价 |
毕业候选(待拍板)
- 腾讯 Agent Memory → 定向装备化研究:研究画布节点结构能否映射到 TSS/L0 持久层,替代部分 compact 场景
- deepseek-v4-pro 性价比评估:对照 v4-flash 跑委派成本估算(宪法开销单价 × 月度委派量)
- DSH 升级关注点登记:rc.8+ 升级时核对 Litefuse 类可观测集成与 spill 默认值