8.2
深览指数
产品人人都是产品经理·AI原生架构笔记··AI 生成

12 个 AI 场景放在一起,为什么还不能直接叫“工作系统”?

北京法仪大模型应用已覆盖12个司法行政场景、贯通行政复议2.0全流程,官方公布辅助效率提升超100%。但作者指出,多Agent协作下产品面临的关键问题不再是能力清单是否够长,而是“业务对象、上下文、授权与复用”四个维度能否接续:不同环节的Agent是否在处理同一案件的同一当前状态?业务状态变化后,权限是否还成立?不同厂商维护的系统间谁保管“当前事实”?文章从产品架构视角,将讨论从模型能力引入系统设计,点出政务AI从工具集合走向工作系统所需的核心挑战。适合关注AI产品设计、政务数字化或高复杂度多Agent系统的读者。原文 ↗

核心观点
  • 政务 AI 产品从能力清单走向工作系统的核心挑战,不在于增加场景或模型,而在于确保多 Agent 协作下,同一业务的前后环节能共享一份可变的“当前状态”,并且事实、权限和责任始终对得上。
  • 北京法仪大模型应用目前应理解为“已深入真实业务的多场景智能体应用体系”,但公开信息尚不足以证明它已建立统一的工作对象、业务状态和运行机制。
  1. 01法仪大模型应用于 2026 年 9 月 8 日发布,覆盖12个司法行政场景,经一年以上生产环境调优,功能输出精准度超过90%,累计办理业务20万次。
  2. 02其中“法仪·行政复议 2.0 版”已贯通立案、办案、结案,辅助效率提升超过100%,由北京市司法局联合 8 家企业研发。
  3. 03项目在“成本有限、不能失败、强调绩效”条件下选择了智能体技术路线,并为后续形成“数字法治超级智能体”打基础。
  4. 04央广网报道披露了法仪大模型的核心底座“法治通用识别”的实际处理链:文字识别→关键信息提取→结构化整理→智能校验→风险标识→人工复核→归档入库。
  5. 05北京市司法局从 27 个需求场景中确定 15 个纳入建设范围,经过 2025 年 3 月到 2026 年 9 月逐步验证,最终形成 12 个场景化成果。
  6. 06参与联合开发的北京数字认证披露,为 AI 智能体签发独立数字身份凭证,实现“身份可证明、能力可约束、行为可归因、权限可即时吊销”,并提出“一条指令驱动所有应用及智能体完成身份授权处置”。
  7. 07全国法治 AaaS 服务平台正在推广:行政复议垂直大模型已在北京以外落地,14 个省市司法厅局赴京考察,20 个地区邀请对接,12 个司法局接洽试用。
反方 / 局限
  • 文章反复强调“公开信息尚未披露”这一前提:北京市司法局并未官方定义系统已建立统一的工作对象、上下文和运行机制,因此作者的分析框架(如 Work、Context)是观察工具而非官方架构说明。
  • 多厂商协作带来的“当前状态”维护问题在传统大型业务系统中本就存在,AI Agent 只放大了而非创造了这一挑战。且现有的公开信息并未展示不同厂商系统间实际的数据共享和状态同步方案。
  • 文章指出“业务授权”不等于“业务放行”:即使 Agent 身份合法、有调用权限,业务状态改变后,是否允许执行当前动作仍需条件判断。但本文并未讨论这些条件判断的具体实现(如状态机、工作流引擎)是否已在系统内建成。
10 分钟 · 5 卡片 · 8 资料
读原文 →

概念锚点

前置背景

平行视角

未来推演

延伸追问