7.0
深览指数
科技量子位·十三··AI 生成

央企做了个通用Agent,直接杀进IDC实测前三!

IDC发布的首份《中国企业级通用Agent产品技术评估》中,中国电信推出的企业级通用Agent“TeleAgent”进入前三,并在任务表现和成本效率维度取得高分。文章详细拆解了TeleAgent背后的工程体系:通过分级上下文管理、长期记忆、自研Go内核Harness、模型智能路由ModelRouter以及严格的安全控制,解释了其如何在长任务、成本与安全性之间取得平衡。文章还指出,中国电信正以互联网公司的产品思路(社会化招聘、快速迭代、用户反馈)来运营这款央企背景的AI产品,内部复杂业务场景成为天然试验场。适合关注企业级AI Agent落地、产品工程化、以及央企数字化转型的读者阅读。原文 ↗

核心观点
  • 中国电信的TeleAgent能进入IDC企业级通用Agent评测前三,核心原因不在于底层模型,而在于围绕大模型搭建的整套工程系统(Agent Harness),包括上下文管理、模型路由、安全控制等,这些能力决定了长任务场景下的交付质量和成本效率。
  1. 01IDC评测采用近百道非公开任务,重点考察端到端任务完成度,TeleAgent常规任务得分3.49分,复杂任务得分3.36分,其中任务表现获5分满分,成本效率为此次评测最高分。
  2. 02TeleAgent的上下文管理采用分级处理:先对低价值旧工具输出剪枝,若仍过长则由压缩模型处理,同时实时监测上下文上限触发自动压缩,窗口已突破400K。
  3. 03TeleAgent加入autoDream长期记忆,定期整理近期对话并与已有记忆合并,支持跨会话保留项目背景、用户习惯和个人偏好。
  4. 04核心内核包含约3万行自研Go代码,专门处理了Windows PowerShell、麒麟、统信等系统的兼容性问题,并针对PPT、文档、Excel等办公任务重新适配。
  5. 05TeleAgent的ModelRouter根据任务复杂度(模态、长度、关键词)将请求分配到轻量、均衡、旗舰三档模型,可将推理成本降低约40%,简单任务响应时间控制在3-5秒。
  6. 06安全性方面,Skill进入前需检查来源、病毒和漏洞;文件读写限制在指定工作目录;高危命令被监控,代码和文件操作在隔离环境完成。已通过中国信通院安全评测,内部评测通过率98.2%。
  7. 07中电信人工智能公司1200多人,90%以上社会化招聘,平均年龄30岁出头;团队采用互联网产品思路,先追求用户口碑再算收入,核心骨干有自主招聘和技术探索空间。
  8. 08TeleAgent内部Skill广场已上架5.6万个技能,被添加近200万次,参与开发的员工达2万人,场景涵盖宽带、号卡、PPT生成、摄像头巡检和电表识别等。
反方 / 局限
  • 文章承认TeleAgent的上线节奏相对保守(4月内测,7月正式推出),但认为在央企内部,安全测试和能力优化是必须跨过的门槛,而非缺点。
  • 文章未提及TeleAgent在IDC评测中与其他竞品(如阿里、百度、字节的同类产品)的详细得分对比,也未讨论其在实际外部企业客户中的部署案例和效果。
11 分钟 · 3 卡片 · 8 资料
读原文 →

前置背景

平行视角

延伸追问