IDC发布企业级通用Agent报告:TeleAgent星辰超级智能体综合第三

大模型之家讯 近日,国际数据公司(IDC)发布《中国企业级通用Agent产品技术评估》报告。在针对国内11款主流及开源通用Agent产品的严苛评测中,中国电信旗下中电信人工智能科技有限公司自主研发的TeleAgent星辰超级智能体凭借出色的工程架构、全流程安全防护与深厚的场景积累,以6.85分的综合成绩位列第三,其中“任务表现”维度获得5分最高档位。

本次IDC技术评估采用了统一模型、统一仿真工具与统一数据基线,并按照“开箱即测试、无提示词优化、失败后不追加人工指令”的闭环标准开展评测,构建了涵盖任务表现、成本效率、交互体验、多智能体编排、记忆与工作空间、可观测、安全可控、工具与技能、生态与开放性等九大维度的评测体系,并在统一MCP仿真环境中设置了近百道非公开实测任务。

IDC发布企业级通用Agent报告:TeleAgent星辰超级智能体综合第三

IDC指出,中国电信自研AI智能体产品——TeleAgent星辰超级智能体,作为个人和企业的AI办公助手型产品,可以理解自然语言输入的任务,自主规划任务步骤、调用多种工具技能、执行操作并返回结果,支持文档写作、表格处理、数据分析、深度调研、任务自动化、创意设计、应用搭建等全方位工作任务。

一、从“满分任务”到“倍率成本”:硬核指标撕开市场缺口

对于企业而言,Agent真正进入生产环境后,更关心的是任务能不能稳定重复执行,工具调用出现异常后能不能恢复,权限不足时会不会越权,执行过程能不能留下完整记录,以及最终结果能不能被验证。

因此,IDC对“任务表现”的考察,并不止于“完成任务”,还包括结果是否准确、可信且可核验,重复执行是否稳定,以及面对模糊指令、工具异常、权限不足和环境变化时,能否恢复执行、交付部分结果或合理停止,均在考察范围内。

在评测的九个维度中,TeleAgent在“任务表现”维度获得了5分,获得了该维度的最高档位,而参评的其他产品的普遍水平为3分;与此同时,在成本效率、交互体验、多智能体编排、记忆与工作空间、可观测、安全可控六项维度均高于参评产品的普遍水平。

IDC发布企业级通用Agent报告:TeleAgent星辰超级智能体综合第三

从综合成绩来看,TeleAgent 6.85分,与第一名7.30分相差仅0.45分,其中,常规任务仅相差0.04分,这表明,在目标明确、路径相对确定的日常办公与系统操作类任务上,TeleAgent已经具备较强的任务执行能力。

而在“成本效率”维度,相较于产品单价,报告重点考察了智能体完成任务所需的时间、Token、积分、工具和运行资源,并要求企业能够按任务、用户、部门、Agent和工具对用量进行统计和归因,并进一步设置预算、配额、告警和降级策略。

在这一维度上,TeleAgent获得4分,高于参评产品约2分的普遍水平。对企业而言,这一指标意味着当Agent开始承担大量重复性、高频次任务后,单位任务的综合成本是否可控,进而决定AI能不能从一次性的试点工具进入规模化使用。

IDC在报告中指出:“Agent Harness能力决定了各家产品的任务表现情况”,“复杂长链路任务的完成情况,尤其在上下文溢出和过程异常时任务能否继续顺利完成,相关Harness工程的设计起到决定性作用”。

围绕复杂任务执行,TeleAgent持续加强上下文管理、任务状态管理、工具调度、异常处理及结果核验能力,并通过Model Router智能调度机制,根据不同任务需求匹配相应模型,进一步提升任务执行效率。

二、从“国产底座”到“政企场景”:原生自研筑牢护城河

今年7月,在2026世界人工智能大会中国电信人工智能生态论坛上,TeleAgent星辰超级智能体正式发布,成为中国电信首款AI原生应用。它依托中国电信自研国内首个全模态、全尺寸、全国产化的基础大模型——星辰大模型与国产智算底座,将大模型的理解、推理和生成能力进一步延伸至任务执行,通过Agent、Skill和工具协同,为用户提供更加完整的智能办公体验。

随着AI进一步进入企业实际工作流程,除了任务完成效率,安全性、场景适配能力和使用体验成为影响智能体规模化应用的重要因素。

面向企业实际应用需求,TeleAgent围绕安全防护、办公场景和使用体验进行了针对性优化。

在安全可靠方面,TeleAgent是首批通过信通院的安全测试的智能体软件,并通过多家头部厂商安全核验。作为中国电信打造的AI产品,TeleAgent天然具备央企级安全保障。中国电信在算力、传输和服务端全线部署端到端的企业级防护体系,大模型与算力服务相互独立、隔离管控,同时TeleAgent通过自研轻量级沙盒将文件访问限制在工作区内,叠加电信官方安全防护双环节,从底层算力到日常使用,为办公数据全方位保驾护航。

在办公场景方面,TeleAgent针对高频办公场景和文档处理需求,在架构、模型、技能与上下文策略方面进行优化,并结合大型企业管理场景,预置合同审查、采购查询、合规审批等政企技能。

在易用性方面,TeleAgent操作简洁、使用门槛低,并结合记忆引擎持续理解用户需求,实现“越用越懂”的使用体验。

从安全能力到场景能力,再到使用体验,TeleAgent正在将底层大模型能力进一步转化为面向真实工作场景的产品能力。

三、从“单点提效”到“系统入口”:提前落子组织级布局

如今,通用Agent正逐步成为企业员工处理日常办公与跨系统任务的重要入口,并将随着Skill与工具体系的完善、企业系统连接范围的扩大,逐步打通传统软件间的操作壁垒与数据孤岛,实现从个人效率工具向组织级智能协作基础设施的演进。

IDC调研显示,48.5%的受访企业已进入通用Agent的评估、试点或使用阶段。

IDC发布企业级通用Agent报告:TeleAgent星辰超级智能体综合第三

报告进一步将通用Agent未来的发展方向概括为四个方面:指出通用Agent将逐步成为企业任务入口;Agent Harness将更多围绕具体任务进行动态组合;受控安全沙盒与全链路可观测将成为规模化部署的重要前提;以及Skill资产化与成本治理将成为实现ROI闭环的重要路径。

这些趋势正在TeleAgent的产品演进中逐步落地。

面对越来越复杂的办公任务,TeleAgent覆盖文档、数据、调研、自动化等高频办公场景,并打通微信、企业微信、飞书等办公端入口,实现“从生成材料到发送沟通”的端到端闭环,配合“核心技能+技能广场+自主创建”的生态模式,将智能体无缝融入企业现有工作流。

随着应用场景不断扩展,TeleAgent的Skill数量持续增长至5万个,覆盖文件整理、深度调研、文档写审、应用生成等多类办公需求。

在市场落地层面,TeleAgent注册用户数已突破110万。从发布到规模化使用,产品正在加速进入更多真实工作场景。

四、从“能干”到“敢用”:走向组织级基础设施的下一程

过去几年,人工智能的应用边界正在不断向真实工作场景延伸。随着智能体开始承担信息处理、内容生产、数据分析和任务执行等工作,AI正在从辅助工具进一步走向生产力工具。2026年全国两会上,“智能体”首次写入国务院政府工作报告;“十五五”规划纲要进一步提出深化拓展“人工智能+”。在政策与产业的双重推力之下,通用Agent正加速走向更广泛的真实场景,而“敢用”,正在成为新的门槛。

“敢用”的底气,来自安全、效率与普惠三个方向的长期功课:全栈国产化保障自主可控,沙盒隔离与最小权限守住数据底线,免费体验与积分机制降低使用门槛,让更多普通人用得上、用得起,正是技术真正的价值所在。

从个人效率工具到组织级智能协作基础设施,通用Agent的下一程已经开启。以安全为底线、以效率为准绳、以普惠为方向——TeleAgent星辰超级智能体的答案,将沿着这个方向无限延伸。

原创文章,作者:志斌,如若转载,请注明出处:http://www.damoai.com.cn/archives/18823

(0)
上一篇 1小时前
下一篇 2026年9月1日 下午6:49

相关推荐

发表回复

登录后才能评论