星辰MaaS平台是中国电信天翼云面向企业用户提供的模型即服务(Model as a Service)平台,是企业开发、部署和管理AI智能体应用的核心基础设施。它将大模型能力以云服务的形式交付,使企业无需自建AI基础设施即可快速构建智能体应用。本文将全面介绍星辰MaaS平台的架构设计、核心组件、开发流程和最佳实践。

一、MaaS平台的概念与价值

1.1 什么是MaaS?

MaaS(Model as a Service,模型即服务)是一种将AI模型作为云服务提供的交付模式。其核心理念是:企业不需要自建大模型训练和推理基础设施,通过API调用即可使用大模型能力。这种模式类似于SaaS(软件即服务),但交付的不是软件功能,而是AI模型能力。

常识:MaaS与传统云服务的区别

传统云服务(IaaS/PaaS/SaaS)交付的是计算资源、平台功能或软件应用。MaaS在此基础上更进一步,交付的是AI模型的"智能"能力。企业按Token使用量付费,而非按服务器小时数付费,使AI能力的获取更加精细化和经济化。

1.2 星辰MaaS平台的核心价值

  • 降低门槛:企业无需AI专家团队和GPU集群,通过平台即可使用大模型能力。
  • 多模型选择:除自研星辰大模型外,还支持glm、deepseek、qwen等多种第三方大模型,企业可根据任务特点灵活选择。
  • 成本可控:通过TokenHub进行精细化的Token使用管理和成本归因。
  • 一站式服务:从模型选择、智能体开发、部署上线到运营监控的完整工具链。
  • 生态丰富:通过AI Store应用市场获取现成智能体应用,支持一键部署。

二、星辰MaaS平台架构

星辰MaaS平台的整体架构可以划分为以下层次:

2.1 基础设施层:息壤智算

底层是天翼云"息壤智算"平台,提供"五位一体"的智算服务体系:

层次内容说明
算力公共算力服务、智算一体机弹性算力供给,"让算力像水电一样随用随取"
平台模型开发、训推服务、应用托管覆盖从开发到部署的完整工具链
数据可信数据空间安全合规的数据管理环境
模型模型适配专家服务支持多模型接入和管理
应用AI Store算力市场、模型市场、应用市场

2.2 模型层:星辰大模型 + 多模型支持

星辰MaaS平台支持多种大模型接入,企业可以根据任务特点选择最合适的模型:

  • 星辰大模型(自研):中国电信自研的核心大模型,是TeleAgent的技术底座。
  • GLM系列:glm-5.3-flash(快速响应)、GLM-5.2(通用能力强)。
  • DeepSeek系列:deepseek-v4-pro(深度推理)、deepseek-v4-flash(轻量推理)。
  • Qwen系列:qwen3.8-flash(多语言支持)。

多模型支持架构使企业可以根据任务复杂度和成本预算灵活选择:简单查询使用flash版本降低成本,复杂推理任务使用pro版本获得更好效果。

2.3 平台层:MaaS智能体平台

平台层包含两个核心组件:

  • 星辰大模型服务:提供模型API调用服务,支持文本生成、理解、推理等基础AI能力。
  • 星辰MaaS智能体平台:提供智能体开发、管理和部署的一站式平台服务,是构建TeleAgent智能体应用的核心环境。

三、智能体引擎详解

智能体引擎是天翼云提供的独立产品,是TeleAgent智能体运行的核心运行时环境。它负责管理智能体的完整生命周期:

3.1 执行循环管理

智能体引擎管理智能体的自主执行循环(Agentic Loop),包括:

  • 调度LLM调用和工具调用的交替执行
  • 管理每次工具调用的输入参数和输出结果
  • 在每次工具调用后触发交错思考(Interleaved Thinking),评估结果质量
  • 基于评估结果决定下一步操作

3.2 上下文和记忆管理

智能体引擎负责管理智能体的上下文窗口和记忆持久化:

  • 上下文窗口管理:在有限的上下文窗口内高效管理信息,防止关键信息因超出窗口而被截断。
  • 外部记忆存储:将任务计划、中间结果等保存到外部存储,通过引用方式访问,避免上下文溢出。
  • 文件系统输出:将结构化产出(代码、报告等)直接存储到外部文件系统,仅传递轻量引用。

3.3 错误恢复与状态管理

智能体引擎实现了完善的错误恢复机制:

  • 断点恢复:在错误发生时从断点继续执行,而非从头重启。
  • 重试逻辑:对可重试的错误自动进行重试。
  • 定期检查点:定期保存执行状态,作为故障恢复的基准。
  • AI适应性:告知智能体工具故障,让其自适应调整策略。

3.4 部署策略

智能体引擎采用彩虹部署(Rainbow Deployment)策略进行版本更新:

  • 逐步将流量从旧版本切换到新版本
  • 新旧版本同时运行,确保平滑过渡
  • 避免版本切换中断正在执行中的智能体
  • 支持灰度发布和快速回滚

四、TokenHub运营服务平台

星辰TokenHub是面向企业开发者提供的大模型Token管理服务平台,是星辰MaaS平台的重要组成部分。

4.1 什么是Token?

在大语言模型中,Token是模型处理文本的基本单位。大致来说,一个Token相当于一个英文单词或几个中文字符。Token消耗量直接决定了大模型使用的成本,因此Token管理是企业级AI应用成本控制的关键。

科普:Token与字符的关系

不同语言的Token效率不同。英文中,一个Token约等于0.75个单词。中文中,一个汉字通常消耗1-2个Token。这意味着同样的信息量,中文可能比英文消耗更多Token。了解Token效率对于成本优化至关重要。

4.2 TokenHub的核心功能

  • 使用监控:实时监控Token使用情况,包括按部门、项目、应用维度的使用统计。
  • 成本归因:将Token使用成本精确归因到具体的业务部门或项目,支持内部成本核算。
  • 配额管理:为不同部门或项目设置Token使用配额,防止单一应用消耗过多资源。
  • 效率优化:分析Token使用模式,识别低效调用,提供优化建议。
  • 报表生成:生成Token使用报表,支持成本分析和预算规划。

4.3 Token成本优化策略

基于TokenHub的管理能力,企业可以采取以下成本优化策略:

  • 模型分级:简单任务使用flash版本(低Token成本),复杂任务使用pro版本(高Token成本但效果好)。
  • 上下文压缩:使用子智能体作为"智能过滤器",将海量信息压缩为最重要的tokens。
  • 缓存策略:对重复性查询结果进行缓存,避免重复消耗Token。
  • 提示词优化:精简提示词,去除冗余信息,提高Token使用效率。

五、AI Store应用市场

AI Store是天翼云构建的AI应用生态市场,包含三个子市场:

算力市场

支持算力服务商入驻,提供多样化的算力选择。企业可以根据需求选择不同规格和价格的算力资源,实现算力采购的灵活性和经济性。

模型市场

提供多种大模型可选,包括自研星辰大模型和第三方模型。企业可以根据任务特点选择最合适的模型,支持灵活切换和组合使用。

应用市场

提供现成的智能体应用,支持一键部署。企业无需从零开发,可以直接获取和部署行业垂直智能体应用,大幅缩短上线周期。

六、开发者最佳实践

6.1 从简单方案开始

智能体开发的第一个原则是"从最简单的方案开始,仅在需要时增加复杂性"。具体来说:

  • 简单任务:优化单次LLM调用 + 检索 + 上下文示例,通常已经足够。
  • 定义明确的任务:使用工作流(Workflow)获得可预测性和一致性。
  • 需要灵活性的任务:使用自主Agent,以延迟和成本换取更好的任务性能。
  • 特别复杂的任务:使用多智能体协作架构,实现并行化推理。

6.2 优先直接使用LLM API

许多智能体模式只需几行代码即可实现,建议优先直接使用LLM API而非过度依赖框架。如果使用框架,必须理解底层代码逻辑——对底层逻辑的错误假设是开发者最常见的错误来源。框架的额外抽象层可能 obscuring提示词和响应,增加调试难度。

6.3 精心设计工具接口

工具接口(ACI)设计是智能体开发中最关键的环节之一。最佳实践包括:

  • 给模型足够的思考空间:避免过早限制输出长度。
  • 使用模型熟悉的格式:格式应接近模型在训练数据中见过的自然文本形式。
  • 避免格式开销:如需精确计数千行代码或处理字符串转义,考虑替代方案。
  • 反复测试迭代:在workbench中运行大量示例,观察错误模式并迭代优化。
  • 防呆设计:修改参数使犯错更难,如强制使用绝对路径。

6.4 可观测性建设

生产环境的智能体系统需要完善的可观测性:

  • 全链路追踪:监控智能体决策模式和交互结构(不监控对话内容以保护用户隐私)。
  • 性能指标:跟踪任务完成率、工具调用成功率、平均迭代次数等关键指标。
  • 异常检测:识别"智能体未找到明显信息"等异常模式,帮助诊断根因。

6.5 评测体系建设

建立多层次的评测体系来衡量智能体质量:

  • 小样本评测(约20个查询):快速发现大幅效果变化。
  • LLM-as-Judge:按事实准确性、引用准确性、完整性、来源质量、工具效率等维度输出量化分数。
  • 人工评测:发现自动化评测遗漏的边缘情况。
  • 终态评测:关注最终状态是否正确,适用于有状态变异的智能体。

七、"应用+算力+Tokens"普惠套餐

天翼云为星辰MaaS平台提供了"应用+算力+Tokens"套餐的普惠降本交付模式,这是其区别于其他AI平台的重要特色:

  • 零配置一键部署:企业无需复杂的环境配置,选择套餐后即可一键部署智能体应用。
  • 套餐打包了应用许可、所需算力和Token额度,企业可以一站式获取所有资源。
  • 这种模式大幅降低了AI智能体的使用门槛和成本,特别适合中小企业和初次尝试AI应用的企业。
  • 以AI短剧场景为例,全链路Agent从剧本到视频一站式创作,内置多重创作场景,通过套餐实现普惠降本。

八、总结

星辰MaaS平台是中国电信为企业级AI智能体应用提供的一站式服务平台,涵盖了从底层算力到上层应用的完整技术栈。通过息壤智算基础设施、多模型支持、智能体引擎、TokenHub成本管理、AI Store应用生态以及"应用+算力+Tokens"普惠套餐,星辰MaaS平台为企业提供了低门槛、高效率、成本可控的智能体开发与部署路径。

对于希望快速拥抱AI智能体技术的企业而言,星辰MaaS平台提供了一条从概念验证到生产部署的完整路径,其多模型灵活选择、精细化成本管理和丰富的应用生态,使其成为企业级智能体基础设施的有力候选。