星辰MaaS平台是中国电信天翼云面向企业用户提供的模型即服务(Model as a Service)平台,是企业开发、部署和管理AI智能体应用的核心基础设施。它将大模型能力以云服务的形式交付,使企业无需自建AI基础设施即可快速构建智能体应用。本文将全面介绍星辰MaaS平台的架构设计、核心组件、开发流程和最佳实践。
一、MaaS平台的概念与价值
1.1 什么是MaaS?
MaaS(Model as a Service,模型即服务)是一种将AI模型作为云服务提供的交付模式。其核心理念是:企业不需要自建大模型训练和推理基础设施,通过API调用即可使用大模型能力。这种模式类似于SaaS(软件即服务),但交付的不是软件功能,而是AI模型能力。
传统云服务(IaaS/PaaS/SaaS)交付的是计算资源、平台功能或软件应用。MaaS在此基础上更进一步,交付的是AI模型的"智能"能力。企业按Token使用量付费,而非按服务器小时数付费,使AI能力的获取更加精细化和经济化。
1.2 星辰MaaS平台的核心价值
- 降低门槛:企业无需AI专家团队和GPU集群,通过平台即可使用大模型能力。
- 多模型选择:除自研星辰大模型外,还支持glm、deepseek、qwen等多种第三方大模型,企业可根据任务特点灵活选择。
- 成本可控:通过TokenHub进行精细化的Token使用管理和成本归因。
- 一站式服务:从模型选择、智能体开发、部署上线到运营监控的完整工具链。
- 生态丰富:通过AI Store应用市场获取现成智能体应用,支持一键部署。
二、星辰MaaS平台架构
星辰MaaS平台的整体架构可以划分为以下层次:
2.1 基础设施层:息壤智算
底层是天翼云"息壤智算"平台,提供"五位一体"的智算服务体系:
| 层次 | 内容 | 说明 |
|---|---|---|
| 算力 | 公共算力服务、智算一体机 | 弹性算力供给,"让算力像水电一样随用随取" |
| 平台 | 模型开发、训推服务、应用托管 | 覆盖从开发到部署的完整工具链 |
| 数据 | 可信数据空间 | 安全合规的数据管理环境 |
| 模型 | 模型适配专家服务 | 支持多模型接入和管理 |
| 应用 | AI Store | 算力市场、模型市场、应用市场 |
2.2 模型层:星辰大模型 + 多模型支持
星辰MaaS平台支持多种大模型接入,企业可以根据任务特点选择最合适的模型:
- 星辰大模型(自研):中国电信自研的核心大模型,是TeleAgent的技术底座。
- GLM系列:glm-5.3-flash(快速响应)、GLM-5.2(通用能力强)。
- DeepSeek系列:deepseek-v4-pro(深度推理)、deepseek-v4-flash(轻量推理)。
- Qwen系列:qwen3.8-flash(多语言支持)。
多模型支持架构使企业可以根据任务复杂度和成本预算灵活选择:简单查询使用flash版本降低成本,复杂推理任务使用pro版本获得更好效果。
2.3 平台层:MaaS智能体平台
平台层包含两个核心组件:
- 星辰大模型服务:提供模型API调用服务,支持文本生成、理解、推理等基础AI能力。
- 星辰MaaS智能体平台:提供智能体开发、管理和部署的一站式平台服务,是构建TeleAgent智能体应用的核心环境。
三、智能体引擎详解
智能体引擎是天翼云提供的独立产品,是TeleAgent智能体运行的核心运行时环境。它负责管理智能体的完整生命周期:
3.1 执行循环管理
智能体引擎管理智能体的自主执行循环(Agentic Loop),包括:
- 调度LLM调用和工具调用的交替执行
- 管理每次工具调用的输入参数和输出结果
- 在每次工具调用后触发交错思考(Interleaved Thinking),评估结果质量
- 基于评估结果决定下一步操作
3.2 上下文和记忆管理
智能体引擎负责管理智能体的上下文窗口和记忆持久化:
- 上下文窗口管理:在有限的上下文窗口内高效管理信息,防止关键信息因超出窗口而被截断。
- 外部记忆存储:将任务计划、中间结果等保存到外部存储,通过引用方式访问,避免上下文溢出。
- 文件系统输出:将结构化产出(代码、报告等)直接存储到外部文件系统,仅传递轻量引用。
3.3 错误恢复与状态管理
智能体引擎实现了完善的错误恢复机制:
- 断点恢复:在错误发生时从断点继续执行,而非从头重启。
- 重试逻辑:对可重试的错误自动进行重试。
- 定期检查点:定期保存执行状态,作为故障恢复的基准。
- AI适应性:告知智能体工具故障,让其自适应调整策略。
3.4 部署策略
智能体引擎采用彩虹部署(Rainbow Deployment)策略进行版本更新:
- 逐步将流量从旧版本切换到新版本
- 新旧版本同时运行,确保平滑过渡
- 避免版本切换中断正在执行中的智能体
- 支持灰度发布和快速回滚
四、TokenHub运营服务平台
星辰TokenHub是面向企业开发者提供的大模型Token管理服务平台,是星辰MaaS平台的重要组成部分。
4.1 什么是Token?
在大语言模型中,Token是模型处理文本的基本单位。大致来说,一个Token相当于一个英文单词或几个中文字符。Token消耗量直接决定了大模型使用的成本,因此Token管理是企业级AI应用成本控制的关键。
不同语言的Token效率不同。英文中,一个Token约等于0.75个单词。中文中,一个汉字通常消耗1-2个Token。这意味着同样的信息量,中文可能比英文消耗更多Token。了解Token效率对于成本优化至关重要。
4.2 TokenHub的核心功能
- 使用监控:实时监控Token使用情况,包括按部门、项目、应用维度的使用统计。
- 成本归因:将Token使用成本精确归因到具体的业务部门或项目,支持内部成本核算。
- 配额管理:为不同部门或项目设置Token使用配额,防止单一应用消耗过多资源。
- 效率优化:分析Token使用模式,识别低效调用,提供优化建议。
- 报表生成:生成Token使用报表,支持成本分析和预算规划。
4.3 Token成本优化策略
基于TokenHub的管理能力,企业可以采取以下成本优化策略:
- 模型分级:简单任务使用flash版本(低Token成本),复杂任务使用pro版本(高Token成本但效果好)。
- 上下文压缩:使用子智能体作为"智能过滤器",将海量信息压缩为最重要的tokens。
- 缓存策略:对重复性查询结果进行缓存,避免重复消耗Token。
- 提示词优化:精简提示词,去除冗余信息,提高Token使用效率。
五、AI Store应用市场
AI Store是天翼云构建的AI应用生态市场,包含三个子市场:
算力市场
支持算力服务商入驻,提供多样化的算力选择。企业可以根据需求选择不同规格和价格的算力资源,实现算力采购的灵活性和经济性。
模型市场
提供多种大模型可选,包括自研星辰大模型和第三方模型。企业可以根据任务特点选择最合适的模型,支持灵活切换和组合使用。
应用市场
提供现成的智能体应用,支持一键部署。企业无需从零开发,可以直接获取和部署行业垂直智能体应用,大幅缩短上线周期。
六、开发者最佳实践
6.1 从简单方案开始
智能体开发的第一个原则是"从最简单的方案开始,仅在需要时增加复杂性"。具体来说:
- 简单任务:优化单次LLM调用 + 检索 + 上下文示例,通常已经足够。
- 定义明确的任务:使用工作流(Workflow)获得可预测性和一致性。
- 需要灵活性的任务:使用自主Agent,以延迟和成本换取更好的任务性能。
- 特别复杂的任务:使用多智能体协作架构,实现并行化推理。
6.2 优先直接使用LLM API
许多智能体模式只需几行代码即可实现,建议优先直接使用LLM API而非过度依赖框架。如果使用框架,必须理解底层代码逻辑——对底层逻辑的错误假设是开发者最常见的错误来源。框架的额外抽象层可能 obscuring提示词和响应,增加调试难度。
6.3 精心设计工具接口
工具接口(ACI)设计是智能体开发中最关键的环节之一。最佳实践包括:
- 给模型足够的思考空间:避免过早限制输出长度。
- 使用模型熟悉的格式:格式应接近模型在训练数据中见过的自然文本形式。
- 避免格式开销:如需精确计数千行代码或处理字符串转义,考虑替代方案。
- 反复测试迭代:在workbench中运行大量示例,观察错误模式并迭代优化。
- 防呆设计:修改参数使犯错更难,如强制使用绝对路径。
6.4 可观测性建设
生产环境的智能体系统需要完善的可观测性:
- 全链路追踪:监控智能体决策模式和交互结构(不监控对话内容以保护用户隐私)。
- 性能指标:跟踪任务完成率、工具调用成功率、平均迭代次数等关键指标。
- 异常检测:识别"智能体未找到明显信息"等异常模式,帮助诊断根因。
6.5 评测体系建设
建立多层次的评测体系来衡量智能体质量:
- 小样本评测(约20个查询):快速发现大幅效果变化。
- LLM-as-Judge:按事实准确性、引用准确性、完整性、来源质量、工具效率等维度输出量化分数。
- 人工评测:发现自动化评测遗漏的边缘情况。
- 终态评测:关注最终状态是否正确,适用于有状态变异的智能体。
七、"应用+算力+Tokens"普惠套餐
天翼云为星辰MaaS平台提供了"应用+算力+Tokens"套餐的普惠降本交付模式,这是其区别于其他AI平台的重要特色:
- 零配置一键部署:企业无需复杂的环境配置,选择套餐后即可一键部署智能体应用。
- 套餐打包了应用许可、所需算力和Token额度,企业可以一站式获取所有资源。
- 这种模式大幅降低了AI智能体的使用门槛和成本,特别适合中小企业和初次尝试AI应用的企业。
- 以AI短剧场景为例,全链路Agent从剧本到视频一站式创作,内置多重创作场景,通过套餐实现普惠降本。
八、总结
星辰MaaS平台是中国电信为企业级AI智能体应用提供的一站式服务平台,涵盖了从底层算力到上层应用的完整技术栈。通过息壤智算基础设施、多模型支持、智能体引擎、TokenHub成本管理、AI Store应用生态以及"应用+算力+Tokens"普惠套餐,星辰MaaS平台为企业提供了低门槛、高效率、成本可控的智能体开发与部署路径。
对于希望快速拥抱AI智能体技术的企业而言,星辰MaaS平台提供了一条从概念验证到生产部署的完整路径,其多模型灵活选择、精细化成本管理和丰富的应用生态,使其成为企业级智能体基础设施的有力候选。