通过这次在华为云ModelArts Studio平台上的落地实践,让我认识到了华为云在AI智能体搭建的遍历性,从开通DeepSeek-V3,再到一键部署Dify-LLM应用开发平台,再到自己开发一个Agent智能体,不到1小时就完成了,整个体验过程也比较简单,都是一些可拖拽配置化的参数设置,完全不用写代码来实现,同时,也让我感受到华为云大模型应用正在变得越来越易用和高效、便捷。

一、前言:

随着GPT的到来,预示着人工智能AI的技术会飞速发展,大语言模型(LLM)的应用场景也是百花齐放、各式各样。那么,对于用户来讲,怎么能够快速部署一套完整流程的LLM应用开发平台是至关重要的,不需要所谓的训练模型、开发模型、对接模型,华为云ModelArts Studio(MaaS)是一个全托管的AI开发平台,为中小企业和个人用户提供了便捷的大模型部署和应用能力。

同时,通过华为云的一键部署开源的Dify-LLM 应用开发平台,对于开发者来说,不管是技术上还是服务器硬件,都需要一定的成本,但是通过华为云Flexus云服务以其高性能、高可靠、易管理等特点,为用户提供了一个“一键部署”单机,高可用集群的版本,让用户能够更加便捷部署Dify-LLM 应用开发平台。

接下,让我们体验一下,通过华为云的产品如何快速构建一个功能强大且智能体的AI助手。


二、使用“ModelArts Studio大模型即服务平台”开通DeepSeek-V3大模型:

ModelArts Studio大模型即服务平台(后续简称为MaaS服务),提供了简单易用的模型开发工具链,支持大模型定制开发,让模型应用与业务系统无缝衔接,降低企业AI落地的成本与难度。

ModelArts Studio大模型即服务平台给新用户分配了每个模型200万Tokens的免费调用额度,无需部署即可一键体验DeepSeek系列的预置模型服务。

在这里插入图片描述

  • ①. 模型全、免配置、免调优、性能优:
    业界SOTA大模型覆盖度99%,预置最优超参配置,基于昇腾算子、显存优化,大模型训练与推理性能大幅提升;并围绕大模型性能与精度评价体系构建标准化自动流水线。

  • ②. 开箱即用,一站式模型开发服务:
    提供模型调优、压缩、部署、评测等全栈工具,功能覆盖大模型全生命周期,支持用户即开即用,低门槛使用各类大模型。

  • ③. 资源一站式按需开通,建设周期短:
    资源可分钟级获得,按需收费,按需扩缩容,并支持故障快恢与断点续训。

  • ④. 多服务组合竞争力,一站式应用能力集成:
    即插即用MCP Server,LangChain、九问、RAG、Agent、Guard等组件化集成,快速构建一站式应用。

在这里插入图片描述

在ModelArts Studio大模型即服务平台可以将模型广场的预置服务或用户自建的模型部署为我的服务,便于在“模型体验”或其他业务环境中进行调用。

2.1 ModelArts Studio大模型即服务平台(MaaS)的应用场景:

  • ①. 业界主流开源大模型覆盖全:
    MaaS集成了业界主流开源大模型,含Llama、Baichuan、Yi、Qwen、DeepSeek模型系列,所有的模型均基于昇腾AI云服务进行全面适配和优化,使得精度和性能显著提升。开发者无需从零开始构建模型,只需选择合适的预训练模型进行微调或直接应用,减轻模型集成的负担。

  • ②. 零代码、免配置、免调优模型开发:
    平台结合与100+客户适配、调优开源大模型的行业实践经验,沉淀了大量适配昇腾,和调优推理参数的最佳实践。通过为客户提供一键式训练、自动超参调优等能力,和高度自动化的参数配置机制,使得模型优化过程不再依赖于手动尝试,显著缩短了从模型开发到部署的周期,确保了模型在各类应用场景下的高性能表现,让客户能够更加聚焦于业务逻辑与创新应用的设计。

  • ③. 资源易获取,按需收费,按需扩缩,支撑故障快恢与断点续训:

  • (1). 企业在具体使用大模型接入企业应用系统的时候,不仅要考虑模型体验情况,还需要考虑模型具体的精度效果,和实际应用成本。

  • (2). MaaS提供灵活的模型开发能力,同时基于昇腾云的算力底座能力,提供了若干保障客户商业应用的关键能力。

  • (3). 保障客户系统应用大模型的成本效率,按需收费,按需扩缩的灵活成本效益资源配置方案,有效避免了资源闲置与浪费,降低了进入AI领域的门槛。

  • (4). 架构强调高可用性,多数据中心部署确保数据与任务备份,即使遭遇故障,也能无缝切换至备用系统,维持模型训练不中断,保护长期项目免受时间与资源损耗,确保进展与收益。

  • ④. 大模型应用开发,帮助开发者快速构建智能Agents:
    在企业中,项目级复杂任务通常需要理解任务并拆解成多个问题再进行决策,然后调用多个子系统去执行。MaaS基于多个优质昇腾云开源大模型,提供优质Prompt模板,让大模型准确理解业务意图,分解复杂任务,沉淀出丰富的多个智能Agent,帮助企业快速智能构建和部署大模型应用。


2.2 配置“ModelArts Studio大模型即服务平台”:

我们通过打开ModelArts Studio大模型即服务平台的官网连接,进入后,可以通过点击“ModelArts Studio控制台”跳到控制台页面中。

在这里插入图片描述

跳转ModelArts Studio控制台页面中,需要在左侧的菜单栏中找到“模型推理”,然后再次进入二级菜单“在线推理”,在右侧中的“商用服务”找到DeepSeek-V3/R1模型,点击“开通服务”,即可开通对应的模型服务。

在这里插入图片描述

根据个人需要可以针对性的开通DeepSeek-V3、DeepSeek-R1模型,开通成功之后,返回控制台就可以看到付费状态显示开通。

在这里插入图片描述


三、快速搭建Dify-LLM应用开发平台-华为云:

快速搭建Dify-LLM应用开发平台,可以帮助在华为云上快速部署单机版、高可用版Dify LLM应用开发平台,同时支持将在Dify应用开发平台创建的的文档知识库挂载华为云对象存储服务 OBS桶。

在这里插入图片描述

对于入门级AI应用来说,可以选择单机版本一键部署搭建Dify-LLM应用开发平台,屏蔽部署的细节、简化操作流,社区版单机部署方案如下:

  • ①. 创建一台华为云Flexus云服务器X实例(FlexusX),用于搭建Dify-LLM应用开发平台。
  • ②. 创建一个弹性公网IP EIP并关联FlexusX实例,提供访问公网和被公网访问能力。
  • ③. 创建一个安全组,通过配置安全组规则,为云服务器提供安全防护。

3.1 Dify是什么?

Dify是一款开源的大语言模型(LLM)应用开发平台。它融合了后端即服务(Backend as Service)和LLMOps的理念,使开发者可以快速搭建生产级的生成式AI应用。

在这里插入图片描述

Dify基于 LLM 大模型的开源平台,将智能对话与可视化编排完美结合,提供开箱即用的数据处理、模型调用、RAG检索、可视化AI工作流编排等能力,无论您是开发者还是业务人员,都能轻松打造专属的 AI 应用。


3.2 华为云Flexus实例主机:

这里通过华为云Flexus云服务器X实例的优势,一键部署Dify-LLM应用开发平台,在性能优化、部署便捷性、安全性和成本效益方面均优于普通云服务器,更适合高效、稳定地部署Dify-LLM应用开发平台,主要的优势体现在如下几点:

在这里插入图片描述

  • ①. 性能优化:基于用户业务负载动态和内存峰值画像,动态推荐规格,减少算力浪费,提升资源利用率,首创大模型加持,智能全域调度;X-Turbo加速,常见应用性能最高可达业界同规格6倍。
  • ②. 部署便捷性:提供预置模板和自动化部署工具,用户只需简单配置即可快速完成部署,并支持可视化管控,降低运维难度。
  • ③. 安全性:提供多层次安全防护(VPC网络隔离、数据加密、应用防火墙等),保障平台稳定性和数据安全。。
  • ④. 成本低:支持按需付费,灵活调整资源,并提供优惠套餐,结合高性能与高可靠性,降低总体拥有成本。

3.3 社区版单机部署方案:

通过打开快速搭建Dify-LLM应用开发平台官方链接,通过点击“一键部署(社区版单机部署)”,

在这里插入图片描述

3.3.1 创建资源栈 - 选择模板:

进入到控制台后,第一步是选择模板,默认会值填充到表单里面,这里官方提供了一个示例的模板URL,看了一下是一个json文件,里面存放着一些键值对,应该是用来标识一些参数使用的。

在这里插入图片描述

如果有兴趣,可以自己在“可视化编辑器创建”一个新的模板,这里需要注意的是如果使用URL的模板,必须每个资源栈都是基于模板创建的,模板中必须要有 部署代码文件 (扩展名为tf和tf.json),点击右下角的下一步按钮,可以进入到下一个页面。


3.3.2创建资源栈 - 参数配置:

进入到参数配置页面,这里可以看到跟上面的json文件,非常的相似,其实就是json文件中定义好的一个参数,渲染到页面上,不过,注意的是需要设置一下服务器密码,其它参数默认不修改,当然,也可以根据实际的业务需求进行调整。

在这里插入图片描述


3.3 创建资源栈 - 资源栈设置

在资源栈设置界面中,通过创建委托,可以将资源共享给其他账号,或委托更专业的人或团队来代为管理资源。被委托方使用自己的账号登录后,切换到委托方账号,即可管理委托方委托的资源,避免委托方共享自己的安全凭证(密码/密钥)给他人,确保账号安全。

通过设置“回滚设置开关”,可以开启回滚表示操作失败时,会自动回滚至系统所保存的上一个成功的资源状态。并且设置“删除保护开关”可以防止资源栈被意外删除,这些参数都是可以在创建后可在资源栈详情页面修改,单击“下一步”。

在这里插入图片描述


3.4 创建资源栈 - 配置确认

这一步会显示所有之前设置过的参数值,如果想要修改,可以返回上一步进行操作,如果觉得没有问题,就可以点击“创建执行计划”进入部署的流程了。

在这里插入图片描述


3.5 创建资源栈 - 创建执行计划:

点击“创建执行计划”之后,等待几秒,执行计划状态创建成功,会弹出的创建执行计划框中,自定义填写执行计划名称,点击“确定”,即可生成一个执行计划的任务,可以看到这里右上角还是可以来进行修改和编辑一些参数的,最后点击“部署”。

在这里插入图片描述


3.6 创建资源栈 - 部署:

点击费用明细,可以看到费用预估,在操作栏点击部署,执行计划弹出框点击执行,接下来就等待完成即可。

在这里插入图片描述

待“事件”中出现“Apply required resource success”,表示该解决方案资源已发放完成,同时创建成功也可收到华为云短信。

在这里插入图片描述

此时,会出现一个网址,在基本信息也可以看到Dify-LLM应用开发平台(云服务器单机部署)部署成功。点击访问这个IP地址就可以进行访问,能打开Dify-LLM应用开发平台。


四、总结:

通过上述部署过程,可以看到华为云Flexus云服务结合Dify-LLM应用开发平台,为开发者提供了 高性能、低成本、易操作 的AI开发环境,是构建LLM应用的理想选择。无论是新手入门还是企业级应用,均可快速上手并享受高效稳定的开发体验。

总的来说,有如下优势:

  • ①. 部署遍利性:通过开箱即用的一键部署,提供内置预设的模板和自动化工具,只需简单配置几个参数,就可以在没有任何开发的情况下,完成Dify-LLM平台的单机版本快速部署,无需复杂运维操作。

  • ②. 成本效益:“按时计费”和“包年包月”2种灵活收费模式,外加不同的资源配置,避免资源闲置,本次部署方案每月仅需 197元(按实际使用量计费),性价比高,对于企业用户而言,尤其在需要部署多个 Dify 应用或在不同业务场景中尝试模型微调时,Flexus X 带来的成本优势将更加凸显。

  • ③. 大模型的表现:DeepSeek-V3在中文理解和生成上的表现的非常优异与出色,同时搭配Dify-LLM平台的单机版平台则让开发过程变得非常轻量,特别适合快速验证想法和搭建原型。

  • ④. 运维与安全性:在安全性与可用性方面,Flexus X 提供为 Dify 在企业级场景中的应用部署提供了强大安全支撑,使 AI 系统的可靠运行更有保障。在 Dify 平台整体部署方案中,Flexus X 实例选用的是 华为云通用计算型服务器规格 x1.8u.16g,具体配置为 8 vCPUs 与 16 GiB 内存。该规格为通用型负载与 AI 场景的平衡之选,兼具算力性能与成本效率。

828 B2B企业节已经开幕,汇聚千余款华为云旗下热门数智产品,更带来满额赠、专属礼包、储值返券等重磅权益玩法,是中小企业和开发者上云的好时机,建议密切关注官方渠道,及时获取最新活动信息,采购最实惠的云产品和最新的大模型服务!

Logo

更多推荐