阿里云边缘容器云帮助AI推理应用快速落地

内外统一的边缘原生云基础设施架构——火山引擎边缘 再对边缘的镜像预创建快照,当需要创建虚拟机时直接基于快照进行创建,虚拟机底层共享同一快照层,快照采用Copy On Write 机制,虚拟机创建时并不会完全拷贝镜像数据,而是当真正要写入数据时才对需要变动的数据进行拷贝,通过快照机制,可以做到虚拟机的秒级创建。图示为创建虚机调度的过程,首先用户发起创建虚机实例请求,虚机管控收到后再向库存服务发起请求,调度系统经过全局最优的调度策略,返回结果,管控系统将资源下发至对应的边缘节点,通过边缘管控及边缘调度器执行轻量化调度,最终将实例运行到具体节点之上。 阅读详情

近日,阿里云技术专家徐若晨在全球分布式云大会上,分享了《边缘容器云助力 AI 推理高效落地》的主题演讲,分享了阿里云边缘容器云如何助力开发者实现更快速的 AI 推理应用的迭代和部署。此外,他还分享了边缘 AI 推理应用在实际业务中的应用案例。

终端算力上移 云端算力下沉

客户在边缘部署时面对的挑战包括:首先,构建自有边缘机房的时间周期长,资本成本高,且常常需要处理设备的迁移与淘汰,这使得相对于传统数据中心,边缘机房的服务水平协议(SLA)表现较为逊色。其次,由于边缘环境受到物理条件的限制,单个集群的规模往往较小,最多包含几十到几百台服务器,导致业务的扩展性不够强。尽管如此,由于需要部署较多这样的小规模集群,并且它们通常具有明显的地域特性,因此这大大增加了集群维护的成本和复杂度。

边缘云给客户带来的价值有这些:首先是提升了交付效率,做到秒级算力交付;其次是降低了成本,可以按量付费,弹性扩容;另外可运维性也有较大的提升。其实本质上来说,这几方面,都是上云带来的价值。那么边缘云由于其广覆盖,低延迟的特点,可以使终端用户获得时延更低的算力资源,从而提升终端用户的体验。一方面,通过终端计算的上移,去获得更多的算力,提升业务的灵活性。另一方面通过云端算力的下沉,来降低成本、缩短时延、提升用户体验。

云—边—端模式的优势

对比中心 Region 来看,边缘云实际是一个云端算力下沉的过程。将更多的服务放在边缘上运行。分布式部署,来应对高并发场景,卸载中心服务器的负荷。流量在边缘云这一层进行收敛,可以有效的降低中心 Region 的带宽,从而降低成本。边缘云本身的特点是离用户更近,时延更低,更加适合一些交互性更强的业务。

对比终端程序来看,边缘云实际是一个终端算力上移的过程。将更多的终端服务跑在边缘上,实现终端瘦身。在这个过程中,开发者可以获得更加标准化的运维方式,做到云边一致的体验,使得应用程序可以更高速的迭代,减少终端发版。边缘上丰富的生态及常用的中间件,可以使应用程序的实现更加灵活。

此外还可以提供专属的 ARM 阵列、 GPU 硬件等异构资源,使得应用程序的性能可以进一步提升。例如当前所说的 AI 推理等应用,它就需要 GPU 硬件资源,跑在终端上的可能就比较小。

边缘容器云技术架构帮助 AI 推理应用高效开发和部署

从下往上看,最下面这一层是资源建设和运维的平台,主要作用是将各种物理资源通过统一的模型纳管到系统中来,通过这一层去向上提供统一的界面。另外一些基础资源的运维也是在这里。

往上是异构资源纳管,简单来说就是要将各种资源接入 k8s 集群中去,无论是 ARM 阵列,带有 GPU 的服务器等,在 K8s 中都体现为一个 Node。

由于前面提到的边缘资源的规模很大,在一个 K8s 集群中无法容纳,所以再往上是集群的管理和融合调度,它对上提供的是一个标准化的 k8s 界面。使用户可以通过一个 K8s 集群,将应用部署到所有的边缘节点中,而不需要考虑太多分布式的逻辑,是保持云边一致体验的重要组成部分。

再往上是边缘特性的增强,边缘就要有边缘的特点,突出边缘的优势。结合边缘云的特性,我们做了域名服务导出,边缘数据集分发,镜像加速,工作负载增强,以及超大规模的服务网格,让用户可以更方便的使用边缘的能力。

这些能力可以以 K8s 的形式使用,也可以通过我们应用管理功能来整合使用,用户可以自主选择。一般来说,如果用户有自建的发布管控系统,可能对接我们的 k8s 界面比较多。如果用户更多的注重于应用开发,暂无精力投入建设自己的发布管控系统,直接用我们的应用中心的能力也是可以的。

最上面是能力开放层,本质是期望用户、开发者,能基于下层提供的能力,通过适合自己的方法,把业务跑起来。助力 AI 推理应用的高效开发、部署,发挥边缘计算的价值,就会重点用到上面介绍的这几层能力。

边缘数据集让应用开发者高效使用模型和数据

通常一个 AI 推理应用,它是需要一个模型文件的,这个模型文件有不同大小,需要在推理应用的进程中读取模型。可以说,模型文件是 AI 推理应用必不可少的部分。针对这一特点,我们设计了边缘数据集分发功能。提前传到我们的边缘协同存储 EOS 或者是中心对象存储 OSS 上的模型,可以通过简单的来源配置,制作成我们定义的边缘数据集。它可以随你的容器分发到不同的边缘节点,依托阿里云边缘云团队长期技术积累和资源优势,让数据集可以做到高效、安全、迅速的分发。通过边缘数据集分发能力,AI 推理应用的开发者,可以便捷的在自己的程序中读取、使用模型和数据,更加专注于应用的开发,提升效率。

开发者只需关注一个租户集群即可实现全域算力管理

通过前面提到的多集群管理、融合调度、异构资源管理,我们为用户提供多租的虚拟 K8s 集群。在租户 K8s 这个层面上,他是多租并且是硬隔离的,不会因为其他用户的异常操作而影响到你。一般为了管理不同地域的资源,通常需要使用多个 K8s 集群,但是在我们这个架构下,开发者只需要关注一个租户集群,把自己的 Pod 创建在自己的租户集群中,我们的融合调度和多集群同步功能就会将 Pod 同步分发到众多的边缘节点。开发者不需要投入过多的精力去关注多集群管理,集群规划等细节,这些我们替他搞定。

此外,我们还支持用户定义的资源使用策略,不管是关注时延,还是关注成本,都可以自己定义。通过全域算力覆盖的能力,我们希望能让开发者体验到云边体验的一致,可以更聚焦于自己的应用业务逻辑。

边缘镜像服务提高开发者部署应用的效率

部署的过程中,会涉及到镜像使用,接下来介绍边缘镜像加速能力首先我们的边缘镜像仓库和应用中心的账号体系是打通的,也就是说在应用中指定了边缘镜像地址之后,无需单独维护用户名密码的配置,我们会自动在应用中注入,开发者以外的人看到的还是一个私有镜像仓库,开发者感受到的是一个免密拉取的仓库。

其次依托边缘云在文件分发场景的长期积累和沉淀,我们构建了镜像快速分发到边缘的能力,以及镜像的主动预热能力,以支撑超大流量规模的并发,为扩容提速。

此外,我们的镜像仓库还支持与各类 DevOps 流水线集成,优化开发者使用体验。还是那句话,我们期望开发者把应用部署到边缘,去获取云边端架构带来的收益,同时减少因为应用部署位置差异带来的负担。

域名导出服务方便开发者进行简单部署提高应用访问体验

应用部署完成之后,接下来需要考虑应用如何提供给终端用户访间,基于这样的诉求,我来介绍一下我们的域名服务导出能力。

用户部署完应用之后,他需要创建一个 4/7 层负载均衡,以对外提供服务,然后要拿着这个负载均衡的公网地址,去自己的 DNS 服务上加一条配置。然后还需要描述下哪些区域的终端用户去访问哪些服务器地址。如果一个地区有多个节点或者服务,还得想办法描述这个 IP 的能力权重,比如有的 ip 后面服务能力强,有的 IP 后面服务能力不强。这些操作对 CDN 的专家来说,那是轻车熟路。但是这对于一个 AI 推理应用的开发者来说,就稍微有点门槛,要关心的东西太多了。

而现在,直接使用我们现在的域名服务导出能力,只要把域名权威托管或者 CNAME 解析过来,我们就可以联动部署去给你自动做就近解析。因为你是通过边缘容器云部署的,IP 有哪些,我们可以直接给你添加到边缘云的解析服务中;ip 的运营商属性是什么,我们可以直接给你添加到边缘云的解析服务中;IP 的能力是多少,能跑多少 QPS,我们可以基于后面的副本数转换,权重信息可以给到边缘云的解析服务中;服务的能力跑高了,负载均衡的监控数据我们也对接到边缘云的解析服务中,他可以自动做切量和水位控制。

不需要关注过多细节,只需要很简单的几步,你就可以具备一个全网覆盖的,可以就近访问的 AI 推理应用。开发者关心的东西少了,创新的热情才会进一步进发,促进 AI 生态的繁荣。

业务数据可观测,自定义弹性扩缩容

应用跑起来了,运行过程中,开发者会需要关注考虑自身业务的观测数据,比如业务的 QOS 的统计,任务的处理数量等,所以这里我也介绍一下我们可观测和弹性伸缩能力。

对接开源的标准,我们支持 Prometheus 格式的 metrics 采集,并且支持自定义给你投递到对应的服务器上。比如你可以阿里云控制台开一个 Prometheus 实例,然后把地址配置到我们这,我们就可以给你把数据投递过去,当然开发者自建的 Prometheus 服务地址也是可以的,这个没有限制。然后可以在我们这定义一些弹性伸缩的规则,比如最少多少个副本,最多多少个副本,什么指标到达什么水位的时候扩容,什么指标低至什么水位的时候缩容,可以是你自定义的指标采集,也可以是我们内置的基础指标例如 CPU、内存、GPU 利用率等。

边缘容器云助力边缘 AI 推理的业务实践

开发者通过我们的边缘应用管理,可以便捷的使用到这些能力。上面提到的边缘数据集分发、全域算力覆盖、边缘镜像加速、服务域名导出、可观测和弹性伸缩,构成了边缘容器云支撑 AI 推理应用高效落地的一个最佳实践,可以极大的降低了 AI 推理应用在边缘落地的门槛。

让我们来看一个实际运行在我们边缘容器云平台上的业务案例。这是一个手机应用内机器人,它允许用户通过多轮的对话交互来在边缘执行推理任务,最终生成操作意图。这个意图随后被上传到中心服务器,以执行全局业务查询逻辑,紧接着操作将被下发至用户终端执行具体任务,如帮助用户完成特定动作,并将结果展现给用户。在这个业务案例的实施过程中,我们关键地利用了先前提及的域名服务导出的就近服务功能、边缘数据集分发、以及边缘镜像加速等核心能力。

我们的目的是简化 AI 推理应用在边缘的部署过程,以促进边缘计算与 AI 技术生态系统的共同繁荣。我们提供的解决方案能够让开发者能够迅速而轻松地上线他们的应用。想象一下,不久的将来,仅需一声指令,开发者助手机器人便可帮你将应用顺利部署至边缘容器云平台。

自主知识产权的边缘AI推理架构Tengine:拥有完全自主知识产权的开源AI推理框架|百万人学AI评选 2020 无疑是特殊的一年,而 AI 在开年的这场”战疫“中表现出了惊人的力量。站在“新十年”的起点上,CSDN【百万人学AI】评选活动正式启动。本届评选活动在前两届的基础上再度升级,设立了「AI优秀案例奖Top 30」、「AI新锐公司奖Top 10」、「AI开源贡献奖Top 5」三大奖项。我们相信,榜样的力量将成为促进AI行业不断发展的重要基石,而CSDN将与这些榜样一起,助力AI时代的”新基建“。 活动官网:https://bss.csdn.net/m/topic/ai_selection/in... 阅读详情

相关推荐

阿里云公网弹性IP找到对应服务(ecs、ack)

3. 打开监控与日志,查询弹性公网IP访问的目标域名解析IP,到底哪个私有IP在访问。9. 进入后一直往下滚动,看到“容器组”,搜索之前在“私网IP地址列表”查看的源IP。记住标签中的ack.aliyun.com的id,这是对应pod容器组,后面会用到。8. 进入后点击节点,查找之前记录个“实例名称IP”7. 进入ack集群,查找标签对用pod。2. 进入后搜索IP,进入实例。5. 私有IP查询进入ECS。1. 通过公网弹性IP找到。可以看到标签与之前是一样的。进入实例,将实例名称记住。

墨痕诉清风的博客 39

从物联网到AI推理边缘计算的7种高价值应用场景,你错过了几个?

边缘计算应用前景广阔,可有效解决物联网与AI推理中的延迟和带宽瓶颈。涵盖智能制造、智慧交通、远程医疗等7大高价值场景,实现数据本地化处理与实时响应。提升效率、降低成本,点击了解你错过的应用场景,值得收藏。

InitFlow的博客 877

4、分布式发电系统中用于改善电能质量的有源、无源和混合滤波器

本文探讨了分布式发电系统中,尤其是光伏(PV)系统运行过程中引入的电能质量问题,并分析了有源滤波器、无源滤波器及混合滤波器在改善电能质量方面的应用。文章详细介绍了光伏系统的建模、最大功率点跟踪(MPPT)技术,以及谐波、电压波动等技术问题,同时对各类滤波器的拓扑结构和控制方法进行了系统性总结。通过仿真实例比较了不同滤波器在减少谐波方面的效果,为实际工程应用提供了参考依据。

transformer2023的博客 74

AI 推理市场全景解析:战火从云端到边缘

OpenAI新发布的O1模型,让AI推理成了行业焦点。这是首次在AI系统中,推理计算占了很大比重。随之诞生的推理时ScalingLaw表明,让模型多"思考"一会,准确度就会更高。Anthropic也在跟进,推出非常依赖推理能力的“Computer Use”的Agent功能。这说明AI应用越来越复杂,对推理能力的要求也越来越高。推理性能直接影响用户体验 - 反应快不快,放在本地还是云端,都会影响实际使用感受。用的人越多,需要的算力就越大,这就涉及到成本和效率问题了。

m0_59235245的博客 2069

【每天一个AI小知识】:什么是边缘AI

摘要: 边缘AI(Edge AI)是将人工智能计算能力从云端迁移至数据源附近的终端设备(如手机、摄像头等)的技术。其核心优势包括:本地化处理提升响应速度、增强隐私保护、节省带宽成本以及适应网络不稳定环境。技术实现涉及模型压缩、专用硬件加速(如NPU)和联邦学习等。应用场景广泛,涵盖智能安防、手机助手、自动驾驶和工业物联网等。尽管面临算力平衡、安全等挑战,边缘AI与5G、云计算的协同将推动其在智慧城市、医疗等领域的深入应用,使AI更贴近日常生活。

码道源码 1295

2026边缘AI推理芯片:产业现状、技术趋势与市场机遇解析

边缘AI推理芯片,是专门用于在终端设备本地完成人工智能推理任务的半导体处理器,区别于依赖集中式云计算平台的运行模式,它能让终端设备直接运行已训练好的AI模型,实现实时数据处理与智能决策。从智能手机的人脸识别到自动驾驶的路况感知,从工业设备的故障监测到智能摄像头的实时分析,这类芯片已广泛渗透到各类智能终端场景中。与部署在数据中心、专注于模型训练的AI训练芯片相比,边缘AI推理芯片更注重低功耗、低延迟和高能效比的平衡。

2603_95348957的博客 1879

AI“既强又好用”:英特尔携手生态伙伴共赢智能新纪元

进而让技术更贴近现实,也让AI创新像‘拼图’一样被精准嵌入每个行业的版图,推动真正的共赢。在近日举办的第18届英特尔互联网数据中心大会(2025 IPDC Summit)上,英特尔与业界领先的云服务商、互联网厂商、行业客户、OEM/ODM等500余位生态合作伙伴代表齐聚一堂,围绕云与AI融合等20多个产业热门话题进行深入交流,共同探讨从算力基础设施到行业应用的全链路协同路径,并通过业界领先的云厂商、互联网厂商及一众生态合作伙伴的实践经验分享,探索技术演进和落地所带来的应用创新,及对产业升级的推动作用。

xinyuan82的博客 257

边缘计算边缘计算edge_Edge AI-边缘上的计算机视觉推理

翻译自: https://medium.com/datadriveninvestor/edge-ai-computer-vision-inference-on-the-edge-part-2-2-aaddfae870f0

weixin_26752765的博客 2173

5G时代的智能边缘计算AI-EC平台

5G时代的智能边缘计算AI-EC平台 转自http://www.ccf.org.cn/c/2017-10-20/617329.shtml 阅读量:19 10月20日 收藏本文 2017年9月初华为透露:首款搭载AI芯片的商务手机将于10月发布并提出:Mobile AI=On_Device AI + Cloud AI。无独有偶,一周后苹果公司也发布了搭载A11可以人脸识别的

思索的IT脚印 3544

不要错过边缘计算和边缘人工智能AI)浪潮

近10年来嵌入式行业随着芯片技术和软件行业的发展,行业变化速度非常快。细数这十年的变化包括:高可用性便携式OS出现、互联网发展带来的嵌入式培训业态改变、物联网技术、高计算高性能MCU和SOC出现等等。现在又一波浪潮出现了,而且仅仅是发端,会给行业带来一个新的爆发点——那就是边缘计算和边缘人工智能。早就有人预言了边缘计算和边缘人工智能的出现,就像PC和服务器等叫固定端随着IC算力的进步出现大数据、A...

z3256789的博客 4611

5个可以让你的模型在边缘设备上高效推理的算法

点击上方“AI公园”,关注公众号,选择加“星标“或“置顶”作者:James Le编译:ronghuaiyang随着深度学习的发展,神经网络变得越来越大。例如,在Image...

AI公园 1734

分布式边缘容器项目 SuperEdge新版本发布

作者 SuperEdge 开发者团队,腾讯云容器中心TKE Edge团队 摘要 SuperEdge是基于原生Kubernetes的分布式边缘云容器管理系统,由腾讯云牵头,联合英特尔、VMware威睿、虎牙、寒武纪、美团、首都在线等多家厂商在2020年12月共同发起的边缘计算开源项目,旨在将把Kubernetes强大的容器管理能力无缝的扩展到边缘计算和分布式资源管理的场景中,为边缘IoT,边缘AI边缘智慧行业等赋能,推动物联网和数字化的落地。目前已成为CNCF Sandbox项目,由CNCF基金会进行托管。

吉小白的博客 554

边缘计算容器化是否有必要?

01简要由于容器有轻量级、安全性、秒级启动等优秀的特性,容器天然的轻量化和可移植性,非常适合边缘计算的场景,这一点边缘计算的厂家和开发者们都心知肚明。而且鉴于K8S已经成...

边缘计算社区 1315

科技云报道:还在琢磨云原生?边缘容器已经来了

科技云报道原创。 手机、摄像头、路由器、自动驾驶汽车、工业机器人等各种智能设备,影响着我们的衣食住行,也带来了物联网数据量的指数级增长。Gartner认为,到2025年,在传统集中式数据中心或云外部创建和处理企业生成的数据量,将从今天的10%猛增到75%。 此外,5G网络的来临,以及在边缘执行人工智能任务的需求日益增长,共同推动了业界对边缘计算的研究。Gartner直接把边缘计算列为下一个十年的关键技术方向。 事实上,边缘计算是云计算的一种变体,用于计算、存储、网络的基础架构服务在物理上更靠近生成数据的现场

科技云报道 936

边缘计算和云计算的混合方案才是自动驾驶的未来?

(长按识别上方二维码,报名第29届IEEE IV大会 )边缘计算、雾计算和云计算将在自动驾驶领域发挥什么样的作用?哪些任务交给边缘计算,哪些交给云端?在之前的文章中,曾多次提到过5G网联技术将给自动驾驶带来的巨大变化。5G网络能提供20Gbps速率,时延仅仅1毫秒,每平方公里100万连接,网络稳定性可达99.999%的下一代蜂窝无线通讯网络,将从单车的信息流共享、车队的编队无人化、远程驾驶三个方面...

weixin_41361987的博客 3630

阿里云发布边缘容器,云边端一体化时代来临

2019年6月26日KubeCon SH大会上,阿里云正式发布边缘容器(ACK@Edge)。边缘容器致力于实现云-边-端一体化协同,通过非侵入增强方式,完美拓展云原生的边界。 阿里云边缘容器已经顺利落地杭州‘亲橙里’智能楼宇项目,实现智慧停车、物业管理、人脸识别、千人千面等场景应用,这也是阿里云首次成功在IoT领域落地边缘容器,通过云原生方式提升IoT领域DevOps效率。 边缘容器简介 如...

数据库技术 9527

阿里云边缘计算及边缘云的技术演进、场景实践与学术探索

阿里云边缘计算与边缘云的技术演进路线、商业场景实践与学术探索。

阿里云CloudImagine 7474

IEEE EDGE 2020论文:Astraea - 以优雅的方式在边缘部署AI服务

前言 为什么说边缘计算带来了数据、计算的根据变化? 边缘AI边缘计算最重要的应用之一,它的挑战是什么? 一个用于边缘计算场景的新型AI服务部署平台——Astraea是如何诞生的? 如何通过Astraea一键化部署边缘AI服务? 近日,阿里云边缘计算团队博士后付哲的论文《Astraea: Deploy AI Services at the Edge in Elegant Ways》入选2020年IEEE边缘计算国际会议(IEEE International Conference on Edge Co

数据库技术 574

Day59-阿里云ACK实战:生产级K8s集群部署与运维

本文以阿里云 ACK(容器服务 Kubernetes)为载体,从集群创建、节点池管理、日志采集(SLS)到监控告警(ARMS),一站式讲透生产级 K8s 集群的落地与运维全流程。读完你将掌握:如何在云上创建一个符合生产标准的 K8s 集群、如何用节点池做弹性伸缩与混合部署、如何让应用日志自动汇聚到 SLS、以及如何用 ARMS 实现 JVM 级别的应用监控和告警。

雨1986的博客 754

实战!C#整合YOLO+Halcon做玻璃瓶口缺陷检测:裂纹识别+尺寸测量一步到位(附DLL交互代码)

AI擅长语义识别(裂纹、缺陷),传统机器视觉擅长精密测量(尺寸、位置),C#做整合层,才能满足工业生产的“精度+效率+稳定性”要求。这套方案不只是玻璃瓶检测能用,改改模型和测量逻辑,还能用到瓶盖缺陷检测、饮料瓶液位检测等场景。如果你们厂也有类似的质检痛点,评论区留个言,我帮你看看怎么调整算法参数。

这里只有干货:从 Modbus 通信到 MES 对接,从 YOLO 训练到工控机部署,带你搞定工业软件开发全流程。 828

最新全球各国一级(省级)行政区划数据 shp格式 84坐标

最新全球各国一级(省级)行政区划数据 shp格式 84坐标

上一篇: 对话阿里云佘俊泉:边缘云的持续突破和创新
下一篇: 阿里云入选Gartner「边缘分发平台市场指南」代表厂商
EdgeCloud
博客等级 码龄3年 132粉丝 8原创
评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值