(注:离在线混部计划另文阐述) 图 1 混部示意图 在离线混部的成本价值 为了更形象的了解在离线混部的成本价值,我们来看一个中小型企业,4 核 8G 的机器一共有 1000 台,主要计算资源就是 由此可见,在离线混部的成本价值是清晰可计算且收益巨大的。 业界实践来看,谷歌利用混部技术将资源利用率从 10% 提升到 60%,每年节省上亿美金。 阿里等大厂也成功借助混部将资源利用率提升了 3 倍以上,成本节省可观。 在离线混部的技术门槛 在离线混部虽然有明显的成本价值,但目前真正落地到生产环境的还是只有头部的一些大厂。 究其原因,主要是在离线混部涉及服务观测、调度部署、容灾治理等多方面底层技术难题,甚至还包括组织成本核算、跨部门协同等非技术问题,有较高的实施门槛。 比较典型的是字节跳动的方案,架构图如下所示: 图 4 字节跳动在离线混部架构图 字节跳动依托于 K8s 与业务 quota 做整机腾挪的在离线混部,以集群转让节点的方式提高整体资源利用率,主要实现思路为
在今年 9 月份的 QCon 全球软件开发大会(北京站),贝联珠贯 (www.lccomputing.com) 合伙人王元良老师以《增强型 RunC 的最佳实践:克服离线高压力混部场景的关键挑战》为题, 二级告警,LCC-Agent 通知 NM NM 会调整心跳时间 NM 会根据任务的优先级,优先 KILL 低优先级任务 三级告警,LCC-Agent 直接 kill 非白名单进程 机器夯死问题得到解决,混部解决掉最关键的资源卡点问题 集群维度感知,先于业务发现问题 前期为了了解客户混部集群中的各种资源问题状态,我们采用手动脚本单台机器日志并聚类的方式来拿到结果;这种方式耗时长 (两周一次)、只能分析问题大类、没法观察问题走势和分布等 混部后单机压力与复杂度指数级上升,需要高频全视角的分析问题,这种方式不再适用。需要一套能分钟级展示、多视角、自动聚类分析的手段,包括时间对比、子系统分布、问题大类、问题子类、业务角度等。 尽管这个方案技术上很合理,但工作量较大,无法满足业务四个月上线的目标。 将 YARN 部署为 Kubernetes 中的服务,并由 Kubernetes 进行管理。
(云原生)资源隔离技术主要包括 CPU、memory、IO 和网络4个方面。本文聚焦于 CPU 隔离技术和相关背景,后续(系列)再循序渐进,逐步展开到其他方面。 混部也是业界非常热门的话题和技术方向,当前主流的头部大厂都在持续投入,价值显而易见,也有较高的技术门槛(壁垒)。 相关技术起源甚早,颇有渊源,大名鼎鼎的 K8s(前身 Borg)其实源于 Google 的混部场景,而从混部的历史和效果看,Google 算是行业内的标杆,号称 CPU 占用率(均值)能做到60%,具体可参考其经典论文 技术挑战 如前面所说,混部场景中,底层资源隔离技术至关重要,其中的“资源”,整体上分为4个大类: CPU Memory IO 网络 本文聚焦于 CPU 隔离技术,主要分析在 CPU 隔离层面的技术难点、 CPU隔离 前面说的4类资源中,CPU 资源隔离可以说是最基础的隔离技术。
腾讯云自 2015 年起在混部领域进行探索,在支撑海量自研业务上云的过程中广泛使用。目前管理规模已达数千万核,混部能力使服务器资源利用率从30% 提升至 65%。 《云原生混部技术能力要求》标准的由来 随着企业数字化转型工作深入推进,企业正在通过精细化的资源管理、跨集群跨地域资源协同、灵活快捷的资源编排调度,以及异构资源共享复用等方式,实现灵活的弹性资源供给、更加智能的应用自动部署 云原生混部解决方案依托容器、微服务、平台编排调度等云原生技术,帮助用户将业务负载与大数据分析、人工智能计算等不同优先级的应用混合部署到共享的基础设施上,提高资源利用率,实现“降本增效”。 在此背景下,中国信通院牵头,联合腾讯云等多家云服务商,经过多轮研讨,形成了《云原生混部技术能力要求》标准。 标准涉及基础设施能力要求、平台混部能力要求、业务应用能力要求,以及混部效果评价四个部分,从资源隔离、资源复用、干扰检测、负载反馈、任务调度、资源预测、应用服务质量等不同维度,对混部产品及解决方案进行全面评估
3、混搭.NET开源社区技术 Stack Overflow 主要使用微软的.NET技术,混搭.NET开源社区的技术。 ServiceStack.redis,它是Stack Exchange的一位开发者Demis Bellot 所开发的开源的、支持.NET与Mono平台的REST Web Services框架ServiceStack 的一部分 4、混搭其他技术 使用 http://logstash.net/做日志管理,SSD 改变了搜索的使用方式。 因此,在进行混搭创新之前,首先要对混搭的技术有一个准确的评估,比如你的技术方案与要混搭创新的技术之间有没有优势互补,微软在2011年以前经常是复制社区的技术,一个微软技术的使用者局限于微软的技术,这就好比是近亲繁殖 消息来自他的博客 http://t.cn/RPLN4Hj。.NET和ASP.NET的巨大生产力可以提供给那些使用混合开发环境的团队。
本篇文章结合腾讯技术团队在混部方面的落地和实战经验,来介绍各类场景下在线离线混部的相关概念、面临的问题及混部技术方案,抛砖引玉,供大家交流。 混部领域的喜马拉雅山是Google Borg,其在2019年发布的论文Borg中,集群的cpu利用率通过混部技术达到50%。 如何通过混部技术提高集群利用率,是每家集群大规模后不可避免的问题。 ;3)对应用有依赖性,比如需要依赖应用是无状态的,可以被自动迁移等;4)不能很好保证应用服务质量,做不到安全混部;5)混部的场景有限。 图4 节点Agent模块 混部agent采集各种数据指标,包括在线资源、机器资源等。
基于以上背景,为了帮助业务降低资源使用成本,小红书容器团队从 2022 年开始规模化落地混部技术,提升集群 CPU 利用率。 技术演进 小红书混部技术演进分为以下四个阶段(如图所示): 阶段一:闲置资源再利用 在早期,小红书的集群资源管理相对粗放,集群中存在大量业务独占的资源池。 通过合池、资源超卖等技术手段,我们有效提升了 CPU 分配率,但依旧无法解决合并后的资源池夜间利用率较低等问题。另外,在合池后的复杂混部场景下,整机腾挪、分时混部离线的调度策略很难再继续实施。 通过采用更先进的弹性、混部、超卖等技术手段,进一步提升集群资源利用率,实现资源成本的大幅度下降。 作者简介 桑铎(宋泽辉):基础技术部/云原生平台 小红书资源调度负责人,在容器资源调度、混部部署、资源隔离等方面有丰富的实践经验,目前主要负责小红书大规模容器资源调度、在离线混部等方向的技术研发工作。
相关笔记:谷歌Borg论文阅读笔记(一)—— 集群操作系统 Google的混部情况 Google几乎所有的机器都是混部的,在一台机器上,可能运行着不同jobs的tasks。 因此,Google有完善的隔离技术来保证task之间不相互影响。目前,Google使用的隔离技术是Chroot和Cgroup。Cgroup是Google最先提交到内核社区的。 性能影响 对于性能的影响,Google使用了很多技术来减少影响,这个是文章后面详细讲的。这里主要讲的是Google对任务混部对CPU性能影响的研究。 资源分类 混部的一大问题是某个资源不足的情形。但是,不同的资源有不同的特点,有的资源能快速调整,而有的则需要很大的代价来调整。 总结 应用混部,尽可能使用多线程。 使用轻量级的隔离机制,而不是VM。 合理的对资源超分配,以此提高资源利用率。很多任务并不是任何时刻都会用到很多资源。 对任务和资源进行分级。
【云原生正发声】开播至今,已推出4期啦~本月干货主题更精彩! 6月初初到来,我们集结了一批技术专家,为技术爱好者们精心策划了一场大数据云原生专场——腾讯基于K8s的全场景在离线混部技术实践。 腾讯大数据,基于多年在混部技术积累的实践经验与基于 Kubernetes 的全场景在线离线混部解决方案,对 K8s 零入侵,兼容各种场景(容器化、非容器化等),已经在腾讯内部业务多方落地,节约了上亿成本 · 直播流程 · 19:30-20:15 讲师分享 20:15-20:30 互动问答 · 听众收益 · 了解云原生场景下在线离线混部的意义、全场景混部,及设计原则; 了解Caelus方案的整体设计思路 ,及关键功能模块解析,包括在线预测、资源隔离、干扰检测等; 了解Caelus在落地过程的实践经验,及混部未来的发展方向。 · 直播流程 · 19:30-20:15 讲师分享 20:15-20:30 互动问答 · 听众收益 · 了解在离线混部场景中调度系统的需求与痛点 了解在离线混部场景中调度系统的整体设计思路,离线调度器的整体架构与优化点
48V混动技术作为节油减排的一种有效手段,在日益严苛的排放要求,由其是我国国六排放法规的推行下,已得到国内大多数OEM的青睐,今天就跟大家聊聊48V混动技术。 近段时间以来,由其是国六排放法规推行之际,可以明显感受到OEM对48V混动技术的热情,OEM越来越青睐于48V的原因是对成本和收益的双重考虑和权衡。 首先,48V系统只需对整车做小幅的改造即可集成,而且48V相比高压混动技术不需要额外的保护措施,零部件成本也明显低于高压混动部件,大约是其1/3,但收益却接近高压混动技术的2/3。 例如奥迪在其A6、A8及SQ7等不同车型上都标配48V轻混技术,不同车型上会有不同的48V系统集成方案。 48V系统的拓扑 根据48V电机在动力系统中的位置,48V系统的拓扑主要有P0、P1、P2、P3和P4这五种构型,各种构型的详细介绍请参看小编另一篇公众号文章《浅谈混合动力构型(二)》,这里不再详细赘述
基于以上背景,为了帮助业务降低资源使用成本,小红书容器团队从 2022 年开始规模化落地混部技术,提升集群 CPU 利用率。 技术演进 小红书混部技术演进分为以下四个阶段(如图所示): 阶段一:闲置资源再利用 在早期,小红书的集群资源管理相对粗放,集群中存在大量业务独占的资源池。 通过合池、资源超卖等技术手段,我们有效提升了 CPU 分配率,但依旧无法解决合并后的资源池夜间利用率较低等问题。另外,在合池后的复杂混部场景下,整机腾挪、分时混部离线的调度策略很难再继续实施。 通过采用更先进的弹性、混部、超卖等技术手段,进一步提升集群资源利用率,实现资源成本的大幅度下降。 作者简介 桑铎(宋泽辉):基础技术部 / 云原生平台 小红书资源调度负责人,在容器资源调度、混部部署、资源隔离等方面有丰富的实践经验,目前主要负责小红书大规模容器资源调度、在离线混部等方向的技术研发工作
目录前言国产大模型进入长跑期,从参数至上转向实用优先有价值的技术代码实战经验分享基于腾讯混元大模型的技术开发实践、新颖的技术场景应用对腾讯混元大模型的深入理解和代码使用技巧番外篇:发现腾讯混元的友好之处结束语前言随着去年腾讯推出的混元大模型以来 下面分享一下腾讯混元大模型微信小程序的应用界面一角:有价值的技术代码实战经验分享先来通过技术代码实践相关来分享使用腾讯混元大模型的体验,在与腾讯混元大模型的技术代码实践中,以自然语言处理为例,我们可以了解如何使用腾讯混元大模型进行文本生成 基于腾讯混元大模型的技术开发实践、新颖的技术场景应用再来分享一下基于腾讯混元大模型的技术开发实践、新颖的技术场景应用的体验,大家都知道腾讯混元大模型的强大功能为开发者提供了广阔的技术开发实践和应用空间, /gradlew lint 4、查看检查结果。检查结果会输出到控制台,同时生成 HTML 和 XML 格式的报告文件。 security/recommended'], rules: { // 自定义 ESLint 规则 'security/detect-object-injection': 'off', },};4、
昨天又有4项技术上了美国出口管制「黑名单」!其中ECAD软件技术与芯片设计直接相关,必不可少。 从贸易战到芯片大战,要说美国哪个机构在中国媒体上最「高光」,莫过于美国商务部了,确切地说,是商务部下属的工业与安全局(BIS)。 )技术。 BIS认为,作为必要政策调整,美国在《出口管制清单》(EAR)中应尽早落实2021年12月西澳全会的决定,将上述4项技术列入EAR管制范围。 那么,这次被禁的这几类技术,都是干啥用的? ECAD是一类软件工具,用于设计、分析、优化和验证集成电路或印刷电路板的性能。GAAFET技术方法是扩展到3纳米及以下技术节点的关键。
导读 / Introduction 11月4日,在2021腾讯数字生态大会上,腾讯正式宣布开源全场景在离线混部系统Caelus。 由于很多大数据任务具有实时性要求不高、运行时间较短、使用碎片资源等特点,而在线应用的资源使用通常具有潮汐的特点,因此大数据任务比较适合复用在线应用的空闲资源,但混部也面临诸多核心技术难题,具体包括: 大部分混部系统只针对云原生场景 解决这些问题,也是Caelus混部研发的初衷。 充分兼容的架构设计 Caelus Caelus为了适应各种的混部场景,遵循了几个关键原则,主要包括: 不改变业务使用方式,便于业务迁移到Caelus混部平台。 扫码关注 | 即刻了解腾讯大数据技术动态
11月4日,在2021腾讯数字生态大会上,腾讯正式宣布开源其全场景在离线混部系统Caelus。 由于很多大数据任务具有实时性要求不高、运行时间较短、使用碎片资源等特点,而在线应用的资源使用通常具有潮汐的特点,因此大数据任务比较适合复用在线应用的空闲资源,但混部也面临诸多核心技术难题,具体包括: 1 部分混部方案要求大数据必须云原生化改造,增加了依赖条件; 3. 资源复用在粒度、灵活性、时间等方面策略都不够精细,导致利用率不高; 4. 混部调度器缺乏在离线应用调度的兼容性、高性能以及SLA保证。 解决这些问题,也是Caelus混部研发的初衷。 充分兼容的架构设计 Caelus为了适应各种的混部场景,遵循了几个关键原则,主要包括: 1. 不改变业务使用方式,便于业务迁移到Caelus混部平台。
作为腾讯全链路自研的大模型,自2023年9月公开亮相以来,腾讯混元大模型共经历了数十次迭代,支持内部超过400个业务和场景接入,并通过腾讯云面向企业和个人开发者全面开放(API个人权益与企业客户一致,已实名腾讯云账号提供累计
针对上述难题,业界公认的解决方式是 “在离线混部”技术(如 Koordinator,Caelus,Katalyst,Crane)。 但混部并非“银弹”,当企业将混部能力从单个集群扩展到全局多个集群时,资源仍然被物理集群边界锁死。 面对企业级多元业务的资源运营困境,TKE 首创全新产品形态“算力集群”,通过整合“在离线混部(深度利用)” 与 “跨集群调度(广度扩展)” 两大技术支柱,致力于整合全局资源,在统一的调度平面下将分散在不同业务集群中的闲置算力池化 方案默认集成了多集群资源管理、Crane 扩展调度 、混部隔离保障的 RUE 内核以及超大规模集群管控功能,全面降低用户在跨集群管理、资源调度和在离线混部上的维护复杂度。 4 产品优势和适用场景 算力集群就像一位资源管家:帮你盘点所有集群的闲置资源,给离线任务分配 “临时工位”,在线业务忙时就请离线任务“暂让”,还可以请“算力外援”来保障离线任务运行质量。
徐蓓,腾讯云容器技术专家,腾讯云异构计算容器负责人,多年云计算一线架构设计与研发经验,长期深耕 Kubernetes、在离线混部与 GPU 容器化领域,Kubernetes KEP Memory QoS GPU 在离线混部技术,在充分保证业务安全、稳定的前提下,将 GPU 利用率提升到了极致。 除此之外,腾讯云 qGPU 创新性的将在离线混合部署技术与 GPU 相结合,在业界首次实现了 GPU 在离线混部的方案,将 GPU 容器共享技术推进到了下一个纪元。 可以说,腾讯云 qGPU 在离线混部是提升 GPU 利用率的创新性的突破技术。 腾讯云 qGPU 立足 AI 领域,依托 GPU 资源细粒度调度、GPU 资源强隔离、GPU 在离线混部等技术产品,通过为企业提升 GPU 使用效率,释放 AI 算力生产力,最终帮助企业带来持续和不断的巨大商业价值
本文将深入剖析腾讯云团队如何借助Serverless容器技术与深度混部策略,在保障核心业务SLA的前提下,将生产集群利用率稳定提升至65%以上,并分享实战中沉淀的关键技术与踩坑经验。 四、稳定性守卫:多维熔断与逃生机制混部的最大风险在于资源争抢导致在线业务抖动。 五、效果验证:从理论到生产的数据飞跃在日均百亿请求的电商核心集群落地混部方案:指标 混部前 混部后 提升幅度集群CPU利用率 22% 68% 、OOM Kill次数系统层: 节点(逻辑)资源争抢率、调度器Pending时长混部不是单纯的技术叠加,而是资源效率、稳定性、成本三角的艺术平衡。 腾讯云的实践印证:在Serverless架构的深水区,精细化运营与技术创新同等重要。本文基于腾讯云某头部电商客户真实场景实践,数据已脱敏。混部方案需结合业务特性深度调优,不可直接复制参数。
作者徐蓓,腾讯云专家工程师,长期从事云计算 IaaS、PaaS 架构和研发工作,现负责腾讯云 TKE 资源调度、离在线混部、大数据云原生化等领域。 Google Borg 是资源调度管理和离在线混部领域的鼻祖,同时也是 Kubernetes 的起源与参照,已成为从业人员首要学习的典范。 Isolation 由于 Google Borg 天生就考虑混部场景,所以资源隔离对其尤为重要。 Google Borg 作为 Google 内部的经验结晶,系统的阐述了混部应有的基本形态,很有启发意义。 后续会持续分享混部相关的理论和实战经验。