QCon北京「鸿蒙专场」火热来袭!即刻报名,与创新同行~ 了解详情
写点什么

小红书 FinOps 实践:云成本优化与资源效率提升之道 |QCon 北京

  • 2025-03-31
    北京
  • 本文字数:1426 字

    阅读完需:约 5 分钟

大小:764.90K时长:04:21
小红书 FinOps 实践:云成本优化与资源效率提升之道 |QCon北京

2025 年 4 月 10 - 12 日,QCon 全球软件开发大会将汇聚全球 140+ 技术先行者及创新实践者,直击行业痛点,解锁可复制的经验与模式。这不仅是一场会议,更是一次对技术演进的集体探索。无论你是资深开发者,还是技术管理者,都能在这里有所收获,为下一步的技术决策提供方向。


小红书混合云资源管理负责人梁啟成已确认出席并发表题为《小红书 FinOps 实践:云成本优化与资源效率提升之道》的主题分享。眼下,云计算已成为众多互联网企业支撑业务运行的关键基础设施,然而云计算的便利性和灵活性也带来了一系列资源成本管理挑战,包括成本增速过快、成本归属不清晰、缺乏有效成本控制手段、对云厂商高度依赖等。本次分享将重点介绍小红书的 FinOps 实践经验,并通过技术优化手段提升资源使用效率,每年节省数亿成本。


梁啟成多年 IT 资源管理与成本优化经验,曾深度参与头部互联网企业上云、大规模在离线业务混部,并持续推进业财一体化以及精细化的混合云资源成本管理,2024 年参与了信通院《IT 基础设施资源运营成熟度模型》标准制定,是 FinOps 文化的践行者。他在本次会议的详细演讲内容如下:


演讲提纲

1. 小红书用云概述 2. 成本优化面临的问题与挑战

  • 分摊云成本与实际资源用量存在偏差

  • 资源规模不断增长但利用效率持续低下

  • 大模型的部署与运行成本高昂

3. 成本洞察与优化实践

  • 技术商品化实现内外账分离

  • 大 Node 小 Pod 策略下的在线业务混部

  • 工作负载性能瓶颈分析

  • 机型收敛与 RightSizing

  • 内容大模型的降本增效

  • 多维并行提升训练效率

  • 量化蒸馏压缩模型大小

  • 算子优化提升推理速度

4. 总结与展望


这样的技术在实践过程中有哪些痛点?

  • 常规按比例分账方法能帮助测算出各业务部门的资源成本费用,但不一定能解释清楚其背后的量价对应关系,进而影响了技术优化方向判断

  • 云厂商硬件经过虚拟化后,不同规格大小虚拟机会存在跨 numa、共用一个 Socket 产生干扰,进而表现出内存性能差、业务 CPU 使用率明显分层、服务 RT 抖动明显等问题,云上客户不得不开通更多资源降低容量水位来保证在线服务不受损,最终造成了成本浪费

  • 高昂的训练和推理成本、高硬件需求、资源利用效率低下,这些问题限制了内容大模型的广泛应用和普及,需要通过技术创新和优化策略来解决


演讲亮点

  • 重点聚焦于建立清晰、透明的成本洞察机制以及配套系统能力建设,尝试分别从买卖家视角梳理清楚各自团队的资源用量、技术成本支出以及收入情况

  • 看清、看准、分析出系统关键性能瓶颈,通过机型迭代、内核优化等措施确保各业务具备将 CPU 跑高的能力,进而执行缩容退机操作达到降低成本的目标

  • 分别从数据、训练、压缩、推理等方面介绍小红书对于内容大模型的降本增效实践

听众收益

  • 可以帮助相关从业人员了解或学习云成本优化的主要技术方案,并在日常工作中进行运用


除此之外,本次大会还策划了多模态大模型及应用AI 驱动的工程生产力面向 AI 的研发基础设施不被 AI 取代的工程师大模型赋能 AIOps云成本优化Lakehouse 架构演进越挫越勇的大前端等专题,届时将有来自不同行业、不同领域、不同企业的 100+资深专家在 QCon 北京现场带来前沿技术洞察和一线实践经验。

目前,所有大会演讲嘉宾已结集完毕,了解更多报名和详情信息可扫码或联系票务经理 18514549229 咨询。



为确保大会顺利举行,现诚邀志愿者加入,时长 3.5 天。可与大咖交流、获极客时间 VIP 月卡、大会演讲视频资源和证书。主办方提供午餐和交通支持。时间:4 月 9 日 13:00-4 月 12 日 18:00,地点:北京万达嘉华酒店,报名链接:https://www.infoq.cn/form/?id=2088

2025-03-31 14:00270

评论

发布
暂无评论

爆肝整理!一文带你吃透软件测试

测试人

软件测试

AIP智能体平台:解锁未来软件开发的新篇章

大东(AIP内容运营专员)

人工智能

Mac文件同步对比工具Beyond Compare 5最新密钥及安装教程

Rose

Babylon.js 开发框架的优缺点分析

北京木奇移动技术有限公司

软件外包公司 webgl开发 babylon.js

通过数据驱动的方式实现自动化测试框架封装

测试人

软件测试

Vector Magic for Mac:一键将图片转为矢量图,设计更高效!

Rose

Babylon.js 开发框架的主要特点

北京木奇移动技术有限公司

软件外包公司 webgl开发 babylon.js

数字先锋 | “点击就成片”,中国电商人是懂做生意的!

天翼云开发者社区

云计算 存储 智能算力

FlowJo 10:流式细胞数据分析的巅峰之作,解锁生命科学的无限可能!

Rose

Byteman 使用指南(一)

FunTester

Commander One Mac:双窗口管理,文件操作新纪元!

Rose

人与AI协作的未来:共存还是竞争?

天津汇柏科技有限公司

AI 人工智能

新能源电池行业MES系统解决方案

万界星空科技

mes 锂电池 万界星空科技 电池mes 新能源电池

腾讯一面:那些数据库的高频问题

王中阳Go

数据库 腾讯 MySQL 高可用 面试问题

【极致观影】Movist Pro:重新定义你的家庭影院体验!

Rose

首批!云高性能计算平台CHPC通过云超算资质测评,百度智能云引领算力服务新高度!

Baidu AICLOUD

高性能 高性能计算

Topaz Video AI:一键提升视频画质,让回忆更清晰!

Rose

软件工程3.0时代,AI落地研效成熟时

思码逸研发效能

研发效能 AIGC 研发效能度量 研发效能管理

Three.js 的优缺点分析

北京木奇移动技术有限公司

three.js 软件外包公司 webgl开发

HttpRunner 接口测试框架

测试人

软件测试

《HAP信创生态白皮书》正式发布

明道云

鸿蒙原生游戏上新!《王者荣耀》鸿蒙版上线华为游戏中心

最新动态

Downie 4 for Mac v4.8.13最新中文版 苹果电脑专业youtube视频下载器

Rose

敏捷不是拖延借口,如何把控准时交付?

禅道项目管理

敏捷开发 项目管理软件 优先级 准时交付 sprint计划

一文教你如何本地部署玩转DeepSeek-V3,免费体验100度算力包跑通!

九章云极DataCanvas

开发 #编程 DeepSeek v3

Royal TSX for Mac:一站式远程管理利器,效率与安全并存的终极选择!

Rose

信息安全小课堂开讲啦!大伙看这里!

行云管家

网络安全 信息安全 数据安全

Rhinoceros 8 for Mac(犀牛8mac中文版)专业三维建模工具

Rose

AIP智能体平台:开启教育与科技的新篇章

大东(AIP内容运营专员)

Bigasoft Video Downloader Pro:支持全球视频平台,下载无障碍!

Rose

理工人的假期带娃搭子,和孩子一起动手建水塔,筑大坝……

博文视点Broadview

小红书 FinOps 实践:云成本优化与资源效率提升之道 |QCon北京_云计算_QCon全球软件开发大会_InfoQ精选文章