写点什么

阿里云企业 AI 搜索大模型关键技术优化实践 |QCon 北京

  • 2025-03-21
    北京
  • 本文字数:1744 字

    阅读完需:约 6 分钟

阿里云企业 AI 搜索大模型关键技术优化实践 |QCon北京

2025 年 4 月 10 - 12 日,QCon 全球软件开发大会将在北京召开,大会以 “智能融合,引领未来” 为主题,将汇聚各领域的技术先行者以及创新实践者,为行业发展拨云见日。


阿里云高级算法工程师姚舰航、徐光伟已确认出席并发表题为《阿里云企业 AI 搜索大模型关键技术优化实践》的主题分享。随着人工智能和深度学习的迅猛发展,大模型(Large Language Model)在自然语言处理、计算机视觉等领域取得了突破性的成果。这些进步促使搜索技术迎来了新的变革。传统搜索主要依赖于关键词匹配和预定义的规则,强调精确的相关性匹配。然而,AI 大模型的引入,使得搜索技术从关键词检索转向了语义理解,从单一模态走向了多模态融合,从确定性检索演变为基于相似度的智能检索。


本次演讲将聚焦于 AI 搜索大模型的关键技术应用,涵盖文本向量化、降维、重排序、NL2Search(自然语言到搜索)、文档解析与切片、问答大模型评测与微调、 Agentic RAG(检索增强生成)及客户专属大模型的最新进展。具体将结合实际业务场景和案例(如智能问答系统、文档搜索、人工智能助手等),深入阐述这些技术如何提升搜索的质量和效率,以及在实践中如何克服各种技术挑战。


姚舰航是浙江大学自动化控制专业硕士,毕业后一直从事搜广推算法研究与应用工作。涉及信息流推荐、商业化广告定向 DMP、OCPX 深度转化模型优化以及云上智能推荐等领域,具备丰富的 C 端和 B 端算法优化和实践经验。目前专注于企业级 AI 搜索方向,负责搜索专属大模型训练以及 Agentic RAG 能力建设。


徐光伟在搜索技术和 NLP 算法方向有十年以上的经验,共有 20 篇以上的顶会论文发表和 50 篇以上的专利,拿到 MS MARCO 和 TREC 2022 文档检索的冠军、NL2SQL 任务 BIRD 榜单的冠军。在 to B 业务方向有八年的经验,搜索云服务业务上推动了行业版算法效果超越竞品,创新地提出轻量化客户定制与多模态检索的产品功能持续迭代,赢得多个标杆客户的认可。


本次大会,两位讲师分享的详细演讲内容如下:


演讲提纲

  • AI 大模型在搜索领域的背景与趋势

  • 文本向量化与降维

  • 搜索结果的重排序模型

  • NL2Search:从自然语言到搜索

  • 基于大模型的语义切片

  • 大模型问答质量评测与微调

  • Agentic RAG 实践

  • 客户专属大模型训练探索

您认为,这样的技术在实践过程中有哪些痛点?

  • 文本向量化与降维:向量化可能导致高维数据难以处理,而降维可能导致信息丢失,影响搜索效果

  • 重排序算法:需要高效的算法以确保实时性,尤其是在大规模数据集上,但计算复杂度可能成为瓶颈

  • NL2Search(自然语言到搜索):构建高质量的自然语言处理模型需要大量标注数据,且模型的准确性对于搜索体验非常关键

  • 基于大模型的语义切片:切片语义完整度直接影响搜索结果的相关性

  • 大模型问答质量评测与微调:大模型问答缺乏全面且高精度的质量评测体系,大模型在 AI 搜索场景中仍存在幻觉、回答不完整、回答冗余等问题

  • Agentic RAG 实践:单轮 RAG 难以解答复杂问题(如多跳问题、聚合问题等)

  • 客户专属大模型训练:由于大模型缺乏客户专有域知识,对客户场景特有问题的理解不足,回答不专业

演讲亮点

  • 实际业务场景结合:通过智能问答系统和文档搜索案例,展示 AI 搜索技术如何在现实中应用,增强观众理解

  • 前沿技术进展:介绍 Agentic RAG 的最新进展,帮助听众了解技术的未来发展趋势

  • 技术问题与解决方案:不仅指出各项技术的实际痛点,还提供了相应的解决策略,使内容更加实用

  • 综合性讨论:涵盖从文本向量化到问答大模型的多个技术层面,提供全方位的知识视角

听众收益

  • 深入了解 AI 搜索大模型的核心技术和应用场景,掌握最新的行业动态和技术趋势

  • 学习如何将大模型技术应用于实际业务中,解决传统搜索难以应对的问题,提升系统的智能化水平

  • 开拓新的思路和方法,了解如何结合传统技术和大数据处理,实现高效的搜索解决方案

  • 了解当前领域的技术挑战,为未来在 AI 搜索领域的研究和实践提供指引


除此之外,本次大会还策划了多模态大模型及应用AI 驱动的工程生产力面向 AI 的研发基础设施不被 AI 取代的工程师大模型赋能 AIOps云成本优化Lakehouse 架构演进越挫越勇的大前端等专题,届时将有来自不同行业、不同领域、不同企业的 100+资深专家在 QCon 北京现场带来前沿技术洞察和一线实践经验。


现在报名即可以享受 9 折优惠,单张门票立省 680 元,详情可扫码或联系票务经理 18514549229 咨询。



2025-03-21 17:045207

评论

发布
暂无评论
发现更多内容

Go- 切片的使用

HelloBug

Go 语言 切片 追加 拷贝 扩缩容

浅析智慧交通有哪些应用场景?

一只数据鲸鱼

数据可视化 智慧城市 智慧交通 城市交通

cocoapods 的主模块如何判断子模块有没有被加载?

fuyoufang

ios swift 8月日更

阿里资深架构师终于把微服务架构与实践第2版PDF分享出来了

公众号_愿天堂没有BUG

Java 编程 程序员 架构 面试

如何用 Nacos 构建服务网格生态

阿里巴巴云原生

Go- 数组

HelloBug

数组 Go 语言

Spring 配置加载

樊江。

Spring Framework

使用mock模拟登录接口数据

与风逐梦

大前端 后端 Mock

CERT和CWE之间有什么联系?

鉴释

安全编码规范 cwe cert

云原生多云容器编排平台karmada上手指南

谐云

云原生 开源技术

如何从内部保障企业数据安全?用IT运维审计系统可以吗?

行云管家

网络安全 数据安全 堡垒机 IT运维 运维审计

TCP协议认知篇

邱学喆

TCP协议 拥塞避免算法 慢启动算法 坚持定时器 TCP状图切换

关于告警管理的软件,您还只知道Pagerduty吗?

睿象云

运维 告警 运维平台 智能告警 告警管理

通过明道云实现培训机构客户管理

明道云

WebRTC中的RefCountedObject解析

她的男人是程序员

👊 【Spring技术原理】异步编程机制以及功能分析讲解

码界西柚

spring springboot 异步编程 8月日更

来!看排名一年上升16位的ClickHouse,如何在京东落地实践

京东科技开发者

数据库 Clickhouse

如何对接口参数的描述进行集中管理

CodeNongXiaoW

大前端 测试 后端 接口工具

华为18级工程师三年心血终成趣谈网络协议文档(附大牛讲解)

公众号_愿天堂没有BUG

Java 编程 程序员 架构 面试

阿里巴巴首发:Java核心框架指导手册1小时点击量破千万!

Java 编程 面试 程序人生 Alibaba

【“互联网+”大赛华为云赛道】GaussDB命题攻略:支持三种开发语言,轻松完成数据库缓冲池

华为云开发者联盟

数据库 华为云 GaussDB 互联网+ 缓冲池

关于C++中“不能返回对象引用”的思考

她的男人是程序员

微信业务架构 | 架构实战营

樊江。

架构实战营

打开vscode好像打开了原神?vscode原神背景推荐,比博燃

CodeNongXiaoW

vscode vscode背景 原神

高可用 | Xenon 实现 MySQL 高可用架构 部署篇

RadonDB

MySQL 数据库 Xenon RadonDB

关于飞书的告警通知,这里有个更好的办法

睿象云

运维 告警 运维平台 智能告警

Go- 切片的定义

HelloBug

slice Go 语言 切片

计算机网络常用知识总结

Java 架构 后端 网络 计算机

干货!4大实验项目,深度解析Tag在可观测性领域的最佳实践!

观测云

可观测性 dataflux tag ngix

模块一作业

当归

仿照Hystrix,手写一个限流组件

码农参上

限流 Hystrix 8月日更

阿里云企业 AI 搜索大模型关键技术优化实践 |QCon北京_阿里巴巴_QCon全球软件开发大会_InfoQ精选文章