写点什么

Claude 3 震撼发布,这家云巨头同时宣布已接入该模型,全球开发者均可访问

  • 2024-03-08
    北京
  • 本文字数:2632 字

    阅读完需:约 9 分钟

大小:1.27M时长:07:22
Claude 3震撼发布,这家云巨头同时宣布已接入该模型,全球开发者均可访问

最近几日,Claude 3 的受关注度无人能敌。

 

这家总部位于旧金山的初创公司 Anthropic 发布了一款新的大型语言模型(LLM) Claude 3,据称是迄今为止世界上最强大的大模型,因为它在常规的基准测试中击败了之前的领导者 OpenAI 的 GPT—— 4 和谷歌的 Gemini。

 

Anthropic 官宣的三款 Claude 3 模型——按照智力从高到低的顺序分别命名为 Opus、Sonnet 和 Haiku。三个模型均提供 200k 长度的上下文,并针对不同的用例进行了优化:

 

  • Haiku 的优势在于速度和成本效益,这是一种快速紧凑的模型,具有近乎即时的响应能力。

  • Sonnet 在智能和速度之间实现了理想的平衡,适用于绝大多数工作负载,速度比 Claude 2 和 Claude 2.1 快 2 倍,且智能水平更高。它擅长执行需要快速响应的智能任务,例如知识检索或销售自动化。

  • Opus 是最先进、最强大的大模型,具有深度推理、高级数学和编码能力,在高度复杂的任务上具有顶级性能。它可以非常流畅地导航开放式提示和新颖场景,包括任务自动化、假设生成以及图表、图形和预测的分析。

 

有趣的是,新模型是根据合成数据进行训练的,即由人工智能本身生成的数据,而不是主要由人类作者生成的数据,这应该会消除一些人们对模型崩溃的担忧。


 Anthropic Claude 3 模型的智能与成本图。

 

Anthropic 的研究数据显示,Claude 3 Opus 作为其模型家族中最为智能的成员,已经在推理、数学和编程等领域树立了新标杆,超越了现有的其他模型,包括 OpenAI 的 GPT-4。具体来说,Opus 在人工智能系统的大多数常见评估基准上都优于同行,包括本科水平专家知识(MMLU)、研究生水平专家推理(GPQA)、基础数学(GSM8K)等。 下图是 Claude 3 与 GPT 和 Gemini 的基准测试成绩对比:

 


 资料来源:https ://www.anthropic.com/news/claude-3-family

 

Claude 3 的三类模型均提供了视觉功能,可以理解不同格式的结构化和非结构化数据,不仅是语言,还包括图像、图表、图表等,这使得企业能够构建集成不同多媒体源并解决真正跨领域问题的生成式人工智能应用程序。例如,制药公司可以查询药物研究论文以及蛋白质结构图,以加速发现;媒体组织可以自动生成图像标题或视频脚本。

 

值得一提的是,在 Claude 3 出现之前,幻觉现象是所有大模型的共同之痛,这一痛点在业内都没有特别有效的办法。而 Claude 3 模型通过“宪法 AI(Constitutional AI)”的训练方法原则为该 Claude 聊天机器人提供了明确的“价值观”,这些技术提供了对模型推理过程的透明度,并且提高了准确性。

 

此外,Claude 3 Opus 在困难的开放式问题上比 Claude 2.1 显示出 2 倍的预估准确性增益,降低了错误响应的可能性。随着企业客户依赖 Claude 跨越医疗、金融和法律研究等行业,减少幻觉现象对于安全性和性能至关重要。

 

这样的理念与亚马逊云科技倡导的以负责任的方式推进 AIGC 的发展不谋而合。事实上,早在去年亚马逊云科技就宣布向 Anthropic 投资 40 亿美元。除了通过 Amazon Bedrock 使用 Claude3 之外,用户也可以在 Anthropic 网站上访问 Claude 3。Amazon Bedrock 提供的领先 LLM 厂商的名单并不止 Anthropic 一家,包括 AI21 Labs、Cohere、Meta、Mistral、Stability 等大模型厂商提供的模型以及独占的 Amazon Titan 系列模型。


那么,利用 Amazon Bedrock 托管服务部署 Anthropic Claude 3 大模型的便捷之处?

 

据悉,Amazon Bedrock 已经推出了多项特色服务,包括模型评估功能能够帮助客户识别、比较和选择最适合的模型;知识库功能能够简化生成式 AI 应用构建并利用专有数据提供基于最新内容的定制化响应;模型调优功能支持对更多先进模型进行调优;代理功能可支持生成式 AI 应用在确保安全和隐私保护的情况下执行多步骤业务指令;Guardrails 功能可更好地帮助实现负责任 AI。这些功能为企业利用生成式 AI 提供多种选项,使得企业能够根据其业务和场景的特定需求,使用 Anthropic 的最新模型进行构建。这不仅包括自然语言模型,还包括扩展的多模式人工智能模型,能够跨文本、图像、图表等进行高级推理。

 

亚马逊云科技认为没有一种模型可以满足所有需求。为此,Amazon Bedrock 与全球领先的大模型供应商合作,为用户提供领先大模型选择,并在近日将大模型提供商扩充至 7 家。至此,Amazon Bedrock 的大模型供应商共有 AI21 Labs、Anthropic、Cohere、Meta、Stability AI、Amazon 和 Mistral AI,Mistral AI 的两种高性能模型 Mistral 7B 和 Mixtral 8x7B 也已经在 Amazon Bedrock 正式可用。Mistral 7B 是 Mistral AI 推出的首个基础模型,支持英语文本生成任务并具备自然编码能力。而 Mixtral 8x7B 则采用当下备受关注的 MoE(优质稀疏专家混合)技术,功能比 Mixtral 7B 更强大,可支持英语、法语、德语、西班牙语和意大利语文本生成任务并具备自然编码能力,非常适用于文本摘要、问题解答、文本分类、文本完善和代码补全等使用案例。

 

亚马逊云科技全球产品副总裁 Matt Wood 博士在其最新的博客文章中提到:“基础模型是未来 100 年最重要的软件组件之一。尽管生成式 AI 演示因其撰写博客文章或回答问题的能力而闻名(而且它们确实做得很好),但这些卓越的模型更应被视为能够重新定义我们与数据、信息以及彼此互动方式的推理和集成引擎。单独来看,Claude 3 在这些方面是行业领先的。在 Amazon Bedrock 中,这些模型与其他基础模型结合,获得了新的超能力,加上易于使用你自己的数据来定位响应、添加自主代理和可配置的安全护栏,其效果远大于各部分之和。”

 

Matt Wood 博士特别强调了 Claude3 模型在交互和安全方面的优势:“在交互方面,所有的 Claude 3 模型更容易被‘引导’,并且被设计得更好地支持流行的输出格式,如 JSON。这使得开发人员构建能够与 Claude 3 模型进行交互的应用程序变得更加容易。这些模型也不太可能拒绝回答那些处于模型安全边界边缘的提示,从而开放了更多企业用例,这些用例曾经可能因为模型的限制而被阻止。在安全方面,Claude 3 也保持了 Anthropic 的高安全标准。”

 

可见,此次宣布接入 Claude 3 模型是亚马逊云科技 更广泛战略的一部分,该战略旨在通过投资生成式 AI 堆栈的所有层(基础设施、模型和面向用户的应用程序)来抢占生成式 AI 领域的有利地位。亚马逊云科技表示,全球有超过 10,000 个组织已经在使用 Amazon Bedrock 来探索和部署生成式 AI 应用程序。

 

与此同时,有传言称 OpenAI 很快就会用自己对 Claude 3 的答案 GPT-5 进行反击,具体结果如何,我们可以拭目以待。

 

参考链接:

https://foresightnews.pro/article/detail/32716

https://aws.amazon.com/cn/blogs/machine-learning/unlocking-innovation-aws-and-anthropic-push-the-boundaries-of-generative-ai-together/

 

2024-03-08 10:069805
用户头像
李冬梅 加V:busulishang4668

发布了 1002 篇内容, 共 616.8 次阅读, 收获喜欢 1178 次。

关注

评论

发布
暂无评论
发现更多内容

手把手教你成为荣耀开发者:账户结算操作指南

荣耀开发者服务平台

android 开发者 手机 荣耀 honor

结合RocketMQ 源码,带你了解并发编程的三大神器

华为云开发者联盟

RocketMQ 开发 华为云 12 月 PK 榜

国内主流商业智能BI工具剖析

流量猫猫头

大数据

前端培训学习程序员如何提高解决问题的能力

小谷哥

java培训怎么学习才好?

小谷哥

【11.25-12.02】写作社区优秀技术博文回顾

InfoQ写作社区官方

热门活动

大数据培训学习程序员还好找吗

小谷哥

雾霾对户外LED显示屏的考验

Dylan

LED LED显示屏 户外LED显示屏

刘德华在线演唱会,火山引擎边缘云助力打造极致视频直播体验

火山引擎边缘云

云原生 边缘计算 节点 火山引擎边缘计算

星环科技数据中台解决方案,助力某政府机构建设新型智慧城市

星环科技

译文 | A poor man's API

API7.ai 技术团队

API APISIX RESTful API

BSN-DDC基础网络DDC SDK详细设计(七):数据解析

BSN研习社

BSN-DDC

白嫖GitHub Pages,轻松搭建个人博客

LigaAI

Hexo GitHub Pages 个人博客 个人网站 12 月 PK 榜

在一次又一次的失败中,我总结了这份万字的《MySQL性能调优笔记》

钟奕礼

Java 程序员 java面试 java编程

云原生应用的最小特权原则

HummerCloud

k8s rbac 云原生安全

SEAL 0.3 正式发布:国内首个全链路软件供应链安全管理平台

SEAL安全

安全 全链路 软件供应链 SEAL

火山引擎DataTester揭秘:字节如何用A/B测试,解决增长问题的?

字节跳动数据平台

大数据 AB testing实战 12 月 PK 榜

解读数仓中的数据对象及相关关系

华为云开发者联盟

数据库 后端 华为云 数据对象 12 月 PK 榜

前端培训没有基础应该怎么学习

小谷哥

架构实战营模块1第1课 - 什么是架构,你理解对了么

净意

架构实战营

从React源码角度看useCallback,useMemo,useContext

goClient1992

React

从React源码来学hooks是不是更香呢

goClient1992

React

三翼鸟,用两年开启下一个十年

脑极体

基于云原生的火山引擎边缘云应用与实践

火山引擎边缘云

分布式 云原生 边缘计算 节点 火山引擎边缘计算

一线大厂为什么面试必问分布式?

钟奕礼

Java 程序员 java面试 java编程

一张「有想法」的表单,玩出线上填表新花样

爱科技的水月

【JUC】交换器Exchanger详解

JAVA旭阳

Java JUC

编译器优化丨Cache优化

华为云开发者联盟

后端 开发 华为云 12 月 PK 榜

从React源码分析看useEffect

goClient1992

React

技术内幕 | 阿里云EMR StarRocks 极速数据湖分析

StarRocks

#数据库

大数据培训程序员工作前景如何

小谷哥

Claude 3震撼发布,这家云巨头同时宣布已接入该模型,全球开发者均可访问_亚马逊云科技_李冬梅_InfoQ精选文章