写点什么

Claude 3 震撼发布,这家云巨头同时宣布已接入该模型,全球开发者均可访问

  • 2024-03-08
    北京
  • 本文字数:2632 字

    阅读完需:约 9 分钟

大小:1.27M时长:07:22
Claude 3震撼发布,这家云巨头同时宣布已接入该模型,全球开发者均可访问

最近几日,Claude 3 的受关注度无人能敌。

 

这家总部位于旧金山的初创公司 Anthropic 发布了一款新的大型语言模型(LLM) Claude 3,据称是迄今为止世界上最强大的大模型,因为它在常规的基准测试中击败了之前的领导者 OpenAI 的 GPT—— 4 和谷歌的 Gemini。

 

Anthropic 官宣的三款 Claude 3 模型——按照智力从高到低的顺序分别命名为 Opus、Sonnet 和 Haiku。三个模型均提供 200k 长度的上下文,并针对不同的用例进行了优化:

 

  • Haiku 的优势在于速度和成本效益,这是一种快速紧凑的模型,具有近乎即时的响应能力。

  • Sonnet 在智能和速度之间实现了理想的平衡,适用于绝大多数工作负载,速度比 Claude 2 和 Claude 2.1 快 2 倍,且智能水平更高。它擅长执行需要快速响应的智能任务,例如知识检索或销售自动化。

  • Opus 是最先进、最强大的大模型,具有深度推理、高级数学和编码能力,在高度复杂的任务上具有顶级性能。它可以非常流畅地导航开放式提示和新颖场景,包括任务自动化、假设生成以及图表、图形和预测的分析。

 

有趣的是,新模型是根据合成数据进行训练的,即由人工智能本身生成的数据,而不是主要由人类作者生成的数据,这应该会消除一些人们对模型崩溃的担忧。


 Anthropic Claude 3 模型的智能与成本图。

 

Anthropic 的研究数据显示,Claude 3 Opus 作为其模型家族中最为智能的成员,已经在推理、数学和编程等领域树立了新标杆,超越了现有的其他模型,包括 OpenAI 的 GPT-4。具体来说,Opus 在人工智能系统的大多数常见评估基准上都优于同行,包括本科水平专家知识(MMLU)、研究生水平专家推理(GPQA)、基础数学(GSM8K)等。 下图是 Claude 3 与 GPT 和 Gemini 的基准测试成绩对比:

 


 资料来源:https ://www.anthropic.com/news/claude-3-family

 

Claude 3 的三类模型均提供了视觉功能,可以理解不同格式的结构化和非结构化数据,不仅是语言,还包括图像、图表、图表等,这使得企业能够构建集成不同多媒体源并解决真正跨领域问题的生成式人工智能应用程序。例如,制药公司可以查询药物研究论文以及蛋白质结构图,以加速发现;媒体组织可以自动生成图像标题或视频脚本。

 

值得一提的是,在 Claude 3 出现之前,幻觉现象是所有大模型的共同之痛,这一痛点在业内都没有特别有效的办法。而 Claude 3 模型通过“宪法 AI(Constitutional AI)”的训练方法原则为该 Claude 聊天机器人提供了明确的“价值观”,这些技术提供了对模型推理过程的透明度,并且提高了准确性。

 

此外,Claude 3 Opus 在困难的开放式问题上比 Claude 2.1 显示出 2 倍的预估准确性增益,降低了错误响应的可能性。随着企业客户依赖 Claude 跨越医疗、金融和法律研究等行业,减少幻觉现象对于安全性和性能至关重要。

 

这样的理念与亚马逊云科技倡导的以负责任的方式推进 AIGC 的发展不谋而合。事实上,早在去年亚马逊云科技就宣布向 Anthropic 投资 40 亿美元。除了通过 Amazon Bedrock 使用 Claude3 之外,用户也可以在 Anthropic 网站上访问 Claude 3。Amazon Bedrock 提供的领先 LLM 厂商的名单并不止 Anthropic 一家,包括 AI21 Labs、Cohere、Meta、Mistral、Stability 等大模型厂商提供的模型以及独占的 Amazon Titan 系列模型。


那么,利用 Amazon Bedrock 托管服务部署 Anthropic Claude 3 大模型的便捷之处?

 

据悉,Amazon Bedrock 已经推出了多项特色服务,包括模型评估功能能够帮助客户识别、比较和选择最适合的模型;知识库功能能够简化生成式 AI 应用构建并利用专有数据提供基于最新内容的定制化响应;模型调优功能支持对更多先进模型进行调优;代理功能可支持生成式 AI 应用在确保安全和隐私保护的情况下执行多步骤业务指令;Guardrails 功能可更好地帮助实现负责任 AI。这些功能为企业利用生成式 AI 提供多种选项,使得企业能够根据其业务和场景的特定需求,使用 Anthropic 的最新模型进行构建。这不仅包括自然语言模型,还包括扩展的多模式人工智能模型,能够跨文本、图像、图表等进行高级推理。

 

亚马逊云科技认为没有一种模型可以满足所有需求。为此,Amazon Bedrock 与全球领先的大模型供应商合作,为用户提供领先大模型选择,并在近日将大模型提供商扩充至 7 家。至此,Amazon Bedrock 的大模型供应商共有 AI21 Labs、Anthropic、Cohere、Meta、Stability AI、Amazon 和 Mistral AI,Mistral AI 的两种高性能模型 Mistral 7B 和 Mixtral 8x7B 也已经在 Amazon Bedrock 正式可用。Mistral 7B 是 Mistral AI 推出的首个基础模型,支持英语文本生成任务并具备自然编码能力。而 Mixtral 8x7B 则采用当下备受关注的 MoE(优质稀疏专家混合)技术,功能比 Mixtral 7B 更强大,可支持英语、法语、德语、西班牙语和意大利语文本生成任务并具备自然编码能力,非常适用于文本摘要、问题解答、文本分类、文本完善和代码补全等使用案例。

 

亚马逊云科技全球产品副总裁 Matt Wood 博士在其最新的博客文章中提到:“基础模型是未来 100 年最重要的软件组件之一。尽管生成式 AI 演示因其撰写博客文章或回答问题的能力而闻名(而且它们确实做得很好),但这些卓越的模型更应被视为能够重新定义我们与数据、信息以及彼此互动方式的推理和集成引擎。单独来看,Claude 3 在这些方面是行业领先的。在 Amazon Bedrock 中,这些模型与其他基础模型结合,获得了新的超能力,加上易于使用你自己的数据来定位响应、添加自主代理和可配置的安全护栏,其效果远大于各部分之和。”

 

Matt Wood 博士特别强调了 Claude3 模型在交互和安全方面的优势:“在交互方面,所有的 Claude 3 模型更容易被‘引导’,并且被设计得更好地支持流行的输出格式,如 JSON。这使得开发人员构建能够与 Claude 3 模型进行交互的应用程序变得更加容易。这些模型也不太可能拒绝回答那些处于模型安全边界边缘的提示,从而开放了更多企业用例,这些用例曾经可能因为模型的限制而被阻止。在安全方面,Claude 3 也保持了 Anthropic 的高安全标准。”

 

可见,此次宣布接入 Claude 3 模型是亚马逊云科技 更广泛战略的一部分,该战略旨在通过投资生成式 AI 堆栈的所有层(基础设施、模型和面向用户的应用程序)来抢占生成式 AI 领域的有利地位。亚马逊云科技表示,全球有超过 10,000 个组织已经在使用 Amazon Bedrock 来探索和部署生成式 AI 应用程序。

 

与此同时,有传言称 OpenAI 很快就会用自己对 Claude 3 的答案 GPT-5 进行反击,具体结果如何,我们可以拭目以待。

 

参考链接:

https://foresightnews.pro/article/detail/32716

https://aws.amazon.com/cn/blogs/machine-learning/unlocking-innovation-aws-and-anthropic-push-the-boundaries-of-generative-ai-together/

 

2024-03-08 10:0610038
用户头像
李冬梅 加V:busulishang4668

发布了 1111 篇内容, 共 721.7 次阅读, 收获喜欢 1253 次。

关注

评论

发布
暂无评论
发现更多内容

无常中的僵硬与柔软

zhoo299

随笔杂谈 教育 生命 5月日更

来了,Anolis OS 8.2 正式版首发!100% 兼容 CentOS 8

阿里云基础软件团队

阿里三面:你连HashMap都不会还敢问我要23K?我:0.0

北游学Java

Java 面试 hashmap

算法训练营 - 学习笔记 - 第六周

心在飞

xSocket框架接入需实现的接口

风翱

xSocket 5月日更

Golang 工作区和 GOPATH

escray

学习 极客时间 Go 语言 5月日更

区块链赋能产业,构建良好的数字经济生态

CECBC

乡村的振兴之始,5G的均衡之道

脑极体

百度助力智慧丽江“数智”管理 丽江城市大脑正式上线

百度大脑

百度 大脑 丽江

Python 包管理

若尘

Package Python编程 5月日更

网络攻防学习笔记 Day12

穿过生命散发芬芳

5月日更 网络攻防

码农是如何百炼成钢的?6面阿里、5面字节、4面腾讯,终斩腾讯Offer

Java架构师迁哥

社工技巧 | 一些社工入门技巧介绍

Thrash

「学习笔记」《02 | 第一个程序:教你输出彩色的文字》之二

Nydia

学习

深入浅出c++协程丨C++协程实现

Linux服务器开发

c++ 后端 协程 Linux服务器开发 协程原理

OLAP计算引擎怎么选?

数据社

大数据 OLAP 5月日更

精选面试题教你应对高级iOS开发面试官(提供底层进阶规划蓝图)

程序员 移动开发 ios开发

Python自动打印文件

IT蜗壳-Tango

IT蜗壳教学 5月日更

双非本科,聊聊我是怎么学习编程的。

JavaGuide

Java 学习 编程

鬼知道发生了什么?痛述阿里Java岗5轮技术面经历,险幸上岸

Java 编程 程序员 架构 面试

kotlin基础

ES_her0

5月日更

找Matlab代码,看这一篇就够了

攻城先森

matlab 工具分享 5月日更

鸿蒙系统之Codelab布局组件尝鲜

liuzhen007

华为 鸿蒙 5月日更

cri-o 技术探秘2

xumc

教你两招,轻松搞定html页面导出为pdf文件

麦洛

Java PDF wkhtmltopdf html2canvas

区块链的现实之痛与解决之道(区块链的爱与恨)

CECBC

零基础学习 NLP-DAY3

Qien Z.

动态规划 nlp 5月日更

手把手 Golang 实现静态图像与视频流人脸识别

天黑黑

音视频 人脸识别 Go 语言

C++解析一些特殊符号tab、换行符号

良知犹存

c++

区块链,让付费的知识真正“物超所值”

CECBC

架构概述之架构演化、模式与核心要素

xcbeyond

架构 架构演进 5月日更

Claude 3震撼发布,这家云巨头同时宣布已接入该模型,全球开发者均可访问_亚马逊云科技_李冬梅_InfoQ精选文章