写点什么

哈佛大学联合 MIT 研究人员发布了 Clevrer 数据集,以推进视觉推理和神经符号 AI 的发展

  • 2020-06-08
  • 本文字数:1705 字

    阅读完需:约 6 分钟

哈佛大学联合MIT研究人员发布了Clevrer数据集,以推进视觉推理和神经符号AI的发展

近日,哈佛大学和麻省理工学院沃森 AI 实验室的研究人员发布了 Clevrer 数据集,用于评估 AI 模型识别因果关系和进行推理的视频诊断数据集。麻省理工学院 IBM 沃森实验室负责人大卫·考克斯 (David Cox) 称, Clevrer 数据集可以在创造混合 AI 方面取得进展,混合 AI 是指结合了神经网络和符号 AI 的混合型 AI。IBM 研究团队负责人达里奥·吉尔 (Dario Gil) 亦将神经符号 AI 列为 2020 年最重要的进展之一。


Clevrer 是一个诊断视频数据集,用于系统评估各种推理任务上的计算模型。近期,在全数字化的国际表征学习会议 (ICLR) 上发表的一篇论文中,介绍了有关视频表征与推理 (Clevrer) 数据集碰撞事件的初步研究成果。


Clevrer 建立在 Clevr 基础之上。Clevr 是斯坦福大学 (Stanford University) 和 Facebook AI 研究团团队 (Facebook AI Research)于 2016 年发布的一组数据集,用来分析神经网络的视觉推理能力。该团队成员包括大名鼎鼎的 ImageNet 创始人李飞飞 (Fei Fei Li) 博士。在国际表征学习会议 (ICLR) 上,Clevrer 的共同创作者例如来自麻省理工学院-IBM 沃森实验室 (MIT-IBM Watson Lab) 的庄根和来自 Deepmind 的普希梅特·科利 (Pushmeet Kohli) 等人对神经符号概念 NS-DR (Neuro Symbolic Concept Learner,NS-DR),一种应用于 Clevr 的神经符号学模型做了介绍。


该论文写道:“我们对视频的时间和因果推理进行了系统性的研究。视频的时间和因果推理这个问题非常深刻且具有挑战性,它困扰研究人员很久了,但我们才刚刚开始用‘现代化的’ AI 工具来对它进行研究。”“我们新开发的 Clevrer 数据集和 NS-DR 模型即是朝这个研究方向进行的初步探索。”


Clevrer 数据集由 Bullet 物理模拟器制作,包括 2 万部展示桌面上物体碰撞的合成视频和一组自然语言数据集,其中包括与视频内物体相关的问题和答案。总共有超过 30 万个这样的问题和答案,它们被分为描述性、解释性、预测性和反事实性等类别。


麻省理工学院-IBM 沃森实验室负责人大卫·考克斯 (David Cox) 在一次采访中向 媒体透露,他坚信 Clevrer 数据集将有助于创造混合 AI,混合 AI 结合了神经网络和符号 AI。考克斯表示,IBM 研究团队 (IBM Research) 将把该方法应用于 IT 基础设施管理和工厂、建筑工地等工业环境。


考克斯称:“我认为这个数据集对几乎所有类型的应用都很重要。“通过该数据集,我们可以将世界简单化为许多到处移动的球,这也正是观察世界、了解世界、以及做计划并改变世界的第一步。因此,我们认为这个数据集的应用或将横跨多个领域,而视觉和机器人技术则是很好的开始。”


麻省理工学院-IBM 沃森 AI 实验室成立于三年前,旨在取得与广义 AI 主题相关的颠覆性进展。该实验室如 ObjectNet 等一些成果凸显了 ImageNet 之类的深度学习成功案例相对薄弱,所以该实验室已把重心转向了神经网络和符号或经典 AI 的结合上。


符号 AI 和神经网络一样,已经存在了几十年之久。考克斯认为,神经网络在等待着合适的条件出现,如足够多的数据和足够多的计算符号,与此同时 AI 也在等待着神经网络的发展,以便再度复苏。


考克斯说,这两种 AI 的互补性很好,如果能够结合,我们便可以用更少的数据和更高的效能来打造更稳健和更可靠的模型。在年初与 VentureBeat 的一次访谈中,IBM 研究团队负责人达里奥·吉尔 (Dario Gil) 称神经符号 AI 将成为 2020 年最重要的进展之一。


考克斯说,不论你想得到什么结果,通过神经符号 AI,你都可以表征知识或程序,而不是像神经网络那样映射输入和输出。因此,这或许能够使 AI 更好地帮助我们解决现实世界的问题。


考克斯称,“谷歌有一条数据之河,亚马逊也有,这些都不是坏事,但我们绝大多数的问题更像是智力游戏,所以我们认为,要向前发展,真正让 AI 不再是概念上的炒作,我们需要建立能够实现这一点的系统,这些系统有逻辑组件,可以能够灵活地重新配置自己,可以根据环境和实验采取行动,可以解释这些信息,并拥有其认知世界的内在心理模型”。


麻省理工学院-IBM 沃森 AI 联合实验室成立于 2017 年,总投资 2.4 亿美元。


原文链接:


https://venturebeat.com/2020/04/28/mit-researchers-release-clevrer-to-advance-visual-reasoning-and-neurosymbolic-ai/


2020-06-08 10:281741
用户头像
李冬梅 加V:busulishang4668

发布了 1188 篇内容, 共 811.0 次阅读, 收获喜欢 1303 次。

关注

评论

发布
暂无评论
发现更多内容

Elasticsearch Enterprise 8.19 (macOS, Linux, Windows) - 分布式搜索和分析引擎

sysin

elasticsearch

Xcode 26 beta 5 (17A5295f) - Apple 平台 IDE

sysin

xcode

Cisco Expressway Release X15.3.0 - 统一通信网关

sysin

Cisco

扣子,正式拥抱开源!

北京中暄互动广告传媒有限公司

给「AI+软件工程」泼一瓢冷水

行云创新

氛围编程 AI + 软件工程 AI将取代程序员

Amazon Bedrock的两年征程:从大放厥词到战略实现

Alter

3000字节C语言实现GPT-2聊天机器人

qife122

自然语言处理 低代码实现

高性能椭圆曲线加密算法25519优化解析

qife122

密码学 形式化验证

低代码+大模型组合拳:JeecgBoot 分类器节点让流程编排更聪明

JEECG低代码

低代码 AIGC 流程编排 JeecgBoot

Bonree ONE发布直通车 | 可观测平台如何深度应用LLM技术

博睿数据

Metasploit Pro 4.22.8-2025080401 (Linux, Windows) - 专业渗透测试框架

sysin

Metasploit

Nessus Professional 10.9 Auto Installer for Windows (updated August 2025)

sysin

Nessus

数智先锋 | Bonree ONE 赋能通威股份有限公司提升全栈可观测性能力

博睿数据

Nexpose 8.17.0 for Linux & Windows - 漏洞扫描

sysin

Nexpose

FBI 成功瓦解 Hive 勒索软件网络的行动与技术内幕

qife122

网络安全 执法行动

以太坊合约可复用属性指南 - 提升智能合约安全的模糊测试技术

qife122

区块链 智能合约

程序员:氛围编程爽啊!老板:我睡不着哇……

行云创新

平台工程 AI 编码 AI 编码隐患

HCL AppScan Standard 10.9.0 新增功能简介

sysin

AppScan

多智能体评估框架MAJ-EVAL:实现LLM自动评估与人类多维度评价对齐

qife122

自然语言处理 自动评估

ApacheCon 2025中国开源年度报告:Apache Doris 国内第一

SelectDB

Apache 开源 apache doris 实时分析 数据库 大数据

都说 AI 能给研发开外挂,可企业为啥总玩不转?答案来了!

行云创新

软件工程 氛围编程 vibe coding

Metasploit Pro 4.22.8-2025073001 (Linux, Windows) - 专业渗透测试框架

sysin

Metasploit

火山引擎Data Agent:突破传统BI局限,用智能对话打造"数据决策大脑"

字节跳动数据平台

Proxmox VE 9.0 正式版发布 - 开源虚拟化管理平台

sysin

proxmoxve

垂直和领域 Agent 的护城河:上下文工程

阿里巴巴云原生

阿里云 云原生 agent

能自定义、能分享的智能体,还支持生成随机头像

北京中暄互动广告传媒有限公司

2025年空气净化器品牌选购避坑指南:除甲醛核心技术解析

编程猫

Elasticsearch Enterprise 9.1.0 (macOS, Linux, Windows) - 分布式搜索和分析引擎

sysin

elasticsearch

Proxmox Backup Server 4.0 正式版发布 - 开源企业级备份解决方案

sysin

Proxmox

Splunk Enterprise 10.0.0 (macOS, Linux, Windows) - 搜索、分析和可视化,数据全面洞察平台

sysin

Splunk Enterprise

AI内容检测新工具SynthID与水印技术解析

qife122

ai检测 内容认证

哈佛大学联合MIT研究人员发布了Clevrer数据集,以推进视觉推理和神经符号AI的发展_文化 & 方法_KHARI JOHNSON_InfoQ精选文章