首页 > 科技 > 白天打工,晚上科研,谷歌大脑研究科学家破解了困扰数学界几十年的猜想

白天打工,晚上科研,谷歌大脑研究科学家破解了困扰数学界几十年的猜想

选自quantamagazine

作者:Kevin Hartnett

机器之心编译

编辑:蛋酱、小舟

离开数学界七年后,一直从事 AI 领域工作的谷歌研究科学家 Justin Gilmer,却突破了研究生时期未曾获得进展的难题。

2022 年 10 月中旬,Justin Gilmer 从加利福尼亚飞往纽约,在东海岸拜访了他以前的导师 Michael Saks,一位罗格斯大学的数学家。

叙旧期间,他们并未谈及数学。事实上,自从 2015 年在罗格斯大学获得博士学位后,Gilmer 就再没认真思考过数学问题。那时候他决定不在学术界发展,同时开始自学编程。当他和 Saks 共同用餐时,Gilmer 向导师讲述了自己在谷歌的工作:机器学习和人工智能。

在校园的小路上,Gilmer 边走边回忆,2013 年,他花了一年多的时间走在这条路上,思考一个叫做「并封闭集猜想(又称Frankl猜想)」的问题。这一直是个没有结果的难题。Gilmer 所做的一切努力,只是成功地教会了自己,为什么这个关于数字集合的看似简单的问题会如此难以解决。

但在七年后的这次访问后,Gilmer 突然有了全新的灵感。他开始思考如何应用信息论来解决并封闭集猜想。经过一个月的研究后,通往证明的路径不断打开。11 月,他在 arXiv 上发布了研究结果,宣布在证明整个猜想方面取得了重大进展。

论文链接:https://arxiv.org/pdf/2211.09055.pdf

这篇论文掀起了后续研究的热潮。牛津大学、麻省理工学院和高等研究院等机构的数学家们迅速在 Gilmer 的新方法基础上开展工作。

什么是并封闭集猜想?

并封闭集猜想与数的集合相关,如 和 。你可以对集合进行运算,包括取它们的并集,也就是合并它们。例如, 和 的并集是 。

如果该族中任何两个集合的并集等于族中任何现有的集合,这个集合或族被认为是「并集封闭」的。例如,考虑这个由四个集合组成的族:, , , 。

将任何一对组合起来,你就会得到一个已经在族中存在的集合,所以说这个族是并封闭集的。

数学家们早在 20 世纪 60 年代就讨论过并封闭集猜想,但直到 1979 年它才得到了第一次正式陈述,是在 Péter Frankl 的一篇论文中,他是一位匈牙利数学家,80 年代移民到日本,除了数学还热爱街头表演。

Frankl 猜想,如果一个集合的族是并封闭集的,那么它必须至少有一个元素(或数字)出现在至少一半的集合中。这是一个自然存在的阈值,原因有二。

Justin Gilmer

首先,在现成的并封闭集族的例子中,其中所有元素正好出现在 50% 的集合中。比如说,你可以用数字 1 到 10 组成所有不同的集合,总共会有 1024 个这样的集合。它们构成了一个并封闭集族,10 个元素中的每一个都出现在其中的 512 个集合。

在 Frankl 提出这个猜想的时候,还没有人提出过一个猜想不成立的并封闭集族的例子。所以 50% 似乎是正确的预测。

这并不意味着它很容易被证明。在 Gilmer 的工作之前,很多论文只能设法建立了随族中集合数量变化的阈值(而不是对所有大小的集合族都是相同的 50% 阈值)。

哥伦比亚大学的 Will Sawin 说:「感觉它应该很容易,而且它与很多容易的问题相似,但它一直未被攻克。」

缺乏进展既反映了这个问题的棘手性质,也反映了许多数学家宁愿不去想它。他们担心自己会浪费多年的职业生涯,去追逐一个不可能解决的问题。Gilmer 记得 2013 年的一天,他去 Saks 的办公室提到这个并封闭集猜想,这些也曾经与这个问题搏斗过的导师把他赶出了房间。

不确定性的洞察

在访问罗格斯大学之后,Gilmer 的脑海中滚动着这个问题,试图理解为什么它是如此困难。他用一个基本事实提示自己:如果你有一个由 100 个集组合组成的族,有 4950 种不同的方式来选择二者并将他们结合起来。然后他想:如果没有任何元素至少以某种频率出现在这些结合中,那么 4950 种不同的结合又怎么可能映射到 100 个集合呢?

在这一点上,他已经在通往破解的路上了,尽管他还不自知。

信息论在 20 世纪上半叶得到发展,其中最著名的是 Claude Shannon 1948 年的论文《通信的数学理论》。这篇论文提供了一种精确的方法来计算发送信息所需的信息量,基于围绕着信息表达内容的不确定性的大小。这种信息和不确定性之间的关联,正是香农的卓越见解。

信息论经常出现在组合学中,这是一个与计数对象有关的数学领域,这也是 Gilmer 在研究生时期研究的内容。但当他飞回加州的家中时,他还担心将信息论与并封闭集猜想联系起来的方式是一个业余者的天真见解。

「说实话,我有点惊讶之前没有人想到这个,」Gilmer 表示。「但也许我不应该感到惊讶,因为我自己也想了一年,而且我是懂信息论的。」

探索难题

Gilmer 对数学的钻研来源于自己对数学的热爱。他工作日主要忙于谷歌的日常工作,闲暇时间就潜心研究数学问题。上班时他也带着一本数学教科书,以便随时查找忘记的公式。Gilmer 脚踏实地,也仰望星空 —— 他喜欢看著名数学家 Tim Gowers 的博客,这会让他备受鼓舞。

Gilmer 谦虚地说道:「也许你认为解决数学难题的人不应该查阅《Elements of Information Theory(信息论基础)》第 2 章,但我查阅了。」

Gilmer 提出的方法是设想一个并封闭集族,其中任何元素在所有集合中出现的概率都小于 1%。这是一个反例,如果它真的存在,将证伪 Frankl 的猜想。

假设从这个族中随机选择两个集合 A 和 B,问:集合 A 包含数字 1 的概率是多少?集合 B 呢?由于每个元素出现在任何给定集合中的概率略低于 1%,因此不应期望 A 或 B 包含 1。这意味着如果两者实际都不包含 1,我们也不会感到惊讶,当然也不会获得什么信息。

接下来,考虑 A 和 B 的并集包含 1 的概率。这仍然不太可能,但比 1 出现在任何一个单独集合中的概率大一些,是 1 出现在 A 中的概率与 1 出现在 B 中的概率之和减去 1 同时出现在两者中的概率。所以 A 和 B 的并集包含 1 的概率约低于 2%。

这仍然很低,但更接近 50% 的猜想,这意味着需要更多信息才能共享结果。换句话说,如果存在一个并封闭集族,其中任何元素在所有集合中出现的概率都小于 1%,则两个集合的并集比任何一个集合本身包含的信息要多。

「逐个元素证明猜想的思路非常聪明」,普林斯顿大学的 Ryan Alweiss 评价道。

Gilmer 的工作开始接近 Frankl 的猜想。这是因为很容易证明:在并封闭集族中,两个集合的并集包含的信息必然少于两个集合本身 —— 而不是更多。

原因很简单,以包含 1024 个不同集合的并封闭集族为例,每个集合中元素是 1 到 10 的数字。如果随机选择其中两个集合,平均会得到包含五个元素的并集。(在这 1024 个集合中,有 252 个包含五个元素,这是最常见的集合大小。)也有可能我们会得到一个包含大约七个元素的并集。但是只有 120 种不同的组合方法能得到包含七个元素的并集。

关键是,两个随机选择的集合包含的元素比其并集具有更多的不确定性。并集更像是一个具备更多元素、可能性更少的更大集合。当你在一个并封闭集族中对两个集合进行并集操作时,你可能会知道合并结果,就像是抛出一个有偏重的硬币,你很容易猜到硬币落向哪面,并集包含的信息少于两个集合本身的信息。

基于此,Gilmer 认为至少要有一个元素在集合中出现的概率大于等于 1%。

失之东隅,收之桑榆

当 Gilmer 在 11 月 16 日发布他的证明时,他附上了一条说明 —— 他认为使用他的方法可能更接近完整猜想的证明,有可能将阈值提高到 38%。

五天后,三个不同的数学家团体在几个小时内相继发表了论文,他们在 Gilmer 的工作基础上做到了这一点。这场爆发似乎已经将 Gilmer 的方法发挥到了极致,不过要想达到 50%,可能需要更多的新想法。

不过,对于后续论文的一些作者来说,他们想知道为什么 Gilmer 不自己做完相对简单的达到 38% 的研究。事实上,原因并不复杂:在脱离数学超过 5 年之后,Gilmer 只是不知道如何进行技术分析工作来实现这一目标。

「我有点生疏,老实说,我被困住了,」Gilmer 说。「但我很想知道数学社区会把它带到哪里。」

但 Gilmer 也认为,使他失去实践机会的同一原因,在某种程度上也使他的证明首先成为了可能:「这是唯一的解释 —— 为什么我在研究生院想了一年这个问题毫无进展,离开数学六年之后再回到这个问题上却取得了突破。除了机器学习让我的想法产生变化之外,我不知道还有什么解释。」

本文来自网络,不代表趣头条立场,转载请注明出处:https://www.ngnnn.com/article/4_159514.html
上一篇腾讯首次对“全真互联网”全面解读,并发布《全真互联白皮书》
下一篇不需要烤机 Linux 6.1系统新功能来了:识别CPU何时损坏

为您推荐

谷歌推出文本到图像模型Muse:生成图片质量更高、推理时间更短

谷歌推出文本到图像模型Muse:生成图片质量更高、推理时间更短

作者 | 冬梅自 2021 年初以来,随着大量深度学习支持的文本到图像模型(例如 DALL-E-2、Stable Diffusion 和 Midjourney 等)的诞生,人工智能研究的进展发生了革命性的变化。近日,谷歌Muse AI 系统正式亮相。据谷歌 Muse AI 团队称,Muse 是一种文本到图像的 Transformer 模型,该模型可以实现先进的图像生成性能。我们提
盖茨盛赞ChatGPT:人工智能历史意义不亚于“PC或互联网诞生”

盖茨盛赞ChatGPT:人工智能历史意义不亚于“PC或互联网诞生”

腾讯科技讯 2月3日消息,微软联合创始人比尔·盖茨表示,像ChatGPT这样的AI聊天机器人将变得与个人电脑或互联网同样重要。盖茨今日接受采访时表示:“AI将成为2023年最热门的话题。这是不可避免的。”他随后补充道:“ChatGPT将变得与个人电脑、互联网同样重要。”盖茨在20世纪80年代帮助开创了个人电脑时代。在微软和苹果等
谷歌街景独立 App 将于 2023 年停止运营

谷歌街景独立 App 将于 2023 年停止运营

IT之家 11 月 2 日消息,安卓和 iOS 版谷歌街景 App 将于明年初停止运营,并将在未来几周从应用商店中删除。一位 Google 发言人证实,该应用将从 2023 年 3 月起停用。这是安卓和 iPhone 上的专用街景应用程序,允许用户使用谷歌公司的服务来获得世界各地的 360 度视图。需要注意的是,该功能不会从标准的谷歌地图应用中删
专访墨奇科技CEO邰骋:人工智能需要新的AI数据基础设施

专访墨奇科技CEO邰骋:人工智能需要新的AI数据基础设施

“人工智能要发展到下一代,必然需要基础理论和基础设施的革新,特别是需要新的 AI 数据基础设施。”9月2日,新京报贝壳财经记者获悉,在近日举办的HICOOL2022全球创业者峰会上,AI(人工智能)基础技术和平台墨奇科技的项目团队获得“HICOOL 2022 全球创业大赛一等奖”。墨奇科技联合创始人、CEO 邰骋接受了新京报贝壳财
人工智能大会将举办智慧体育高峰论坛,发布AI+体育蓝皮书

人工智能大会将举办智慧体育高峰论坛,发布AI+体育蓝皮书

2022年世界人工智能大会智慧体育高峰论坛将于9月2日开幕。  主办方供图AI+体育,将成为世界人工智能大会的全新命题和新亮点。2022年世界人工智能大会智慧体育高峰论坛将于9月2日开幕。论坛上将发布由上海人工智能研究院牵头,联合上海交通大学、上海体育学院、首都体育学院、同济大学等单位编制的国内首本《“AI+体育”蓝
大脑还有多少秘密?世界人工智能大会首开脑机接口主题论坛

大脑还有多少秘密?世界人工智能大会首开脑机接口主题论坛

在2022世界人工智能大会上,天桥脑科学研究院(简称TCCI)转化中心联合中国科学院上海微系统与信息技术研究所、脑虎科技、中国神经科学学会、上海市神经科学学会共同举办“脑·机智能融合-让大脑连接未来”论坛,这也是脑机接口首次以主题论坛的形式登陆世界人工智能大会。英国皇家工程院院士、上海交大医疗机器人研究院院
我国人工智能学科主要奠基人涂序彦逝世,享年 88 岁

我国人工智能学科主要奠基人涂序彦逝世,享年 88 岁

IT之家 3 月 28 日消息,据北京科技大学消息,我国人工智能领域著名科学家、人工智能学科的主要奠基人、中国人工智能学会的主要创始人之一、第二和第三届中国人工智能学会理事长、北京科技大学计算机与通信工程学院教授涂序彦先生,因病医治无效,于 2023 年 1 月 1 日 0 时 10 分在北京逝世,享年 88 岁。IT之家附讣告原文
苹果谷歌牵头制定追踪行业规范草案 防止功能遭滥用

苹果谷歌牵头制定追踪行业规范草案 防止功能遭滥用

【CNMO新闻】在2021年的春季发布会上,苹果推出了蓝牙追踪设备AirTag,该产品配合苹果设备的“查找”应用,可以追踪和查找重要物品。然而,也有用户发现这类设备可能会遭到滥用,例如将其放在他人不知情的地方,可以对个人进行跟踪。AirTag为了杜绝此类现象,苹果与谷歌宣布联合提交一份行业规范草案,帮助应对蓝牙定位追踪
梁建章:人工智能如何影响经济和各行各业

梁建章:人工智能如何影响经济和各行各业

近日人工智能再次成为了热门话题。很多人好奇的是,人工智能未来到底会如何影响经济、人口和创新?今天,我跟大家分享个人的一些看法——谈谈人工智能对于经济以及各行各业的影响。自从深度神经网络出现以来,人工智能的发展速度超乎想象。ChatGPT的出现是个奇迹,超出了几乎所有计算机科学家的预料。一个简单的神经网络模
劈柴哥预告Bard将迎重磅升级,谷歌“最强大脑”能否超车ChatGPT?

劈柴哥预告Bard将迎重磅升级,谷歌“最强大脑”能否超车ChatGPT?

财联社4月2日讯(编辑 赵昊)上周,美国科技巨头谷歌公司推出了聊天机器人“巴德”(Bard)的测试版本。由于用户使用体验远不如ChatGPT,Bard反响平平。当地时间周五(3月31日),谷歌首席执行官"劈柴哥"桑达尔·皮查伊(Sundar Pichai)在播客节目中表示,这种状况可能很快就会改变,因为Bard将在未来几天从目前基于的LaM
科技巨头欧洲裁员不易,谷歌亚马逊设法“吸引”员工离职

科技巨头欧洲裁员不易,谷歌亚马逊设法“吸引”员工离职

勒紧裤腰带“过冬”的美国科技巨头现在碰到新的难题,想在欧洲搞大裁员谈何容易,特别是要在国内劳动法对员工保护力度位居欧盟成员国前列的法国和德国,更是难上加难。在美国,企业宣布大裁员后就能在几个月内解雇数百甚至数千名员工,许多公司已经这样做。而在欧洲,媒体发现,科技企业的大裁员已经停滞,因为在一些欧洲国
AI炒股新纪元?头部量化私募幻方宣布全力探索人工智能应用

AI炒股新纪元?头部量化私募幻方宣布全力探索人工智能应用

头部量化私募幻方宣布成立新的独立的研究组织,探索AGI(即通用人工智能,Artificial General Intelligence)的本质。4月14日,幻方发布公告显示,幻方将集中资源和力量,全力投身到服务于全人类共同利益的人工智能之中,成立新的独立的研究组织,探索AGI的本质,“我们将充分而持续地投入,不做中庸的事,用最长期的眼光去
谷歌Stadia发布新试玩系统:玩家解锁特定成就完成试玩

谷歌Stadia发布新试玩系统:玩家解锁特定成就完成试玩

【CNMO新闻】游戏试玩我们都曾有所接触,在过去游戏试玩版本通常是开发者在游戏上市之前发布的一个涵盖游戏部分内容的封包进行上传后,有意试玩的玩家进行下载测试,这样的方式已经延续了很久,其弊端就是玩家需要在游戏正式发布后在单独下载新的游戏包体,增加了重复下载的困扰。也有一些开发者选择游戏整包作为测试版本上
史上AI最高分!谷歌大模型创美国医师执照试题新纪录

史上AI最高分!谷歌大模型创美国医师执照试题新纪录

杨净 羿阁 发自 凹非寺量子位 | 公众号 QbitAI史上AI最高分,谷歌新模型刚刚通过美国医师执照试题验证!而且在科学常识、理解、检索和推理能力等任务中,直接与人类医生水平相匹敌。在一些临床问答表现中,最高超原SOTA模型17%以上。此进展一出,瞬间引爆学界热议,不少业内人士感叹:终于,它来了。广大网友在看完Med-PaL
谷歌计划打造全新搜索引擎应对必应等竞争 推AI功能升级现有引擎

谷歌计划打造全新搜索引擎应对必应等竞争 推AI功能升级现有引擎

【美媒:谷歌计划打造全新搜索引擎应对必应等竞争 将推出AI功能升级现有引擎】财联社4月17日电,据纽约时报消息,新必应等AI竞争者正成为25年来谷歌搜索业务的“最严重威胁”,作为回应,谷歌据悉正寻求打造一款由AI技术驱动的全新搜索引擎。查阅的内部文件显示,谷歌还在用AI功能升级现有引擎。据悉,谷歌正测试项目名为“
卷完模型卷芯片!为提升效率,微软准备推出专属人工智能芯片

卷完模型卷芯片!为提升效率,微软准备推出专属人工智能芯片

在早期成功押注ChatGPT的研发公司OpenAI之后,市场发现,微软在其武器库中还拥有另一个秘密武器:自研人工智能芯片,这一芯片将为生成式AI背后的大型语言模型提供强大动力。4月18日周二,据媒体援引两位知情人士的话说,微软早在2019年就开始开发内部代号为Athena的AI芯片。其中一位知情人士称,一些微软和OpenAI的员工已经
真正的应用级量子人工智能距离我们还有多远?

真正的应用级量子人工智能距离我们还有多远?

·“量子科技是强国竞争的战略制高点,但不能一哄而上,低水平重复内卷,或片面追求发论文、抢专利,各自为战,闭门造车,而缺少真正的技术投入和系统配合。”·“当下量子系统的规模非常重要,而这很大程度上取决于芯片。”当前,发展量子计算和人工智能已成为世界各国的重要战略,两者交汇而生的量子人工智能更是发展迅速
消息称谷歌正测试一款类似ChatGPT的聊天机器人

消息称谷歌正测试一款类似ChatGPT的聊天机器人

鞭牛士 2月2日消息,据外媒报道,据知情人士表示,谷歌正在测试新的人工智能驱动的聊天产品,可能会影响未来公共产品的发布。这些产品包括一个新的聊天机器人,以及一种将其整合到搜索引擎的潜在方式。
负责人离职,谷歌AR似乎是要复刻Android模式

负责人离职,谷歌AR似乎是要复刻Android模式

2022年年末ChatGPT的横空出世,让人工智能再次踏上了风口浪尖,甚至一众科技巨头也纷纷为之“倾倒”,仿佛错过它就错失了通往未来的船票。特别是在微软方面将ChatGPT与Bing搜索引擎结合、以挑战谷歌搜索之时,谷歌很快就成为了这些巨头中反应最激烈的一个,但与ChatGPT针锋相对的产品Bard,出道即遭遇了翻车。然而强如谷歌
返回顶部