前言
上一篇我们讲述了人工智能,机器学习与联邦学习的关系。
这篇我们将继续探索联邦学习方法的分类。联邦学习方法被分为横向联邦学习、纵向联邦学习和迁移联邦学习三类,适用于解决不同的实际问题。
横向联邦学习
在两个数据集的用户特征重叠较多而用户重叠较少的情况下,把数据集按照用户维度切分,并取出双方用户特征相同而用户不完全相同的那部分数据进行训练。这种方法叫做横向联邦学习。
▲?应用场景
欧科云链集团正式启动区块链科普行动“星途计划”:欧科云链集团于4月26日,正式宣布启动了区块链科普行动——“星途计划”,行动包括将在全国范围展开系列沙龙,加大力度推进区块链科普进机关、进国企、进校园等,联合政府部门、行业协会等共同构建起更加完善和有效的区块链科普教育生态,与此同时,直击区块链科普现存痛点,推出简单易懂的“秒懂区块链”公益短视频课。
该计划旨在全维度推动社会建立对产业更清晰的认知,与“鲲鹏计划”一道助力数字经济及区块链产业本身健康发展夯实“人才”和“产业认知”两大基础。[2021/4/26 20:59:37]
横向联邦学习的本质是样本的联合,适用于参与者间业态相同但触达客户不同,即特征重叠多,用户重叠少时的场景,比如不同地区的银行间,他们的业务相似,但用户不同。
比如,有两家不同地区银行?—?上海与杭州两地的两家银行,它们的用户群体分别来自上海与杭州的居住人口,用户的交集相对较小。由于银行间的业务相似,记录的用户特征大概率是相同的。因此,横向联邦学习可以被考虑用来构建联合模型。
TRON数字钱包科普资料《波场钱包的现在过去与未来》已上线:据最新消息显示,由TokenPocket联合波场TRON官方,以及 TokenPocket 社区志愿者共同撰写的《波场钱包的现在过去与未来》已正式上线。《波场钱包的现在过去与未来》又称为波场钱包小白书,详细介绍了当前TRON钱包与TRON生态密切结合的实例,是目前市面上最为详细的TRON数字钱包科普资料。波场钱包作为波场公链生态中极为重要的入口,是波场生态的重要构成要素。波场钱包从一开始只提供权限管理、转账收款、节点投票等基础功能,到如今不仅可以为用户提供法币交易、闪兑和去中心化交易所等方便快捷的交易服务,还能让用户直接在钱包上体验波场上DApp,挖矿、DeFi、Staking等资产增值服务。详情见原文链接。[2020/8/20]
于2017年,Google提出了一个针对安卓手机模型更新的数据联合建模方案:在单个用户使用安卓手机时,不断在本地更新模型参数并将参数上传到安卓云上,从而使特征维度相同的各数据拥有方建立联合模型的一种联邦学习方案。
声音 | CNBC主持人:加密货币最大的缺点之一就是难以向外行快速科普:CNBC主持人Ran NeuNer近期发推称,加密货币最大的缺点之一就是很难向外行快速解释。当人们要求我向他们解释比特币时,我知道他们至少需要一个小时才能真正理解。[2019/9/10]
▲?学习过程
Step1.参与方各自从协调方上下载最新模型;
Step2.每个参与方利用本地数据训练模型,加密梯度上传给协调方,协调方聚合各用户的梯度以更新模型参数;
中科院自动化研究所将面向大中小学生开展区块链等主题的科普讲座:5月21日,新华网讯,今年,中国科学院自动化研究所将举办第十四届“自动化之光”公众科学开放日活动。届时,自动化所将面向大中小学生分别开展《脑与智能》、《区块链技术与平行智能》、《大数据时代的视觉智能》、《动画真奇妙》等4个主题报告,用实例和生动的演示深入浅出地为大家揭示智能技术的原理和奥妙。[2018/5/21]
Step3.协调方返回更新后的模型给各参与方;
Step4.各参与方更新各自模型。
纵向联邦学习
在两个数据集的用户重叠较多而用户特征重叠较少的情况下,把数据集按照特征维度切分,并取出双方用户相同而用户特征不完全相同的那部分数据进行训练。这种方法叫做纵向联邦学习。
财政部副部长朱光耀:数字经济还处在发展的过程中,要以科普、推动的态度来推进数字经济发展:今日,在中国发展高层论坛2018年会上,财政部副部长朱光耀表示:“数字经济还处在发展的过程中,要以科普、推动的态度来推进数字经济发展。也要关注数字经济的其他影响,包括税收征管、反监管措施等要跟上。”[2018/3/25]
▲?适用场景
纵向联邦学习的本质是特征的联合,适用于用户重叠多,特征重叠少的场景,比如同一地区的商超和银行,他们触达的用户都为该地区的居民,但业务不同。
比如,有两个不同机构,一家是某地的银行,另一家是同一个地方的电商。它们的用户群体很有可能包含该地的大部分居民,用户的交集可能较大。由于银行记录的都是用户的收支行为与信用评级,而电商则保有用户的浏览与购买历史,因此它们的用户特征交集较小。纵向联邦学习就是将这些不同特征在加密的状态下加以聚合,以增强模型能力的联邦学习。
▲?学习过程
介绍一种简单通用的纵向联邦学习的建模学习过程,加密方式也以半同态加密的PallierEncryption为主。
训练前:
先采用加密文本对齐的技术手段,在系统内筛选出不同企业之间的共同用户。
训练时:
Step1.协调方C向企业A与B发送公钥,用来加密所需传输的数据;
Step2.A和B分别计算和自己相关特征的中间结果,并加密完后进行交互,用来求解各自的梯度结果和损失结果;
Step3.A和B分别计算各自加密后的梯度并添加掩码后发送给C,同时B计算加密后的损失先发送给C;
Step4.C解密梯度和损失后回传给A和B,A、B去除掩码并更新模型。
迁移联邦学习
在两个数据集的用户与用户特征重叠都较少的情况下,不对数据进行切分,而可以利用迁移学习来克服数据或标签不足的情况。这种方法叫做联邦迁移学习。
▲?适用场景
当参与者间特征和样本重叠都很少时可以考虑使用联邦迁移学习,如不同地区的银行和商超间的联合。主要适用于以深度神经网络为基模型的场景。
迁移学习的核心是,找到源领域和目标领域之间的相似性。举一个杨强教授经常举的例子来说明:我们都知道在开车时,驾驶员坐在左边,靠马路右侧行驶。这是基本的规则。然而,如果在英国、香港等地区开车,驾驶员是坐在右边,需要靠马路左侧行驶。那么,如果我们从到了香港,应该如何快速地适应他们的开车方式呢?诀窍就是找到这里的不变量:不论在哪个地区,驾驶员都是紧靠马路中间。这就是我们这个开车问题中的不变量。找到相似性?(不变量),是进行迁移学习的核心。
比如有两个不同机构,一家是位于中国的银行,另一家是位于美国的电商。由于受到地域限制,这两家机构的用户群体交集很小。同时,由于机构类型的不同,二者的数据特征也只有小部分重合。在这种情况下,要想进行有效的联邦学习,就必须引入迁移学习,来解决单边数据规模小和标签样本少的问题,从而提升模型的效果。
▲?学习过程
联邦迁移学习的步骤与纵向联邦学习相似,只是中间传递结果不同。
以上是常见的几种联邦学习类型,联邦学习这件“小事”能用在什么场景中,带来怎样的价值,会在下一篇文章中详细介绍。也欢迎各位与我们一起对以上三种类型的联邦学习进行更深一步的讨论,添加小助手加入技术交流群。
作者简介
严杨
来自数据网格实验室BitXMesh团队?PirvAIの修道者
据Newsbitcoin7月6日消息,据DappRadar数据显示,Pokemon风格的战斗类NFT游戏AxieInfinity目前是最大的NFT市场,上周交易用户达5万.
1900/1/1 0:00:00NFT市场分析师PlungeFather今发推特称在过去24小时里,一个名为“CoolCats”的销售额正在快速上升,超越NBATopShot.
1900/1/1 0:00:00来源:知道创宇区块链安全实验室作者:创宇区块链实验室北京时间2021年7月12日凌晨1点,Anyswap官方发推声称Anyswap多链路由v3版本遭到攻击,V3跨链资金池受影响.
1900/1/1 0:00:00据Forkast消息,近日美国地方法官SarahNetburn拒绝了SEC要求提供有关Ripple近期XRP的交易信息,但部分批准了SEC关于额外取证的请求.
1900/1/1 0:00:00巴比特讯,7月9日,ETCCooperative发推宣布Cardano创始人及IOHK首席执行官CharlesHoskinson重新成为其董事会新成员,并表示其一直是ETC的支持者.
1900/1/1 0:00:00据Ambcrypto6月27日消息,IOHK技术经理KevinHammond?表示,Cardano将于下周从Alonzoblue过渡到AlonzoWhite.
1900/1/1 0:00:00