发帖

楼主: 论文库

790 0

以LDA为例的大规模分布式机器学习系统分析 [推广有奖]

0关注
13粉丝

会员

学术权威

74%

还不是VIP/贵宾

-

0%

威望: 0 级
论坛币: 5 个
通用积分: 0.0363
学术水平: 0 点
热心指数: 0 点
信用等级: 0 点
经验: 38440 点
帖子: 3839
精华: 0
在线时间: 836 小时
注册时间: 2017-9-5
最后登录: 2018-4-9

楼主

论文库

发表于 2017-9-29 01:40:01 |AI写论文

是否 +2 论坛币

k人参与回答

经管之家送您一份

应届毕业生专属福利!

求职就业群

赵安豆老师微信：zhaoandou666

经管之家联合CDA

送您一个全额奖学金名额~ !

立即领取

感谢您参与论坛问题回答

经管之家送您两个论坛币！

+2 论坛币

摘要：针对构建大规模机器学习系统在可扩展性、算法收敛性能、运行效率等方面面临的问题,分析了大规模样本、模型和网络通信给机器学习系统带来的挑战和现有系统的应对方案.以隐含狄利克雷分布(LDA)模型为例,通过对比三款开源分布式LDA系统-Spark LDA、PLDA+和LightLDA,在系统资源消耗、算法收敛性能和可扩展性等方面的表现,分析各系统在设计、实现和性能上的差异.实验结果表明:面对小规模的样本集和模型,LightLDA与PLDA+的内存使用量约为Spark LDA的一半,系统收敛速度为Spark LDA的4至5倍;面对较大规模的样本集和模型,LightLDA的网络通信总量与系统收敛时间远小于PLDA+与SparkLDA,展现出良好的可扩展性.“数据并行+模型并行”的体系结构能有效应对大规模样本和模型的挑战;参数弱同步策略(SSP)、模型本地缓存机制和参数稀疏存储能有效降低网络开销,提升系统运行效率.

原文链接:http://d.wanfangdata.com.cn/Periodical/jsjyy201703003

送人玫瑰，手留余香~如您已下载到该资源，可在回帖当中上传与大家共享，欢迎来CDA社区交流学习。（仅供学术交流用。）

扫码加我拉你入群

请注明：姓名-公司-职位

以便审核进群资格，未注明则拒绝

分享0 收藏0 回帖

关键词：机器学习学习系统系统分析大规模 LDA 隐含狄利克雷分布主题模型文本聚类吉布斯采样变分贝叶斯推理

以LDA为例的大规模分布式机器学习系统分析 [推广有奖]

经管之家送您一份

经管之家联合CDA

感谢您参与论坛问题回答

扫码加我拉你入群

相关帖子

浏览过的帖子

浏览过的版块

本版微信群

以LDA为例的大规模分布式机器学习系统分析 [推广有奖]

经管之家送您一份

经管之家联合CDA

感谢您参与论坛问题回答

扫码加我 拉你入群

相关帖子

浏览过的帖子

浏览过的版块

本版微信群

扫码加我拉你入群