V2EX = way to explore
V2EX 是一个关于分享和探索的地方
Sign Up Now
For Existing Member  Sign In
V2EX  ›  anonymoustian  ›  全部回复第 4 页 / 共 6 页
回复总数  111
1  2  3  4  5  6  
@luojing 谢谢 能详细说一下吗
@hqfzone 不知道。。。 只知道加一个!important 再覆盖回去
2016 年 5 月 2 日
回复了 anonymoustian 创建的主题 CSS wordpress(或者说 bootstrap 和 css) 如何自定义字体?
@Shura 能具体说一下吗
2016 年 4 月 27 日
回复了 anonymoustian 创建的主题 Hadoop Hive 可以知道数据有多大吗?
@firstway 是这样的, 要给客户做系统性能的汇报~
2016 年 4 月 26 日
回复了 anonymoustian 创建的主题 程序员 域名是如何做到多级的?
@sarices 这样解析了以后,那么 QQ 空间怎么知道是谁的空间呢?
@knightdf 什么是 slave ?
@Lonely 谢谢!
@LossLess 谢谢!
@Showfom 谢谢 请问这个可以下载吗?
@heliumhgy 好的谢谢 我试试
@Galileo 好的 谢谢您
@Galileo 谢谢,但是我能问您一个问题吗? 我单机内存是 32G 的话,如果在 spark 上读入 200G 的数据 到内存 (比如说 是一个 List ) 会出现什么情况呢? 这个 List 是不是因为只能存 32G 然后报错呢? 谢谢 我想问问这个。。。。 我明白 SPark 存储的分布式 和计算分布式
@liuzhster 是这样的,但是请问如果数据有 200G 的话,全部读入 List, 这个 list 的内存 是不是单机占用的内存? 而不是集群全部的内存? 您说的 内存够的意思是不是 单机内存够的意思??

所以我现在也在思考 对待数据时候 用 spark 的优势以及优点在哪里,也希望能指导一下。

另外如果内存不够的话, 18 亿条数据, 我每次用 Spark SQL limit 出来 几十万条,是不是也可以做,我现在就是这些概念搞得很糊涂,希望能指一条明路,谢谢!
@Galileo 那请问我有 200G 的数据,把这 200G 的数据全部读入到 List 中,和用 RDD 处理有什么区别吗?
这个 List 读进来是 怎么存储的呢? 是不是一个单机的内存?
我的意思就是说, java RDD 处理的数据, 直接按行读入 放入 List 然后对 List 操作不也一样吗? 貌似 RDD 更慢些, 大家能详细说一下吗
@liprais spark 的 conf 下面在哪里?
@liprais 对不起,这个我知道,但是前期的配置工作和后期的读写您能方便 给个例子吗? 我现在对读入 hive 里的数据 输出出来一无所知,我还是有点不懂 /。

谢谢了
@liprais 能再详细点吗,看了 spark 的文档,就一两句话。。
谢谢大家 我去尝试一下
2016 年 3 月 7 日
回复了 anonymoustian 创建的主题 Java Intellij IDEA 14 使用 maven 打包时如何选择主类?
@wucao219101 请问这个 maven-assembly-plugin 插件我怎么没有找到? 在 Intellij IDEA 里面没有看到, 怎么解决?
1  2  3  4  5  6  
About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   957 Online   Highest 6679   ·     Select Language
创意工作者们的社区
World is powered by solitude
VERSION: 3.9.8.5 · 22ms · UTC 19:26 · PVG 03:26 · LAX 12:26 · JFK 15:26
♥ Do have faith in what you're doing.