subject:"How do we control output part files created by Spark job\?"

Re: How do we control output part files created by Spark job?

2015-07-11 Thread Umesh Kacha

no of small files. Please guide I am new to Spark. Thanks in advance. -- View this message in context: http://apache-spark-user-list.1001560.n3.nabble.com/How-do-we-control-output-part-files-created-by-Spark-job-tp23649.html Sent from the Apache Spark User List mailing list archive at Nabble.com

Re: How do we control output part files created by Spark job?

2015-07-11 Thread Srikanth

in advance. -- View this message in context: http://apache-spark-user-list.1001560.n3.nabble.com/How-do-we-control-output-part-files-created-by-Spark-job-tp23649.html Sent from the Apache Spark User List mailing list archive at Nabble.com

Re: How do we control output part files created by Spark job?

2015-07-10 Thread Srikanth

we have large no of small files. Please guide I am new to Spark. Thanks in advance. -- View this message in context: http://apache-spark-user-list.1001560.n3.nabble.com/How-do-we-control-output-part-files-created-by-Spark-job-tp23649.html Sent from the Apache Spark User List mailing list

Re: How do we control output part files created by Spark job?

2015-07-07 Thread Umesh Kacha

this message in context: http://apache-spark-user-list.1001560.n3.nabble.com/How-do-we-control-output-part-files-created-by-Spark-job-tp23649.html Sent from the Apache Spark User List mailing list archive at Nabble.com

Re: How do we control output part files created by Spark job?

2015-07-07 Thread Gylfi

Hi. I am just wondering if the rdd was actually modified. Did you test it by printing rdd.partitions.length before and after? Regards, Gylfi. -- View this message in context: http://apache-spark-user-list.1001560.n3.nabble.com/How-do-we-control-output-part-files-created-by-Spark-job

Re: How do we control output part files created by Spark job?

2015-07-07 Thread ponkin

.nabble.com/How-do-we-control-output-part-files-created-by-Spark-job-tp23649p23706.html Sent from the Apache Spark User List mailing list archive at Nabble.com. - To unsubscribe, e-mail: user-unsubscr...@spark.apache.org

Re: How do we control output part files created by Spark job?

2015-07-07 Thread Srikanth

.1001560.n3.nabble.com/How-do-we-control-output-part-files-created-by-Spark-job-tp23649.html Sent from the Apache Spark User List mailing list archive at Nabble.com. - To unsubscribe, e-mail: user-unsubscr...@spark.apache.org

Re: How do we control output part files created by Spark job?

2015-07-07 Thread Umesh Kacha

.nabble.com/How-do-we-control-output-part-files-created-by-Spark-job-tp23649.html Sent from the Apache Spark User List mailing list archive at Nabble.com. - To unsubscribe, e-mail: user-unsubscr...@spark.apache.org For additional

How do we control output part files created by Spark job?

2015-07-06 Thread kachau

these parquet/orc directory and I heard Hive is slow when we have large no of small files. Please guide I am new to Spark. Thanks in advance. -- View this message in context: http://apache-spark-user-list.1001560.n3.nabble.com/How-do-we-control-output-part-files-created-by-Spark-job-tp23649.html

Re: How do we control output part files created by Spark job?

2015-07-06 Thread Sathish Kumaran Vairavelu

in context: http://apache-spark-user-list.1001560.n3.nabble.com/How-do-we-control-output-part-files-created-by-Spark-job-tp23649.html Sent from the Apache Spark User List mailing list archive at Nabble.com. - To unsubscribe, e-mail

RE: How do we control output part files created by Spark job?

2015-07-06 Thread Mohammed Guller

Subject: How do we control output part files created by Spark job? Hi I am having couple of Spark jobs which processes thousands of files every day. File size may very from MBs to GBs. After finishing job I usually save using the following code finalJavaRDD.saveAsParquetFile(/path/in/hdfs

Re: How do we control output part files created by Spark job?

2015-07-06 Thread Gylfi

-list.1001560.n3.nabble.com/How-do-we-control-output-part-files-created-by-Spark-job-tp23649p23660.html Sent from the Apache Spark User List mailing list archive at Nabble.com. - To unsubscribe, e-mail: user-unsubscr

Re: How do we control output part files created by Spark job?

Re: How do we control output part files created by Spark job?

Re: How do we control output part files created by Spark job?

Re: How do we control output part files created by Spark job?

Re: How do we control output part files created by Spark job?

Re: How do we control output part files created by Spark job?

Re: How do we control output part files created by Spark job?

Re: How do we control output part files created by Spark job?

How do we control output part files created by Spark job?

Re: How do we control output part files created by Spark job?

RE: How do we control output part files created by Spark job?

Re: How do we control output part files created by Spark job?

12 matches

Site Navigation

Mail list logo

Footer information