[SPARK-3604] unbounded recursion in getNumPartitions triggers stack overflow for large UnionRDD - ASF JIRA

XML

Word

Printable

JSON

Details

Type: Bug
Status: Resolved
Priority: Critical
Resolution: Not A Problem
Affects Version/s: 1.1.0
Fix Version/s: None
Component/s: Spark Core
Labels:
None
Environment:

linux. Used python, but error is in Scala land.

Target Version/s:

1.2.0

Description

I have a large number of parquet files all with the same schema and attempted to make a UnionRDD out of them.

When I call getNumPartitions(), I get a stack overflow error

that looks like this:

Py4JJavaError: An error occurred while calling o3275.partitions.
: java.lang.StackOverflowError
at scala.collection.TraversableLike$class.builder$1(TraversableLike.scala:239)
at scala.collection.TraversableLike$class.map(TraversableLike.scala:243)
at scala.collection.AbstractTraversable.map(Traversable.scala:105)
at org.apache.spark.rdd.UnionRDD.getPartitions(UnionRDD.scala:65)
at org.apache.spark.rdd.RDD$$anonfun$partitions$2.apply(RDD.scala:204)
at org.apache.spark.rdd.RDD$$anonfun$partitions$2.apply(RDD.scala:202)
at scala.Option.getOrElse(Option.scala:120)
at org.apache.spark.rdd.RDD.partitions(RDD.scala:202)
at org.apache.spark.rdd.UnionRDD$$anonfun$1.apply(UnionRDD.scala:65)
at org.apache.spark.rdd.UnionRDD$$anonfun$1.apply(UnionRDD.scala:65)
at scala.collection.TraversableLike$$anonfun$map$1.apply(TraversableLike.scala:244)
at scala.collection.TraversableLike$$anonfun$map$1.apply(TraversableLike.scala:244)
at scala.collection.IndexedSeqOptimized$class.foreach(IndexedSeqOptimized.scala:33)
at scala.collection.mutable.WrappedArray.foreach(WrappedArray.scala:34)
at scala.collection.TraversableLike$class.map(TraversableLike.scala:244)
at scala.collection.AbstractTraversable.map(Traversable.scala:105)
at org.apache.spark.rdd.UnionRDD.getPartitions(UnionRDD.scala:65)
at org.apache.spark.rdd.RDD$$anonfun$partitions$2.apply(RDD.scala:204)
at org.apache.spark.rdd.RDD$$anonfun$partitions$2.apply(RDD.scala:202)

Attachments

Issue Links

links to

[Github] Pull Request #2463 (harishreedharan)

Activity

People

Assignee:: Unassigned

Reporter:: Eric Friedman

Votes:: 0 Vote for this issue

Watchers:: 6 Start watching this issue

Dates

Created:: 19/Sep/14 15:09

Updated:: 25/Sep/14 00:11

Resolved:: 25/Sep/14 00:11