wForget commented on PR #12514: URL: https://github.com/apache/gluten/pull/12514#issuecomment-4978734397
Successfully reproduced this issue, https://github.com/apache/gluten/actions/runs/29396675906/job/87292215408?pr=12514 ``` 2026-07-15T08:05:01.9825974Z - Gluten - GLUTEN-12474: preserve ordering for dynamic partition writes *** FAILED *** 2026-07-15T08:05:01.9827943Z org.apache.spark.SparkException: Job aborted due to stage failure: Task 0 in stage 64.0 failed 1 times, most recent failure: Lost task 0.0 in stage 64.0 (TID 82) (705c9412ef57 executor driver): org.apache.spark.SparkException: [TASK_WRITE_FAILED] Task failed while writing rows to file:/__w/gluten/gluten/gluten-ut/spark35/target/scala-2.13/test-classes/unit-tests-working-home/spark-warehouse/gluten_12474_tgt/.spark-staging-2f3d085e-dac8-4ee5-92b7-b06bc0b10194. 2026-07-15T08:05:01.9830247Z at org.apache.spark.sql.errors.QueryExecutionErrors$.taskFailedWhileWritingRowsError(QueryExecutionErrors.scala:775) 2026-07-15T08:05:01.9831086Z at org.apache.spark.sql.execution.datasources.FileFormatWriter$.executeTask(FileFormatWriter.scala:420) 2026-07-15T08:05:01.9831899Z at org.apache.spark.sql.execution.datasources.WriteFilesExec.$anonfun$doExecuteWrite$1(WriteFiles.scala:100) 2026-07-15T08:05:01.9832558Z at org.apache.spark.rdd.RDD.$anonfun$mapPartitionsInternal$2(RDD.scala:893) 2026-07-15T08:05:01.9833090Z at org.apache.spark.rdd.RDD.$anonfun$mapPartitionsInternal$2$adapted(RDD.scala:893) 2026-07-15T08:05:01.9833638Z at org.apache.spark.rdd.MapPartitionsRDD.compute(MapPartitionsRDD.scala:52) 2026-07-15T08:05:01.9834137Z at org.apache.spark.rdd.RDD.computeOrReadCheckpoint(RDD.scala:367) 2026-07-15T08:05:01.9834561Z at org.apache.spark.rdd.RDD.iterator(RDD.scala:331) 2026-07-15T08:05:01.9834982Z at org.apache.spark.scheduler.ResultTask.runTask(ResultTask.scala:93) 2026-07-15T08:05:01.9835494Z at org.apache.spark.TaskContext.runTaskWithListeners(TaskContext.scala:166) 2026-07-15T08:05:01.9835965Z at org.apache.spark.scheduler.Task.run(Task.scala:141) 2026-07-15T08:05:01.9836424Z at org.apache.spark.executor.Executor$TaskRunner.$anonfun$run$4(Executor.scala:620) 2026-07-15T08:05:01.9837231Z at org.apache.spark.util.SparkErrorUtils.tryWithSafeFinally(SparkErrorUtils.scala:64) 2026-07-15T08:05:01.9837858Z at org.apache.spark.util.SparkErrorUtils.tryWithSafeFinally$(SparkErrorUtils.scala:61) 2026-07-15T08:05:01.9838472Z at org.apache.spark.util.Utils$.tryWithSafeFinally(Utils.scala:94) 2026-07-15T08:05:01.9838952Z at org.apache.spark.executor.Executor$TaskRunner.run(Executor.scala:623) 2026-07-15T08:05:01.9839993Z at java.base/java.util.concurrent.ThreadPoolExecutor.runWorker(ThreadPoolExecutor.java:1136) 2026-07-15T08:05:01.9840686Z at java.base/java.util.concurrent.ThreadPoolExecutor$Worker.run(ThreadPoolExecutor.java:635) 2026-07-15T08:05:01.9841178Z at java.base/java.lang.Thread.run(Thread.java:833) 2026-07-15T08:05:01.9842856Z Caused by: org.apache.hadoop.fs.FileAlreadyExistsException: File already exists: file:/__w/gluten/gluten/gluten-ut/spark35/target/scala-2.13/test-classes/unit-tests-working-home/spark-warehouse/gluten_12474_tgt/.spark-staging-2f3d085e-dac8-4ee5-92b7-b06bc0b10194/_temporary/0/_temporary/attempt_202607150105011536507608415885554_0064_m_000000_82/day=2026-06-01/part-00000-2f3d085e-dac8-4ee5-92b7-b06bc0b10194.c000.snappy.orc 2026-07-15T08:05:01.9844817Z at org.apache.hadoop.fs.RawLocalFileSystem.create(RawLocalFileSystem.java:421) 2026-07-15T08:05:01.9845372Z at org.apache.hadoop.fs.RawLocalFileSystem.create(RawLocalFileSystem.java:459) 2026-07-15T08:05:01.9846018Z at org.apache.hadoop.fs.ChecksumFileSystem$ChecksumFSOutputSummer.<init>(ChecksumFileSystem.java:433) 2026-07-15T08:05:01.9846650Z at org.apache.hadoop.fs.ChecksumFileSystem.create(ChecksumFileSystem.java:521) 2026-07-15T08:05:01.9847179Z at org.apache.hadoop.fs.ChecksumFileSystem.create(ChecksumFileSystem.java:500) 2026-07-15T08:05:01.9847670Z at org.apache.hadoop.fs.FileSystem.create(FileSystem.java:1195) 2026-07-15T08:05:01.9848100Z at org.apache.hadoop.fs.FileSystem.create(FileSystem.java:1175) 2026-07-15T08:05:01.9848567Z at org.apache.orc.impl.PhysicalFsWriter.<init>(PhysicalFsWriter.java:94) 2026-07-15T08:05:01.9849202Z at org.apache.orc.impl.WriterImpl.<init>(WriterImpl.java:230) 2026-07-15T08:05:01.9849796Z at org.apache.orc.OrcFile.createWriter(OrcFile.java:1040) 2026-07-15T08:05:01.9850358Z at org.apache.spark.sql.execution.datasources.orc.OrcOutputWriter.<init>(OrcOutputWriter.scala:49) 2026-07-15T08:05:01.9851115Z at org.apache.spark.sql.execution.datasources.orc.OrcFileFormat$$anon$1.newInstance(OrcFileFormat.scala:89) 2026-07-15T08:05:01.9852012Z at org.apache.spark.sql.execution.datasources.BaseDynamicPartitionDataWriter.renewCurrentWriter(FileFormatDataWriter.scala:298) 2026-07-15T08:05:01.9852980Z at org.apache.spark.sql.execution.datasources.DynamicPartitionDataSingleWriter.write(FileFormatDataWriter.scala:365) 2026-07-15T08:05:01.9853873Z at org.apache.spark.sql.execution.datasources.FileFormatDataWriter.writeWithMetrics(FileFormatDataWriter.scala:85) 2026-07-15T08:05:01.9855256Z at org.apache.spark.sql.execution.datasources.FileFormatDataWriter.writeWithIterator(FileFormatDataWriter.scala:92) 2026-07-15T08:05:01.9856136Z at org.apache.spark.sql.execution.datasources.FileFormatWriter$.$anonfun$executeTask$1(FileFormatWriter.scala:403) 2026-07-15T08:05:01.9856886Z at org.apache.spark.util.Utils$.tryWithSafeFinallyAndFailureCallbacks(Utils.scala:1397) 2026-07-15T08:05:01.9857571Z at org.apache.spark.sql.execution.datasources.FileFormatWriter$.executeTask(FileFormatWriter.scala:410) 2026-07-15T08:05:01.9858070Z ... 17 more ``` -- This is an automated message from the Apache Git Service. To respond to the message, please log on to GitHub and use the URL above to go to the specific comment. To unsubscribe, e-mail: [email protected] For queries about this service, please contact Infrastructure at: [email protected] --------------------------------------------------------------------- To unsubscribe, e-mail: [email protected] For additional commands, e-mail: [email protected]
