AK
Size: a a a
AK
ИК
AK
R
R
N
AK
VI
ПФ
VI
ПФ
VI
PK
PK
VI
VI
SI

SI
HashAggregate — одну перед exchange, другую послеVI
SI
(df.repartition("product_id")
.sortWithinPartitions("product_id", "effective_ts")
.write …
df.rdd.repartitionAndSortWithinPartitions где Spark обходится без этого?