я тебе сразу сказал что не надо было паралелить риды дфов, ты мог забесплатно параллельности добиться на экзеках просто отправив на каждый мету какую часть читать; более того ты в дальнейшем будешь знать где что лежит и даже любой шафл в дальнейшем сможешь минимизировать
метку то отправить то можно, по сути у меня есть сейчас List[Sql] и можно его в RDD кастануть, выполнить все на экзекьюторах, но потом все равно этот большой датафрейм нужно получить, чтобы у него была какая-то схема и можно было сделать какую-то следущую операцию