Size: a a a

2021 December 03

ЕГ

Евгений Глотов... in Data Engineers
В смысле последнее😐
источник

ЕГ

Евгений Глотов... in Data Engineers
Обязательное решение
источник

ЕГ

Евгений Глотов... in Data Engineers
На кластере из 30 человек
источник

S

Stanislav in Data Engineers
Зависит от подготовленности этих людей и количества данных. Если питон на начальном уровне, то конечно все склеит ласты
источник

AB

Anatoly B in Data Engineers
а так всё и есть.
источник

ЕГ

Евгений Глотов... in Data Engineers
Да на начальном даже не знают, как нормально проц забить😆
источник

S

Stanislav in Data Engineers
зато по мануалам знают, как взять датасет гигабайт в дцать, потом второй, и потом поджойнить в пандасе
источник

S

Stanislav in Data Engineers
но если цепелин еще не крутили, там и так общий на всех интерпретатор и все 35 человек будут ждать своей очереди на запуск :)
источник

AG

Arsen Gumin in Data Engineers
Spark на одной машине эффективней pandas?
источник

AG

Arsen Gumin in Data Engineers
16 ram 8 cpu
источник

D

Dmitry Nechaev in Data Engineers
источник

t

tsla in Data Engineers
лол
источник

AG

Arsen Gumin in Data Engineers
Если вопрос не корректный, не бейте
источник

D

Dmitry Nechaev in Data Engineers
если распараллелишь на пандасе вычисления то будет быстрее.
источник

ЕГ

Евгений Глотов... in Data Engineers
+
источник

AG

Arsen Gumin in Data Engineers
Звучит сложно
источник

AG

Arsen Gumin in Data Engineers
По потокам?
источник

A

Aleksey in Data Engineers
Привет.
Подскажите пож-та aws kinesis data streams:
1. есть какая-то удобная тула, чтобы читать/писать данные из стрима (что-то вроде kafka-tool, kafka cli)?
2. подкиньте ссылку как можно локально отлаживать flink app для kinesis analytics?
3. если мне нужно прочитать одни и теже данные из стрима несколько раз (делаю это через aws cli), то использую --shard-iterator-type TRIM_HORIZON. Но почему-то при повторной попытке (даже с новым shard-iterator) не возвращает данные. Что делаю не так?
источник

D

Dmitry Nechaev in Data Engineers
тогда посомтри либу что скинул выше. да по потокам.
источник

AG

Arsen Gumin in Data Engineers
Не понятно зачем мне это делать
источник