Size: a a a

2021 August 02

M

Mari in PyLadies SPb
Мб типа
df1[df2.index.min():]?
Вроде по индексам должно отрезать
источник

k

karine in PyLadies SPb
@marhrusk Да. вот так мне нравится. Спасибо.
Я теряюсь от количества вариантов, подходящих для достижения цели. Пытаюсь разглядеть грабли впереди, но пока не видно.
источник

AT

Aleksandra Tsareva in PyLadies SPb
Если у вас индекс достоверно непрерывный, то с предложенным выше все ок. Если нет, df1[df1.index.isin(df2.index)] вроде тоже должно работать
источник
2021 August 03

A

Alina in PyLadies SPb
Всем привет! Ищем себе в команду Senior Data Scientist. Можно как с Python, так и с R. Подробное описание можно найти здесь:
https://www.jetbrains.com/careers/jobs/data-scientist-market-research-analytics-617/ .
Если вдруг вам интересно узнать подробнее и вы отлично подходите, или вы знаете кого-то, кто подходит, пишите :)
источник

А

Александра in PyLadies SPb
Всем привет! Я совсем-совсем новенькая в IT. Изучаю Пайтон, смотрю в сторону data science. Посоветуйте книги по математике для этого направления на русском, пожалуйста.
источник
2021 August 05

Aс.енька Мак... in PyLadies SPb
Книги или курсы?
источник

А

Александра in PyLadies SPb
Можно и то и другое)
источник
2021 August 06

ГГ

Галия Гарифулина... in PyLadies SPb
источник

A

Alyona in PyLadies SPb
Спасибо!
источник
2021 August 10

k

karine in PyLadies SPb
Ребят. Привет. Я опять с ламерским вопросом.

Есть df1, который я посчитала сама (на основе значений из базы)
Есть df2, который я прочитала из файла.

Задача проверить эквивалентность значений соответствующих столбцов df1 и df2

проблема1:
когда я делаю
df1.iloc[:,0].values - он мне возвращает dtype object
проблему решила добавив astype(float)

проблема2:
для равных значений он возвращает false.
Базово использовала allclose(df1[i], df2[j])
После стала просить вывести на экран конкретные значения, которые не равны через "=="

differencePoints = (df1.iloc[:,0].values.astype(float)*1000000000).astype(int)==(df1[key].values*1000000000).astype(int)
tmp = pd.DataFrame({"FIRST": differencePoints, "SECOND":df1.iloc[:, 0].values.astype(float)*1000000000, "THIRD":df2[key].values*1000000000})
print(tmp.loc[tmp['FIRST'] == False])


выводит :
second - значение из df1
third - значение из df2

    FIRST        SECOND         THIRD
27   False -5.743710e+08 -5.743710e+08

тут похоже какая-то концептуальная ошибка. Но я её не осознаю
источник

k

karine in PyLadies SPb
Так. С точностью надо поиграть. Только сейчас дошло. Но все равно ощущение, что я иду куда-то не туда
источник

И

Игорь in PyLadies SPb
float объекты так не сравнивают. может лучше посчитать разницу для каждой пары значений и убедиться что она меньше допустимого предела?
источник

i

iriskin0 in PyLadies SPb
может, попробовать в момент создания обоих датафреймов указать dtype=float64?
источник

И

Игорь in PyLadies SPb
это концептуально неправильно, значения с плавающей запятой сравниваются через эпсилон
источник

И

Игорь in PyLadies SPb
надо решить насколько числам можно различаться и считать равными те которые ближе этого уровня

у меня даже статья про float есть
https://github.com/IgorZyktin/Zettelkasten/blob/master/content/cs_theory_floating_point.md
источник

k

karine in PyLadies SPb
Он изначально вроде как float, я проверю где тип путается.
источник
2021 August 11

k

karine in PyLadies SPb
Спасибо за статью.
источник
2021 August 13

P

Patience in PyLadies SPb
Ребята, расскажите, пожалуйста, хороших добрых историй о переходе с фриланса на фуллтайм. А то я немного в тревоге
источник

i

iriskin0 in PyLadies SPb
А что тревожит: поиск, процесс работы или иное? Вроде обычно фриланс больше пугает
источник

P

Patience in PyLadies SPb
процесс
боюсь выгореть за месяц
источник