Добрый день! А можно ли в CatBoost как-то предобучить словарь для текстовых данных? То есть, у меня есть небольшой объем размеченных данных и значительно больший не размеченных. Хотел попробовать наполнить словарь на основании всех данных, но не нашел, как это можно сделать. Может кто знает?
Привет! К сожалениию, такой возможности у нас сейчас нет Сможешь создать нам issue на гитхабе с таким реквестом?
Всем привет. Подскажите, никак не могу решить проблему. С помощью параметра plot=True пытаюсь отрисовать графики обучения модели. Но после запуска получаю MetricVisualizer(layout=Layout(align_self='stretch', height='500px')) и всё. Работаю на windows, модуль ipywidgets установлен. В чём может быть проблема?
Всем привет. Подскажите, никак не могу решить проблему. С помощью параметра plot=True пытаюсь отрисовать графики обучения модели. Но после запуска получаю MetricVisualizer(layout=Layout(align_self='stretch', height='500px')) и всё. Работаю на windows, модуль ipywidgets установлен. В чём может быть проблема?
Возможно, это распространённая фишка, но я не могу найти ответ. В пакете для R на GPU модель при одинаковых параметрах менее точна, чем на CPU. В чём прикол? В другой структуре GPU?
там канал для обмена данными с виджетом не создается бывает, такое лечится переназванием/перемещением ipynb файлика
@kizill кернел перезапускать пробовал, остальное попробую, спасибо. Что ещё интересно, попробовал свой код на другой машине - на другой машине всё норм. Начал сверять версии библиотек: и catboost, и ipywidgest одинаковой версии на обоих машинах. Интересно, в общем
Возможно, это распространённая фишка, но я не могу найти ответ. В пакете для R на GPU модель при одинаковых параметрах менее точна, чем на CPU. В чём прикол? В другой структуре GPU?
попробуйте тесты Хи-квадрат, тау Кендалла, Мак-Немара
Я вроде нашел рабочую софтину, которая корреляцию любых типов фичей проверяет. Теперь осталось разобраться с тем, что такое хорошо и с тем, что такое плохо. Не очень понятно до какой степени коррелирующие фичи нужно резать.