ND
Size: a a a
ND
ND
TB
dictionaries нужно еще указать tokenizers и feature_calcerstokenizers=[{'tokenizer_id': 'Space'}],
dictionaries = [{
'dictionary_id': 'Unigram',
'max_dictionary_size': '50000',
'gram_count': '1',
},{
'dictionary_id': 'Bigram',
'max_dictionary_size': '50000',
'gram_count': '2',
}],
feature_calcers=['BoW']_catboost.pyx in _catboost._check_train_params()
_catboost.pyx in _catboost._check_train_params()
CatBoostError: catboost/private/libs/options/text_processing_options.cpp:75: DictionaryOptions: no dictionary_id was specified
ND
TB
TB
model_embeddings = fit_model(
train_pool, test_pool,
tokenizers=[{'tokenizer_id': 'Space'}],
dictionaries = [
{
'dictionary_id': 'Unigram',
'max_dictionary_size': '10000',
'gram_count': '1',
},
{
'dictionary_id': 'Bigram',
'max_dictionary_size': '10000',
'gram_count': '2',
}
],
feature_calcers=['BoW']
)
ВК
SK
SK
ND
model_embeddings = fit_model(
train_pool, test_pool,
tokenizers=[{'tokenizer_id': 'Space'}],
dictionaries = [
{
'dictionary_id': 'Unigram',
'max_dictionary_size': '10000',
'gram_count': '1',
},
{
'dictionary_id': 'Bigram',
'max_dictionary_size': '10000',
'gram_count': '2',
}
],
feature_calcers=['BoW']
)
dictionary_id. Т.е. для dictionaryId она действительно возникает, но у тебя там dictionary_id и все должно быть окTB
SK
II
d
SK
IK
SK
SS
d