А вот если так уже обучать начал tokenizer = GPT2Tokenizer.from_pretrained("gpt-2", bos_token='<startoftext>', eos_token='<endoftext>', pad_token='<pad>')
Что-то можно исправить при применении модели? Или заново переобучать нужно?
Да. Понял. Спасибо большое. При обучении я так понял это же не влияет? Ведь там я generate не вызываю. Или там тоже что то в Trainer надо было добавлять?
Я как раз так тексты и делал, в таком формате. Т.е. такая строка получалась в таком виде prep_txt = '<startoftext>Title: Test title\nGenerated Text: I love apples very much<endoftext>'
Всем привет! Прошу заранее извинить, очень базовый вопрос. Посоветуйте, пожалуйста, статьи и книги, где есть история развития искусственного интеллекта, а так же рассматриваются различные определения искусственного интеллекта, будут очень полезны.
Вот да. У меня сложилось ощущение, что в середине XX века слово "кибернетика" было баззвордом, обозначающим любые нетривиальные алгоритмы, таким же, как "ИИ" сегодня, и "биг дата" 10 лет назад.