Перейти к содержимому
JS
JScriptiser
Система Онлайн
Патчи
Платформа
Квиз
FAQ
🇺🇸
en
Войти
В Лабораторию
Войти
База знаний
Machine Learning
NLP
NLP
Tokenization, embeddings, BERT, GPT, fine-tuning, метрики
Все
Легкие
Средние
Сложные
По умолчанию
По популярности
Сначала легкие
Сначала сложные
Развернуть
Свернуть
1
Легкий
7
Что такое токенизация и какие уровни разбиения текста существуют?
2
Легкий
2
Что такое NLP и зачем оно нужно? Какие задачи решает обработка естественного языка?
3
Легкий
6
Что такое токенизация простыми словами? Как текст превращается в числа?
4
Средний
7
Чем отличаются BPE, WordPiece и SentencePiece как алгоритмы subword-токенизации?
5
Легкий
6
Что такое мешок слов (bag of words) и почему это самая простая модель текста?
6
Легкий
6
Что такое word2vec и чем CBOW отличается от skip-gram?
7
Средний
6
Чем отличаются word2vec, GloVe и FastText как методы word embeddings?
8
Легкий
5
Что такое embedding для слов на пальцах? Как работает word2vec?
9
Сложный
8
Что такое T5 и BART, чем они отличаются от BERT/GPT и когда выбирать seq2seq предобученную модель?
10
Легкий
6
Как машина понимает тональность отзыва? Классификация sentiment на пальцах
Назад
1
2
Вперёд
NLP | JScriptiser