HackerNoon на русском
Подписаться
Давайте создадим нашу собственную LLM (Часть 1): Токенизация и подготовка данных
Как большие языковые модели превращают текст в числа: пошаговое объяснение BPE-токенизации, почему выбор токенизатора влияет на качество модели и создание конвейера данных.