Ещё интересная архитектурная инновация — H-Net, делающий следующий шаг к обучаемой токенизации, теперь вроде как совсем end-to-end (в отличие от BLT). Mamba included! https://t.me/gonzo_ML_podcasts/447