- Опубликовано
вот здесь особенно хорошо видно принципиальную...
- Автор
- Имя
- ElKornacio
- Telegram
- ElKornacio14723 подписчика408 постов
Кратко
принципиальная разница архитектур LLM и dLLM в скорости генерации ответов
вот здесь особенно хорошо видно принципиальную разницу архитектур.
пока LLM слева пишет ответ токен за токеном, последовательно
dLLM справа итеративно превращает хаотичную дичь из символов в полноценный качественный ответ
и, как можно заметить, это происходит сильно быстрее
ElKornacio
14723 подписчика
408 постов
Предыдущий пост
- Опубликовано
Inception Labs выпустили diffusion LLM с 10‑кратным ускорением
diffusion LLM от Inception Labs: 10‑кратное ускорение и качество уровня gpt‑4o
Следующий пост
- Опубликовано
полная подробная новость по классике
полная подробная новость с Хабра



