Главная страница TG News Новый дроп от DeepSeek: выложили полностью открытый стек для ускорения генерации LLM
Data Secrets
29.06.2026
Data Secrets

Новый дроп от DeepSeek: выложили полностью открытый стек для ускорения генерации LLM

Новый дроп от DeepSeek: выложили полностью открытый стек для ускорения генерации LLM

Внутри готовые алгоритмы, обучение, эвал и даже пайплайн для данных. Бери и пользуйся, супер практично. github.com/deepseek-ai/DeepSpec

Основная соль – в алгоритме DSpark. Его DeepSeek уже использует для DeepSeek-V4 Flash и Pro в проде, и, по их данным, относительно старого бейзлайна скорость генерации для пользователя выросла примерно на 60–85%.

Как устроен алгоритм:

– Фундаментально, это небольшая модель, которая пишет черновики для основной LLM. Это называется драфт-модель.

– Такой подход сейчас в моде (Google, например, делают такое для Gemma: t.me/data_secrets/9179), но DeepSeek выводят его на новый уровень. Их драфт-модель работает необычно, в два этапа. Сначала параллельно набрасывается блок токенов, а потом легкий марковский модуль уточняет зависимости между соседними токенами. Благодаря такому подходу драфтер и работает быстро, и не очень сыпится в хвостах.

– После того, как драфтер накидал черновик, основная LLM его проверяет и принимает только правильный префикс, корректируя остальное. При этом DSpark сам решает, сколько токенов отправить на проверку, основываясь на оценках уверенности по токенам и текущей нагрузке на железо.

В результате получаем ускорение минимум в 1.5 раза абсолютно без потери качества. Снимаем шляпу перед DeepSeek за такой опенсорс.

Новый дроп от DeepSeek: выложили полностью открытый стек для ускорения генерации LLM

Чо, как вам статья?

Материалы по теме

Про регистрацию в .mx
Недавно у меня спросили можно ли регистрировать в .mx домены на нерезидента. Если в кратце, то да В принципе в Европе и uk выбираешь регистратор и просто регаешь на выдуманные доки похожие на реального человека, в латаме тоже самое. Главное не…
Как сравнивать промпты и модели LLM перед запуском конвейера?
В прошлый раз разбирали как ловить плохую статью на выходе с помощью deepeval. Но можно ловить раньше: на самом промпте и модели, которой вы этот промпт скармливаете (спасибо, Кэп!). Инструмент для этого - бесплатный promptfoo (есть веб-версия на…
Наткнулся на занятную штуку, одно время было довольно популярно делать llms.txt с…
Наткнулся на занятную штуку, одно время было довольно популярно делать llms.txt с инструкциями для АИ ботов которые в 98% никто не читал - тыц. Как же я, мягко сказать, "удивился" увидев как чел загоняет эти файлы в индекс ботов (прочитать…

Вставить свои 5 копеек:

Awesome image
Awesome image Awesome image Awesome image Awesome image
Awesome image