Модель имеет 552 млрд параметров, поддерживает текст и изображения и может работать с контекстом до 1 млн токенов. При этом её кэш занимает около 890 байт на токен — в 4 раза меньше, чем у DeepSeek-V4-Flash, а объём постоянно сохраняемого кэша удалось сократить в 8 раз.

