Nemotron-Labs-Diffusion
model: семейство диффузионных языковых моделей от NVIDIA для ускорения инференса.
Модели генерируют несколько токенов параллельно, что значительно повышает скорость вывода по сравнению с традиционными autoregressive-подходами. Это решение предназначено для сценариев, где критична задержка при генерации текста.
Источник: @NVIDIAAI, 20-05-2026