NVIDIAAI — 08-05-2026
9 твитов за сутки. NVIDIA анонсировала интеграцию TokenSpeed в Dynamo, представила алгоритм ускорения инференса Guess-Verify-Refine и поделилась кейсами оптимизации от Perplexity и Harvey.
Инференс и оптимизация — Dynamo получил поддержку TokenSpeed в качестве бэкенда, а NVIDIA Research представила алгоритм Guess-Verify-Refine для TensorRT LLM на Blackwell, обеспечивающий ускорение Top-K attention в 1.88 раза и улучшение задержки на 9.3%. Perplexity использует стек CUTLASS Python для создания специализированных GPU-ядер через свой движок ROSE, а пользователь stevibe зафиксировал рост производительности Gemma4 на DGX Spark благодаря MTP.
Разработка и экосистема — NVIDIA DeepStream в связке с агентами вроде Claude Code позволяет генерировать vision AI-пайплайны из текстовых промптов, сокращая цикл разработки. Harvey выпустил новый бенчмарк для оценки агентов на длинных задачах, а Jensen Huang выступил на конференции Milken Institute, аргументируя важность open source для кибербезопасности.
События — Состоялся стрим Dev Community Live, посвящённый победителям хакатона GTC Vibe Hack, и прошла трансляция GTC.