@Yuchenj_UW

Выпуск

1 твитов

Автор делится успехами команды инференса Databricks: модель GLM-5.3-Flash достигает скорости 270 токенов/с. На бенчмарке OfficeQA Pro v2 она показывает на 10% более высокое качество, чем GLM-5.2, при десятикратно меньшей стоимости. Гордится своей командой и подчёркивает сочетание скорости, дешевизны и качества.

Темы: Инференс Databricks · GLM-5.3-Flash · Скорость и стоимость · Бенчмарки LLM

Ключевые твиты