@dotey
Аккаунт обсуждал два разных, но интересных направления. Первое — концепция «когнитивной формы вознаграждения» от Jason Wei: как выбранный спорт (теннис vs футбольный нападающий) формирует профессиональное мышление и отношение к риску. Второе — технические детали GLM-5.3 от Zhipu: модель на 743B параметров (MoE, ~40B активных) без смены базовой модели за месяц RL-тренировки подняла кодинг на 50%, с разбором эволюции подходов к масштабированию моделей от Kaplan через Chinchilla к современным практикам.