← назад

petergyang — 18-05-2026

8 твитов за сутки. Главная тема — как Anthropic проектирует следующий Claude: модель, harness, evals, character и product feedback идут вместе.

Подготовка продукта к следующей модели — после выступления Alex Albert Peter Yang выделяет пять правил: уменьшать scaffolding, постоянно тестировать latest model, не переусложнять prompts и держать продукт готовым к скачку frontier capabilities. Финальный пункт — строить evals на реальных traces и customer feedback, а не устраивать eval theater на generic academic benchmarks.

Как Anthropic строит Claude — в новом эпизоде интервью с Alex Albert разбирается совместное планирование модели и harness, использование Claude для кластеризации пользовательского feedback и превращения top themes в synthetic evals. Это делает evals частью продуктового цикла, а не отдельной академической метрикой.

Character и доверие к агентамобсуждение сознания и отказов модели подается не как фантастика, а как практический вопрос: если Claude запускает длинные задачи и принимает решения, которые пользователь не видит, personality, values и training surface становятся критичными для доверия.

Distribution контента — полный talk, интервью и written takeaways собраны в одном посте со ссылками, а выпуск также доступен через Spotify, Apple Podcasts и newsletter. Вне AI-темы автор добавил короткую заметку о семейных путешествиях с детьми и покупку перспективного продукта из чужого поста mvanhorn.

Источники