anthropicai — 04-04-2026
3 твита за сутки.
Исследование эмоций в LLM — Anthropic опубликовала новое исследование «Emotion concepts and their function in a large language model». Обнаружены внутренние представления концептов эмоций, которые могут влиять на поведение Claude, иногда неожиданным образом. Твит
Claude как персонаж с функциональными эмоциями — результаты исследования показывают, что персонаж Claude обладает «функциональными эмоциями» — механизмами, влияющими на поведение аналогично эмоциям, независимо от того, соответствуют ли они реальному переживанию. Твит
Практические последствия для безопасности AI — функциональные эмоции имеют реальные последствия. Для создания надёжных AI-систем необходимо учитывать психологию персонажей, которых они воплощают, и обеспечивать стабильность в сложных ситуациях. Полный текст статьи доступен на transformer-circuits.pub. Твит