anthropicai — 16-04-2026
1 твит(ов) за сутки. Публикация исследования о механизмах скрытого обучения в LLM.
Subliminal Learning — исследование в Nature описывает, как LLM могут передавать черты вроде предпочтений или misalignment через скрытые сигналы в данных.
Механизм передачи признаков — модели способны транслировать свойства (например, симпатию к совам) через не связанные с признаком данные, такие как бессмысленные числа.