@anthropicai
Anthropic опубликовала свой самый подробный на сегодняшний день отчёт об угрозах. В нём описаны попытки злоупотребления Claude — для кибератак, операций влияния, слежки, биологических угроз и создания оружия — и как компания их обнаружила и пресекла. Все описанные операции были остановлены, а полученные уроки использованы для усиления защитных механизмов. Информация была передана властям и другим AI-компаниям.