@atomicbot_ai

Выпуск

4 твитов

Аккаунт Atomic Bot провёл день, демонстрируя сравнительные бенчмарки AI-агентов на своей платформе. Сначала сравнили OpenClaw 2.0 и Hermes Agent на задаче генерации сцен из фильмов — оба агента показали способность к самопроверке и автоисправлению, но разными способами. Затем столкнули Claude Fable 5.1 и GPT-5.6 Sol на задаче воссоздания видео — Fable потратил в 27 раз больше, но трижды пересобрал результат с самокоррекцией, тогда как GPT отдал первую версию за $0.83.

Темы: Сравнение AI-агентов · Самокоррекция моделей · Стоимость инференса · OpenClaw 2.0 · Claude Fable vs GPT-5.6

Ключевые твиты