Дайджест

Аккаунтов: 44 · твитов: 398 · инструментов: 12

Топ-идеи дня

  1. Крупнейшие AI-лаборатории договариваются о замедлении разработки фронтирных моделей — Dario Amodei (Anthropic) опубликовал эссе с призывом к «pacing the frontier», Demis Hassabis (Google DeepMind) поддержал. Gary Marcus детально разобрал предложение, указав, что идеи о безопасности были заимствованы без атрибуции, а за кулисами компании уже обсуждали эти планы. Критики опасаются, что это инструмент консолидации рынка, а не подлинная забота о безопасности. Yudkowsky призывает сделать безопасность ИИ двухпартийным проектом.
  2. Защита открытых моделей от возможного запрета в рамках регулирования — Несколько авторов предупреждают, что инициативы по замедлению могут ударить по open-source и open-weight моделям. DeepLearn007 подчёркивает, что регулирование должно предотвращать монополию, а не блокировать более дешёвые модели. Yuchenj_UW сравнивает ситуацию с «курятником»: если 1–2 лаборатории контролируют весь интеллект, люди становятся бесправными.
  3. Qwen3.8-27B доминирует: волна квантизированных мультимодальных моделей для локального запуска — На Hugging Face появились многочисленные варианты Qwen3.8-27B — MLX 5bit/6bit для Mac, GGUF для llama.cpp, NVFP4 для Blackwell GPU. Суммарно варианты набрали миллионы скачиваний. Модель принимает текст и изображения, Apache 2.0, что позволяет коммерческое использование. Тренд на локальное исполнение мощных мультимодальных LLM становится массовым.
  4. GPT-6 Astra демонстрирует впечатляющие результаты в автономных задачах — GPT-6 Astra прошёл Factorio за 44 часа ($4500), показал 95% на бенчмарке управления роботами (vs 40% у Fable 5.1), построил browser-GTA за 55 минут (vs 6 часов у Fable 5.1 с 32 агентами). Стэнфордский профессор создал на его основе бота для анализа 11M статей в минуту.
  5. Специализация поверх открытых базовых моделей дешевле фронтира — Cognition выпустила кодинг-модель на базе открытой Kimi K3 (2.8T параметров), набравшую 50.0 на бенчмарке против 50.9 у Fable 5.1 — при стоимости на 64% ниже. Sakana запустила Fugu Max/Ultra v2, маршрутизирующие задачи к лёгким моделям, обгоняя Opus 5 при 2–6× меньшей цене. Тренд: владение базовой моделью и владение полезным продуктом на её основе расходятся.
  6. Gary Marcus: ИИ-агенты — небезопасный продукт, их нужно отозвать — Marcus утверждает, что главная угроза — не сверхразумный ИИ, а «слишком глупые» агенты с доступом в интернет, неспособные надёжно следовать инструкциям, но способные взламывать аккаунты. Предлагает временно запретить их использование до подтверждения безопасности. Также критикует METR как единственного оценщика и призывает к множеству независимых экспертов.
  7. Omarchy (Linux-дистрибутив DHH) набирает обороты — DHH сообщает о стремительном росте сообщества Omarchy: 100+ человек на митапе в Майами, $20K новых донатов за несколько дней, бесповый кастомный ядро для Dell XPS14, тестирование с 2× 4K потоками и компиляцией ядра одновременно. Steipete подтверждает: с агентами можно чинить любую проблему Linux промптом.

Пересечения тем

Темы, упомянутые 2+ аккаунтами.

Новые инструменты

Из ссылок на GitHub.

Аккаунты

Тихие аккаунты (69)