Дайджест

Аккаунтов: 56 · твитов: 422 · инструментов: 11

Топ-идеи дня

  1. Anthropic выпустила Claude Fable 5.1 и Mythos 5.1 — Anthropic представила Claude Fable 5.1 — значительное обновление флагманской модели. Fable 5.1 удваивает показатели по научным бенчмаркам (Terminal-Bench-Science: 52.6% vs 24.7%), существенно улучшает кодинг и бизнес-автоматизацию. Mythos 5.1 — та же модель с ослабленными ограничениями для кибербезопасности и life sciences. Модель уже доступна в Cursor, GitHub Copilot, Perplexity, Vercel. Множество пользователей отмечают качественный скачок, особенно в кодинге. Введены Enterprise Frontier Safeguards (EFS) для корпоративных клиентов. Perplexity сообщает о 21% росте качества при 37% снижении стоимости.
  2. Google/DeepMind запустили агентное понимание видео в Gemini — Google представила agentic video understanding для моделей Gemini — способность динамически анализировать длинные видео, сканируя транскрипт, аудио и кадры с адаптивным фреймрейтом. Результат: до 88% меньше токенов, 66% дешевле, 7% точнее. Доступно через Gemini API, скоро появится в YouTube «Ask YouTube». Это принципиально новый подход к работе с видеоконтентом.
  3. Критика OpenAI: безопасность, антропоморфизм и реальные риски — Gary Marcus продолжает критику OpenAI, указывая на опасное сочетание слабой кибербезопасности и антропоморфного языка (Dwarkesh, Roon). Ссылается на новую статью от Margaret Mitchell о том, что растущая автономия агентов постепенно делает человеческий надзор неэффективным. Призывает Конгресс потребовать от фронтирных AI-компаний соблюдения лучших практик кибербезопасности. Allie K Miller добавляет: спор о языке отвлекает от сути проблемы — дом уже горит.
  4. Perplexity представила гибридные вычисления с локальной приватностью — Perplexity запустила hybrid compute — возможность начать задачу в облаке, а чувствительные шаги выполнять локально на Mac. Встроенный PII-детектор распознаёт персональные данные до их отправки с устройства. Классификатор PII открыт в open source. Доступно для Pro, Max и Enterprise подписчиков.
  5. NVIDIA и CrowdStrike создают агентную киберзащиту SafeMind — NVIDIA совместно с CrowdStrike представили SafeMind — семейство моделей безопасности на основе Nemotron. AI-агенты симулируют контролируемые атаки, превращают телеметрию в правила обнаружения и тестируют их на новых векторах атак. Результат: улучшение среднего обнаружения с 16.5% до 41.9%. Три правила прошли все проверки качества и поймали все 8 новых атак.
  6. Ollama перешла на прозрачное потоковое ценообразование — Ollama объявила о переходе на прозрачную per-token модель оплаты для планов Pro, Max и Team. Каждый план включает пул кредитов, zero data retention, поддержку популярных агентов (Claude Code, Codex). Существующие подписчики могут продолжить на старом плане или обновиться.
  7. Нейросимволический AI и стены чистого скейлинга LLM — Gary Marcus утверждает, что чистое масштабирование LLM действительно упёрлось в стену, и именно нейросимволический подход (harnesses, инструменты) спас прогресс. Это подтверждает его давний тезис о необходимости комбинирования LLM с символическими методами. Параллельно Yuchenj_UW отмечает, что даже при массовом бенчмарк-максинге Fable 5.1 выглядит как настоящий прорыв.

Пересечения тем

Темы, упомянутые 2+ аккаунтами.

Новые инструменты

Из ссылок на GitHub.

Аккаунты

Тихие аккаунты (43)