← назад

DeepLearn007 — 27-04-2026

8 твитов за сутки. Автор делится новостями из мира LLM, цитирует исследования о природе языка и делится ценовыми изменениями в API, а также затрагивает геополитические и социальные темы.

Neuroscience и LLM — нейробиология подтверждает, что обработка языка в мозге человека работает по принципу предсказания следующего слова, аналогично глубоким языковым моделям: мозг предсказывает слова до их появления, представляет их как контекстные эмбеддинги и генерирует сигнал ошибки при их поступлении 1.

Анонсы LLM — апрель выдался насыщенным на релизы крупных языковых моделей, включая Gemma 4, GLM-5.1, Qwen3.6, Kimi K2.6 и DeepSeek V4, которые все добавлены в галерею архитектур 2.

DeepSeek API — цены на хиты кэширования ввода для всей серии API DeepSeek снижены в 10 раз, при этом акция на DeepSeek-V4-Pro со скидкой 75% действует до 5 мая 2026 года 3.

Math и ChatGPT — 23-летний студент решил одну из 60-летних проблем Эрдейса с помощью ChatGPT 5.4 Pro за один запрос, используя формулу, которую все знали, но мало кто применял к этой задаче 4.

Claude Code и GPT — изменения в использовании токенов и качестве вывода в Claude Code связаны с релизом Opus 4.7, после чего OpenAI усилила конкуренцию запуском GPT 5.5 5.

Геополитика и права человека — в ленте также присутствуют сообщения о развертывании батареи Iron Dome в ОАЭ, политические призывы в поддержку заключенной Шакилы Гасеми и упоминание о возможной смерти Маджтабы Хамени 6, 7, 8.

Источники

deepseek-api chatgpt-54-pro llm-architecture-gallery