← назад

perplexity_ai — 21-05-2026

3 твитов за сутки. Perplexity представила новую систему сжатия контекста, которая повышает точность ответов за счёт фильтрации шума и сохранения цитат.

Query-aware context compression — система, которая сокращает количество токенов контекста до 70%, улучшая качество ответов за счёт удаления шума (рекламы, навигации, метаданных) и повышения релевантности каждого фрагмента на 63% More signal, less noise.

Производительность и архитектура — решение работает с коэффициентом сжатия 50x на бенчмарке SimpleQA при уровне производительности передовых моделей, сохраняя при этом цитируемость и скорость, необходимую для оркестрации Better context is better than more context.

Научное обоснование — подход отличается от стандартного RAG тем, что сжатие учитывает запрос пользователя и сохраняет ссылки на источники, что позволяет быстрее получать более чистые данные для модели Query-aware context compression for better snippets.

Источники

perplexity-ai