#LLM
Подборка материалов по теме «LLM»: релизы, исследования, бенчмарки, опенсорс.

VizRAG: визуализация гиперграфов усиливает RAG-поиск для мультимодальных моделей
Исследователи представили VizRAG — первую RAG-систему, которая показывает языковой модели гиперграф знаний картинкой, а не только текстом, и

TriAgent: комитет мелких моделей вместо дорогого LLM экономит $9,3 млн в год
Исследователи представили TriAgent — многоагентную систему анализа финансовых настроений, где дешёвые модели заменяют облачный LLM и экономя

SLPO: метод переносит RL с проверяемой наградой на латентные модели рассуждений

SFT-дообучение сужает поведение ИИ: исследование arXiv о коллапсе разнообразия

CRA-Bench и CRA-Net: как ловить вред, который копится по ходу диалога с LLM

Spectral-LSH: сжатие промптов до 16× без дообучения для ускорения LLM-инференса

NEXUS: рантайм-контроль безопасности для LLM-агентов с инструментами — F1 0.949
Исследователи представили NEXUS — монитор, который в реальном времени решает, разрешить, заблокировать или уточнить действие ИИ-агента, доба

Бенчмарк Learn2Discern: LLM почти не отличают надёжные источники от популярных
Исследование на arXiv проверило 13 языковых моделей на почти 670 000 тестов: они опираются на популярность источника вдвое сильнее, чем на е













