#Исследования
Подборка материалов по теме «Исследования»: релизы, исследования, бенчмарки, опенсорс.

Аудит метрик grokking показал: ранние оценки сжатия представления завышены в разы
Аудит показал: метрика effective rank завышает степень сжатия представления нейросети в момент grokking-перехода в разы, а не отражает финал

UASPL: новая методика самообучения нейросетей учитывает неопределённость предсказаний
Исследователи представили метод UASPL, который выбирает обучающие примеры для нейросети не только по величине ошибки, но и по надёжности пре

Экс-глава ФРС Бен Бернанке вошёл в совет по долгосрочной пользе Anthropic

Liquid AI выпустила LFM2.5-350M: эффективная модель на 350M параметров с масштабным RL

AWS: GraphRAG и BYOKG ускоряют научные открытия в фармацевтике

Ragas, DeepEval, RAGChecker, Opik: какие метрики RAG действительно работают

Нейросеть для текста генерирует 41% контента в LinkedIn
AI detection компания Pangram обнаружила, что пользователи видят огромное количество AI-контента при повседневном использовании LinkedIn и X

OpenAI обнаружила критические ошибки в популярном тесте SWE-Bench Pro
Примерно 30% заданий в популярном тесте SWE-Bench Pro, используемом для оценки AI моделей программирования, содержат ошибки. OpenAI отозвала













