Все новости
8621
Роутинг LLM-запросов с учётом задержки: +40% к accuracy-cost при тех же latency
Новый latency-aware роутер LLM-запросов оценивает время до первого токена и совместно оптимизирует задержку, точность и стоимость — до 40% п

SAAG: метод трёхэтапной диагностики ошибок вызова функций у AI-агентов
Метод SAAG раскладывает оценку вызова функций AI-агентами на три стадии и по каждой показывает, где именно агент ошибся, — вместо единого ба

ToolDNS: обнаружение инструментов для AI-агентов через DNS сокращает поиск на 95%

Как измерить остаточный риск автономных ИИ-агентов: фреймворк CPSAINT и FRIESA-K

BatchDAG: LLM-планировщик строит граф операций и режет вызовы модели в 47 раз

Thinky выпустила открытую модель Inkling 975B-A41B по лицензии Apache 2.0

Kimi K3 — крупнейшая открытая ИИ-модель уровня Opus 4.8 по цене Sonnet 5
Moonshot AI выпустила Kimi K3 — MoE-модель на 2,8 триллиона параметров (около 50 млрд активных), крупнейшую открытую модель в истории: по ка

Xaira представила X-Cell — «виртуальную клетку» на 4,9 млрд параметров для поиска лекарств
Xaira обучила «виртуальную клетку» X-Cell на 4,9 млрд параметров: крупнейший датасет генных пертурбаций и ставка на то, что каузальным модел













