Издание · проверено редакцией

MarkTechPost

Источник AI-новостей. Материалы автоматически отбираются и адаптируются редакцией Hamidun News.

304 материалов в Hamidun·Последний: 3 августа· Активен·marktechpost.com ↗

Последние публикации

Нейросеть NVIDIA Nemotron для текста: три режима генерации
LLMMarkTechPost

Нейросеть NVIDIA Nemotron для текста: три режима генерации

NVIDIA выпустила языковую модель Nemotron-Labs-Diffusion, которая объединяет три режима декодирования и обрабатывает токены в 6 раз быстрее, чем Qwen3-8B.

21 мая 2026 г.·2 мин
Граф знаний для анализа текста: как ИИ извлекает информацию
LLMMarkTechPost

Граф знаний для анализа текста: как ИИ извлекает информацию

Туториал по автоматическому извлечению сущностей и связей из текста с помощью kg-gen, построению интерактивных графов знаний и их анализу через NetworkX.

21 мая 2026 г.·3 мин
Turbovec: векторный индекс на Rust с алгоритмом TurboQuant от Google Research
LLMMarkTechPost

Turbovec: векторный индекс на Rust с алгоритмом TurboQuant от Google Research

Turbovec использует алгоритм TurboQuant от Google для сжатия векторов в 16 раз без предварительного обучения, упрощая развёртывание RAG-приложений.

21 мая 2026 г.·2 мин
Лучшие платформы для агентских AI в 2026 году: рейтинг Salesforce, Microsoft и других
LLMMarkTechPost

Лучшие платформы для агентских AI в 2026 году: рейтинг Salesforce, Microsoft и других

Компании переходят с пилотов на production. MarkTechPost составил рейтинг топ-10 платформ для агентских AI: Salesforce Agentforce, Microsoft Copilot Studio, ServiceNow и другие. Проверенные цены и данные реального внедре

19 мая 2026 г.·3 мин
NVIDIA создала метод обучения нейросетей в 4-bit точности
LLMMarkTechPost

NVIDIA создала метод обучения нейросетей в 4-bit точности

NVIDIA представила NVFP4 — методологию обучения больших моделей с 4-битной точностью вместо стандартной 8-битной, экономя память в 2 раза без потери качества.

19 мая 2026 г.·3 мин
OpenAI представила протокол MRC для сетей суперкомпьютеров с миллионами GPU
LLMMarkTechPost

OpenAI представила протокол MRC для сетей суперкомпьютеров с миллионами GPU

OpenAI создала новый открытый сетевой протокол MRC для больших AI кластеров, который распределяет данные по сотням путей и восстанавливается от сбоев за микросекунды, позволяя строить суперкомпьютеры с 100+ тысячами GPU.

17 мая 2026 г.·3 мин
Meta AI представила NeuralBench — фреймворк для тестирования моделей мозговой активности
LLMMarkTechPost

Meta AI представила NeuralBench — фреймворк для тестирования моделей мозговой активности

Meta выпустила NeuralBench — открытый фреймворк для стандартизированного тестирования AI-моделей на основе ЭЭГ, объединив 36 задач, 94 датасета и 13,603 часов мозговых записей в один интерфейс. *Meta признана экстремист

17 мая 2026 г.·2 мин
Как сжать языковую модель в 3 раза: гайд по FP8, GPTQ и SmoothQuant
LLMMarkTechPost

Как сжать языковую модель в 3 раза: гайд по FP8, GPTQ и SmoothQuant

Разработчики получили пошаговый гайд по сжатию больших языковых моделей с помощью llmcompressor, сравнив эффективность FP8, GPTQ и SmoothQuant квантизации для снижения нагрузки на железо.

17 мая 2026 г.·3 мин
OpenAI выпустила три аудио-модели: перевод, транскрипция и рассуждение в реальном времени
LLMMarkTechPost

OpenAI выпустила три аудио-модели: перевод, транскрипция и рассуждение в реальном времени

OpenAI расширила Realtime API тремя новыми аудио-моделями для обработки голоса: агентами рассуждения, мультиязычным переводом и потоковой транскрипцией.

17 мая 2026 г.·2 мин
Anthropic создала инструмент для перевода мыслей Claude на человеческий язык
LLMMarkTechPost

Anthropic создала инструмент для перевода мыслей Claude на человеческий язык

Anthropic разработала Natural Language Autoencoders — технологию, которая переводит внутренние активации Claude в текстовые объяснения, раскрывая работу нейросети.

17 мая 2026 г.·2 мин
Нейросеть NVIDIA Star Elastic: 360× экономия на обучении
LLMMarkTechPost

Нейросеть NVIDIA Star Elastic: 360× экономия на обучении

NVIDIA представила метод Star Elastic, который упаковывает три модели разных размеров в один checkpoint и обучается в 360 раз эффективнее.

17 мая 2026 г.·3 мин
NVIDIA выпустила cuda-oxide: компилятор Rust-кода для GPU
LLMMarkTechPost

NVIDIA выпустила cuda-oxide: компилятор Rust-кода для GPU

NVIDIA открыла cuda-oxide — инструмент для компиляции Rust-функций напрямую в GPU код PTX. Это упростит разработку CUDA приложений на Rust и сделает параллельные вычисления доступнее.

17 мая 2026 г.·1 мин
NadirClaw: экономия на ИИ через маршрутизацию запросов
LLMMarkTechPost

NadirClaw: экономия на ИИ через маршрутизацию запросов

NadirClaw — это инструмент для интеллектуальной маршрутизации промптов, который классифицирует запросы на простые и сложные, направляя их в подходящую модель для экономии на затратах.

17 мая 2026 г.·2 мин
Открытый ИИ-агент Hermes: лидер потребления токенов OpenRouter
LLMMarkTechPost

Открытый ИИ-агент Hermes: лидер потребления токенов OpenRouter

Открытый AI-агент Hermes от Nous Research обогнал закрытую платформу OpenClaw и занял первое место на OpenRouter, генерируя 224 млрд токенов в день. Это произошло всего за три месяца и показывает силу open-source решений

17 мая 2026 г.·3 мин
Нейросети для поиска 2026: как выбрать — девять систем
LLMMarkTechPost

Нейросети для поиска 2026: как выбрать — девять систем

Девять ведущих векторных БД теперь ключевая инфраструктура для RAG и agential AI. Обзор по архитектуре, цене и масштабируемости помогает выбрать под задачу.

17 мая 2026 г.·2 мин
ИИ для кодирования: язык Zero от Vercel
LLMMarkTechPost

ИИ для кодирования: язык Zero от Vercel

Vercel выпустила Zero — язык программирования, где компилятор выдаёт JSON вместо текста, чтобы AI-агенты могли самостоятельно писать, исправлять и развёртывать нативные программы

17 мая 2026 г.·2 мин
Как Memori создаёт постоянную память для агентов и мультисессионных LLM
LLMMarkTechPost

Как Memori создаёт постоянную память для агентов и мультисессионных LLM

Memori — инфраструктура памяти для LLM-приложений, которая позволяет агентам сохранять контекст между сессиями и работать с несколькими пользователями одновременно.

17 мая 2026 г.·2 мин
SHAP для машинного обучения: сравнение explainers и практический гайд
LLMMarkTechPost

SHAP для машинного обучения: сравнение explainers и практический гайд

Новый гайд показывает, как выбрать между четырьмя методами SHAP для интерпретации моделей — от быстрого Tree до универсального Kernel.

17 мая 2026 г.·3 мин
DeepMind создала AI-мышь на Gemini, чтобы пользователи не переключались на чаты
LLMMarkTechPost

DeepMind создала AI-мышь на Gemini, чтобы пользователи не переключались на чаты

Google DeepMind представила AI-мышь на основе Gemini, которая анализирует контекст вокруг курсора и позволяет дать команды голосом, не открывая отдельное окно.

17 мая 2026 г.·3 мин
Мира Мурати показала первую систему для естественного диалога с ИИ в реальном времени
LLMMarkTechPost

Мира Мурати показала первую систему для естественного диалога с ИИ в реальном времени

Thinking Machines Lab представила модель TML-Interaction-Small, которая слушает и отвечает одновременно, обрабатывая речь, видео и текст без задержек — впервые ИИ может разговаривать как человек.

17 мая 2026 г.·2 мин
Nous Research представила Lighthouse Attention для ускорения обучения LLM
LLMMarkTechPost

Nous Research представила Lighthouse Attention для ускорения обучения LLM

Nous Research опубликовала новый механизм внимания Lighthouse Attention, который ускоряет обучение больших языковых моделей в 1.4–1.7 раза при работе с длинными контекстами.

17 мая 2026 г.·2 мин
GLiGuard от Fastino Labs: модель безопасности, которая на 16x быстрее больших конкурентов
LLMMarkTechPost

GLiGuard от Fastino Labs: модель безопасности, которая на 16x быстрее больших конкурентов

Fastino Labs открыла GLiGuard — 300-миллионную модель модерации, которая за один проход проверяет промпт по четырём параметрам и работает в 16 раз быстрее аналогов.

16 мая 2026 г.·2 мин
Теневой AI в 63% компаний: как инструменты обогнали корпоративные политики
LLMMarkTechPost

Теневой AI в 63% компаний: как инструменты обогнали корпоративные политики

Большинство компаний всё ещё не имеют формальных политик управления AI, при этом сотрудники уже активно внедряют инструменты самостоятельно — это создаёт серьёзные риски для безопасности.

16 мая 2026 г.·3 мин
Nous Research ускорила предобучение LLM в 2.5 раза без смены архитектуры
LLMMarkTechPost

Nous Research ускорила предобучение LLM в 2.5 раза без смены архитектуры

Nous Research разработала Token Superposition Training — метод, который сокращает время предобучения языковых моделей в 2.5 раза, не меняя архитектуру и поведение при инференсе.

16 мая 2026 г.·3 мин
Zyphra выпустила первую MoE-модель диффузии с ускорением в 7.7x
LLMMarkTechPost

Zyphra выпустила первую MoE-модель диффузии с ускорением в 7.7x

Zyphra представила ZAYA1-8B-Diffusion-Preview — первую MoE-модель диффузии, конвертированную из языковой модели LLM. Инференс ускорился в 7.7 раз за счёт перераспределения вычислений с памяти на процессор GPU.

16 мая 2026 г.·3 мин
Как собрать MCP-стиль систему для интеллектуальных AI-агентов
LLMMarkTechPost

Как собрать MCP-стиль систему для интеллектуальных AI-агентов

Полная инструкция по построению системы AI-агентов, которая сама открывает нужные инструменты, маршрутизирует задачи и выполняет их пошагово.

16 мая 2026 г.·3 мин
BerriAI выпустила LiteLLM Agent Platform для агентов в production
LLMMarkTechPost

BerriAI выпустила LiteLLM Agent Platform для агентов в production

BerriAI открыла исходный код LiteLLM Agent Platform — инфраструктуры на Kubernetes для запуска AI-агентов в продакшене с изолированными окружениями и сохранением сессий между перезагрузками.

16 мая 2026 г.·3 мин
Repowise для анализа репозиториев: граф-анализ и мёртвый код
LLMMarkTechPost

Repowise для анализа репозиториев: граф-анализ и мёртвый код

Repowise помогает разработчикам анализировать кодовые репозитории на уровне всего проекта: построение графов зависимостей, поиск мёртвого кода и контекст для AI.

16 мая 2026 г.·3 мин
NVIDIA представила SANA-WM: модель для 60-секундных видео в 720p на одном GPU
LLMMarkTechPost

NVIDIA представила SANA-WM: модель для 60-секундных видео в 720p на одном GPU

NVIDIA показала SANA-WM — открытый world model, генерирующий 60-секундные видео в 720p с точным управлением камерой на одном графическом процессоре.

16 мая 2026 г.·3 мин
Как построить стриминговый агент принятия решений с онлайн-перепланированием в динамической среде
LLMMarkTechPost

Как построить стриминговый агент принятия решений с онлайн-перепланированием в динамической среде

Подробный туториал по созданию стримингового агента принятия решений, который адаптируется к движущимся препятствиям и меняющимся целям в реальном времени.

3 мая 2026 г.·2 мин