MarkTechPost
Источник AI-новостей. Материалы автоматически отбираются и адаптируются редакцией Hamidun News.
Последние публикации

Нейросеть для голоса StepAudio: синтез речи в реальном времени
Китайская лаборатория StepFun представила реальную голосовую модель StepAudio 2.5 Realtime, которая лучше конкурентов справляется с естественностью речи и может менять голос по сценарию пользователя.

Langfuse для инженеров LLM: полный пайплайн трейсинга и экспериментов
Langfuse — инструмент для отладки и оптимизации LLM-приложений. Узнайте, как настроить полный пайплайн мониторинга, управления промптами и экспериментов без платных моделей.

WorkOS представила auth.md — открытый протокол регистрации ИИ-агентов
WorkOS выпустила auth.md — открытый стандарт, который позволяет ИИ-агентам регистрироваться в приложениях через Markdown-файл без участия человека.

Нейросеть Lance для видео: как работает универсальная ИИ-модель
ByteDance выпустила Lance — открытую модель, которая в одном фреймворке работает с изображениями и видео: понимает, генерирует и редактирует контент при использовании всего 3B активных параметров.

Нейросеть Cohere Command A+: 218 млрд параметров для агентов
Cohere представила открытую модель Command A+ на 218 млрд параметров с многомодальными возможностями, которая работает на двух GPU H100 и поддерживает 48 языков.

Perplexity открыла AI-сканер Bumblebee для защиты кода разработчиков
Perplexity опубликовала исходный код Bumblebee — инструмента для сканирования уязвимостей в зависимостях разработческих систем без запуска кода.

Qwen3.7-Max: новая нейросеть Alibaba с миллионным контекстом
Alibaba представила Qwen3.7-Max — самую продвинутую модель-агента от Qwen с 1M-токенным контекстом и режимом рассуждений для сложных многошаговых задач.

CopilotKit: полный стек для ИИ-агентов в 2026
CopilotKit выпустил новый стек для разработчиков agentic AI: AG-UI протокол, платформу тестирования AIMock и сервер Pathfinder — полное решение для production-среды.

Как создать нейросеть-трансформер в Colab: MLA и GQA
OpenMythos позволяет строить рекуррентные трансформеры в Google Colab, сравнивая архитектуры MLA и GQA. Новый видео-туториал проверяет стабильность моделей через анализ спектральных радиусов injection матриц.

Управление поведением нейросети без переобучения: метод CNA
Компания Nous Research представила метод Contrastive Neuron Attribution (CNA), который позволяет управлять поведением больших языковых моделей, находя и отключая отдельные нейронные цепи без переобучения и изменения весо

AI-агенты в production: 8 платформ аутентификации
Аутентификация вышла в топ-приоритеты разработки. MCP достиг 97 млн загрузок в месяц, AI-агенты идут в production, и выбор платформы стал критической стратегической задачей.

Инструмент для Claude API: фреймворк SuperClaude
SuperClaude Framework предоставляет разработчикам встроенные компоненты для создания продвинутых AI-workflows: команды, агенты, режимы работы и память сессии — всё в одной системе.

Память для ИИ-агентов: локальная система от Tencent
Tencent открыла исходный код TencentDB Agent Memory — локальной системы памяти для AI-агентов, которая сокращает расход токенов на 61% и повышает точность на 28%.

Как новая нейросеть NVIDIA экономит память: Gated DeltaNet-2
NVIDIA создала новый механизм линейного внимания Gated DeltaNet-2, который улучшает управление памятью в больших языковых моделях благодаря раздельным вратам стирания и записи вместо единого затвора.

Gemini 3.5 для кодирования: новая нейросеть дешевле и быстрее
На I/O 2026 Google представила Gemini 3.5 Flash — модель, которая на 75% дешевле флагманской версии, работает в 4 раза быстрее и лучше справляется с кодом и автоматизацией.

Alibaba выпустила нейросеть для синхронного перевода видео
Alibaba представила модель для реального перевода видео и речи одновременно на 60 языках — с минимальной задержкой и сохранением голоса переводящего.

Нейросеть NVIDIA Nemotron для текста: три режима генерации
NVIDIA выпустила языковую модель Nemotron-Labs-Diffusion, которая объединяет три режима декодирования и обрабатывает токены в 6 раз быстрее, чем Qwen3-8B.

Граф знаний для анализа текста: как ИИ извлекает информацию
Туториал по автоматическому извлечению сущностей и связей из текста с помощью kg-gen, построению интерактивных графов знаний и их анализу через NetworkX.

Turbovec: векторный индекс на Rust с алгоритмом TurboQuant от Google Research
Turbovec использует алгоритм TurboQuant от Google для сжатия векторов в 16 раз без предварительного обучения, упрощая развёртывание RAG-приложений.

Лучшие платформы для агентских AI в 2026 году: рейтинг Salesforce, Microsoft и других
Компании переходят с пилотов на production. MarkTechPost составил рейтинг топ-10 платформ для агентских AI: Salesforce Agentforce, Microsoft Copilot Studio, ServiceNow и другие. Проверенные цены и данные реального внедре

NVIDIA создала метод обучения нейросетей в 4-bit точности
NVIDIA представила NVFP4 — методологию обучения больших моделей с 4-битной точностью вместо стандартной 8-битной, экономя память в 2 раза без потери качества.

OpenAI представила протокол MRC для сетей суперкомпьютеров с миллионами GPU
OpenAI создала новый открытый сетевой протокол MRC для больших AI кластеров, который распределяет данные по сотням путей и восстанавливается от сбоев за микросекунды, позволяя строить суперкомпьютеры с 100+ тысячами GPU.

Meta AI представила NeuralBench — фреймворк для тестирования моделей мозговой активности
Meta выпустила NeuralBench — открытый фреймворк для стандартизированного тестирования AI-моделей на основе ЭЭГ, объединив 36 задач, 94 датасета и 13,603 часов мозговых записей в один интерфейс. *Meta признана экстремист

Как сжать языковую модель в 3 раза: гайд по FP8, GPTQ и SmoothQuant
Разработчики получили пошаговый гайд по сжатию больших языковых моделей с помощью llmcompressor, сравнив эффективность FP8, GPTQ и SmoothQuant квантизации для снижения нагрузки на железо.

OpenAI выпустила три аудио-модели: перевод, транскрипция и рассуждение в реальном времени
OpenAI расширила Realtime API тремя новыми аудио-моделями для обработки голоса: агентами рассуждения, мультиязычным переводом и потоковой транскрипцией.

Anthropic создала инструмент для перевода мыслей Claude на человеческий язык
Anthropic разработала Natural Language Autoencoders — технологию, которая переводит внутренние активации Claude в текстовые объяснения, раскрывая работу нейросети.

Нейросеть NVIDIA Star Elastic: 360× экономия на обучении
NVIDIA представила метод Star Elastic, который упаковывает три модели разных размеров в один checkpoint и обучается в 360 раз эффективнее.

NVIDIA выпустила cuda-oxide: компилятор Rust-кода для GPU
NVIDIA открыла cuda-oxide — инструмент для компиляции Rust-функций напрямую в GPU код PTX. Это упростит разработку CUDA приложений на Rust и сделает параллельные вычисления доступнее.

NadirClaw: экономия на ИИ через маршрутизацию запросов
NadirClaw — это инструмент для интеллектуальной маршрутизации промптов, который классифицирует запросы на простые и сложные, направляя их в подходящую модель для экономии на затратах.

Открытый ИИ-агент Hermes: лидер потребления токенов OpenRouter
Открытый AI-агент Hermes от Nous Research обогнал закрытую платформу OpenClaw и занял первое место на OpenRouter, генерируя 224 млрд токенов в день. Это произошло всего за три месяца и показывает силу open-source решений