MarkTechPost
Источник AI-новостей. Материалы автоматически отбираются и адаптируются редакцией Hamidun News.
Последние публикации

Genesis AI выпустила Genesis World 1.0 — платформу для оценки роботов в 400 раз быстрее
Genesis AI выпустила платформу Genesis World 1.0 для симуляции роботов, которая сокращает время оценки с 200 часов до 30 минут и совпадает с реальным поведением на 90%.

NVIDIA выпустила Polar — фреймворк для обучения кодовых агентов
NVIDIA создала Polar — фреймворк для обучения языковых агентов через reinforcement learning, улучшивший производительность на SWE-Bench на 22.6 балла в Codex-окружении.

UC Berkeley создала mKernel: единая библиотека для синхронизации GPU в кластерах
UC Berkeley выпустила mKernel — новую CUDA-библиотеку для синхронизации тысяч GPU в дата-центрах, объединив локальную и дистанционную коммуникацию в один persistent kernel.

Stability AI выпустила Stable Audio 3 для быстрой генерации музыки
Stability AI представила Stable Audio 3 — модели для генерации музыки и звуковых эффектов, которые работают на MacBook и потребительских GPU с 8GB VRAM.

ZeroEntropy представила Zerank-2 — лёгкий переранжировщик для точного поиска
ZeroEntropy выпустила Zerank-2, компактный кроссэнкодер на базе Qwen3, который значительно улучшает качество поиска в двухэтапных RAG-системах.

Sakana AI представила DiffusionBlocks: метод обучения нейросетей блоками
Компания Sakana AI представила DiffusionBlocks — новый метод, который позволяет обучать слои остаточных нейросетей независимо друг от друга, интерпретируя обновления как обратную диффузию.

Векторный поиск в PostgreSQL: полный гайд pgvector для AI-приложений
Узнайте, как превратить PostgreSQL в векторную БД с помощью pgvector и использовать её для семантического и гибридного поиска в AI-приложениях — полный гайд с примерами кода.

Perplexity опубликовала токенайзер для нейросетей: в 5 раз быстрее
Perplexity AI опубликовала переписанный токенайзер Unigram, который ускоряет обработку текста в 5 раз и сокращает нагрузку на процессор в 5-6 раз в production-среде.

Ученые создали MEMO — фреймворк для расширения памяти LLM без переобучения
Ученые предложили MEMO — фреймворк, который позволяет LLM учиться на новых данных без переобучения основной модели, используя отдельный модуль памяти.

EAGLE 3.1: как исправить нестабильность спекулятивного декодирования в LLM
Совместный релиз EAGLE team, vLLM и TorchSpec исправляет критическую проблему спекулятивного декодирования — дрейф внимания, который замедлял инференс больших языковых моделей в production.

Anthropic выпустила Claude Opus 4.8 с динамическими workflow'ами и дешёвым fast mode
Anthropic представила Claude Opus 4.8 с динамическими рабочими процессами и более дешёвым быстрым режимом. Обновление доступно в исследовательском превью Claude Code.

Как использовать нейросеть LFM2.5 локально на своем ПК
Liquid AI представила новую модель LFM2.5-8B-A1B — экономную MoE-модель, которая активирует только 1.5B параметров из 8.3B. Работает на потребительском ПК с контекстом 128K.

Нейросеть SIA для самообновляющихся ИИ-агентов (open source)
Hexo Labs выпустила открытый код SIA — системы, которая улучшает сама себя, обновляя как инструкции агента, так и веса его нейронной сети.

Microsoft Research выпустила Webwright — агента для браузера, который решает web-задачи на 60%
Microsoft Research представила Webwright — браузер-агента, который выполняет сложные web-задачи лучше, чем большие языковые модели: 60% успеха на Odysseys вместо 33.5% у базового GPT-5.4.

Нейросеть для голоса StepAudio: синтез речи в реальном времени
Китайская лаборатория StepFun представила реальную голосовую модель StepAudio 2.5 Realtime, которая лучше конкурентов справляется с естественностью речи и может менять голос по сценарию пользователя.

Langfuse для инженеров LLM: полный пайплайн трейсинга и экспериментов
Langfuse — инструмент для отладки и оптимизации LLM-приложений. Узнайте, как настроить полный пайплайн мониторинга, управления промптами и экспериментов без платных моделей.

WorkOS представила auth.md — открытый протокол регистрации ИИ-агентов
WorkOS выпустила auth.md — открытый стандарт, который позволяет ИИ-агентам регистрироваться в приложениях через Markdown-файл без участия человека.

Нейросеть Lance для видео: как работает универсальная ИИ-модель
ByteDance выпустила Lance — открытую модель, которая в одном фреймворке работает с изображениями и видео: понимает, генерирует и редактирует контент при использовании всего 3B активных параметров.

Нейросеть Cohere Command A+: 218 млрд параметров для агентов
Cohere представила открытую модель Command A+ на 218 млрд параметров с многомодальными возможностями, которая работает на двух GPU H100 и поддерживает 48 языков.

Perplexity открыла AI-сканер Bumblebee для защиты кода разработчиков
Perplexity опубликовала исходный код Bumblebee — инструмента для сканирования уязвимостей в зависимостях разработческих систем без запуска кода.

Qwen3.7-Max: новая нейросеть Alibaba с миллионным контекстом
Alibaba представила Qwen3.7-Max — самую продвинутую модель-агента от Qwen с 1M-токенным контекстом и режимом рассуждений для сложных многошаговых задач.

CopilotKit: полный стек для ИИ-агентов в 2026
CopilotKit выпустил новый стек для разработчиков agentic AI: AG-UI протокол, платформу тестирования AIMock и сервер Pathfinder — полное решение для production-среды.

Как создать нейросеть-трансформер в Colab: MLA и GQA
OpenMythos позволяет строить рекуррентные трансформеры в Google Colab, сравнивая архитектуры MLA и GQA. Новый видео-туториал проверяет стабильность моделей через анализ спектральных радиусов injection матриц.

Управление поведением нейросети без переобучения: метод CNA
Компания Nous Research представила метод Contrastive Neuron Attribution (CNA), который позволяет управлять поведением больших языковых моделей, находя и отключая отдельные нейронные цепи без переобучения и изменения весо

AI-агенты в production: 8 платформ аутентификации
Аутентификация вышла в топ-приоритеты разработки. MCP достиг 97 млн загрузок в месяц, AI-агенты идут в production, и выбор платформы стал критической стратегической задачей.

Инструмент для Claude API: фреймворк SuperClaude
SuperClaude Framework предоставляет разработчикам встроенные компоненты для создания продвинутых AI-workflows: команды, агенты, режимы работы и память сессии — всё в одной системе.

Память для ИИ-агентов: локальная система от Tencent
Tencent открыла исходный код TencentDB Agent Memory — локальной системы памяти для AI-агентов, которая сокращает расход токенов на 61% и повышает точность на 28%.

Как новая нейросеть NVIDIA экономит память: Gated DeltaNet-2
NVIDIA создала новый механизм линейного внимания Gated DeltaNet-2, который улучшает управление памятью в больших языковых моделях благодаря раздельным вратам стирания и записи вместо единого затвора.

Gemini 3.5 для кодирования: новая нейросеть дешевле и быстрее
На I/O 2026 Google представила Gemini 3.5 Flash — модель, которая на 75% дешевле флагманской версии, работает в 4 раза быстрее и лучше справляется с кодом и автоматизацией.

Alibaba выпустила нейросеть для синхронного перевода видео
Alibaba представила модель для реального перевода видео и речи одновременно на 60 языках — с минимальной задержкой и сохранением голоса переводящего.