MarkTechPost
Источник AI-новостей. Материалы автоматически отбираются и адаптируются редакцией Hamidun News.
Последние публикации

Thinking Machines Lab выпустила Inkling-Small: открытая MoE-модель 276B превзошла учителя
Thinking Machines Lab открыла веса Inkling-Small — мультимодальной MoE-модели на 276B параметров. При четверти размера «учителя» она превосходит его на SWE-bench, HLE и ARC-AGI-2.

NVIDIA выпустила Molt: PyTorch-фреймворк для агентного RL в 8600 строк кода
NVIDIA NeMo выпустила Molt — компактный PyTorch-фреймворк для агентного RL: 8600 строк кода против 62 000 у конкурентов при производительности, сопоставимой с Megatron-стеком.

NVIDIA Transformer Engine: фьюзед-ядра, FP8 и BF16 для обучения трансформеров
NVIDIA Transformer Engine ускоряет обучение трансформеров через фьюзед GPU-ядра и форматы FP8/BF16. Туториал показывает, как подключить TE к GPT-подобной модели и измерить выигрыш по памяти.

Tencent открыл AngelSpec: фреймворк для ускорения инференса LLM через speculative decoding
Tencent выложил в open source AngelSpec — torch-native фреймворк для обучения draft-моделей speculative decoding, который ускоряет генерацию LLM без потери качества ответов.

Moonshot AI открыла код MoonEP — библиотеки для обучения MoE-модели Kimi K3
Moonshot AI открыла под лицензией MIT исходники MoonEP — библиотеки экспертного параллелизма, которая выдаёт каждому GPU-рангу ровно S×K токенов и ускорила масштабирование Kimi K3 в 2,5 раза.

Prompt vs Loop vs Graph Engineering: три уровня контроля в AI-разработке
Издание MarkTechPost 29 июля 2026 года разложило три термина AI-инженерии — prompt, loop и graph engineering — как три вложенных уровня контроля, а не конкурирующие подходы.

Token Saver: open-source MCP-расширение режет расход токенов Claude на PDF на 90-99%
Marktechpost выпустила Token Saver — бесплатное MCP-расширение для Claude Desktop, которое обрабатывает большие PDF локально и снижает расход токенов на 92-99%.

Fireworks Nexus: маршрутизация кода в open-weight модели и снижение AI-расходов в 3–5 раз
Fireworks Nexus направляет рутинный код на дешёвые open-weight модели и снижает расходы на AI-агентов в 3–5 раз, не меняя привычные инструменты разработчиков.

Microsoft выпустила MAI-Cyber-1-Flash: 5B активных параметров и 95,95% на CyberGym
Microsoft AI выпустила MAI-Cyber-1-Flash — модель на 5 млрд активных параметров для киберзащиты, которая в связке с harness MDASH подняла результат на бенчмарке CyberGym до 95,95%.

Liquid AI выпустила энкодеры LFM2.5-Encoder-230M и 350M с контекстом 8K токенов
Liquid AI выпустила открытые энкодеры LFM2.5-Encoder-230M и 350M с контекстом 8192 токена: они держат скорость на длинных входах даже на CPU и конкурируют с моделями в разы крупнее.

Perplexity выпустила pplx: CLI для Search API прямо в терминале за $5 за 1000 запросов
Perplexity представила pplx — официальный CLI-клиент, который отдаёт результаты Search API в терминал как JSON: две команды, цена $5 за 1000 запросов, заточен под coding-агентов.

Black Forest Labs выпустила FLUX 3: видео до 20 секунд со звуком из одной модели
Black Forest Labs представила FLUX 3 — мультимодальную модель, которая из одного набора весов делает картинки, видео до 20 секунд со звуком и управляет роботом.

Meta AI представила Brain2Qwerty v2 — неинвазивный MEG-декодер текста с точностью 61%
Meta AI выпустила Brain2Qwerty v2 — неинвазивный пайплайн на основе MEG, который декодирует напечатанные предложения по сигналам мозга с точностью 61% слов, и открыла код обучения.

Sakana AI выпустила Sakana Marlin — агента для отчётов на 100 страниц со слайдами
Sakana AI представила первый коммерческий продукт — корпоративного агента Marlin, который автономно работает до восьми часов и готовит отчёты объёмом до 100 страниц со слайдами.

Baidu развивает CUP — набор Python-инструментов для надёжных бэкенд-пайплайнов
Портал MarkTechPost разобрал CUP — набор Python-утилит Baidu для логирования, кэша, пулов потоков и мониторинга ресурсов Linux в одном пакете.

Google Research выпустила TabFM — foundation-модель для табличных данных с zero-shot
Google Research представила TabFM — foundation-модель для таблиц, которая делает zero-shot классификацию и регрессию без обучения под каждый датасет.

Linq выпустила iMessage Apps — платежи, билеты и игры для ИИ-агентов прямо в переписке
Компания Linq представила iMessage Apps — интерактивные карточки imessage_app для оплаты, покупки билетов, бронирования рейсов и игр внутри переписки.

Claude Sonnet 5 против Opus 4.8: сравнение агентного кодирования и цен API от Anthropic
MarkTechPost сравнил Claude Sonnet 5, Sonnet 4.6 и Opus 4.8 от Anthropic: новая модель приближается к флагману в агентном кодировании при более низкой цене токенов Sonnet.

Anthropic возобновила работу Claude Fable 5 после снятия экспортных ограничений США
Anthropic 1 июля 2026 года вернула доступ к Claude Fable 5 и представила классификатор, блокирующий джейлбрейк-технику из отчёта Amazon в 99% случаев.

OpenAI выпустила GPT-Realtime-2.1 и mini-версию для голосовых агентов в API
OpenAI добавила в API две модели для голосовых агентов — GPT-Realtime-2.1 и GPT-Realtime-2.1-mini, снизив задержку p95 минимум на 25% за счёт кеширования.

Tencent выпустила Hy3 — открытую MoE-модель на 295 млрд параметров с контекстом 256K
Tencent представила Hy3 — модель на 295 млрд параметров с активными 21 млрд на токен, лицензией Apache 2.0 и результатом 78.0 на SWE-Bench Verified.

MarkTechPost показал, как собрать ИИ-соучёного QSAR для поиска ингибиторов EGFR
Тьюториал MarkTechPost учит строить автономного ИИ-соучёного на Random Forest QSAR — от данных ChEMBL и RDKit до готовых молекул-кандидатов против EGFR C797S.

Liquid AI выпустила LFM2.5-350M: эффективная модель на 350M параметров с масштабным RL
Компания Liquid AI доказала, что плотность ИИ важнее количества параметров: небольшую модель можно обучить лучше через усиленное обучение.

Parallax: улучшенная локальная линейная внимание с коррекцией ковариации
Исследователи MarkTechPost представили Parallax — новую вариацию механизма внимания для малых LLM с улучшенным качеством и скоростью.

MiniMax M3: новая модель с 1M токенов, мультимодальностью и computer use
Компания представила архитектуру MiniMax Sparse Attention, поддерживающую миллион токенов в контексте и работу с видео, изображениями и управлением компьютером.

Автономные AI-агенты работают в 50 раз дольше, чем поиск: исследование Harvard и Perplexity
Новое исследование Harvard и Perplexity показало, что AI-агенты выполняют 26 минут самостоятельной работы за сессию, против 33 секунд для поисковых ассистентов.

Memory OS: открытый 6-слойный стек памяти для Hermes Agent
Новый проект Memory OS добавляет локальную постоянную память к Hermes Agent через шесть слоёв архитектуры, управляемый поиск и встроенную вики.

Google запустила Gemini 3.5 Live Translate: модель речь-в-речь для 70+ языков
Gemini 3.5 Live Translate переводит речь в реальном времени, синтезируя аудио с задержкой в несколько секунд. Модель доступна в Gemini Live API, Google Meet и приложении Google Translate.

Nous Research представила конструктор профилей Hermes Agent
Новый интерфейс Hermes Agent заменяет многоэтапную настройку через CLI — теперь пользователи собирают профиль агента в едином потоке на дашборде.

SpaceXAI выпустила Grok 4.5 — кодовая модель класса Opus
SpaceXAI представила Grok 4.5, модель класса Opus, натренированную Cursor для кодирования и агентных задач, по цене $2/$6 за миллион токенов.