Издание · проверено редакцией

MarkTechPost

Источник AI-новостей. Материалы автоматически отбираются и адаптируются редакцией Hamidun News.

304 материалов в Hamidun·Последний: 3 августа· Активен·marktechpost.com ↗

Последние публикации

Thinking Machines Lab выпустила Inkling-Small: открытая MoE-модель 276B превзошла учителя
LLMMarkTechPost

Thinking Machines Lab выпустила Inkling-Small: открытая MoE-модель 276B превзошла учителя

Thinking Machines Lab открыла веса Inkling-Small — мультимодальной MoE-модели на 276B параметров. При четверти размера «учителя» она превосходит его на SWE-bench, HLE и ARC-AGI-2.

3 авг. 2026 г.·2 мин
NVIDIA выпустила Molt: PyTorch-фреймворк для агентного RL в 8600 строк кода
LLMMarkTechPost

NVIDIA выпустила Molt: PyTorch-фреймворк для агентного RL в 8600 строк кода

NVIDIA NeMo выпустила Molt — компактный PyTorch-фреймворк для агентного RL: 8600 строк кода против 62 000 у конкурентов при производительности, сопоставимой с Megatron-стеком.

2 авг. 2026 г.·3 мин
NVIDIA Transformer Engine: фьюзед-ядра, FP8 и BF16 для обучения трансформеров
LLMMarkTechPost

NVIDIA Transformer Engine: фьюзед-ядра, FP8 и BF16 для обучения трансформеров

NVIDIA Transformer Engine ускоряет обучение трансформеров через фьюзед GPU-ядра и форматы FP8/BF16. Туториал показывает, как подключить TE к GPT-подобной модели и измерить выигрыш по памяти.

2 авг. 2026 г.·2 мин
Tencent открыл AngelSpec: фреймворк для ускорения инференса LLM через speculative decoding
LLMMarkTechPost

Tencent открыл AngelSpec: фреймворк для ускорения инференса LLM через speculative decoding

Tencent выложил в open source AngelSpec — torch-native фреймворк для обучения draft-моделей speculative decoding, который ускоряет генерацию LLM без потери качества ответов.

30 июл. 2026 г.·3 мин
Moonshot AI открыла код MoonEP — библиотеки для обучения MoE-модели Kimi K3
LLMMarkTechPost

Moonshot AI открыла код MoonEP — библиотеки для обучения MoE-модели Kimi K3

Moonshot AI открыла под лицензией MIT исходники MoonEP — библиотеки экспертного параллелизма, которая выдаёт каждому GPU-рангу ровно S×K токенов и ускорила масштабирование Kimi K3 в 2,5 раза.

30 июл. 2026 г.·3 мин
Prompt vs Loop vs Graph Engineering: три уровня контроля в AI-разработке
LLMMarkTechPost

Prompt vs Loop vs Graph Engineering: три уровня контроля в AI-разработке

Издание MarkTechPost 29 июля 2026 года разложило три термина AI-инженерии — prompt, loop и graph engineering — как три вложенных уровня контроля, а не конкурирующие подходы.

30 июл. 2026 г.·3 мин
Token Saver: open-source MCP-расширение режет расход токенов Claude на PDF на 90-99%
LLMMarkTechPost

Token Saver: open-source MCP-расширение режет расход токенов Claude на PDF на 90-99%

Marktechpost выпустила Token Saver — бесплатное MCP-расширение для Claude Desktop, которое обрабатывает большие PDF локально и снижает расход токенов на 92-99%.

30 июл. 2026 г.·2 мин
Fireworks Nexus: маршрутизация кода в open-weight модели и снижение AI-расходов в 3–5 раз
LLMMarkTechPost

Fireworks Nexus: маршрутизация кода в open-weight модели и снижение AI-расходов в 3–5 раз

Fireworks Nexus направляет рутинный код на дешёвые open-weight модели и снижает расходы на AI-агентов в 3–5 раз, не меняя привычные инструменты разработчиков.

30 июл. 2026 г.·3 мин
Microsoft выпустила MAI-Cyber-1-Flash: 5B активных параметров и 95,95% на CyberGym
LLMMarkTechPost

Microsoft выпустила MAI-Cyber-1-Flash: 5B активных параметров и 95,95% на CyberGym

Microsoft AI выпустила MAI-Cyber-1-Flash — модель на 5 млрд активных параметров для киберзащиты, которая в связке с harness MDASH подняла результат на бенчмарке CyberGym до 95,95%.

30 июл. 2026 г.·2 мин
Liquid AI выпустила энкодеры LFM2.5-Encoder-230M и 350M с контекстом 8K токенов
LLMMarkTechPost

Liquid AI выпустила энкодеры LFM2.5-Encoder-230M и 350M с контекстом 8K токенов

Liquid AI выпустила открытые энкодеры LFM2.5-Encoder-230M и 350M с контекстом 8192 токена: они держат скорость на длинных входах даже на CPU и конкурируют с моделями в разы крупнее.

30 июл. 2026 г.·3 мин
Perplexity выпустила pplx: CLI для Search API прямо в терминале за $5 за 1000 запросов
LLMMarkTechPost

Perplexity выпустила pplx: CLI для Search API прямо в терминале за $5 за 1000 запросов

Perplexity представила pplx — официальный CLI-клиент, который отдаёт результаты Search API в терминал как JSON: две команды, цена $5 за 1000 запросов, заточен под coding-агентов.

30 июл. 2026 г.·2 мин
Black Forest Labs выпустила FLUX 3: видео до 20 секунд со звуком из одной модели
LLMMarkTechPost

Black Forest Labs выпустила FLUX 3: видео до 20 секунд со звуком из одной модели

Black Forest Labs представила FLUX 3 — мультимодальную модель, которая из одного набора весов делает картинки, видео до 20 секунд со звуком и управляет роботом.

30 июл. 2026 г.·3 мин
Meta AI представила Brain2Qwerty v2 — неинвазивный MEG-декодер текста с точностью 61%
LLMMarkTechPost

Meta AI представила Brain2Qwerty v2 — неинвазивный MEG-декодер текста с точностью 61%

Meta AI выпустила Brain2Qwerty v2 — неинвазивный пайплайн на основе MEG, который декодирует напечатанные предложения по сигналам мозга с точностью 61% слов, и открыла код обучения.

17 июл. 2026 г.·2 мин
Sakana AI выпустила Sakana Marlin — агента для отчётов на 100 страниц со слайдами
LLMMarkTechPost

Sakana AI выпустила Sakana Marlin — агента для отчётов на 100 страниц со слайдами

Sakana AI представила первый коммерческий продукт — корпоративного агента Marlin, который автономно работает до восьми часов и готовит отчёты объёмом до 100 страниц со слайдами.

17 июл. 2026 г.·2 мин
Baidu развивает CUP — набор Python-инструментов для надёжных бэкенд-пайплайнов
LLMMarkTechPost

Baidu развивает CUP — набор Python-инструментов для надёжных бэкенд-пайплайнов

Портал MarkTechPost разобрал CUP — набор Python-утилит Baidu для логирования, кэша, пулов потоков и мониторинга ресурсов Linux в одном пакете.

17 июл. 2026 г.·2 мин
Google Research выпустила TabFM — foundation-модель для табличных данных с zero-shot
LLMMarkTechPost

Google Research выпустила TabFM — foundation-модель для табличных данных с zero-shot

Google Research представила TabFM — foundation-модель для таблиц, которая делает zero-shot классификацию и регрессию без обучения под каждый датасет.

17 июл. 2026 г.·2 мин
Linq выпустила iMessage Apps — платежи, билеты и игры для ИИ-агентов прямо в переписке
LLMMarkTechPost

Linq выпустила iMessage Apps — платежи, билеты и игры для ИИ-агентов прямо в переписке

Компания Linq представила iMessage Apps — интерактивные карточки imessage_app для оплаты, покупки билетов, бронирования рейсов и игр внутри переписки.

17 июл. 2026 г.·2 мин
Claude Sonnet 5 против Opus 4.8: сравнение агентного кодирования и цен API от Anthropic
LLMMarkTechPost

Claude Sonnet 5 против Opus 4.8: сравнение агентного кодирования и цен API от Anthropic

MarkTechPost сравнил Claude Sonnet 5, Sonnet 4.6 и Opus 4.8 от Anthropic: новая модель приближается к флагману в агентном кодировании при более низкой цене токенов Sonnet.

17 июл. 2026 г.·1 мин
Anthropic возобновила работу Claude Fable 5 после снятия экспортных ограничений США
LLMMarkTechPost

Anthropic возобновила работу Claude Fable 5 после снятия экспортных ограничений США

Anthropic 1 июля 2026 года вернула доступ к Claude Fable 5 и представила классификатор, блокирующий джейлбрейк-технику из отчёта Amazon в 99% случаев.

17 июл. 2026 г.·2 мин
OpenAI выпустила GPT-Realtime-2.1 и mini-версию для голосовых агентов в API
LLMMarkTechPost

OpenAI выпустила GPT-Realtime-2.1 и mini-версию для голосовых агентов в API

OpenAI добавила в API две модели для голосовых агентов — GPT-Realtime-2.1 и GPT-Realtime-2.1-mini, снизив задержку p95 минимум на 25% за счёт кеширования.

17 июл. 2026 г.·2 мин
Tencent выпустила Hy3 — открытую MoE-модель на 295 млрд параметров с контекстом 256K
LLMMarkTechPost

Tencent выпустила Hy3 — открытую MoE-модель на 295 млрд параметров с контекстом 256K

Tencent представила Hy3 — модель на 295 млрд параметров с активными 21 млрд на токен, лицензией Apache 2.0 и результатом 78.0 на SWE-Bench Verified.

17 июл. 2026 г.·2 мин
MarkTechPost показал, как собрать ИИ-соучёного QSAR для поиска ингибиторов EGFR
LLMMarkTechPost

MarkTechPost показал, как собрать ИИ-соучёного QSAR для поиска ингибиторов EGFR

Тьюториал MarkTechPost учит строить автономного ИИ-соучёного на Random Forest QSAR — от данных ChEMBL и RDKit до готовых молекул-кандидатов против EGFR C797S.

17 июл. 2026 г.·2 мин
Liquid AI выпустила LFM2.5-350M: эффективная модель на 350M параметров с масштабным RL
LLMMarkTechPost

Liquid AI выпустила LFM2.5-350M: эффективная модель на 350M параметров с масштабным RL

Компания Liquid AI доказала, что плотность ИИ важнее количества параметров: небольшую модель можно обучить лучше через усиленное обучение.

16 июл. 2026 г.·3 мин
Parallax: улучшенная локальная линейная внимание с коррекцией ковариации
LLMMarkTechPost

Parallax: улучшенная локальная линейная внимание с коррекцией ковариации

Исследователи MarkTechPost представили Parallax — новую вариацию механизма внимания для малых LLM с улучшенным качеством и скоростью.

16 июл. 2026 г.·3 мин
MiniMax M3: новая модель с 1M токенов, мультимодальностью и computer use
LLMMarkTechPost

MiniMax M3: новая модель с 1M токенов, мультимодальностью и computer use

Компания представила архитектуру MiniMax Sparse Attention, поддерживающую миллион токенов в контексте и работу с видео, изображениями и управлением компьютером.

16 июл. 2026 г.·3 мин
Автономные AI-агенты работают в 50 раз дольше, чем поиск: исследование Harvard и Perplexity
LLMMarkTechPost

Автономные AI-агенты работают в 50 раз дольше, чем поиск: исследование Harvard и Perplexity

Новое исследование Harvard и Perplexity показало, что AI-агенты выполняют 26 минут самостоятельной работы за сессию, против 33 секунд для поисковых ассистентов.

16 июл. 2026 г.·3 мин
Memory OS: открытый 6-слойный стек памяти для Hermes Agent
LLMMarkTechPost

Memory OS: открытый 6-слойный стек памяти для Hermes Agent

Новый проект Memory OS добавляет локальную постоянную память к Hermes Agent через шесть слоёв архитектуры, управляемый поиск и встроенную вики.

16 июл. 2026 г.·3 мин
Google запустила Gemini 3.5 Live Translate: модель речь-в-речь для 70+ языков
LLMMarkTechPost

Google запустила Gemini 3.5 Live Translate: модель речь-в-речь для 70+ языков

Gemini 3.5 Live Translate переводит речь в реальном времени, синтезируя аудио с задержкой в несколько секунд. Модель доступна в Gemini Live API, Google Meet и приложении Google Translate.

16 июл. 2026 г.·3 мин
Nous Research представила конструктор профилей Hermes Agent
LLMMarkTechPost

Nous Research представила конструктор профилей Hermes Agent

Новый интерфейс Hermes Agent заменяет многоэтапную настройку через CLI — теперь пользователи собирают профиль агента в едином потоке на дашборде.

16 июл. 2026 г.·3 мин
SpaceXAI выпустила Grok 4.5 — кодовая модель класса Opus
LLMMarkTechPost

SpaceXAI выпустила Grok 4.5 — кодовая модель класса Opus

SpaceXAI представила Grok 4.5, модель класса Opus, натренированную Cursor для кодирования и агентных задач, по цене $2/$6 за миллион токенов.

14 июл. 2026 г.·1 мин