Издание · проверено редакцией

MarkTechPost

Источник AI-новостей. Материалы автоматически отбираются и адаптируются редакцией Hamidun News.

304 материалов в Hamidun·Последний: 3 августа· Активен·marktechpost.com ↗

Последние публикации

GitNexus: Как новый инструмент научил ИИ-агентов структурному пониманию кода
LLMMarkTechPost

GitNexus: Как новый инструмент научил ИИ-агентов структурному пониманию кода

ИИ-помощники отлично пишут локальный код, но часто не понимают глобальную архитектуру проектов. Open-source проект GitNexus решает эту проблему с помощью графов знаний и протокола MCP.

26 апр. 2026 г.·3 мин
DeepSeek-V4: Как новые алгоритмы сжатия сделали контекст в миллион токенов реальностью
LLMMarkTechPost

DeepSeek-V4: Как новые алгоритмы сжатия сделали контекст в миллион токенов реальностью

DeepSeek представила четвертое поколение своих моделей. Благодаря радикальному сжатию внимания обработка гигантских объемов данных становится доступной не только техногигантам.

26 апр. 2026 г.·3 мин
Архитектура Decoupled DiLoCo от DeepMind решает проблему масштабирования ИИ
LLMMarkTechPost

Архитектура Decoupled DiLoCo от DeepMind решает проблему масштабирования ИИ

Обучение передовых ИИ-моделей всегда было заложником аппаратных сбоев: поломка одного чипа останавливала весь кластер. Новая архитектура от Google DeepMind меняет правила игры.

26 апр. 2026 г.·2 мин
OpenMythos: open-source реконструкция архитектуры Claude Mythos на PyTorch с 770M параметров
LLMMarkTechPost

OpenMythos: open-source реконструкция архитектуры Claude Mythos на PyTorch с 770M параметров

Разработчик Kye Gomez воссоздал предполагаемую архитектуру Claude Mythos от Anthropic с нуля — без утечек, только на основе публичных исследований.

23 апр. 2026 г.·2 мин
OpenAI масштабирует GPT-5.4-Cyber для верифицированных специалистов по кибербезопасности
LLMMarkTechPost

OpenAI масштабирует GPT-5.4-Cyber для верифицированных специалистов по кибербезопасности

OpenAI открывает массовый доступ к GPT-5.4-Cyber — донастроенной версии GPT-5.4 без стандартных ограничений для тысяч верифицированных защитников.

23 апр. 2026 г.·2 мин
Moonshot AI выпустила Kimi K2.6: агентная модель с роем из 300 субагентов
LLMMarkTechPost

Moonshot AI выпустила Kimi K2.6: агентная модель с роем из 300 субагентов

Китайская лаборатория Moonshot AI открыла исходники Kimi K2.6 — мультимодальной агентной модели, координирующей до 300 субагентов и 4000 шагов автономно.

23 апр. 2026 г.·2 мин
Phi-4-Mini от Microsoft: реализация квантизации, RAG и LoRA в одном Jupyter-ноутбуке
LLMMarkTechPost

Phi-4-Mini от Microsoft: реализация квантизации, RAG и LoRA в одном Jupyter-ноутбуке

Туториал показывает полный пайплайн на Phi-4-mini-instruct: 4-битная квантизация, потоковая генерация, рассуждение, вызов инструментов, RAG и LoRA fine-tuning в одном ноутбуке.

23 апр. 2026 г.·2 мин
Qwen 3.6-35B-A3B на практике: мультимодальность, MoE и RAG в одном пайплайне
LLMMarkTechPost

Qwen 3.6-35B-A3B на практике: мультимодальность, MoE и RAG в одном пайплайне

MarkTechPost выпустил 21 апреля 2026 года туториал по мультимодальной MoE-модели Qwen 3.6-35B-A3B — от загрузки под GPU до MoE-роутинга, RAG и сохранения сессии.

22 апр. 2026 г.·2 мин
NVIDIA представила Nemotron 3 Super — открытую модель со 120 млрд параметров
LLMMarkTechPost

NVIDIA представила Nemotron 3 Super — открытую модель со 120 млрд параметров

Новая гибридная модель сочетает архитектуры Mamba и Attention с подходом Mixture-of-Experts, обеспечивая пятикратный прирост производительности для мультиагентных систем. Разрыв между проприетарными и открытыми моделями

11 мар. 2026 г.·2 мин
Google представила TensorFlow 2.21 и LiteRT для мобильного ИИ
LLMMarkTechPost

Google представила TensorFlow 2.21 и LiteRT для мобильного ИИ

Google представила TensorFlow 2.21 и LiteRT — новый стандарт для запуска нейросетей на смартфонах с поддержкой NPU и ускорением GPU для мобильных платформ.

7 мар. 2026 г.·2 мин
Google запустила Android Bench для оценки ИИ в мобильной разработке
LLMMarkTechPost

Google запустила Android Bench для оценки ИИ в мобильной разработке

Google открыла доступ к Android Bench — первому специализированному инструменту для проверки навыков больших языковых моделей в разработке приложений под Android.

7 мар. 2026 г.·2 мин
OpenAI представила Codex Security для автоматического поиска и исправления уязвимостей в коде
LLMMarkTechPost

OpenAI представила Codex Security для автоматического поиска и исправления уязвимостей в коде

OpenAI запускает Codex Security — интеллектуального агента для анализа безопасности кода, который не только находит ошибки, но и предлагает готовые патчи для их устранения.

7 мар. 2026 г.·2 мин
Liquid AI выпустила систему для запуска ИИ-агентов полностью на устройстве
LLMMarkTechPost

Liquid AI выпустила систему для запуска ИИ-агентов полностью на устройстве

Компания Liquid AI представила модель LFM2-24B-A2B и приложение LocalCowork — связку для выполнения сложных рабочих процессов с ИИ-агентами без единого обращения к облаку. Ставка на приватность становится архитектурным п

6 мар. 2026 г.·3 мин
Yuan 3.0 Ultra: триллион параметров при рекордной эффективности
LLMMarkTechPost

Yuan 3.0 Ultra: триллион параметров при рекордной эффективности

Китайская YuanLab AI представила открытую мультимодальную модель с триллионом параметров, которая активирует лишь 68,8 млрд из них. Сокращение параметров на треть при росте эффективности обучения на 49% — как это работае

5 мар. 2026 г.·3 мин
Alibaba выпустила OpenSandbox — единую среду для безопасной работы AI-агентов
LLMMarkTechPost

Alibaba выпустила OpenSandbox — единую среду для безопасной работы AI-агентов

Alibaba открыла исходный код OpenSandbox — инструмента, который даёт AI-агентам изолированные песочницы для выполнения кода, веб-сёрфинга и обучения моделей. Это заявка на стандарт всей инфраструктуры агентного AI.

3 мар. 2026 г.·3 мин
Alibaba выпустила Qwen 3.5 Small — компактные модели для работы прямо на устройствах
LLMMarkTechPost

Alibaba выпустила Qwen 3.5 Small — компактные модели для работы прямо на устройствах

Новая серия моделей Alibaba от 0.8 до 9 миллиардов параметров бросает вызов гонке за размером. Философия «больше интеллекта, меньше вычислений» может изменить правила игры для мобильного AI.

3 мар. 2026 г.·3 мин
SHAP-IQ: новый стандарт объяснимого ИИ выходит на практический уровень
LLMMarkTechPost

SHAP-IQ: новый стандарт объяснимого ИИ выходит на практический уровень

Библиотека SHAP-IQ позволяет не просто оценить важность признаков модели, но и понять, как они взаимодействуют друг с другом. Разбираемся, почему это меняет подход к интерпретации машинного обучения.

2 мар. 2026 г.·3 мин
Google представила STATIC: ускорение генеративного поиска в 948 раз
LLMMarkTechPost

Google представила STATIC: ускорение генеративного поиска в 948 раз

Google AI разработала фреймворк на основе разреженных матриц, который ускоряет декодирование в генеративных рекомендательных системах почти в тысячу раз. Это может изменить подход к промышленным рекомендациям.

2 мар. 2026 г.·3 мин
Alibaba открыла CoPaw — рабочую станцию для масштабирования AI-агентов
LLMMarkTechPost

Alibaba открыла CoPaw — рабочую станцию для масштабирования AI-агентов

Команда Alibaba выпустила open-source фреймворк CoPaw, который превращает локальную машину разработчика в полноценную среду для запуска автономных AI-агентов с памятью и многоканальными рабочими процессами.

1 мар. 2026 г.·2 мин
Unified Latents: Google DeepMind нашла способ улучшить генерацию ИИ
LLMMarkTechPost

Unified Latents: Google DeepMind нашла способ улучшить генерацию ИИ

Новый фреймворк Unified Latents от Google DeepMind решает дилемму между качеством сжатия данных и точностью работы нейросетей.

28 февр. 2026 г.·2 мин
Sakana AI научилась мгновенно адаптировать языковые модели без дообучения
LLMMarkTechPost

Sakana AI научилась мгновенно адаптировать языковые модели без дообучения

Токийская лаборатория Sakana AI представила два метода — Doc-to-LoRA и Text-to-LoRA — которые позволяют адаптировать большие языковые модели к новым данным за доли секунды, без классического файн-тюнинга.

27 февр. 2026 г.·3 мин
Perplexity выпустила pplx-embed: модели эмбеддингов, которые меняют правила поиска
LLMMarkTechPost

Perplexity выпустила pplx-embed: модели эмбеддингов, которые меняют правила поиска

Perplexity представила семейство мультиязычных моделей эмбеддингов pplx-embed на базе Qwen3 с двунаправленным вниманием — и заявляет о новом стандарте качества для поиска в масштабах всего интернета.

27 февр. 2026 г.·3 мин
Liquid AI бросает вызов гонке размеров: гибридная архитектура LFM2 меняет правила игры
LLMMarkTechPost

Liquid AI бросает вызов гонке размеров: гибридная архитектура LFM2 меняет правила игры

Стартап Liquid AI представил модель на 24 миллиарда параметров, которая сочетает механизм внимания с свёртками. Цель — решить проблемы масштабирования, с которыми столкнулась вся индустрия больших языковых моделей.

25 февр. 2026 г.·3 мин
Composio открывает код Agent Orchestrator — инструмента для мультиагентных систем за пределами ReAct
LLMMarkTechPost

Composio открывает код Agent Orchestrator — инструмента для мультиагентных систем за пределами ReAct

Стартап Composio выпустил в открытый доступ оркестратор агентов, который решает главную проблему продакшн-AI: хрупкость простых ReAct-циклов. Новый подход обещает масштабируемые мультиагентные рабочие процессы.

24 февр. 2026 г.·3 мин
WebSocket-режим OpenAI меняет правила игры для голосового AI
LLMMarkTechPost

WebSocket-режим OpenAI меняет правила игры для голосового AI

OpenAI представила WebSocket-режим для Realtime API, который устраняет главного врага голосовых AI-агентов — задержку. Три отдельных этапа обработки голоса теперь сжимаются в один поток.

24 февр. 2026 г.·3 мин
Taalas бросает вызов GPU: жёсткая логика вместо гибкости ради 17 000 токенов в секунду
LLMMarkTechPost

Taalas бросает вызов GPU: жёсткая логика вместо гибкости ради 17 000 токенов в секунду

Канадский стартап Taalas делает ставку на то, что индустрия AI-чипов считала ересью — замену программируемых GPU на специализированные микросхемы с жёсткой логикой. Результат: 17 000 токенов в секунду.

23 февр. 2026 г.·3 мин
TruLens: как перестать доверять LLM вслепую и начать измерять качество
LLMMarkTechPost

TruLens: как перестать доверять LLM вслепую и начать измерять качество

Языковые модели всё ещё остаются чёрными ящиками для большинства разработчиков. TruLens предлагает инструментарий, который делает каждый шаг работы LLM прозрачным и измеримым — от входных данных до финального ответа.

23 февр. 2026 г.·3 мин
Google предлагает думать глубже, а не дольше — и вдвое снижает затраты на инференс
LLMMarkTechPost

Google предлагает думать глубже, а не дольше — и вдвое снижает затраты на инференс

Исследователи из Google и Университета Вирджинии доказали: длинная цепочка рассуждений не означает качественную. Новая метрика Deep-Thinking Ratio позволяет повысить точность LLM и вдвое сократить вычислительные расходы.

22 февр. 2026 г.·3 мин
Google DeepMind представила Lyria 3 для создания музыки по фото
LLMMarkTechPost

Google DeepMind представила Lyria 3 для создания музыки по фото

Новая модель Lyria 3 от Google DeepMind совершает прорыв в генерации аудио. Теперь ИИ способен создавать полноценные треки с вокалом и текстом, опираясь лишь на фотографии или текстовые описания.

19 февр. 2026 г.·2 мин
Tavus представила Phoenix-4: видеоаватары с живыми эмоциями и мгновенным откликом
LLMMarkTechPost

Tavus представила Phoenix-4: видеоаватары с живыми эмоциями и мгновенным откликом

Новая модель Phoenix-4 преодолевает эффект «зловещей долины», добавляя цифровым аватарам эмоциональный интеллект и сокращая задержку генерации до рекордных 600 миллисекунд.

19 февр. 2026 г.·2 мин